对多数用户而言,ChatGPT仍是一个“问答工具”:输入提示词,获取答案,再自行处理后续步骤。OpenAI正试图通过今日发布的“Dots”打破这一局限。

Dots是持久化的AI智能体,拥有独立的云端虚拟计算机。它们能浏览网页、调用已连接的应用程序,并在用户离开ChatGPT界面后继续在后台工作。其核心理念是将任务完全交给Dot执行,而非仅由AI辅助、人工收尾。

ChatGPT获得专属“云端电脑”

理解Dot的最直观方式,是将其视为ChatGPT的专属电脑。每个Dot均在云端隔离的虚拟机中运行,而非接管用户的本地设备或占用浏览器标签页。在此环境中,Dot可访问网站、打开应用并协同服务完成任务。

需明确的是,Dot的云端环境并非用户本地计算机的延伸。除非用户明确授权,否则Dot无法访问本地文件,两者保持隔离。此外,Dots可通过插件连接超过4000款应用,突破ChatGPT内部生态的限制。

交互方式也更为灵活。除网页端外,用户可通过语音通话、Slack及Microsoft Teams联系Dot。OpenAI表示,短信功能也在计划之中,未来用户可像发送普通短信一样与AI助手沟通。

从“问答”到“代劳”

Dots的价值不在于展示复杂的自主编码能力,而在于自动化那些繁琐的日常跨应用任务。

以订餐为例,用户可指令Dot对比多家餐厅。它不仅能推荐选项,还能直接浏览外卖平台,构建包含税费和小费的购物车估算,最终提供对比结果供用户决策。这与传统询问“今晚吃什么”有本质区别。

在工作场景中,Dot可处理面试录音转录、生成社交媒体文案、识别精彩片段,并协调多平台素材分发。它还能监控被遗忘的行政事务,如准备待开发票并提交审批。这种模式大幅减少了用户在获得AI初步结果后,仍需手动复制、切换应用处理的步骤。

交互去中心化与付费策略

OpenAI并不期望用户时刻盯着Dot的工作进度。用户需在桌面端创建并初始配置Dot,连接所需服务。此后,交互可转移至移动端、语音通话或即将推出的短信渠道。这种设计让AI融入用户现有的通讯场景,而非要求用户主动寻找AI。

目前,Dots已向符合条件的ChatGPT Pro及商业高级版订阅用户推出,企业测试版亦同步开放。对于Pro用户,首个Dot包含在订阅费用中,无额外成本,且首月享有扩展使用限额。

安全边界:只读模式与人工确认

针对持久化智能体可能引发的隐私与安全担忧,OpenAI设置了多重限制。首先,云端虚拟机与本地设备默认隔离,凭据也不直接暴露给底层模型。

更关键的是,Dots在后台主动研究时处于“只读模式”。这意味着它可以收集信息,但无法独立发送消息、删除文件或进行支付。此类高风险操作必须经用户重新介入并批准。这一机制旨在防止AI因误解指令而造成意外损失,为“始终在线”的AI划定了安全边界。