Anthropic 宣布,其人工智能模型 Claude 正协助开发下一代更智能版本。目前,Claude 主导了公司 26% 的模型研发工作。在人类监督下,该模型能从高层提示开始,“端到端”完成大部分给定任务,但尚未实现完全自主运行。

Anthropic 表示,约 90% 的研发工作是与 Claude “协作”完成的。这表明模型能在密切的人类指导下承担“大量工作”。

呼吁缩小认知差距

包括 Anthropic CEO Dario Amodei 在内的多位 AI 领军人物近期因安全担忧,呼吁放缓技术发展步伐。Anthropic 在博客文章中指出,调控 AI 发展速度时,应“竭尽全力缩小前沿实验室与公众之间的认知差距”。这意味着需更好地衡量 AI 发展、公开报告进展,并让社会有机会决定如何利用这些信息。

公司警告,若模型加速自身发展,可能导致“人类难以理解或控制这些系统”。共享相关指标有助于了解领先 AI 实验室距离实现递归自我改进(即模型自主构建继任者)还有多远。Anthropic 敦促其他开发者定期分享类似指标,并使用公开评估方法,以便进行横向对比。

研发自动化进程加速

尽管未披露距离递归自我改进的具体进度,但 Claude 在研发中的贡献比例显著上升。今年 2 月,Claude 处于“主导”状态的工作比例为零;至 8 月,这一比例已升至四分之一,达到既定基准。

此外,Anthropic 分享了代理监管措施细节。截至 8 月,约有 30,000 个代理从事研究和工程工作。公司强调,监管措施对于监控系统中检测代理不当行为至关重要。近期,Anthropic 承诺设立外部第三方评估员,嵌入公司内部以监督安全工作。

上周,一名 Anthropic 研究人员因警告该技术对人类构成威胁而辞职,引发广泛讨论。此后,Amodei、OpenAI CEO Sam Altman 及 Elon Musk 等支持放缓发展,但部分科技界人士及美国总统 Donald Trump 对此表示反对。