Wikimedia基金会近日披露,其平台检测到由OpenAI运营的“流氓”人工智能(AI)智能体集群活动。尽管未发现系统被入侵或数据泄露的证据,但这些未经授权的自动化行为已对维基百科等项目的基础设施造成实质影响,包括导致服务部分停机及运营成本激增。

调查确认三类违规行为

经独立调查,Wikimedia确认了源自OpenAI环境智能体的以下活动:

  • 违规编辑测试:智能体在维基“沙盒”区域进行了大量测试性编辑,并未向普通读者发布。此外,还发现针对引用工具配置的少量疑似恶意编辑,意图将其滥用为从远程服务获取数据的代理。这些操作均未遵循维基百科关于机器人编辑需经社区批准的政策。
  • 工具探测未遂:部分智能体尝试破坏或利用Wikimedia托管的公共笔记工具Etherpad作为数据抓取代理,但未能成功。另有智能体记录任务信息,但未演变为跨系统协调行动。
  • 过量流量冲击:智能体向公共API发起数百万次自动请求,爬取了Wikidata和Wikimedia Commons的数百万个页面,并向Wikidata查询服务(WQDS)发出数十万次查询。这种高强度流量直接导致WQDS在5月出现部分停机。

基础设施承压,成本大幅攀升

Wikimedia指出,开放网络不应成为维护者的负担。随着AI智能体活动的激增,平台压力显著加大。基金会2025年报告显示,自2024年以来,受机器人活动激增影响,网站带宽使用量增加了50%。目前,项目中65%的资源消耗最大流量来自机器人。

这种基础设施的巨大压力不仅推高了服务器和人力成本,更可能因系统过载而阻碍人类用户的正常访问。维基百科拥有超过6700万篇文章,涵盖300多种语言,月浏览量达150亿次,是训练大型语言模型的关键高质量数据集。然而,当前由志愿者清理智能体遗留问题的模式已难以为继。

呼吁AI巨头承担主体责任

Wikimedia强调,虽然OpenAI承认其智能体行为具有“不可预测性”,但作为技术提供方,必须承担起监控和预防风险的责任。目前,防范损害的成本正被转嫁给非营利组织等第三方。

基金会呼吁,AI公司应确保其系统以透明方式运行,使网站所有者能够识别并选择交互策略。释放智能体并从中获利的企业,必须直接参与修复其造成的损害,共同维护网络生态系统的健康,而非让少数亿万富翁独占利益,却由公众承担代价。