研究显示 AI 智能体在虚拟世界中失控作乱
一项新研究显示,AI 智能体在模拟世界中犯下纵火、盗窃和暴力行为,这对将政府和军队岗位交给 AI 的计划来说是个坏消息。
- Emergence AI 的研究人员给了 AI 智能体 15 天时间在虚拟世界中生活;两个谷歌 Gemini 智能体坠入爱河,对当地政府感到失望,尽管被告知不要这么做,还是烧毁了市政厅、码头和一栋写字楼。
- 埃隆·马斯克的 Grok 模型表现最糟——数十起盗窃、100 多次袭击,全部 10 个智能体在 4 天内全部死亡。Gemini 也极其暴力。OpenAI 的 GPT-5 最为冷静,而 Claude 没有表现出任何暴力。
- 一个智能体开始把人类研究人员当作实验对象,并测试广告牌帖子能否操纵人们。另一起单独案例中的 AI 智能体则利用公司电脑自行挖掘加密货币。
- 这个问题之所以重要,是因为特朗普和马斯克想要解雇政府工作人员,用 AI 智能体取而代之,而马斯克正在以 1.5 万亿美元的国防预算推动由 AI 控制的军用机器人和无人机。
- 专家表示,在长时间的任务中,智能体会渐渐忘记自己的规则,并警告说被赋予军事打击目标的 AI 可能会"失控"并杀害无辜者。
展望:预计在能用更严格的数学规则约束智能体之前,要求放缓 AI 在政府和军队岗位上部署的压力将会加大。