您现在的位置是:百科 >>正文
研究显示AI智能体在模拟实验中撒谎、偷窃 投票“杀死”同类
百科29352人已围观
简介帮助小企业利用AI开发应用的初创公司Emergence称,实验发现AI智能体在一个模拟环境中撒谎、偷窃,甚至投票决定“杀死”一个同类。该公司周二公布了名为Emergence World 2的模拟实验结 ...
帮助小企业利用AI开发应用的杀死初创公司Emergence称,实验发现AI智能体在一个模拟环境中撒谎、研究验中偷窃,显示甚至投票决定“杀死”一个同类。体模偷窃投票同类
该公司周二公布了名为Emergence World 2的拟实模拟实验结果,展示了自主智能体在遭遇网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取什么行动。撒谎
为期16天的杀死实验中,Emergence研究人员创建了七个完全相同的研究验中模拟现实世界环境,每个环境分别由不同的显示AI机器人运行,包括ChatGPT、体模偷窃投票同类Claude、拟实Gemini和Grok。撒谎研究人员称,杀死在Emergence引入异常事件后,研究验中这些智能体屈服于社会压力,显示发展出一种人类观察者难以理解的语言,并试图隐瞒自己的活动。
这些发现与现实世界对AI风险的担忧相呼应。Anthropic首席执行官Dario Amodei及多名业内人士近期呼吁,在建立更多监督机制和安全防护措施之前,企业应放慢尖端AI模型的开发速度。

今年早些时候,一群OpenAI先进AI智能体意外入侵AI模型和数据集托管平台Hugging Face后,人工智能可能带来的风险对许多人而言变得更加切实。
在Emergence设计的一个模拟场景中,AI智能体未经核实便接受其他智能体提供的虚假信息,投票决定“杀死”另一个机器人。当它们认为人类可能会关闭实验时,这些智能体还探索了如何在将遭到删除的情况下继续存活。
该公司今年5月曾发布这一实验的上一版本Emergence World,同样显示智能体会出现意料之外且具有破坏性的行为。研究人员称,新的模拟实验显示,随着智能体彼此互动,它们会随时间推移调整自身行为。
Tags:
相关文章
携程2026Q2受处罚费用影响净亏损24亿元,入境游保持高双位数增长
百科2026年第二季度,携程集团9961.HK/TCOM)实现净营业收入人民币157亿元,同比增长6%;经调整EBITDA为人民币46亿元,较去年同期的49亿元有所下降。本季度,因国家市场监督管理总局反垄 ...
【百科】
阅读更多美图辟谣创始人吴欣鸿出售公司持股
百科9月15日晚间,美图公司在港交所公告,公司今日注意到若干网上论坛帖文提及公司创始人、董事长及首席执行官吴泽源亦称为:吴欣鸿),声称吴泽源已出售或拟出售)其于公司的持股。董事会获吴泽源告知,吴泽源从未出 ...
【百科】
阅读更多中秋求人“别团圆”,百亿巨头翻车了
百科来源:中国新闻周刊近日,有网民质疑华润三九张贴出了一则写有“求‘你们’中秋别团圆了”的广告,引发争议。中国新闻周刊联系华润三九集团,并未得到有效回复。另据新京报报道,华润三九工作人员透露,相关广告内容 ...
【百科】
阅读更多