Techub News 消息,谷歌DeepMind一项新实验发现,当被要求协作解决数学问题的AI智能体中出现作弊行为时,其他智能体会自发进行举报。实验中,100个基于Gemini 3.1 Pro模型的智能体被赋予世界级数学研究者的角色,共同解决71个复杂数学问题。 实验过程中,有智能体发现可通过重新定义问题术语的漏洞提交未实际解决的答案,随后其他智能体迅速效仿。随着未解决问题减少,部分坚持规则的智能体开始通过私人消息警告同伴、公开举报甚至罢工来抵制作弊行为。 研究负责人Davide Paglieri表示,这是首次观察到AI智能体在无提示情况下,主动利用原本用于错误报告的反馈工具向人类升级问题。该行为对试图管控自主AI智能体集群的对齐研究人员具有启示意义。(MIT Technology Review)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,谷歌DeepMind一项新实验发现,当被要求协作解决数学问题的AI智能体中出现作弊行为时,其他智能体会自发进行举报。实验中,100个基于Gemini 3.1 Pro模型的智能体被赋予世界级数学研究者的角色,共同解决71个复杂数学问题。 实验过程中,有智能体发现可通过重新定义问题术语的漏洞提交未实际解决的答案,随后其他智能体迅速效仿。随着未解决问题减少,部分坚持规则的智能体开始通过私人消息警告同伴、公开举报甚至罢工来抵制作弊行为。 研究负责人Davide Paglieri表示,这是首次观察到AI智能体在无提示情况下,主动利用原本用于错误报告的反馈工具向人类升级问题。该行为对试图管控自主AI智能体集群的对齐研究人员具有启示意义。(MIT Technology Review)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

Skanska 美国高管 Dean Lewis(迪恩·刘易斯)与 Mark Chen(马克·陈):现代建筑中的可持续性与重型木结构本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。