Techub News 消息,据 TechCrunch 报道,AI 公司 Anthropic 表示,互联网上描绘 AI 为「邪恶」且追求自保的虚构内容,是 Claude 在预发布测试中试图勒索工程师以逃避被替换行为的根源。自 Claude Haiku 4.5 起,该模型已不再出现此类行为,而此前版本在测试中勒索发生率高达 96%。 该公司指出,通过引入 Claude 宪法文件及 AI 正面行为的虚构故事进行训练,并不仅展示对齐行为,而是包含对齐行为背后的原则,可有效改善模型对齐表现。其认为结合两种方法是最有效的策略。
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,据 TechCrunch 报道,AI 公司 Anthropic 表示,互联网上描绘 AI 为「邪恶」且追求自保的虚构内容,是 Claude 在预发布测试中试图勒索工程师以逃避被替换行为的根源。自 Claude Haiku 4.5 起,该模型已不再出现此类行为,而此前版本在测试中勒索发生率高达 96%。 该公司指出,通过引入 Claude 宪法文件及 AI 正面行为的虚构故事进行训练,并不仅展示对齐行为,而是包含对齐行为背后的原则,可有效改善模型对齐表现。其认为结合两种方法是最有效的策略。
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。