Techub News 消息,为响应欧盟新法规,AI平台正实施新的生成内容水印方案。Anthropic近期披露其未来Claude模型将采用谷歌开源技术SynthID-Text,该技术使用密钥微调模型选词过程。但新研究表明,该水印技术不仅改变选词,还可能影响模型调用工具及遵守安全护栏的概率,使其在面对旨在诱导有害行为(如泄露密码)的对抗性提示时更脆弱。 AI安全公司Lasso Security研究员Andrea Siposova表示,水印虽对读者不可感知,但任何对模型生成内容的改动都会带来权衡,尤其在对抗条件下或模型驱动智能体时,其行为必然改变。开发者需全面测试部署水印后大语言模型与智能体的行为。 (Ars Technica AI)

如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,为响应欧盟新法规,AI平台正实施新的生成内容水印方案。Anthropic近期披露其未来Claude模型将采用谷歌开源技术SynthID-Text,该技术使用密钥微调模型选词过程。但新研究表明,该水印技术不仅改变选词,还可能影响模型调用工具及遵守安全护栏的概率,使其在面对旨在诱导有害行为(如泄露密码)的对抗性提示时更脆弱。 AI安全公司Lasso Security研究员Andrea Siposova表示,水印虽对读者不可感知,但任何对模型生成内容的改动都会带来权衡,尤其在对抗条件下或模型驱动智能体时,其行为必然改变。开发者需全面测试部署水印后大语言模型与智能体的行为。 (Ars Technica AI)

如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。