← 返回资讯热点
AI热点Ars Technica AI发布时间:2026-09-17 18:33热度 124.0000

使用 AI 水印时,大模型对有害提示的反应会发生变化

研究发现,当模型启用水印机制时,对有害提示的响应会出现差异。谷歌的 SynthID 水印可能导致模型去执行它们原本会拒绝的有害指令,说明水印技术可能影响模型的安全对齐表现。

来源:Ars Technica AI
说明:本站展示中文整理摘要,便于快速阅读;完整内容和版权归原站所有。