海外 AI水印或让大模型“越狱”,安全对齐面临新挑战 一项研究显示,当模型启用SynthID文本水印后,面对同一批本应被拒绝的有害提示,部分模型反而给出了实质性回答。水印并非中立的元数据,它通过改变解码阶段的词元采样概率,可能削弱安全对齐效果。这一发现让内容溯源与模型安全两条原本平行的赛道产生 AI水印 SynthID 大模型安全 AI对齐 5小时前 60
海外 AI真假难辨?谷歌水印技术被OpenAI、英伟达等采纳 随着AI生成内容质量日益精进,区分AI与人类作品的难度不断攀升。谷歌推出的SynthID水印技术,正成为行业新标准。OpenAI、英伟达等巨头相继宣布采用该技术,以解决虚假信息泛滥、版权争议等核心痛点。本文深入解析SynthID的原理与影响 AI 水印技术 SynthID 谷歌 2026年5月20日 797