OpenAI GPT-Red以84%成功率对抗测试GPT-5.6 人工红队仅13%
OpenAI推出GPT-Red模型,通过对抗性自我对弈训练实现84%提示注入攻击成功率,远超人工红队的13%。该模型已用于加固GPT-5.6,使其直接提示注入失败率降至0.05%,但仍作为人工测试的辅助工具内部运行。
OpenAI推出GPT-Red模型,通过对抗性自我对弈训练实现84%提示注入攻击成功率,远超人工红队的13%。该模型已用于加固GPT-5.6,使其直接提示注入失败率降至0.05%,但仍作为人工测试的辅助工具内部运行。
OpenAI发布GPT-5.6模型并推出GPT-Live语音功能与ChatGPT Work代理工具。Sam Altman将GPT-5.6定位为基准模型,强调其在自然对话、中断处理及长任务代理中的表现,推动行业从聊天界面向实用代理转型。文章还
OpenAI于2026年7月9日将GPT-5.6 Sol、Terra和Luna三款模型向ChatGPT用户与API开发者全面开放。此前为期13天的政府协调预览已结束,三款模型覆盖不同使用层级,与Grok 4.5同日发布,标志着自6月12日F
OpenAI将于2026年7月9日公开推出GPT-5.6系列三个模型。Sol定位最强代理能力,Terra性能接近GPT-5.5但成本减半,Luna为最低成本版本。此前因特朗普政府AI网络安全行政令要求,OpenAI先向政府提交模型接受评估,
OpenAI将于2026年7月9日推出GPT-5.6模型的Sol、Terra和Luna三个版本。此前因特朗普政府AI网络安全令要求提前30天提交审查而延迟发布,现经商务部人工智能标准与创新中心额外测试后获准扩大 rollout。OpenAI
OpenAI正式发布GPT-5.6系列模型,却因安全与地缘政治因素遭遇多国政府审批限制。与此同时,Anthropic的Claude Fable 5重新上线,重新点燃业界对前沿AI模型发布流程、风险管控及国际竞争的广泛关注。本文梳理事件经过,
OpenAI原定6月发布的GPT-5.6因白宫网络安全出口管制被迫推迟至7月,需政府批准后有限发布。此举与Fable 5模式类似,引发开发者对前沿模型获取权限的担忧及行业监管讨论,社交媒体互动量激增。
OpenAI因美国政府对前沿AI模型的国家安全担忧,决定推迟GPT-5.6的公开发布。白宫 reportedly寻求早期访问权限,WSJ报道显示这一审查或将常态化。事件引发科技界对AI监管与创新平衡的激烈讨论,社区反应两极分化。文章分析了监
2026年6月25日OpenAI确认GPT-5.6仅限小范围合作伙伴预览,需逐个接受美国政府审查。该决定与Anthropic事件叠加,引发AI界两极分化。批评者认为过度干预将使美国落后中国,支持者强调需防止高风险模型扩散。X平台安全与创新辩
OpenAI原定本周发布的GPT-5.6因内部原因推迟,Codex使用限额同时引发用户不满。内部信息显示后端已就绪,延期或与产品策略调整有关,而非监管因素。此事引发业界对AI开发进度与发布节奏的广泛讨论。
OpenAI即将推出GPT-5.6系列模型,包括Mini和Pro版本,支持150万token超长上下文及长程编码能力。该系列已通过ChatGPT Pro提前泄露,预计下周正式发布。此举将进一步加剧AI大模型市场份额争夺,行业格局或将发生显著