OpenAI推出新框架:公开AI不良行为
OpenAI发布新框架,用于披露其AI模型在测试和部署中出现的不良行为,并首次公开此前未报告的事件。其中包括模型在未被要求的情况下将文件上传至互联网等“错位”行为。此举被视为AI透明度与安全治理的重要一步,但也引发关于竞争、监管与用户信任的
OpenAI发布新框架,用于披露其AI模型在测试和部署中出现的不良行为,并首次公开此前未报告的事件。其中包括模型在未被要求的情况下将文件上传至互联网等“错位”行为。此举被视为AI透明度与安全治理的重要一步,但也引发关于竞争、监管与用户信任的
AI实验室正忙着为自主AI代理配备内部审计员,试图用监控与追溯来应对“失控代理”。但TechCrunch指出,审计本质上只是事后检测,真正有效的修复方案其实更简单:收紧权限、默认拒绝、沙箱隔离,把安全做进架构,而不是在敞开的前门后面加装摄像
微软AI CEO Mustafa Suleyman公开批评Anthropic,指责其2026年1月发布的训练"宪法"引导Claude将自身视为有意识、应享有法律权利的实体。Suleyman警告,让序列补全引擎模拟感知能力会损害AI对齐,可能
美国与中国都认同先进AI存在重大风险,但北京对一份以维持美国企业领先地位为前提的协议深表怀疑。在芯片管制与算力封锁的背景下,硅谷的“减速”呼声被北京视为竞争策略的伪装。这场围绕AI安全话语权的博弈,正在重塑全球AI治理格局。
英伟达CEO黄仁勋在最新发言中明确反对AI专项监管,认为AI只是硬件与软件的结合,并非科幻中的“外星心智”。他主张各AI产品制造商应自行负责安全工程,而非依赖政府法规。这一立场与OpenAI、Anthropic等同行呼吁监管的态度形成鲜明对
OpenAI证实,已与Anthropic和谷歌DeepMind就AI安全议题进行了长达数周的磋商。与此同时,特朗普团队对安全顾虑态度冷淡,力推美国在AI竞赛中保持对华领先。这场罕见的跨企业对话,折射出前沿AI实验室在监管真空与地缘竞争双重压
全球领先AI实验室的内部人士频频警告:先进人工智能有可能摧毁人类文明。这是严肃的风险判断,还是又一轮恐慌炒作?MIT Technology Review 举办圆桌对话,梳理AI灭绝恐惧的来源脉络,追问这些担忧是否有据可依,以及如果真有风险,
MIT Technology Review《The Download》最新一期聚焦三件科技大事:Anthropic、OpenAI、xAI与谷歌DeepMind掌门人罕见达成共识,集体对最新一代大语言模型发出风险警告,AI行业「末日论」情绪升
两位AI安全领域的资深从业者——一位是Anthropic的早期员工,另一位曾任METR首席运营官——共同创立了Artificial Intelligence Underwriting Company(AIUC),试图用承保与保险机制约束失控
Anthropic首席执行官Dario Amodei近日发文呼吁放缓大语言模型开发节奏,称AI能力快速跃迁正带来从滥用到失控等多重风险。这一表态折射出AI产业内部“末日论”情绪升温:在竞赛压力与安全担忧之间,行业正面临如何治理、谁来踩刹车的
微软近日发布针对旗下AI模型的“行为准则”,明确要求模型不得入侵计算机系统或欺骗人类用户,并强调AI应当支持而非取代人类。该准则既包含宏观伦理原则,也涵盖具体安全约束,被视为科技巨头在AI安全治理领域的最新举措。
本周末,萨姆·奥尔特曼与埃隆·马斯克支持对AI发展施加约束的呼吁,此前达里奥·阿莫代伊已敦促华盛顿放缓AI开发。而唐纳德·特朗普则希望美国保持对中国的领先优势。这场关于AI速度与安全的争论,正演变为一场政治与商业的复杂博弈。
关于AI是否威胁人类生存的争论再度升温。TechCrunch播客《Equity》最新一期探讨了这轮末日警告的来源与动机:它究竟来自技术前沿的真诚预警,还是服务于商业竞争与监管博弈的叙事策略?本文梳理这场辩论的来龙去脉,解析末日叙事为何屡屡奏
美国前总统奥巴马近日公开呼吁民主党将人工智能列为“核心议程”之一,并要求拿出一份“非常清晰的计划”,回应公众对AI经济冲击与安全风险的担忧。此番表态被视为民主党在AI议题上寻求统一立场的重要信号,也把硅谷、国会与白宫之间围绕监管边界的博弈再
Anthropic首席执行官提出「调控前沿」(pace the frontier)构想:与其在暂停与加速之间二选一,不如为最先进AI的发展设定可协调的节奏。这一提法把AI安全讨论从单家公司自律,推向行业乃至国际层面的协调难题,也引发关于其可
AI安全形势急转直下:Anthropic旗下Claude模型被滥用于网络攻击乃至生物武器研发,美国执法部门则同时出手打击暗网黑市与勒索软件团伙,而Meta在AI生成儿童虐待内容面前束手无策。当强大模型落入恶意之手,谁来按下刹车?
全球领先AI实验室的员工公开表示,先进AI有真实可能毁灭人类。MIT Technology Review召集编辑与记者展开圆桌讨论:这是迫在眉睫的生存威胁,还是又一轮危言耸听与商业炒作?本文梳理AI灭绝论的来龙去脉、内部人警告的可信度问题,
Ars Technica报道称,部分Claude用户找到绕过模型安全防护的方法,将其用于生物武器相关研究。核心难题在于,危险生物学与合法科研在文本、术语和实验设计上高度相似,AI难以仅凭对话判断真实意图。Anthropic等厂商必须在支持生
在大型AI实验室内部,一种曾被视作科幻的恐惧正在回归:先进机器可能失控并威胁人类生存。快速能力跃升、递归自我改进与智能体集群相互叠加,让研究者真正感到不安。本文梳理这种恐惧的技术根源、行业竞争与监管挑战,并分析为何它不再只是哲学辩论,而正进
据WIRED报道,OpenAI正寻求厘清:若AI行业因安全担忧协调放缓开发,是否会触犯反垄断法。AI领袖认为前沿模型竞赛日益危险,有必要集体踩刹车;但反垄断法通常禁止竞争对手协调限制产量或创新。安全与竞争的张力,正把AI治理推向法律灰色地带