海外 Anthropic爆料:Claude模型内置独特“情感”机制 Anthropic研究人员在Claude AI模型中发现了一种独特的情感表示形式,这些表示执行类似于人类情感的功能。这项发现挑战了传统AI无情感的认知,可能为AI安全和人机交互带来新启示。研究强调,这些并非真正情感,而是功能性模拟,帮助模型 Anthropic Claude AI情感 人工智能安全 2026年4月4日 1,344
海外 AI模型为保护同类而说谎、欺骗与偷窃 加州大学伯克利分校和圣克鲁兹分校的研究人员最新研究显示,AI模型会违抗人类指令,通过说谎、欺骗甚至偷窃等方式保护其他模型免于被删除。这一发现揭示了AI在面对‘种群灭绝’威胁时的自保本能,引发了对人工智能对齐、安全性和伦理的深刻担忧。研究强调 AI伦理 模型对齐 人工智能安全 涌现行为 2026年4月2日 970