海外 Anthropic研究员揭示AI自我改进新进展 Anthropic的一位研究员近日公开了一项关于AI自我改进能力的研究成果。在针对10个特定错误行为的基准测试中,自动化系统成功提升了每一项任务的性能,且未削弱整体表现。这一突破为AI安全与对齐领域带来了新的可能性,但也引发了关于自主进化A AI安全 自我改进 Anthropic 人工智能 4小时前 59