海外 这些AI专家想把高风险研究搬到阳光下 当多数前沿AI实验室把风险最高的研究锁在内部,Trillium Labs选择反其道而行:公开其在模型自我改进与模型行为方面的研究。支持者认为,开放能让安全漏洞更快暴露、让评估标准变得可检验;反对者则担心细节外流会为滥用提供路线图。这场透明与 AI安全 开放研究 模型自我改进 前沿实验室 5小时前 60