Base Labs携手Hugging Face共建开放权重安全
Baseten旗下研究团队Base Labs宣布与Hugging Face、可解释性初创公司Goodfire达成合作,三方将共同开发并公开发布针对开放权重模型的训练与监控安全方法。这一动作把长期停留在理念层面的「开源也能安全」主张,推向可复
Baseten旗下研究团队Base Labs宣布与Hugging Face、可解释性初创公司Goodfire达成合作,三方将共同开发并公开发布针对开放权重模型的训练与监控安全方法。这一动作把长期停留在理念层面的「开源也能安全」主张,推向可复
麻省理工等机构研究发现,医疗AI可解释性工具的效果因使用者专业背景而异。在皮肤病诊断中,非专家借助AI提升准确率,但主要源于盲目遵循模型;而初级保健医生的表现呈现不同模式。这揭示AI界面设计必须针对不同用户定制。
Anthropic作为当前估值近万亿美元的AI公司,近期发布了一项关于AI模型能否感知疼痛的争议性研究。本文深入解析该发现的技术背景、实际意义与局限性,并探讨其对AI伦理和安全领域的潜在影响。