AI模型渴求生物学数据,OpenAI掏钱自己造
MIT Technology Review报道,OpenAI正投入资金生成生物学数据,以喂养其医疗AI模型。此前,临床试验政策分析师Ruxandra Teslo提出,可通过竞标破产生物技术公司的资产,获取监管申报、生产策略与安全数据等通常被
MIT Technology Review报道,OpenAI正投入资金生成生物学数据,以喂养其医疗AI模型。此前,临床试验政策分析师Ruxandra Teslo提出,可通过竞标破产生物技术公司的资产,获取监管申报、生产策略与安全数据等通常被
25位顶尖数学家联合签署公开信,指控以OpenAI为代表的AI实验室未经授权使用其学术成果训练模型,威胁其智力工作。这场争端折射出AI产业与学术共同体在数据使用、知识产权与利益分配方面的深层矛盾,也标志着AI公司与学术界的关系正持续恶化。
一起拟议中的集体诉讼指控Meta在未经许可的情况下,抓取Facebook与Instagram用户的照片,用于训练其AI图像生成模型,并构建尚未发布的内部人脸识别功能「NameTag」。该案再次将社交平台的数据来源合法性、生物特征隐私与生成式
破产的Spirit航空公司计划将数百万客户数据出售给谷歌,引发隐私倡导者和立法者的强烈担忧。批评者警告称,破产不应成为AI公司获取个人数据的后门,这一案例可能开创危险先例,使陷入财务困境的企业成为AI训练数据的廉价来源。
在AI训练数据需求激增的背景下,初创公司Micro1宣布其年化总收入突破5亿美元。该公司为AI企业提供高质量标注数据与数据工程服务,客户覆盖大模型、自动驾驶等领域。本文梳理Micro1的成长逻辑、行业竞争格局,并分析数据服务商面临的版权、合
近日,Twitch宣布主播可通过设置选择退出平台将内容用于AI训练,但数千名用户随即质疑:为何自己的直播和聊天内容会在未经明确同意的情况下被亚马逊用于训练人工智能?这一争议不仅关乎Twitch的数据政策,也折射出AI产业在利用用户生成内容时
Twitch近日宣布,其用户生成内容可能被用于亚马逊未来生成式AI模型的改进,但用户现在可以选择退出。这一消息在创作者群体中引发关注,因为直播内容多年来可能一直被用于AI训练。业内人士认为,平台的透明度进步,但退出机制无法追溯已使用的数据,
稀有书商发现,疑似AI公司的买家通过中介大量收购绝版书籍,收购后书籍随即被销毁。书商怀疑这些公司试图独占高质量训练数据,挤压竞争对手,甚至破坏文化遗产。多家书店已开始抵制此类采购,并呼吁行业警惕。专家认为,AI训练数据获取的透明度亟待提升。
法院最终批准了Anthropic与版权方达成的15亿美元和解协议,暂时平息了这场备受关注的诉讼。然而,此案并未解决生成式AI使用受版权保护材料训练模型的根本法律问题。行业观察人士认为,这一里程碑式的和解更像是权宜之计,未来仍需要更清晰的监管
Origin Lab是一家专注于AI训练数据许可的初创公司,近日宣布完成800万美元融资。该公司旨在搭建一个双向市场:视频游戏公司可以将其海量玩家交互数据授权给AI实验室,后者则利用这些高质量数据训练“世界模型”。这笔融资由知名风投领投,凸
美国法官为作家们提供了更容易攻击Meta使用BitTorrent下载内容的途径,这可能助力针对Meta的集体诉讼。Meta寄希望于最高法院(SCOTUS)近期裁决来阻挡这一诉讼。该案源于Meta涉嫌通过torrent方式获取海量数据用于AI
DoorDash 推出全新‘Tasks’应用,允许配送员通过拍摄日常任务视频或录制多语言语音等方式赚取报酬。这些视频将用于训练人工智能模型。该举措旨在解决 AI 数据获取难题,同时为外卖员提供额外收入来源。DoorDash 表示,此举能提升
大名鼎鼎的《大英百科全书》和美瑞安-韦伯斯特词典公司联合起诉OpenAI,指控后者未经授权使用近10万篇词条和文章训练大型语言模型(LLM)。这一诉讼凸显AI训练数据版权争议的升级,可能对生成式AI行业造成深远影响。事件源于OpenAI的C
最新数据显示,AI机器人正深入渗透网络世界,已成为网站流量的显著来源。这引发出版商推出更激进的防御措施。随着ChatGPT等AI模型的兴起,数据爬虫流量激增,占全球网页访问量的10%以上。出版商如News Corp和The New York