谷歌AI连自家名字都拼错,这尴尬了谁?
谷歌旗下AI模型在生成文本时频繁出现拼写错误,甚至连公司名“Google”都无法正确拼写。本文深入剖析了这种现象背后的技术原因——基于token的分词机制与概率生成逻辑的固有缺陷,同时对比了OpenAI等竞争对手的处理方式,并指出这不仅是“
谷歌旗下AI模型在生成文本时频繁出现拼写错误,甚至连公司名“Google”都无法正确拼写。本文深入剖析了这种现象背后的技术原因——基于token的分词机制与概率生成逻辑的固有缺陷,同时对比了OpenAI等竞争对手的处理方式,并指出这不仅是“
AI模型的编码能力正大幅降低机器人开发的门槛。通过将大语言模型与实体机器人结合,开发者可以用自然语言指令快速部署复杂动作。本文作者尝试为自己的OpenClaw智能体赋予物理身体,展示了AI从虚拟到现实的关键一步。这一趋势预示着机器人将不再是
阿里巴巴近日发布专为AI智能体设计的处理器Zhenwu M890,并宣布了一系列芯片路线图和新大语言模型。此举表明阿里正构建集成式AI堆栈,而非仅填补美国出口管制空白。该芯片针对智能体工作负载优化,有望改变AI芯片竞争焦点,从通用算力转向智
预印本平台ArXiv宣布将严厉打击在科学论文中不加节制使用大语言模型的行为。新政策规定,若被发现完全依赖AI生成内容、未进行实质性人工贡献的作者,将被禁止提交论文一年。此举旨在维护学术诚信,遏制AI在科研写作中的滥用。ArXiv作为全球最大
随着AI技术迅猛发展,大量专业术语和网络俚语涌入日常对话。许多人面对“大模型”“AGI”“对齐”等词汇时只能点头附和,但内心充满疑问。本文系统梳理了当前最核心的AI概念,从Transformer到扩散模型,从强化学习到提示工程,并补充行业背
本周科技简报聚焦两大前沿:一种可反复潜入深海6000米的廉价水下跳跃器,有望大幅降低深海科考成本,但也可能加速深海采矿。同时,美军正测试基于大语言模型的战术聊天机器人,旨在提升战场决策效率,但引发伦理担忧。两项技术均展示了AI与自动化对传统
OpenAI于2026年5月6日推出了GPT-5.5 Instant,作为ChatGPT的新默认模型。该模型在法律、医学、金融等敏感领域显著减少了AI幻觉现象,同时保持了前代模型的低延迟特性。这一更新旨在提升模型在专业场景下的可靠性与实用性
哈佛大学最新研究发现,在真实急诊病例中,大型语言模型的诊断准确率高于两名人类医生。这一结果引发了对AI辅助医疗的广泛讨论,但也揭示了当前模型在临床推理和患者沟通上的短板。研究团队指出,AI应作为医生决策的补充工具,而非替代品。
美国一家新手机网络瞄准基督徒用户,自动屏蔽色情与性别相关内容,引发言论自由争议。与此同时,大语言模型调试技术迎来突破,两者在内容过滤与模型校准上异曲同工。本文编译自MIT Technology Review,深度解析技术如何重塑信仰与AI的
旧金山初创公司Goodfire发布名为Silico的新工具,允许研究人员和工程师在训练期间深入AI模型内部,调整其参数——即决定模型行为的设置。这为模型制造商提供了前所未有的精细控制能力,改变了以往对AI技术构建方式的认知。Goodfire
OpenAI近日发布了一款专门针对生物学工作流程优化的大语言模型GPT-Rosalind。该模型在封闭访问模式下提供,旨在提升生物学领域的研究效率。通过对生物学数据和流程的深度学习,GPT-Rosalind可帮助科学家更高效地处理复杂的生物
Arcee是一家仅有26人的美国初创公司,却成功构建了一个高性能的大型开源大语言模型(LLM),并在OpenClaw用户中迅速流行开来。在AI领域巨头林立的当下,这家小公司以开源精神挑战行业格局,吸引了众多开发者和企业的关注。其模型不仅性能
MLCommons近日公布了行业标准MLPerf Inference v6.0基准测试套件的最新结果。此次更新包括五个数据中心测试的新增或升级,以及边缘系统的全新物体检测测试。主要亮点有基于GPT-OSS 120B的开源大语言模型基准、扩展
在大语言模型(LLM)早期,我们习惯于每次新模型迭代带来10倍级的推理和编码能力跃升。如今,这些飞跃已趋于平缓,仅剩增量改进。例外在于领域专用智能,这里仍保持阶跃式进步。当模型与企业数据深度融合时,将释放巨大潜力。本文探讨为何转向定制化已成
人工智能模型层出不穷,竞争白热化,谁是真正的最强?Arena(前身为LM Arena)已成为前沿大语言模型(LLM)的公认公共排行榜,在短短七个月内从加州大学伯克利分校博士研究项目崛起,深刻影响融资、产品发布和公关周期。该榜单以‘无法作弊’
人工智能模型层出不穷,竞争白热化,谁来评判最佳?Arena(前身为LM Arena)已成为前沿大语言模型(LLM)的公认排行榜,在短短七个月内,从加州大学伯克利分校的博士研究项目转型为初创公司,深刻影响融资、产品发布和公关周期。这群博士生如
谷歌开发创新方法,利用大型语言模型(LLM)从历史新闻报道中提取定量数据,解决洪水预测的数据稀缺问题。这一技术将定性描述转化为可量化的洪水事件指标,帮助提升突发山洪预警准确性。面对气候变化加剧的极端天气,谷歌的AI方案为灾害预测开辟新路径,
OpenAI 近日推出 GPT-5.4 模型,被誉为‘我们最强大且高效的前沿模型,专为专业工作设计’。该模型分为 Pro 和 Thinking 两个版本,前者优化专业任务效率,后者强化复杂推理能力。作为 GPT 系列最新迭代,GPT-5.4
在巴塞罗那MWC 2026大会上,SK电信详细阐述了其围绕AI重建公司核心的宏伟计划。这一转型不止于引入新AI工具,而是从网络核心到客服一线全面重构内部系统。公司计划将数据中心容量扩容至吉瓦级,并升级自家大语言模型。该举措标志着电信巨头加速
Guide Labs 近日开源一款8亿参数大语言模型Steerling-8B,该模型采用全新架构设计,使其行为高度可解释。这标志着AI领域在黑箱模型向透明化转型的关键一步。传统LLM如GPT系列虽强大,但内部决策过程难以追踪,而Steerl