美军AI令牌告急:“无限用量”只是噱头?

美军AI令牌告急:“无限用量”只是噱头?

据Ars Technica报道,美国陆军近日收到一封内部邮件,措辞颇为紧急:其拥有的AI令牌(AI tokens)正在快速消耗,预计将在数周内触及“隐含上限”。邮件来自负责AI服务采购的国防后勤部门,建议各部队立即减少非必要AI调用,以避免服务中断。

这则消息看似平常,却撕开了当前AI服务营销的一大“皇帝新衣”——所谓“无限AI令牌”从未真正无限。自2024年以来,主流AI平台如OpenAI、Anthropic、谷歌等纷纷推出“无限令牌”订阅计划,面向企业和政府客户,宣称每月仅需支付固定费用即可无限制使用AI能力。然而,几乎所有此类计划都包含“公平使用政策”(Fair Use Policy),即在极端使用场景下,服务方有权限制调用速率或直接切断服务。

“公平使用政策从来不是秘密,但用户总是会忽略那些小字。”——某AI服务行业分析师

军事场景:AI令牌消耗的“超级引擎”

美国陆军是AI技术的重级用户。从情报分析、作战模拟到后勤优化,军方持续调用大语言模型处理海量非结构化数据。一名不愿具名的国防部技术官员透露,仅一个师级单位每天就可能产生数十万次API调用,用于翻译外语资料、自动生成战术简报、辅助决策等。相比之下,普通企业用户每天仅数百到数千次调用。

邮件显示,陆军当前持有的AI令牌由多家供应商共同提供,总配额约为每月数十亿令牌。但在实际使用中,仅过去三个月消耗量就激增了400%,部分原因是生成式AI被整合到更多武器系统和指挥平台中。例如,M1A2主战坦克的“智能辅助终端”就集成了对话式AI,车组人员可随时询问维护步骤或战术数据。

“无限”的达摩克利斯之剑

事实上,AI公司的商业模式本就依赖用户购买超出实际需求的容量,从而获取稳定收入。所谓的“无限令牌”实质是“容量上限极高但非绝对无限”。当整个美国陆军这种级别的客户开始“烧”令牌时,隐形的天花板便迅速浮现。

据行业内部消息,OpenAI的“企业无限计划”其实包含每月10亿令牌的软上限,超出后速度会被限制到原来的1/10。Anthropic的“Claude Enterprise”则设有24小时内连续调用超过5万次的动态限流。更激进的例子是谷歌Gemini Advanced的“无限”计划,其条款明确写道“合理的个人使用”,商用大规模调用被明文禁止。

原文中提及,收到邮件的军官们颇为震惊——他们原以为买了“无限量自助餐”,结果发现餐厅其实每月只提供固定份量的牛排,吃多了就得上“慢餐盘”。

编者按:AI军备竞赛背后的供应危机

这次事件揭开了AI行业一个尴尬的现实:即便是最强大的算力基础设施,也无法支撑真正“无限”的AI调用。随着军事、金融、医疗等领域的超大规模部署,AI令牌的供需矛盾只会更加尖锐。

从商业角度看,AI公司未来可能被迫转向“按需计费”或更透明的分级定价,彻底抛弃“无限”这种营销话术。对于国家机构而言,自建模型或采用开源方案可能成为更明智的中长期策略。毕竟,将核心能力完全寄托于商业API,无异于在别人的地基上建造碉堡。

展望:令牌经济学的博弈

美国陆军的这次“令牌告急”并非孤例。据消息人士称,类似的邮件已出现在多个大型政府合同中。这或许会加速美军自研军事专用AI模型的进程,同时也将促使AI公司重新审视其企业版定价策略。

当AI从玩具变成工具,从工具变成武器,令牌的消耗就不再是简单的成本问题,而是战略资源分配问题。所谓“无限”,最终不过是一张精心计算的商业许可证。

本文编译自Ars Technica