← 最新论文
💻 computer science

The End of the Foundation Model Era: Open-Weight Models, Sovereign AI, and Inference as Infrastructure

该论文指出,随着开源模型性能达到前沿且推理成本趋近于零,2020 至 2025 年的基础模型时代已然终结,AI 产业正经历经济、技术、商业与政治维度的结构性重塑,而开放权重模型已成为国家实现主权人工智能控制的关键手段。

原作者: Jared James Grogan

发布于 2026-04-09
📖 1 分钟阅读☕ 轻松阅读

原作者: Jared James Grogan

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

这篇论文《基础模型时代的终结》(The End of the Foundation Model Era)就像是一份AI 行业的“讣告”兼“新地图”。它告诉我们:过去几年那种“谁砸钱多、谁模型大,谁就是老大”的游戏规则已经彻底失效了。

作者 Jared James Grogan 用非常犀利的眼光指出,AI 行业正在经历一场巨大的重组。为了让你更容易理解,我们可以把整个故事想象成**“从建造摩天大楼到铺设高速公路”的转变**。

以下是用通俗语言和比喻对这篇论文核心观点的解读:

1. 旧时代的终结:昂贵的“魔法石”不再稀缺

过去的故事(2020-2025):
以前大家认为,AI 的核心是“基础模型”(Foundation Models)。这就像是在寻找一种**“魔法石”**。谁掌握了最大的魔法石(训练了最大的模型),谁就拥有了统治世界的力量。

  • 比喻: 就像早期的淘金热,大家觉得只要挖到最大的金矿(大模型),就能发大财。OpenAI、Anthropic 这些公司拼命烧钱,试图造出越来越大的“魔法石”。他们告诉投资者:“我们的石头最大,所以你们必须付高价买我们的服务。”

现在的真相(2026):
这篇论文说:“魔法石”已经变成了“普通石头”。

  • 开源的冲击: 中国的 DeepSeek 等开源团队证明,用很少的钱(几百万美元,而不是几十亿)也能造出同样厉害的模型。这就像有人发现了一种廉价的炼金术,瞬间让那些花几十亿买“魔法石”的人傻眼了。
  • 成本崩塌: 以前训练一个顶级模型要花 10 亿美元,现在可能只要几百万。既然大家都能造出差不多的石头,那谁还愿意花大价钱去垄断它呢?
  • 结论: 基础模型不再是护城河,它变成了像水泥和沙子一样的普通建材。

2. 资本游戏的破灭:一场“击鼓传花”的骗局

过去的玩法:
论文揭露了一个有趣的金融循环:

  • 比喻: 想象一家云巨头(比如亚马逊 AWS)给一家 AI 公司(比如 Anthropic)投资。AI 公司拿到钱后,必须全部用来买这家云巨头的“算力”(服务器)。
  • 结果: 云巨头左手倒右手:既赚了 AI 公司的投资回报(股权升值),又赚了 AI 公司买服务器的钱(高额利润)。
  • 泡沫: 这种循环让 AI 公司的估值像坐火箭一样飞涨(从 10 亿涨到 3800 亿),但这只是因为他们把投资者的钱花在了自己的服务器上,而不是因为他们真的有多大的技术壁垒。
  • 现状: 现在“魔法石”不值钱了,这个击鼓传花的游戏玩不下去了。AI 公司虽然收入很高,但烧钱更快,根本赚不到钱。

3. 政府的介入:从“顾客”变成“房东”

这是论文最核心的国家安全观点。

以前的情况:
美国政府像个大顾客,想买 AI 服务,但必须遵守 AI 公司(私人企业)制定的“家规”。

  • 比喻: 就像你租了房东的房子,房东说:“你可以住,但不能在屋里做这件事,也不能在那件事。”如果房东不高兴,随时可以把你赶走。

现在的转折(Anthropic 事件):
2026 年,美国政府(特别是国防部/战争部)对 Anthropic 说:“不行,你是国家关键基础设施的一部分,你不能制定规则,规则由我来定。”

  • 冲突点: Anthropic 说:“我不能让军队用我的 AI 去杀人或监控。”政府说:“这是合法的军事行动,你必须提供,没得商量。”
  • 结果: 政府直接宣布 Anthropic 为“供应链风险”,把它踢出了政府合同。
  • 深层逻辑: 对于核武器、互联网、加密技术,政府从来不允许私人公司说了算。AI 现在也被视为**“战略武器”**。私人公司不能因为“我觉得这不道德”就拒绝给国家用。

4. 新的生存法则:两条平行线

论文指出,AI 世界现在分裂成了两条完全不相交的轨道

A 轨道:商业 AI(大家都能看到的)

  • 特点:超市里的商品
  • 玩法: 模型是开源的、便宜的。大家拼的不是谁的模型大,而是谁能把模型用好
  • 比喻: 就像电力公司。电力公司(模型公司)只是卖电,真正赚钱的是那些用电造出好产品的人(比如用 AI 做医疗诊断的公司、用 AI 做金融分析的公司)。
  • 赢家: 那些拥有独家数据(如医院病历、银行交易记录)和深厚行业经验的公司。

B 轨道:国家安全 AI(看不见的“地下世界”)

  • 特点:绝密的军事基地
  • 玩法: 这里不关心模型公不公开,只关心政府能不能完全控制
  • 关键变化: 政府现在要求必须拥有**“模型权重”**(即模型的源代码和参数)。
    • 比喻: 以前政府是“租房子”(用 API),房东随时能赶人;现在政府要**“买断房子”**(下载并拥有模型权重),这样就算房东倒闭了,或者房东改规矩了,政府自己还能在“断网”的地下室里继续运行。
  • 赢家: 那些能进入这个“绝密俱乐部”的公司。这通常需要:
    1. 开源模型(政府能自己修改,不受厂商限制)。
    2. 有安全许可的员工(背景清白,能接触机密)。
    3. 财务稳定(不能总靠融资过日子,否则随时可能倒闭)。
    • 例子: SpaceX 收购 xAI。SpaceX 本身就有军方背景、有安全许可、财务稳定,它把 AI 能力直接“吞”进自己的体系里,而不是像 Anthropic 那样作为一个独立的、不可控的供应商存在。

5. 未来的赢家是谁?

这篇论文给投资者、公司和政府画了一张新地图:

  • 对于投资者: 别再赌“谁造出了最大的模型”了,那个赛道已经变成红海(价格战)。要去投那些**“用 AI 解决实际问题”**的公司,特别是那些有独家数据、能进入政府供应链的公司。
  • 对于公司: 如果你还在靠“卖模型”赚钱,你快不行了。你要转型做**“系统集成商”**。就像以前铁路修好了,赚钱的不是修铁路的,而是用铁路运货的钢铁大亨(卡内基)和石油大亨(洛克菲勒)。
  • 对于政府: 必须掌握**“开源模型”**。因为开源模型就像“图纸”,政府拿到图纸,自己就能造,不需要看私人厂商的脸色。这是国家安全的底线。

总结

“基础模型时代”结束了。
这就好比**“电力时代”**结束了,我们不再讨论“谁发电最贵”,而是讨论“谁用电最聪明”。

  • 以前: 谁拥有“大脑”(大模型),谁就是神。
  • 现在: “大脑”已经量产且便宜了。真正的价值在于**“手”(执行能力)、“眼睛”(独家数据)和“信任”**(谁能进入国家核心圈)。

AI 不再是一个单一的、由少数科技巨头控制的“黑盒”,它正在变成一种国家基础设施,一部分在公开市场上像水电一样便宜,另一部分在绝密的地下世界里,由国家完全掌控,用于决定国家的命运。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →