(预告)Xi Jinping 与中国科技公司、芯片禁令的长期影响,以及对台湾的悲观展望
摘要
- DeepSeek 改变了中国对 AI 的心理预期:一家受芯片限制的公司也能做出具备国际竞争力的开源模型——“我们能做到”(Yeah, we can do this)。 Bill Bishop 称这是一个转折点,短暂“令美股暴跌”,也令 NVIDIA 承压,同时推动港股 AI 股上涨;Ben Thompson 指出,市场随后几乎完全收复失地。
- 开源让中国获得了快速触达全球用户的分发渠道,同时打乱了国内模型的定价。 用户可以运行 DeepSeek,而不是付费使用 Anthropic 的 Claude 或 OpenAI;Baidu、Tencent 等中国供应商也被迫转向免费模式,令商业模式“完全说不清”。Ben 提醒,DeepSeek 可能是自行决定开源,而非执行中央政府指令。
- 所谓600万美元奇迹,是对 DeepSeek V3 论文的误读,并不是说完整研发只花了600万美元。 Ben 强调,这一数字只覆盖1次训练,明确排除了实验和研发成本。DeepSeek 的突破确实真实存在,但其神话已经跑在披露的经济账本前面。
- R1 的病毒式爆发,是广泛可用、显性推理、中国焦虑,以及担心西方数十亿美元 AI 资本开支可能打水漂等因素共同作用的结果。 对许多用户而言,这是他们第一次接触推理模型;看着“我的小 AI 朋友”一步步推导答案,让它显得比付费墙后的替代品更好用。Bill 曾质疑这轮增长是否完全自然,听完 Ben 关于“完美风暴”的论证后,仍认为这可能是“多种因素的混合”。
- DeepSeek 促使 Bill 所称“又肥又满足”的美国 AI 公司迅速应战。 Ben 提到 AI 价格下跌、产品发布更加激进、GPT-4o 更新减少了“HR 口吻”,以及 Google 推出了更便宜、且可以说同样出色甚至更好的模型。
- DeepSeek 和 xAI 走出了两条截然不同的强模型路线。 DeepSeek 围绕带宽限制重构了混合专家训练,Ben 认为其使用的是 H800 而非 H100;xAI 则筹集了“160亿美元或120亿美元”,购买 NVIDIA 硬件,利用 NVIDIA 的网络能力,并在成立仅19个月后做出了看起来处于业界领先水平的 Grok 3。Ben 指出,o3 可能更强,但它是另一种推理模型,不太可能直接发布。
- 投资者尚未得到回答的问题是:未来1-2年,工程创新能否继续弥补受限硬件的差距。 Bill 问,如果 DeepSeek 实际上只能购买 Huawei Ascend 芯片,而 xAI 和 OpenAI 仍能持续采购更好的 NVIDIA 系统,两者之间是否会出现真正的分化;预告在 Ben 刚开始展开担忧时戛然而止。
精读
1. DeepSeek 将技术稀缺转化为国家信心
Bill 的核心判断是心理层面的:尽管面临“这场芯片封锁”,DeepSeek 仍找到了“非常有创造力的办法”,做出具备国际竞争力的模型。把成果开源后,这一成就被转化为“我们能做到”(Yeah, we can do this)的集体信心。
市场反应放大了这一转变:Bill 称 DeepSeek“令美股暴跌、令 NVIDIA 暴跌”,并引发港股 AI 股“融化式上涨”;不过 Ben 强调,价格后来几乎回到了此前水平。
DeepSeek 最初是一家对冲基金和量化基金,曾大举采购 NVIDIA 硬件。其 CEO Li Wenfeng 周一与 Xi Jinping 会面;Ben 开玩笑说:“这是我的量化基金。”
2. 开源让 DeepSeek 走向全球,也打乱了国内定价
Bill 的分发逻辑是,全球任何人都可以下载一个强大的中国模型,而不必付费使用 Anthropic 的 Claude 或 OpenAI。Baidu,以及 Bill 认为的 Tencent,都将其整合进产品,让开源成为“中国极其强大的东西”。
被问到 DeepSeek 为什么开源模型时,Bill 称这是“一枚诱饵”。Ben 提醒,人们高估了中央政府对这一决定的知情程度或重视程度,DeepSeek 可能从始至终都在自行决策。
DeepSeek 也打乱了中国 AI 市场:原本对模型收费的公司,如今不得不转向免费。Bill 看不到清晰的商业模式;Ben 回应称,美国也面临同样的问题,尽管 OpenAI 和 Anthropic 已经获得订阅收入,但仍不足以覆盖成本。
Ben 对消费者市场的判断更加明确:ChatGPT 已经拿下科技业最难获得的资产——拥有显著市场份额的消费品牌。广告是“不可避免的终局”,OpenAI 需要尽快走到这一步,让免费用户也能获得能力尽可能强的模型。
3. 病毒式爆发是完美风暴,而不是600万美元魔法
Bill 怀疑 DeepSeek 在 X 和 App Store 上的突然崛起,是否部分来自非自然推动。Ben 判断其“相当真实”;听完这套论证后,Bill 表示认为这是“多种因素的混合”,并认可 Ben 更有说服力的解释。
V3 在圣诞节前后发布,此前 DeepSeek 已经连续多年发表论文。论文中约600万美元的数字只覆盖指定的训练过程,不包括实验或研发;论文也明确披露了这些排除项。Ben 称,人们在利用这一数字服务自己的议程,尽管论文已经清楚说明了它没有包含什么。
R1 随后让许多用户第一次接触推理模型,并看到模型展示思考过程。可比的推理模型此前都被付费墙隔开,而 OpenAI 出于竞争原因没有公开自己的推理过程。再叠加对中国的焦虑、数十亿美元 AI 投资,以及建立在这些支出之上的股市,DeepSeek 便在“一个周末里变成了当下最热的事情”。
4. DeepSeek 和 xAI 针对相反的约束进行优化
Ben 相信 DeepSeek 的技术故事,是因为其架构与所称的瓶颈相吻合。DeepSeek 重做了混合专家训练,使其能够围绕带宽限制扩展;Ben 认为它使用的是 H800 而非 H100。DeepSeek CEO 和员工也曾明确指出,芯片获取是最大的约束。
Grok 3 则提供了相反的案例:成立仅19个月的 xAI,通过筹集“160亿美元或120亿美元”、购买 NVIDIA 芯片,并利用 NVIDIA 的网络能力将芯片大规模连接起来,做出了看起来处于业界领先水平的模型。Ben 对这一比较作了限定:o3 可能更强,但 o3 是另一种思考模型,不太可能直接发布;其 Deep Research 版本虽然令人印象深刻,但也存在明显缺陷。
Ben 用比较优势来类比:初创公司必须捕捉“瓶中闪电”,而现金充裕的在位者则可以通过买下突破背后的团队来降低风险。Facebook 放弃了对 Poke 的跟进,把 Stories 放进了 Instagram。DeepSeek 优化的是稀缺,xAI 购买的是充裕;两种方式都符合各自的处境。
5. 竞争迅速改善,但芯片获取的长期结论仍未揭晓
Ben 观察到竞争性回应已经出现:AI 价格此前已经下降,OpenAI 发布产品时变得更加激进,GPT-4o 更新后的训诫感更弱,少了些“HR 口吻”。Google 也推出了更便宜、且可以说同样出色甚至更好的模型。
Ben 强调,DeepSeek 的工程成果包含真正的突破,这些技术将被、或已经被全球同行采用。市场对这一事件的反应,既包含 AI 神话,也包含一个本身“相当惊人”但尚未被充分理解的现实。
长期问题仍未回答:如果 DeepSeek 继续拿不到最好的 NVIDIA 芯片,实际上只能购买 Huawei Ascend 芯片,而 xAI 和 OpenAI 仍在持续采购更好的 NVIDIA 硬件,Bill 问,1-2年内是否会出现“真正的分化”。预告在 Ben 说出“所以,系好安全带,进入正题”时结束。