DeepSeek 在关于与美国算力差距的评论泄露后暂停融资(记录稿)[pdf]

泄露的 DeepSeek 投资者会议记录显示,这家中国 AI 实验室暂停新的融资,并不是因为缺钱,而是因为美国出口管制和国内政策使其无法买到足够多的高端 GPU,与美国前沿模型竞争。评论者认为,这一“算力差距”既是中国的战略风险,也可能推动更小、更高效、通常开源权重模型的创新;同时他们也在争论,对越来越大的系统持续砸钱是否真是一种可持续优势。讨论还涉及中国推动国产芯片(华为昇腾)、Nvidia 软件护城河的脆弱性,以及围绕 AGI 和国家安全展开的 AI 军备竞赛所具有的更广泛地缘政治意义。

为什么 DeepSeek 暂停融资

  • 标题引发了困惑:有人理解为“因为评论泄露所以暂停”,也有人理解为“因为算力差距而暂停”。
  • 记录稿本身强调的是 GPU 供应限制:资金并不缺,但没有足够硬件可以高效投入使用。
  • 线程中的其他报道指出,暂停还源于对投资者泄密的愤怒,说明硬件瓶颈和保密问题可能同时存在。
  • 几位评论者认为,如果无法以合理价格把现金换成 GPU,那么不再融资是有道理的。

算力差距、硬件约束与战略

  • 创始人描述了美国和中国实验室在纯算力上的巨大差距(激活规模相差数量级,需要约 20 万块高端 GPU,而实际获得的只是其中一小部分)。
  • 有观点认为真正的瓶颈是资源而不是人才;中国和美国团队在技术上被认为大致相当。
  • 一些人预计稀缺会推动算法效率和更小、更优化的模型;另一些人则引用“苦涩的教训”,认为可扩展方法加更多算力通常会胜出。
  • 讨论了超稀疏模型和定制内核作为实现大幅提速、降低硬件需求的路径。

中国–美国芯片与国内硬件推进

  • 线程详细讨论了出口管制、许可机制,以及“中国既想要又限制 NVIDIA 芯片,以加速国产替代(例如华为)”的说法。
  • 讨论中国模型是否真的接近一线,还是主要由美国前沿模型蒸馏而来。
  • 有人认为华为产能受制于良率、工具限制和总体需求;也提到国内晶圆厂正快速扩张,但仍落后于最先进制程。
  • CUDA 被反复描述为一条重要护城河,而 DeepSeek 显然正试图通过自定义框架和华为支持来绕开它。

商业模式、定价与资本纪律

  • 记录稿摘录强调一种“自我克制”的理念:避免筹集无法有效部署的巨额战争资金;把过多资本视为潜在诅咒。
  • 据称推理定价的目标是在约 10 个月内收回资本支出,但并不是为了最大化利润率。
  • 有人认为这与美国实验室“增长优先、不计代价”和“赢家通吃”的假设形成对比。

AGI、商品化与战略意义

  • 对模型是否会像钢铁一样商品化,还是某一家实验室的 AGI/ASI 突破会带来压倒性优势,存在分歧。
  • 一些人怀疑仅靠 LLM 无法达到“真正的 AGI”,但也有人认为当前系统已经远远超出“只是玩具预测器”的范畴。
  • 评论者认为,政策制定者更关注军事和网络安全应用,而非关于 AGI 的哲学问题。
  • 还有人认为真正的护城河是获取海量算力;而高效蒸馏表明当前护城河可能并不牢固。

对美国实验室与治理的看法

  • 一段激烈的旁支讨论比较了不同美国实验室的开放程度、政治游说和安全文化,评价差异极大。
  • 有人担心企业影响监管、出口管制,以及把 AI 描绘为国家安全问题的框架。
  • 讨论还类比了美国和中国的政治压力,不过几位评论者强调两者在程度和后果上存在差异。