Claude Mythos 成 DeepSeek 融资导火索:梁文锋坦言“不储备弹药没法打了”
DeepSeek 近期完成 74 亿美元融资,团队计划翻倍,并加速适配华为芯片。梁文锋透露,看到 Anthropic 的 Claude Mythos 通过海量算力与数据展现出惊人能力后,他意识到必须储备算力才能继续竞争。他坚持开源、低价、专注 AGI 的战略,认为 AI 不应被少数人控制。
融资导火索:Claude Mythos 的震撼
什么原因让 DeepSeek 最终决定开启融资?The Information 最新消息曝光:梁文锋在看到 Anthropic 的 Claude Mythos 后,意识到 DeepSeek 若不储备弹药,根本无法在竞争中生存。
Anthropic 于今年 4 月发布了 Claude Mythos 的第一个预览版。巧合的是,DeepSeek 的融资传闻也是在 4 月中旬首次传出。时间线高度吻合。

团队扩张:300 人规模将翻倍
融资完成后,DeepSeek 在本周四罕见地发布了一则公开声明:所有部门招人“至少翻倍”,覆盖 AI 系统开发、基础设施、产品开发和深度学习研究。
目前 DeepSeek 全公司约 300 人。其中负责将模型转化为自主 AI 智能体的核心部门——Harness 团队,已进入每天面试的状态。该团队负责人崔添翼(今年 3 月从 Jane Street 跳槽加入)本月早些时候在 X 上透露了这一节奏。
芯片适配:不惜代价拥抱国产化
DeepSeek 正在加紧适配国产芯片。梁文锋相信,华为芯片几年内就能追上英伟达的水平,DeepSeek 应该率先完成适配。华为直到去年才得知 DeepSeek 私下试验自家芯片,随后开始与其直接合作。
但适配代价不小。DeepSeek 的训练和部署系统完全基于英伟达 CUDA 软件搭建,工程师必须重写底层软件,才能让模型在华为芯片上高效运行。这直接导致 DeepSeek 长达 15 个月没有发布任何新一代模型——在其他顶级实验室两三个月就发布新模型的时代,这个空窗期格外扎眼。
这也让 DeepSeek 错过了去年下半年 Anthropic Claude Code 掀起的编程工具热潮。但梁文锋在路演中对投资人表示,编程工具和 AI 聊天机器人一样,都只是 AI 进化中的临时产物。如果重注押在这些短期产品上,会偏离通往 AGI 的终极目标。
战略坚守:开源、低价、专注 AGI
最新爆料还显示,梁文锋并非一开始就抗拒风投。2023 年他曾见过投资人,但当对方得知 DeepSeek 只做深度研究和科学探索、没有任何商业化或产品路线图时,纷纷打退堂鼓。最后梁文锋自己掏钱养活了实验室,一养就是三年。
本次 74 亿美元融资中,梁文锋本人写了最大的一张支票:200 亿人民币(约 30 亿美元),占总额的五分之二。融资完成后,DeepSeek 设立了员工持股计划,按实际估值分配股份。
梁文锋告诉身边人,他的战略不会变:继续开源、保持低价、专注 AGI。他把 AGI 定义为机器在理解、推理、学习、规划和适应等广泛任务上达到人类水平。他还强调,AI 不应该被少数人控制。
DeepSeek 是目前唯一一家将所有模型底层代码完全公开的主要 AI 实验室。
市场崛起:美国开发者青睐有加
在美国开发者群体中,DeepSeek 的存在感正在急速膨胀。今年 4 月发布的旗舰模型 V4,5 月在 Vercel 的 AI Gateway 平台上 token 用量份额从不到 1% 飙升至 17%,一个月内成为该平台仅次于 Anthropic 和 Google 的第三大模型。轻量版 V4 Flash 的价格比 Anthropic 模型便宜 20 到 50 倍。这种增长在 6 月仍在继续。
关键要点
- 融资导火索:梁文锋看到 Claude Mythos 的算力优势后,决定储备弹药。
- 团队扩张:300 人团队计划翻倍,核心 Harness 团队密集招聘。
- 芯片适配:重写底层软件适配华为芯片,代价是 15 个月未发布新模型。
- 战略不变:梁文锋坚持开源、低价、专注 AGI,认为短期产品会偏离终极目标。
- 市场表现:V4 模型在美国开发者平台 token 份额从不足 1% 飙升至 17%,价格优势显著。