一场"意外"流出的内部交流
2026年7月23日凌晨,一份梁文锋与DeepSeek投资人的闭门交流实录开始在网上流传。这场交流实际发生在5月20日,持续接近4个小时,共有118组问答,全文合计2.4万多字。
参加交流的是DeepSeek的投资人。当时首轮外部融资已进入后半程,投资人名单基本确定(腾讯、宁德时代体系、京东、网易、IDG资本等),梁文锋先做分享,再接受投资人集中提问。这是人们第一次在公开语境里,看到梁文锋以"融资方"身份如此完整地解释这家公司。
两个月后,DeepSeek已完成首轮510亿元融资,投后估值约4000亿元,梁文锋个人出资约200亿元。与此同时,DeepSeek已开始筹备科创板IPO,目标最快年内申报。
"克制是一种战略,放弃一些东西,是为了提高实现AGI的概率。资源是有限的,每多做一项非核心业务,AGI的成功概率就会下降一点;反之,每放弃一个短期诱惑,就能把更多算力、人才、注意力投入到主线。"
| DeepSeek的"不做什么"清单 | |
|---|---|
| 不做超级App | 不做下一个字节、腾讯,不跟谁竞争 |
| 不做3D/视频生成 | 跟智能的主线没有太大关系 |
| 不做世界模型 | 不是当前阶段最重要的事 |
| 不追C端流量 | C端用户是AGI路上的"副产物" |
| 不闭源 | 最强模型也会开源,看不到闭源的必然好处 |
| 不利润最大化 | 只赚六倍利润(十个月回本),不赚一百倍 |
| 不设KPI | 愿景驱动,不靠规章制度管理 |
| 不加班 | 研究需要松弛环境,逼太紧做不出研究 |
| 阶段 | 内容 | 状态 |
|---|---|---|
| 第一阶梯 | 语言模型(基础能力) | 已完成 |
| 第二阶梯 | CoT(思维链) | 2025年突破 |
| 第三阶梯 | Agent(智能体) | 2026年重点 |
| 第四阶梯 | 持续学习 | 下一代模型核心能力 |
| 第五阶梯 | 自我迭代奇点 | 模型自己开发下一个版本 |
| 第六阶梯 | 具身智能 | 届时"不用我们动手" |
"持续学习是下一代模型的核心能力。必须要有持续学习的能力,它才能叫下一代模型。在那之前,我们能做的就是成本更低、效果更好、速度更快。但是要有大突破,它应该是具备持续学习的。持续学习先做出来,通用智能可能就很容易了——用它来做就很容易。"
| 关键词 | 梁文锋观点 |
|---|---|
| 愿景 | 管理大公司靠的不是规章制度,靠的是愿景。愿景是你怎么做,不是怎么说。 |
| 克制 | 克制是一种战略。有时候你可以舍弃一些,来换更多其他的东西。 |
| 主线 | 我们只做AGI的主线。3D、视频生成跟智能主线没有太大关系,不做。 |
| 持续学习 | 下一代模型的核心能力。必须具备持续学习,才能叫下一代模型。 |
| 通用智能 | 持续学习先做出来,通用智能就很容易了。比较省力、比较轻松。 |
| 稳定性 | 最大的核心利益是保持团队稳定性。只要大家不走,一定能做成AGI。 |
| 中美差距 | 人才不是瓶颈,资源是最大瓶颈。所有区别都是因为算力资源的区别。 |
| 管理 | 两条线:从上到下做正事分工,从下到上自由探索。建立在共识基础上。 |
| 资源 | 卡越多越好,在合理价格内能买到多少卡就买多少卡。 |
| 规模 | 信Scaling,规模越大效果越好。阻止我们的就是算力,不是不想Scaling。 |
| 芯片 | 国产芯片硬件和生态都没问题,唯一问题是产能不够。英伟达在掘自己的坟墓。 |
| 未来五年 | 不太相信五年后还卡在产能问题上。今年、明年、后年可能还卡,但五年后不一定。 |
| 全球分工 | 中国公司角色是产量最大。中国人会把产品做到最便宜,再在效果上发力。 |
| AI差距 | 最终差距是三方面:成本、时间、用户体验。除此以外没有差距。 |
| 少即是多 | 拿得多的人会被拿得少的人打败。愿景是拿得多,你就先输了。 |
| 多模态 | 一直在做。对产品重要,对C端重要。但对智能上限,它是个组件,不是主线本身。 |
| 责先利后 | 首先要对我们自己有用。自己好用了,开发下一版模型就更快。 |
| 开源 | 一开始就想清楚了。愿景第一,商业好处第二。AI足够大,不可能独占。 |
| 数据 | 公司有一半的人在标数据。一半的核心研究员、最重要的人,有一半在标数据。 |
| 商业化 | 本质是公司,有取舍。很多公司因为利润以外的追求变得更伟大,商业化反而更好。 |
| 维度 | DeepSeek(深耕派) | 月之暗面/Kimi等(冲刺派) |
|---|---|---|
| 发展哲学 | 克制是一种战略,耐心换壁垒 | 资本驱动快速扩张,规模换时间 |
| 估值 | ~4000亿元(510亿融资) | 投前500亿美元,赴港上市在即 |
| 开源策略 | 最强模型也开源,无功能阉割 | K3为全球最大开放权重AI系统 |
| 商业化 | B端收入"顺便做的",不优先 | 冲刺商业化,Pre-IPO轮融资 |
| C端策略 | 不参与红包大战,不做超级App | 积极抢占用户入口 |
| 核心聚焦 | Coding Agent + 持续学习 | 参数竞赛(2.8万亿参数K3) |
| 外部评价 | "比Anthropic更Anthropical,比OpenAI更Open" | 黄仁勋:"市场又误读了Kimi" |
V4-Flash上线后长期位居全球AI大模型调用量榜首,月用量达18.4T Tokens,是全球开发者使用最广泛的开源模型。V4-Pro API价格永久降至原价1/4,输入(缓存命中)低至每百万Tokens 0.025元,输出6元,创当时全球大模型价格新低。