小Lin说 - Deepseek突然连融两轮500亿,梁文锋到底想干什么
| 项目 | 内容 |
|---|---|
| 来源 | https://www.douyin.com/video/7680801661580741926 |
| 时长 | 6分26秒 |
| 转录时间 | 2026-09-03 11:35 |
| 字数 | 2727 |
| 分段方式 | AI智能分段(含Markdown标题) |
📝 章节标题由AI根据内容结构生成,非原文内容
📝 AI摘要:DeepSeek近期完成大额融资并保持控制权,核心目的是锁定AI顶尖人才以维持团队稳定,从而专注于实现通用人工智能(AGI)的长远目标。面对算力瓶颈,DeepSeek选择开源路线,一方面借助社区力量分担部署成本、节省稀缺算力资源,另一方面通过构建生态争取更多支持,以此提升达成AGI的胜算。
一、引入现象与背景
你有没有感觉,DeepSeek 最近动静小多了?你看去年年初多火,最近各种 AI 爆发,反倒它的讨论度低了。但偏偏就在这个时候,一向低调的 DeepSeek 惊动了市场。
之前一直号称不缺钱、不融资、不上市,今年六月份却完成了第一笔外部融资,上来就融了五百亿。最近第二轮的五百亿也接近尾声了。而更有意思的是,一向不怎么露面的梁文锋,最近被爆出来了一份跟投资人四个小时闭门会的逐字稿,内容是相当劲爆。
本来呢,大家也不确定是真是假,但之后美国的 Bloomberg 就爆料说,梁总对这个泄露非常生气。你看他这么生气,那这个录音八成是真的,值得说道说道。咱们今天就结合着这个闭门会,来说说这个不走寻常路的 DeepSeek 和梁文锋到底想干嘛?
这个 AI 的发展,中美竞争又会是个什么格局?
二、融资结构与控制权
咱先来快速看一下六月份的这笔融资,总共五百亿,这里边腾讯一百亿,宁德时代五十亿,京东、网易、IDG 各三十亿,还有国家人工智能产业基金十亿。而这一轮里头领投的最大的金主是谁呢?梁文锋自己,一个人自掏腰包两百亿,是吧?
这个有钱真是霸气。
不过啊,虽说腾讯、京东、宁德都进来了,但他们没有投票权,公司还是梁文锋控制。什么公司的发展战略、重大决策,DeepSeek 往哪走,还是我梁文锋说了算。不光你们没有投票权,投的钱还得锁定五年。
这里唯一的例外就是那个国家产业基金,它有投票权。
所以从这个融资你就能看出来,DeepSeek 虽然公众视野这个声量确实小了,但在 AI 圈还是非常有话语权。
三、融资核心:稳定团队
那你看他好像也没那么缺钱,还这么强势,那为什么要融资呢?核心就一个字儿:人。梁文锋原话是说,我们最大的核心利益就是保持团队的稳定性,甚至可以认为是唯一的核心利益。
你看看这个重要性。其实这个 AI 圈竞争,你看着大家是在抢芯片、抢内存、抢电力,但大玩家们最最核心的战场其实是在抢人。这几年 DeepSeek 确实被挖走太多人,第一代大语言模型的核心作者王炳轩去了腾讯,那个天才少女罗芙莉去了小米,还有郭达雅,今年三月。
刚去了字节的席。其实吧,DeepSeek 他给的工资并不低,但大厂们都在疯狂砸钱,有媒体就爆料说,都不是翻个两倍三倍,总包能有八位数,是不是在那数零呢?数清楚了。
对于这些 AI 人才来说,虽然在 DeepSeek 工作,他们也拿期权,但 DeepSeek 没融过资呀,他就没有对价。那我哪知道我这些期权值多少钱?而对面都是大厂们明码标价的 offer,他怎么留人?
所以这轮融资最重要的目的就是这个,我融一轮资,让兄弟们看看,哎,咱这公司多值钱。你算算你手里那期权值多少钱?踏踏实实搁这干吧。
据说,梁文锋还明确给投资人提过要求,说不能挖 DeepSeek 的人,也不能撺掇他们出去创业。他自己也说了,这个风险就是人的风险。随着这轮融资得到了比较大的消除,好,团队稳住了。
四、核心目标:AGI
接下来咱们看看 DeepSeek 他到底要干嘛?梁总说得非常明确,就是 AGI,通用人工智能。他在会上反反复复提到。
可大家都想做 AGI 啊,关键是你怎么做,什么路线?哎,我跟你说,你要是去看梁文锋的原话,八成得晕,因为他大部分时间说了一大堆不做,多模态不做,世界模型不做,C端不重点做,D端顺便做,什么金融、医疗这些 agent 优先级更低。你这也不做,那也不做,你怎么通往 AGI 啊?
哎,他要做的,落到具体的动作上,最大的一个就是开源。这点非常明确。他说看不到闭源的好处呀,甚至还点名了,说字节的模型就是闭源,它有什么好处?
我看不到有什么好处。
五、关键路径:开源
5.1 开源内容:权重
好,咱总听说开源,他到底开了个啥呢?其实这里头最主要的就是权重。什么意思呢?
你可以简单把一个训练好的大模型理解成训练好的大脑,它里边有几千亿个参数,这个参数也叫权重。你输入信息,它根据参数输出信息,就有点像 y 等于 ax 加 b,你输入 x,它输出 y,这个 a 和 b 就叫权重。开源呢,就是 DeepSeek 把训练好的大模型的这些权重打包放在网上,谁都可以拿去改、部署,甚至拿去卖,也不用给 DeepSeek 一分钱。
当然了,你也可以直接接 DeepSeek 的 API 去用它部署好的。
总之就是开源之后谁都能用。
5.2 开源的商业逻辑
那问题来了,这个开源对它做成 AGI 有啥AGI有啥好处呢?Anthropic、OpenAI都是闭源,开源好在哪儿呢?哎,其实这背后因为中美环境的差异,DeepSeek和他们的处境是完全不一样的。
梁文锋也说得很直白,说现在中美竞争,差距只有一个,就是卡。人才几乎没有差距,都是同一批人。国产的卡呢,性能上也OK,差不多四张华为的卡约等于一张英伟达。
但主要的限制在于产能。你看华为一年给互联网大厂的十几万张,DeepSeek只有一万六千张,根本不够训练用的,真的是有钱也买不到。他自己也说了,要是融的钱半年就能花光,那就太幸福了。
所以这个卡,他肯定是想用在刀刃上。你要是闭源,我得拿出来很多卡去给消费者提供算力,而且像什么推理框架、部署优化,我都得自己招人自己干,还不如开源。开源的社区可以一起帮忙来解决这些脏活累活,在帮我给用户们提供服务,那不就相当于省了我的卡吗?
而我自己呢,就可以全力以赴奔赴AGI,把卡都用在训练上。另外呢,开源还能帮DeepSeek在AI圈儿占据一个有利的位置,帮他拿到更多资源、更多卡。那这块儿不是梁总自己说的,是我分析的。
你想,华为就那么多卡,他肯定是想卖给对自己更有帮助的人。为什么AI圈儿大家都用英伟达呢?除了卡本身,很重要的就是它CUDA那套编程工具、软件库,全世界都在上面写代码,很难换。
而梁文锋呢,就在用一个叫做TileLang的语言,能把跑在CUDA上那套在华为的卡上重新写一遍。这个对华为就很有吸引力了。尤其是你开源,就会有更多的人来用,更多的人用这个TileLang,用华为的卡,就可以让DeepSeek站到一个生态共建者的有利位置上,有机会帮他拿到更多的卡。
5.3 开源的技术考量
好,刚才我们说商业上主要就是开源,那技术上呢?你看AI这块儿从大语言模型到推理,再到Agent,它是一步一步的。梁文锋觉得下一步就是持续学习,就让AI有自己反思、自我进化的能力。
这个现在全球都在摸索。而在达到持续学习之前,模型的迭代主要就干三件事儿:成本更低、效果更好、速度更快。
六、总结:所有策略服务于AGI
所以总的来说呢,在现在算力紧缺的情况下,闭源对于DeepSeek,就算我赚到了钱,我也换不来更多的卡。那梁总手头也不差钱,他的目标还是很远的,不是为了当下赚钱,而是为了那个AGI。那我莫不如开源,不树敌,广结善缘,可以帮他分担一些脏活累活,也可以帮助他拿到更多的卡,包括融资也是广结善缘,同时避免人才的流失。
总之都是为了提高做成AGI的概率。