一、新闻核心内容大白话总结
靠“500多万美金就训出顶级大模型”出圈的国内AI头部公司DeepSeek,最近正式官宣启动上市流程:已经找了中信证券当保荐机构,目标是上交所科创板,同时还在同步推进一轮规模500亿人民币的大额私募融资。
这件事直接打破了之前全网传的“大模型靠省钱就能做出来”的神话:本质是已经跑在全球第一梯队的DeepSeek,现在进入了“烧大钱换长期竞争力”的新阶段,既要找长期资金囤算力、养核心团队,又不想被短期资本绑住手脚,刚好赶上科创板上个月给大模型企业开了上市绿色通道,它也成了国内第一个往A股公开市场冲的头部原生大模型公司。
---
二、详细拆解解读
1. 别被“557万美金训大模型”的梗骗了:那根本不是一家大模型公司的全部成本
之前全网吹DeepSeek省钱,说它训V3大模型只花了500多万美金,很多人以为搞大模型是一本万利的买卖,其实这个数字的水分特别大:
这个钱只是最后一步“正式跑通完整训练流程”的GPU电费+算力租赁费,相当于你考清华的最后一科考试报名费,几十块钱而已,完全没算过去几年团队试错、调算法、攒训练数据、做几百次小实验的成本,更没算后面的持续开销:现在它的模型每天有几十万开发者调用、上亿用户用,光维持服务器不宕机、给用户提供稳定服务的工程团队就要几百人,接下来要训下一代更大的模型,提前囤几万片H800 GPU,每片就十几万人民币,这些钱加起来是千亿级别的,之前那点融资根本撑不了太久。
“团队能把钱花出更高效率”和“公司需要花更多钱”一点都不矛盾,就像学霸能把复习资料用透,不代表他不用买新的复习资料、不用报进阶班。
2. 一边融私募一边冲IPO:它要的不只是买GPU的钱,更是留人的“硬通货”
很多人奇怪,DeepSeek今年6月刚融了74亿美金,怎么转头又要融500亿、还要上市?其实钱只是目的之一,更重要的是解决大模型行业最头疼的“抢人难题”:
现在全全球都缺顶尖的大模型工程师,成熟的后端AI工程师年薪开到200万都抢破头,之前没上市的公司给员工发股权,本质就是一张没法定价的纸,你说值1000亿没人信,员工根本不认,不如直接发现金。但上市之后股权的价值是明明白白写在股价上的,给核心技术人员分的股权,哪天值多少钱、未来能兑多少现所有人都看得懂,相当于给所有人戴了个明码标价的“金手铐”,不用靠画饼就能把人留住,这对靠核心团队搞技术突破的大模型公司来说,比多买1万片GPU还重要。
3. 有钱也不是谁都能投:它宁愿挑钱,也不想被投资人瞎指挥
这次DeepSeek的新一轮融资条款特别离谱:要求投资人必须签5年锁定期,而且投了钱也没有投票权,不能干涉公司运营,就这条件各路资本还抢破头,份额根本不够分。
为啥它要搞这么苛刻的条款?因为大模型行业的研发逻辑和普通生意完全不一样:你要搞前沿技术突破,可能连续3-5年都看不到任何收入,要是普通上市公司的股东天天追着管理层要“今年赚多少钱、什么时候回本”,团队根本不敢往长期的、暂时看不到收益的方向投。DeepSeek现在就是要“花钱买自主权”:我要你的钱扩张,但你别管我怎么搞研发,我不用为了短期好看的财报砍掉长期研究项目,哪怕少融点钱,也不能让短视的资本打乱自己的技术节奏。
4. 为啥偏偏选科创板?专门给大模型开的绿色通道刚好踩中了
很多人问它为啥不选估值更高的美股、或者流程更简单的港股,非要上科创板?其实它刚好踩中了一个月前刚落地的政策红利:
之前A股上市的硬要求是要么连续几年盈利,要么年收入大几亿,大部分大模型公司现在还在烧钱搞研发,收入规模根本够不上,完全没资格上市。结果2026年6月上交所专门给大模型企业改了规则,把科创板第五套上市标准向AI大模型公司开放:只要你技术够硬、产品已经上线有规模化用户,哪怕还没赚大钱,也可以走专门的通道申报上市。相当于监管层专门给这类“研发跑在收入前面”的硬核大模型公司开了绿灯,不用再像之前很多科技公司那样舍近求远去海外上市。
5. 未来看它的价值,别光吹“大模型跑分世界第一”,要盯一个核心指标
等之后DeepSeek正式提交招股书,肯定会有一堆人吹它是“AI大模型第一股”,拿它的模型跑分、全球排名炒概念,普通投资者千万别被忽悠,重点要盯一个最实在的数字:
它的模型影响力这么大,到底有多少用户是真金白银付费的?现在开源大模型到处都是,很多人免费拿你的模型改改就用,根本不会给你交钱,要是最后算下来,它一年赚的服务费,连每个月烧的GPU电费都覆盖不了,那哪怕模型跑分全世界第一,也只是个烧钱的技术玩具,不是能长期经营的生意。
这次DeepSeek冲刺IPO,本质就是把之前藏在“技术神话”背后的真实生意摊开给所有人看:它到底是能靠技术赚大钱,还是一直要靠融资烧钱续命,很快就会有答案。