DeepSeek新一轮融资或达千亿,“豪赌”国产算力预训练

2026-10-07 15:06:06
分享
文章提及标的
人工智能--
腾讯控股--
中信证券--
宁德时代--
创投--
智谱--
查看股票机会下载客户端

10月6日,据媒体报道,杭州深度求索人工智能(885728)基础技术研究有限公司(以下简称“DeepSeek”)已接近锁定最新一轮至少800亿元人民币融资,最终规模按已签署条款清单可逼近1000亿元,远超公司最初约500亿元募资目标。

此前有报道称,DeepSeek本轮目标估值约5000亿元人民币,但未言明投前或投后估值。本轮融资规模或近千亿元,意味着DeepSeek实际估值水平并未较此前完成的首轮有明显提升。

消息指出,以上融资程序接近收官,宁德时代(HK3750)与腾讯控股(HK0700)或成为承诺出资金额最高的投资方,且所筹资金将为公司IPO铺路。

21世纪经济报道此前曾报道,DeepSeek拟聘请中信证券(HK6030)筹备上交所科创板上市事宜,但尚未就辅导协议完成签字。DeepSeek则计划年内启动IPO流程,但具体募资规模、发行时间、目标估值均未最终确定。

9月末,前高瓴创投(885413)合伙人严文韬已加入DeepSeek出任首席财务官,IPO筹备似乎进入加速阶段。

历史级融资

据21世纪经济报道此前报道,DeepSeek新一轮融资阵容或以首轮融资的主要股东以及未进入首轮的候补投资者为主。

根据8月媒体报道,DeepSeek的第二轮新进投资方以产业机构为主,石溪资本、中芯聚源、博裕资本、CPE源峰、合肥国资投资平台等出现在洽谈名单中。

同时,首轮老股东中,腾讯、宁德时代(HK3750)、IDG资本、砺思资本、拾象资本、正心谷投资拟继续加码投资DeepSeek,国家人工智能(885728)产业投资基金亦在考虑增资,但额度未定。

消息还指出,DeepSeek原定将更早完成新一轮融资计划,但由于其首轮融资舆论反响过于激烈,且其融资路演会议录音及纪要遭泄露引起市场热议,此次公司以及梁文锋希望更为低调地完成这一轮融资。

进入2026年下半年,中国大模型企业融资进度显著加速。7月,智谱(HK2513)公司启动港股新一轮配售计划,融资规模达到313.75亿港元;9月则再启动一轮配售与可转债组合融资,规模达393亿港元,三个月内完成700亿港元融资,刷新中国人工智能(885728)累计融资规模纪录。

DeepSeek方面,在首轮融资中,创始人梁文锋出资约200亿元,腾讯约100亿元,宁德时代(HK3750)体系(含宁德时代(HK3750)及溥泉资本)约50亿元,网易(NTES)、京东(JD)、Monolith砺思资本、IDG资本各约30亿元,正心谷投资、拾象资本各约15亿元,国家人工智能(885728)产业投资基金入局,市场预估投后估值约500亿美元。

而从新一轮融资规模来看,DeepSeek势必再度超越智谱(HK2513),成为中国融资规模最大的人工智能(885728)大模型企业。

梁文锋豪赌国产算力训练

而令这一场盛宴显得与众不同的是,此次DeepSeek的融资蕴含了对中国人工智能(885728)算力闭环的终极探索。

据媒体报道,DeepSeek计划在内蒙古建设大型数据中心,部署至少16万颗华为高端昇腾950DT超节点加速器。若该计划落地,以上设施将成为已知规模最大的华为AI芯片集群之一。

对于以上部署,上述媒体报道称,梁文锋在新一轮融资路演中禁止录音——但据与会者转述,此次DeepSeek将首次基于国产算力进行前沿模型的预训练。就连梁文锋也将此举描述为“DeepSeek最大的一场豪赌”。

值得注意的是,受华为供应能力限制,DeepSeek短期内或难以扩大采购总量并完成算力部署;按当前市场单价估算,短期内该公司的芯片采购规模约170亿元。

上述说法也得到了各方的侧面印证。

9月,华为副董事长、轮值董事长徐直军表示,华为昇腾(886058)950DT超节点仍在测试,预计年底或明年初规模供货,且定位于训练与部分推理。而新一代960DT芯片则规划2027年一季度出货。

软件适配方面,DeepSeek于9月30日开源面向昇腾的六个组件,包括TileLang昇腾版、DeepGEMM-Ascend、DeepEP-Ascend、TileKernels、FlashMLA、DeepSelect。华为则将联合创新成果放入CANN社区,覆盖大EP低延时推理、大规模训练、KV Cache池化与Agentic RL等。

此前,前沿大模型与国产算力的“合作”方式主要基于模型推理,国产算力并未进入预训练市场,主要是因为当下全球大模型训练体系与英伟达(NVDA)CUDA生态高度闭环。

有专家指出,前沿模型训练需要万卡级算力集群长期运行,涉及算子正确性、混合精度数值对齐、分布式通信、流水线调度和断点续训,其对环境稳定性要求极高。同时,国产芯片此前软件栈不成熟,把CUDA代码重写到国产栈再做精度对齐,工程代价显著高于英伟达(NVDA)生态。

加之国产算力产能不稳定,对于大模型企业来说,风险较高。

不过,眼下DeepSeek想当第一个吃螃蟹的大模型企业。

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME