五天里,中国大模型的三家代表公司先后遭遇不同维度的压力测试。
9月9日—13日,DeepSeek在新旧版本切换时,最终选择保留DeepSeek V4Pro API(应用程序编程接口),并下调DeepSeekV4.1Flash定价。
Kimi一边启动企业合作伙伴计划,一边因网传创始人及团队信息而紧急辟谣。智谱(HK2513)则在9月13日公告中披露,通过配售新股和发行可转债,完成融资约50亿美元。三家公司曾共享技术神话的红利,如今进入现实考场,产品迭代要回应用户反馈,规模扩张伴随管理复杂度,高估值也需业绩验证。竞赛仍在继续,但重心移向运营。
摇摆频繁
一天时间,一家明星公司改变了主意。
9月10日,DeepSeek正式发布DeepSeek V4.1Flash模型,一款全新模型结构系列中最小尺寸的模型,相应的API同步上线,计划有序下线DeepSeek V4Pro模型。次日,DeepSeek又称在2026年9月14日之后继续提供DeepSeek V4Pro的API调用服务。让公司改变主意的是用户需求。
9月14日,北京商报记者登录DeepSeek开放平台官网,DeepSeek V4.1Flash发布通知、调价通知,以及继续提供DeepSeek V4Pro的API调用服务的通知均以蓝色提亮。
根据DeepSeek介绍,随着DeepSeek V4.1Flash上线,API价格同步下调。空闲时段百万Tokens输入缓存命中价格0.02元、输入缓存未命中价格1元,输出单价4元;高峰时段价格为空闲时段的2倍。
DeepSeek的定价像一口钟摆,近几个月摆动得格外频繁。
4月,DeepSeek发布V4系列模型预览版,1.6T参数版本为DeepSeekV4Pro,284B参数版是DeepSeek V4Flash。8月正式版上线,API价格上调,且采用峰谷定价,空闲时段价格为高峰时段的一半。
当时,DeepSeekV4Flash空闲时段百万Tokens输入缓存命中价格为0.05元,输入缓存未命中价格为1.5元,输出价格为4.5元。高峰时段,上述价格均上涨1倍,分别是0.1元、3元、9元。
9月10日正式发布DeepSeek V4.1Flash模型时,DeepSeek依然采用峰谷定价,但下调了V4.1Flash的定价。
空闲时段DeepSeekV4.1Flash百万Tokens输入缓存命中的价格是DeepSeekV4Flash的40%,百万Tokens输入缓存未命中价格是DeepSeek V4Flash的三分之二,输出价格是DeepSeek V4Flash的九分之八。
多线探路
数月间,DeepSeek经历了涨价、分层、换代、降价,产品层面的调整速度明显快于此前的节奏。即便如此,这家大模型公司的API价格在国内国外的性价比也有口皆碑。
“DeepSeek频繁调价,就是要找中间价,公司现在处在调价周期(883436),还没有摸透价格弹性区间。”文渊智库创始人王超告诉北京商报记者自己的猜测,“从融资后,DeepSeek的风格有了明显的变化。”
定价是一种试探方式,招新是另一种。9月9日,Kimi通过官方账号在全球招聘7名关键人才,一个人可以成为一支队伍。次日,Kimi启动企业合作伙伴计划,与各行各业的IT服务(881271)商、集成商伙伴共建前线部署工程师队伍,深入客户现场,帮助企业把AI真正部署到核心业务中。
有业内人士认为,这是Kimi发力B(企业)端的信号。事实上,Kimi早期尝试C端突破后,B端一直是公司的布局重点。
试探的同时伴随着噪声,同一周内,网传月之暗面创始人及团队相关信息,公司紧急辟谣。对于正处于IPO传闻的Kimi而言,团队在扩张期的稳定性与产品迭代同样重要。
全球最大大模型API聚合平台OpenRouter的数据,提供了一个更直接的切面。本周Kimi系列模型并没有进入OpenRouter最热门的模型前十,DeepSeek V4Flash0731、DeepSeek V4.1Flash、DeepSeek V4Flash0423分别位列第四、第六和第七,智谱(HK2513)的GLM5.3Flash位列第三位。
资本耐力
产品层的探路之外,是这门生意对资本的持续渴求。
9月13日,智谱(HK2513)发布了一则配售新股、发行可换股债券的公告,以每股714港元的价格配售最多2196.5万股新H股,较9月11日(即紧接配售协议签署日期前的交易日)的收盘价793港元折让约9.96%,较截至2026年9月11日(包括该日)止最后五个连续交易日约891.90港元的平均收盘价折让19.95%。此次配售所得约157亿港元。
根据公告,智谱(HK2513)于9月12日已同意发行201.4亿元债券,可按初始换股价每股892.50
港元(可予调整)转换为新H股。较9月11日的收盘价溢价约12.55%,较截至9月11日止最后五个连续交易日约891.90港元的平均收盘价溢价约0.07%。
9月14日,智谱(HK2513)低开低走,收报721港元,较前一交易日下跌约9.1%。1月上市时,智谱(HK2513)发行价116.2港元,6月股价一度涨至2980港元,至7月股票解禁时,股价超过1500港元。
回到此次融资,配售新股+发行可换股债券两项合计融资约50亿美元。
募资用途写得很直接:所得款项净额约60%将用于下一代GLM基础模型及完全自训练(Fully Self Training)体系的研发,以及大规模训练、生产推理、算力资源及相关技术基础设施的部署及升级;约15%将用于支持本公司的业务拓展计划、战略投资及潜在并购;约25%将用于优化资本结构、补充日常运营所需营运资金及其他一般企业用途。
这次融资是北京社科院副研究员王鹏的关注重点,他告诉北京商报记者,“智谱(HK2513)上市后仍快速推进大规模再融资,直接印证了大模型行业重投入、长周期(883436)的底层属性。头部玩家已经从算力的使用者,转向算力基础设施的建设者,国内大模型的竞争正式进入拼长期资本耐力的阶段”。
从基本面看,已上市的智谱(HK2513)和Minimax都需要证明造血能力。2026年上半年智谱(HK2513)实现营收约9.5亿元,同比增长399.7%,经调整净亏损约19.6亿元,同比扩大12.1%。2026年1—6月,MiniMax总营收1.2亿美元,同比增长283.1%,经调整净亏损约2.9亿美元,同比扩大111.2%。
产品也好,业绩也罢,有关国产大模型的动态和格局还不到终局,9月14日有报道称,DeepSeek的CFO即将到岗,截至北京商报记者发稿,DeepSeek并未官方回应。
