今日:2026年07月24日 星期五 首页要闻
权 威 · 及 时 · 准 确

七月大模型竞争白热化 中国公司纷纷亮剑

来源:今日报道 分类:科技
七月大模型竞争白热化 中国公司纷纷亮剑

2026年7月,或许会成为全球大模型产业竞争中的一个转折点。许多年后回望,这一年可能被视作一个分界线,让大家意识到没有任何模型的性能地位是绝对稳固的。短短几周内,中国五家头部的独立大模型公司各自着手不同的事情。

智谱用4.2%的新增股份换取了314亿港元,提出了两年内不追求变现的挑战性计划;MiniMax在同一周推出了160亿港元的配股加可转债组合,其创始人宣布将采取零薪酬策略,直至实现通用人工智能(AGI);月之暗面则推出了顶尖开源的K3模型,并加紧筹备港交所的上市申请;DeepSeek刚刚完成了总额超500亿的融资,IPO进程被提上日程;阶跃星辰则发布了一款没有标价和发售日期的AI手机,意在探索AI软硬件一体化的可能性。

市场的激烈反应最早在7月17日显现,月之暗面K3发布之后,智谱股价下跌了28%,MiniMax股价下跌了16%。尽管7月21日两家公司都出现了强劲反弹,但与之前的高点相比,仍然处于深度调整区间。一家尚未上市模型公司的发布,导致了两家已上市公司估值的重估。

K3或许只是这轮模型竞争的导火索。7月19日,阿里千问正式宣布参数规模达2.4万亿的Qwen3.8上线预览版,并计划进行开源;同一天,DeepSeek V4正式版开始向部分用户进行灰度推送,全量发布指日可待。MiniMax参数规模为2.7万亿的新一代M3 Pro也处于临近发布的状态。xAI正在训练的Grok 4.6,其参数规模达到2万亿,预计本月在内完成初步训练,马斯克认为它有可能超越K3。

大模型行业正成为一个“快速更迭的技术领先优势”可能仅在数月甚至数周内就会被改写的领域。参与者们正在竭尽全力地推出更高性能的模型,以加速推向市场,而模型参数对估值、市值乃至融资能力的促进作用,又转化为了下一阶段模型训练的动力。

这已是大模型公司“性能提升-市值增长-融资能力增强-更高性能”的递归实现过程,这是一场永无止境的战争。

发布活动与估值调整

作为一个拥有2.8万亿参数的拟开放权重模型,K3发布当日,在Arena前端代码盲测榜单上以1679分超越了Fable5,位居全球之首。尽管月之暗面在其官方博客中承认,K3的整体表现仍然落后于Fable 5和GPT-5.6 Sol。在过去的一年中,开源模型的参数规模上限纪录多次由Kimi模型所保持,K3延续了这一趋势。它的API输出价格约为此前Kimi模型近四倍,社区反响中既有关乎性能的赞赏,也有对定价的质疑。

此事发生在月之暗面冲刺上市的关键时点,发布数日后,该公司已经向投资人通报了其赴港上市计划,预计最快能在6个月内完成挂牌。

2025年底,杨植麟曾在内部信中写道:“我们B/C轮融资金额就超过绝大部分IPO募资及上市公司的定向增发。所以我们短期内不着急上市,也不以上市为目的。”

从不急于上市到推出K3再到给出资本化时间表的转变,发生在短短半年之内。一位接近月之暗面的投行人士指出:“智谱和MiniMax上市后市值大幅上涨,一度市销率达到500倍以上。这样的窗口期不大可能永远持续,但融资始终是模型公司的基本需求。”

可以想象,K3的Arena排名、2.8万亿的参数纪录、逼近闭源前沿的综合评估,无疑都将成为月之暗面未来招股书中的核心资产。一次重要的模型发布,既是技术展示,也在客观上构成了融资故事的一个预演。

然而,市场对K3的第一反应,却是针对另外两家公司的股价。7月17日,智谱股价下跌了28%,MiniMax股价下跌了16%。高盛认为,这一反应反映了投资者对中国AI模型公司长期竞争格局及领导地位可持续性的高度不确定性。

在此之前,保持国内开源领先模型用户心智的,是能够成为Claude opus 4.8平替的智谱GLM-5.2。

K3很难直接影响智谱的短期收入,但它冲击的是支撑领先模型市值的“持续领先假设”。

市值即竞争力

在当前阶段的模型公司中,融资估值乃至市值很难不被视为一项关键的竞争要素。智谱上市满半年后的7月8日,2568万股基石投资者股份解除限售,占总股本的约5.76%。JSC基金、泰康人寿等近七成基石投资者已提前表示将长期持有,解禁当日股价上涨了13.35%。

次日,智谱公布了配售方案,以每股1588港元的配售价配售最多1978万股新H股,计划募集约314亿港元,盘中涨幅一度超过了21%。

MiniMax则展示了截然不同的景象。同在7月9日,它迎来了约1.53亿股解禁,占总股本的48.9%,流通盘从不到6%骤增至约50%,当日大跌了17.98%,市值从巅峰时期的约4100亿港元降至约933亿港元。

次日,MiniMax公布了总额约160亿港元的融资方案,其中包括配售约95.4亿港元和65亿港元零息可转债,而闫俊杰宣布将采取零薪酬策略,并拿出个人持股的4%来激励团队。

已上市公司的迫切再融资需求,源于IPO资金的快速消耗。

截至6月30日,智谱IPO募集的约48.96亿港元已使用比例接近94%。

2025年,智谱全年研发投入为31.8亿元,收入仅为7.24亿元,净亏损达47.18亿元;无独有偶,MiniMax2025年的研发开支超过了18亿元,是同期收入约5.7亿元的3.2倍,类似的财务结构下,IPO资金的快速消耗可能只是模型公司的常态。

一位关注港股AI板块的分析师坦言:“许多公司上市是业绩的最终折现结果,但对于大模型公司来说,上市可能仅仅是融资的开始。”

智谱此轮配售约为IPO的6倍,MiniMax约为3倍。两家公司还在同步搭建A股融资入口。

MiniMax在5月29日与中信证券签署了科创板辅导协议,智谱则完成了辅导验收,计划在科创板募资不超过150亿元,一旦A+H双平台建成,融资能力将会进一步巩固。

两次配售的效率差异,直观展示了估值是如何成为融资杠杆的。

智谱用相当于发行后总股本约4.2%的新增股份换取了约314亿港元。一名接近配售的投行人士评价:“4%换300亿,前提是市场对公司有着接近万亿估值的期待。”

估值越高,同等规模融资所需出让的股份越少,公司为下一代模型训练保留的股权空间也越大。

市场当时给出的智谱接近万亿港元的估值核心假设,“独立基础模型平台”在中国具有战略稀缺性,而稀缺性的前提是持续领先。

K3的一次发布就动摇了这个前提,估值跌掉的不只是数字,还有下一轮融资的稀释率、下一代模型的训练预算。

五种战略,一个共同目标

每家公司都需要向资本市场阐述同一个问题:为什么值得持续投入。五家公司给出了各自的解释。

智谱试图触及的是模型的上限和基础设施的稀缺性。

唐杰在《巨浪已来》中称“未来两年不追求短期应用变现”,这除了表达技术信念,也在为刚以1588港元买入的新股东划定预期框架,即不要用短期财务指标衡量公司经营。

7月21日,智谱还完成了对国产AI异构算力公司中科加禾的收购,后者深耕异构算力领域,被视为AI基础设施的顶尖团队之一。

2026年第一季度,智谱MaaS平台披露的年度经常性收入达到17亿元,科创板方案中120亿元将投向通用基座大模型,这笔钱指向的或许是GLM-5.2之后的下一代产品。

MiniMax的特色是全球用户和AI原生产品。

截至2025年底,累计用户数超过2.36亿,覆盖200多个国家和地区,超过70%的收入来自海外。虽然6月M3模型发布的市场评价存在争议,但160亿港元融资的80%将投向AI基础设施和模型研发,下一代参数达2.7万亿的旗舰模型M3 Pro已经箭在弦上。

月之暗面在开拓开发者生态,持续刷新模型规模的纪录。

K3是这个故事的最新一章。杨植麟曾描绘过一条从K4到K100的漫长路线图,每一代都需要新的融资来支持。

DeepSeek擅长于自主架构创新、推理效率和成本控制。

V4的API毛利率超过50%,年化收入达到28亿至35亿元,6月完成了首轮外部融资超500亿元,估值约3700亿元,创始人梁文锋个人跟投超过200亿元,V4正式版进入小范围灰度推送,全量发布指日可待。

一家原本对商业化保持着高度审慎,且以自有资金和推理效率著称的公司也在筹备IPO,这本身便是大模型行业步入市值竞赛阶段的最好证明。

阶跃星辰探索的是软硬一体化。

STEPX Neo手机搭载自研Step AOS系统,但供应商透露不计划量产。在没有量产计划和具体售价的情况下,这款产品承担的战略展示和融资叙事功能,可能高于短期销售意义。

五种路线的指向具有近似性:维持资本市场的信心,保证融资通道不关闭。而阶跃向硬件延伸的尝试,还折射出一层更深的行业焦虑:

通用模型API的业务护城河很脆弱,用户对模型缺乏忠诚度,只有性价比。必须向产品、生态、系统甚至硬件延伸,寻找模型之外的锁定能力。

性能与价格的双重挑战

大模型公司的收入端,恐怕随时都会面对两条压力线的夹击:一是友商的性能追赶,二是永无止境的价格战。

智谱在过去三个月里完整经历了一个周期。4月发布GLM-5.1并提价10%,Coding场景缓存价格首次接近Sonnet 4.6,成为国产大模型首次在核心场景实现与海外头部的价格对标。

6月17日的GLM-5.2开源,凭借7400多亿参数在AI编程上追平Opus级别旗舰,被开发者视为“Claude级编程能力的开源平替”,智谱的估值在这一叙事支撑下站稳了高位。

接着K3登场,从GLM-5.2的登顶到被反超,性能给予的定价权,性能一个月后就收回了。

K3的领先窗口能维持多久尚未可知。

发布后的72小时内,Qwen3.8官宣且预览版已上线,DeepSeek V4正式版开始向部分用户进行灰度推送,MiniMax的M3 Pro排队待发。马斯克同期透露xAI正在训练2万亿参数的Grok 4.6,预计下周完成初始训练。

榜单刷新的节奏,正在从按月压缩到按周。

价格线的压力同样紧迫。

2026年上半年,国内主要厂商进行了6次API价格下调,其中包括3次永久性降价。DeepSeek V4-Pro非高峰的输出价格降至每百万Token约6元,约为GPT-5.5的三十分之一,MiniMax的M3发布一周即被迫实施永久半价策略。

DeepSeek还在V4正式版中引入了峰谷定价,高峰时段API价格为平时的两倍。把电网的定价逻辑搬进大模型,说明算力约束已经真实到需要用价格杠杆削峰填谷,而Token作为商品,正在向电力靠拢。

搜索引擎有数据飞轮,社交网络有关系链,操作系统有生态绑定,大模型只有一个随时会被刷新的性能排名和一个随时会被击穿的价格。

K3的落地只是进一步放大了这个问题。

当一个开放权重模型在关键场景上接近甚至超过闭源旗舰,市场对“模型稀缺溢价”的定价逻辑就会被改写。

即便K3短期内不会直接夺走闭源厂商的企业订单,它也在压缩所有以“技术领先”为核心叙事的公司的估值天花板。

Anthropic围绕自家神级模型Fable 5经历了一轮罕见摇摆。

从原定下架到永久保留,不到2周内出现了4次变化,Anthropic对此的解释是Fable需求一直难以预测。

OpenAI的动作更为激进。

GPT-5.6和ChatGPT Work上线4天后的7月13日,产品负责人宣布临时取消Codex的5小时使用限制,并为海量用户重置了额度,Codex与ChatGPT Work的周活跃用户在5个月内从约100万增至约800万。

xAI以另一种方式参战。按SpaceXAI的SWE-Bench Pro自测,Grok 4.5完成同等工程任务消耗的Token量仅为Claude Opus 4.8的四分之一,马斯克宣布计划每月发布一个大模型,SpaceX此前已以600亿美元收购Cursor母公司Anysphere。

Ramp的4月数据显示,Anthropic在企业AI市场采用率上以34.4%首次反超OpenAI的32.3%。此后双方的攻防进入补贴战模式:一方提额度,另一方就重置;一方延长推广,另一方就取消限制。

表面上争的是额度,实际上争的是编程开发者存量。

每一次额度重置和推广延期,消耗的都是真实的推理算力,这些成本最终都会体现在融资需求中。

OpenAI与Anthropic如今已双双站在IPO的关口。

6月1日,刚完成650亿美元H轮融资、投后估值达到9650亿美元的Anthropic已向SEC秘密提交S-1上市注册草案,最快有望在2026年10月抢先挂牌;一周后的6月8日,OpenAI也官方确认已递交S-1申请。

双方在开发者市场每次针锋相对调额,或许同样指向为IPO前的市场份额与估值叙事积攒筹码。

无尽的比赛

相比于海外巨头,中国这些独立大模型公司所承受的压力可能更为集中。

因为在这个牌桌上,还站着字节、阿里、腾讯、华为、小米和美团等一众大厂。

这些巨头的模型训练费用来自自造血的经营现金流,不需频繁进行额外融资来解释稀释率和亏损额,巨头可以按年度预算做研发规划,独立模型公司必须按融资节奏做研发规划。

同时,这些巨头又是独立公司的股东。月之暗面背后有阿里、腾讯和美团的投资,阿里还投资了MiniMax,腾讯则下注了DeepSeek。在市场上行期,巨头的背书是估值溢价的来源。如果独立公司的技术领先不再显著,这种关系可能被重新评估。

在当前阶段,大模型行业的正循环已经形成:

模型能力支撑起估值叙事,估值叙事兑换成融资,融资变成算力和人才,算力和人才推动下一代模型。

估值或市值不再只是证明模型能力的成绩单,它现在是生产资料,成为继算法、算力、数据、人才之外的第五种生产要素。

但正循环的每一个环节都可以被打断。

估值波动威胁融资端,友商性能追赶缩短领先窗口,价格战压缩收入空间,巨头用主营业务利润碾压独立公司的融资节奏,四重压力指向的共同根源是一个:

大模型API的业务很难形成持久的护城河。

正如任何领先都是暂时的,可能会被竞争对手以各种方式攻击。

今天的K3问世只是一次压力测试,而且和此前的市场下挫性质不同。

正如智谱在7月10日的20%下跌,驱动因素不过是配售稀释和解禁卖压,属于资本结构层面的冲击,随着筹码消化可以修复;

但17日的28%下跌,催化因素是K3对技术领先叙事的冲击,属于竞争格局的结构性重定价,只能靠下一代模型来回应。

前者考验股东的耐心,后者考验公司的研发速度。在领先窗口以月甚至周计算的行业里,后者会不断重来。

从GLM-5.2登顶到K3反超,只用了一个月,而从智谱配售314亿港元到股价下跌28%,只用了8天。

资本市场为下一代模型提供弹药的速度,未必能跟得上对手刷新榜单的速度。

大模型行业的胜负手,正在取决于公司如何长期维持一个串联起技术、收入、估值和融资之间的正反馈环。

对比之下,拥有主营业务现金流的巨头天然比独立公司具有更强的反脆弱性。

但这不意味着独立公司没有希望,它们仍然拥有那些巨头短期内难以复制的东西:专注、速度、对某些技术方向的勇敢试错与押注。

K3的2.8万亿参数、DeepSeek的创新与推理效率、智谱从提价到被反超之间那一个月的高光时刻,都证明了独立公司可以在特定窗口做到巨头做不到的事情。

2026年的这个7月之所以可能会被记住,不是因为这个月里某一家公司的输赢胜负,而是从这个月开始,所有参与者都被迫接受了同一个现实:

没有一款模型强大到可以让公司停止融资,没有一轮融资充足到可以让公司停止迭代,没有一个价格低到可以让对手放弃追赶。

在这场无限战争中,参赛者的每次登顶和超越,都要枕戈待旦,并为下一场战斗做好准备。

文章配图-1

相关推荐