从2月到8月底,中国AI(人工智能)大模型公司月之暗面(Kimi)在私募市场的投前估值从100亿美元涨了4倍至500亿美元;而其7月末开始的350亿美元估值的上轮融资刚刚交割,募资额35亿美元——这意味着,仅仅一个月,月之暗面的估值又涨了150亿美元。
另一家中国大模型公司DeepSeek(深度求索)更是抢手,其在7、8月间启动的第二轮融资谈判,放出的投前估值接近5000亿元人民币。“一级市场能投的大模型标的只有DeepSeek和Kimi两家了,融资热度高涨。相比之下,DeepSeek更难挤进,而Kimi还不算贵。”一名曾与月之暗面有过接触的投资人对财新分析称,月之暗面预期6个月内港股IPO(首次公开募股),参照智谱(02513.HK)和MiniMax(00100.HK)两家公司的港股估值,Kimi的市值不会低于5000亿港元,“因此现在的私募市场融资基本是提前打新。”智谱和MiniMax两家公司目前均处于亏损状态,截至9月2日,市净率(PB)分别达102、11倍,市销率(PS)分别达304、92倍。
多名资本市场人士对财新透露,Kimi对市场化投资人的姿态是不接受尽职调查,“不缺钱、要(份额)就盲投”。
“Kimi符合目前港股对AI公司的高感知和高情绪。”一名中国香港券商人士告诉财新,Kimi的收入情况和MiniMax相当,亦有海外业务;而模型能力和智谱相当,“如果Kimi能上市,大家应该都会配置。” 月之暗面7月发布的Kimi K3模型,掀起了新一轮超大规模参数的竞争。Kimi K3参数规模达2.8T(万亿),是迄今参数量最大的开放权重模型,在多个榜单拿下开源模型SOTA(表现最优),模型能力逼近6月美国AI巨头Anthropic发布的Fable 5和OpenAI发布的GPT-5.6 Sol。
新模型引起海内外市场震动,月之暗面因需求过旺造成算力紧缺,紧急暂停新用户订阅,智谱和MiniMax两大国内竞对公司的股价则应声而落,美国则再次掀起“是否要制裁中国开源模型”的激烈辩论。市场拿Kimi K3的推出与2025年DeepSeek-R1模型横空出世时作比较,称之为“Kimi时刻”。
这一次,业界不仅仅讨论模型性能,更是看到了中国模型公司通过开源建立商业生态、争夺用户,甚至对目前模型的盈利模式带来挑战。Atreides Management创始人兼首席投资官Gavin Baker指出,Kimi K3作为高性能的开源模型,对模型层利润率的重构可能是AI领域的重要转折。
东吴证券7月19日的研报表示,Kimi K3带来的效率突破,强化了市场对传统算力扩张模式的质疑,AI交易或从全面强调资本开支,转向更关注模型效率、商业化能力和投入产出比。
国金证券计算机行业首席分析师刘高畅指出,Kimi K3产生巨大影响主要是因为它引领开源模型迈入“3T”(参数规模)的新时代,其能力证明Scaling 模型参数越大,表现就越全面,对数据表达的颗粒度就能更细,带来更高的智能上限。不过,其带来的震撼程度仍不及DeepSeek-R1,后者发布时水平接近世界顶尖模型,且让世界看到了中国Infra(基础设施)调优能力与后训练能力的强大。
Kimi K3发布两周后,DeepSeek、阿里、智谱和腾讯在一个月时间内几乎以一周一个新模型的频率上线旗舰模型,能力快速跟上;MiniMax和字节跳动也纷纷预告将训练更大参数模型,国产大模型持续交替领跑。
“K3发布之前,市场普遍认为因算力受限,中国大模型和美国顶尖模型的差距已拉开至8到12个月,而在模型一月一更的竞争格局下,不让差距继续扩大已成模型厂商共识。”前述投资人指出,Kimi 5月份透露新模型会全面对齐美国新模型,“真推出来时还是超过预期,这等于告诉全球,中国的模型团队有能力咬住甚至缩小和美国先进模型的差距。” “没有任何模型的优势可以一直保持。以当下行业迭代速度来看,技术领先周期是以月份而非年份来衡量。”市场调研机构Counterpoint人工智能首席分析师孙威也对财新表示。
另一边,却有月之暗面的投资份额在微信群等社交平台被兜售的信息,真假莫辨。过去两个月,月之暗面连续发布两则与融资相关的严正声明,提醒投资者谨防受骗,称市场上冒用公司名义虚假融资,已向公安机关报案。
7月底,工商资料显示,月之暗面已完成股份制改革,为上市铺路。此外,财新了解到,在股东协调下,月之暗面正与创始人杨植麟的上一家创业公司循环智能的投资人谈判和解,以解决在香港的相关仲裁案纠纷,为港股IPO扫除法律风险。
Kimi K3的爆火并非一蹴而就。这家大模型创业公司从2023年3月成立以来,无论是早期做C端产品Kimi Chat,还是在2025年提升模型能力推出Kimi K2、K2.5到如今的K3,一直都在国产大模型的前沿梯队,成为大模型创业“六小龙”之一。
月之暗面核心创始人杨植麟是清华大学和美国卡内基梅隆大学(CMU)的明星学生。在清华大学2014年特等奖学金答辩时,杨植麟称自己所有程序设计课程均为满分。其在计算“毫无疑问,他(杨植麟)是我这几年见过的最优秀、最有天赋的学生。” 以清华大学计算机系年级第一毕业后,杨植麟前往CMU攻读博士,其博士导师是Ruslan Salakhutdinov,曾担任苹果公司人工智能研究负责人;另一位导师William Cohen,如今是谷歌首席研究员。
根据谷歌学术平台记录,学生时代的杨植麟发表论文20余篇,其中一作数量至少15篇,论文发表于多个国际顶级会议。截至目前,杨植麟的论文在谷歌学术平台收获超过5.2万次引用。他影响最深远的两篇论文,分别是介绍XLNet和Transformer-XL,都在2019年发表,是长文本方向里程碑式的学术成果,Kimi早期即以长上下文为主要技术特点。
Ruslan Salakhutdinov评价杨植麟“极度聪慧出众”,并“为机器学习领域做出了极具奠基意义的研究成果”。2019年,杨植麟仅用四年时间就拿到了博士学位,随后还拒绝了苹果等公司的邀约,回国创业。
在杨植麟看来,受大厂组织架构所限,许多AI技术的落地周期过于漫长,而创业是一条打破学术界和工业界隔阂的更激进、更彻底的路径。“他跟我说,倘若不放手尝试一次自主创业,这辈子都会留有遗憾。”Ruslan Salakhutdinov在Kimi K3面世后发文称。
2018年,杨植麟作为联合创始人创办AI公司循环智能,并在此后参与盘古NLP(自然语言处理)模型和超大规模系列模型“悟道1.0”与“悟道2.0”的研发。在GPT-4发布、掀起新一轮人工智能浪潮的2023年初,杨植麟成立月之暗面,称希望“用一间新的、独立的公司,尝试从0到1实现AGI(通用人工智能)”。
月之暗面除了杨植麟,还有三名联合创始人,他们共同持股占比超过65%。根据6月底更新的工商资料,在完成200亿美元估值的融资后,杨植麟占股51.83%,仍是控股股东;周昕宇占股6.56%,负责大模型训练相关业务;首席技术官(CTO)张宇韬负责包括Kimi聊天机器人等模型产品,占股3.33%;吴育昕占股3.91%,负责公司多模态模型业务。除了这三名技术联合创始人,2024年加入公司的张予彤主要负责商业化和投融资事宜。
月之暗面创始团队皆为清华大学背景。张宇韬也是循环智能的联合创始人,本科时曾与杨植麟组队参加数据挖掘比赛。在清华大学读博时同样师从唐杰,参与了清华大学学术大数据平台Aminer的研发,并发表相关论文。Aminer的技术成果,日后造就了中国另一大模型公司智谱。
大学本科时,周昕宇和杨植麟一同组建了摇滚乐队Splay。2015年本科毕业后,周昕宇加入“AI视觉识别四小龙”之一的旷视科技担任研究员,主攻算法量产。2018年,周昕宇发表专门面向移动设备设计的卷积神经网络架构ShuffleNet论文,目前被引用超过1.3万次。
吴育昕也在清华大学本科毕业后赴CMU读博。加入月之暗面前,他在谷歌大脑从事基础模型相关工作,此前也有Meta人工智能研究院计算机视觉相关的工作经历,精通深度学习与计算机视觉领域的研究及基础设施搭建。吴育昕在2020年参与的《用于视觉表示学习的动量对比(MoCo)》论文被引用超过2.1万次。
张予彤于2004年获清华大学电子工程学士学位,在工作六年后赴美国斯坦福大学攻读硕士,2012年取得管理科学与工程硕士学位。此后,她加入金沙江创投,专注科技等领域的早期投资,投资出小红书、黑湖科技、无问芯穹、LibLib等明星项目。张予彤主导了金沙江对循环智能的投资,后晋升为金沙江创投主管合伙人。
“Kimi的团队可说是这一轮中美大模型创业中最有代表性的团队,创始人年轻、履历强,几乎没有特别的短板。”前述投资人指出,模型的成绩之外,这样的团队对继续招揽业界人才非常重要,“现在都说大模型的牵头人必须是能读论文的人,Kimi的团队不仅能读,更是论文和技术社区的贡献者,这是这一轮模型创业者和上一代互联网创业团队最大的区别,也是最高的壁垒。” 目前,这一明星团队还面临二次创业带来的股权争议。2018年,杨植麟、张宇韬和陈麒聪创业成立循环智能,主营AI企业级服务,曾获红杉中国、真格基金、金沙江创投、万物资本、靖亚资本、华山资本和博裕资本近亿美元投资。2023年2月,杨植麟与循环智能首席执行官(CEO)陈麒聪达成一致,自己和张宇韬一起单独成立月之暗面,循环智能无偿获得月之暗面一定股份。但金沙江创投合伙人朱啸虎后来自曝,质疑杨植麟团队的二次创业侵犯原公司老股东利益。但杨植麟方表示,循环智能部分投资人并非不知月之暗面的存在,他们错过投资是因当时对中国大模型,尤其是创业公司做大模型并不看好。2023年初,循环智能老股东中仅红杉中国和真格基金投资了月之暗面。
2024年底,金沙江创投、万物资本、靖亚资本、华山资本和博裕资本对杨植麟和张宇韬在香港国际仲裁中心(HKIAC)提起仲裁,称二人在获得5家投资方同意豁免书前,就启动融资并创立月之暗面为不当行为。双方仍在谈判中,争议的焦点是股权利益的分配,循环智能老股东要求月之暗面支付的赔偿金额远高于后者的预期。
月之暗面成立之初转向做To C(面向消费者)路线,以长文本作为主要技术特点。真格基金联合创始人王强曾在播客节目中称,选择投资月之暗面正是因为杨植麟拥有对长文本拆解的技术,这是他与其他AI创业者最核心的不同。
ChatGPT爆火后,AI企业纷纷以聊天机器人作为主要产品形态。2023年10月,月之暗面发布Kimi Chat,支持输入20万字的长文本;五个月后,又宣布支持200万字超长无损上下文。Kimi由此一炮走红,一度带动A股市场出现所谓月之暗面概念股,直接或间接参股月之暗面、有合作的A股上市公司的股价都迎来一轮爆炒。
与此同时,月之暗面完成了超10亿美元A轮融资,投资方包括阿里、红杉中国、小红书、美团和Monolith砺思资本。其中,阿里以8亿美元购入月之暗面36%的股权。随后,腾讯也在2024年下半年投资月之暗面。
手握10亿美元融资后,月之暗面大规模投放推广App。一位曾在Kimi从事增长投放的人士告诉财新,Kimi当时主要通过达人营销与在海内外社交媒体做广告投放,助推2024年下半年大模型行业达人以及买量的成本增长了1倍以上。另一名月之暗面早期员工也对财新回忆称,当时Kimi认为自身有优势,可以和字节跳动的豆包“掰一掰手腕”。
2025年1月,Kimi月活用户超过2200万,排名第二;榜首的豆包月活用户突破8200万。至此,在激烈的“百模大战”中,月之暗面算是拿到了“船票”。然而,依靠投放拉新获得的用户并没有忠诚度,面对强流量和高补贴的互联网公司,Kimi的大手笔补贴开始让市场担心。
DeepSeek带来了大模型行业的转折点。DeepSeek-R1对标OpenAI最先进的推理模型o1,在2025年春节前后爆火出圈,而与DeepSeek-R1同日发布的Kimi K1.5模型备受冷落。
月之暗面在2025年初召开了内部反思会,重新确定了要做领先的基座模型的目标,放弃更新当时已有的K1模型,集中资源研发上限更高的K2模型。
前述月之暗面员工指出,DeepSeek的成功对Kimi而言是好消息,团队意识到AI初创企业可以凭借模型能力取得成功,“Kimi此前的投放也有意义,因为资本并不只为单一模型埋单,用户规模决定了公司能否有下一阶段的发展,而且用户反馈可以帮助模型产品改进。” 到2025年5月,Anthropic正式发布编程工具Claude Code,月之暗面停止广告投放,和智谱、MiniMax等大模型公司几乎同步,中国AI大模型创业公司也全面转向编程模型开发。
7月11日,月之暗面在沉寂半年后发布其首个开源基座大模型Kimi K2,对标DeepSeek-V3、OpenAI的GPT-4.1等模型,以1万亿总参数量,成为当时参数量最大的开源权重模型。Kimi K2发布三天,就在全球最大AI开源社区HuggingFace获得1.93万次下载,登顶热度第一。该模型也在海外技术圈引发了讨论。
伴随着模型编程能力提升,智能体概念兴起。2025年11月,月之暗面推出开源的K2-thinking,进一步提升智能体和推理能力。K2系列模型成为中美技术圈热度最高的开源模型之一。
2025年的最后一天,杨植麟发布内部信表示,月之暗面完成了5亿美元的C轮融资,现金持有量超过100亿元人民币,明确智能体产品化、商业化是月之暗面2026年的战略目标。直到此时,杨植麟对投资人仍表示没有上市计划。
2026年以来,伴随着智能体需求暴增,以及AI短剧等行业兴起,全球范围内大语言模型和多模态模型的迭代再次提速。
Kimi的模型迭代和融资速度互为促进,进入螺旋式上升的快车道。
1月底,Kimi K2.5发布;2月底,月之暗面完成一轮100亿美元估值的融资,同时开启定价170亿美元的新一轮融资。
每一轮新旧融资交替都是因为买方筹码充沛、投资需求旺盛,一再超募的月之暗面也乐意持续堆高自身价值。
6月12日,编程模型Kimi K2.7发布,到7月末,原本20亿美元募资额又大幅超募至35亿美元,投后估值上涨到350亿美元。几乎同时,月之暗面开启Pre-IPO融资,估值500亿美元,和刚刚完成融资的DeepSeek整体估值几乎持平——DeepSeek此时估值还在3500亿元人民币。而投资了DeepSeek的国家人工智能产业投资基金,也是此轮月之暗面的领投方,此外还有多家国有资本参与投资。
截至2026年8月底,在500亿美元估值的Pre-IPO轮融资前,月之暗面已从私募市场累计吸金近85亿美元,赴港上市时间表缩至最快6个月。
目前,大模型企业普遍处于密集融资阶段,模型训练、推理基础设施和研发人才等各方面都需要大量投入。智谱在半年时间就将IPO九成多募资款——45.88亿港元消耗完毕。
相比智谱,月之暗面的投资人名单更加多元化。国家人工智能产业投资基金、全国社会保障基金、中国移动、北京市人工智能产业投资基金;互联网公司投资人包括阿里巴巴、腾讯、美团、小红书;美元基金投资人则有红杉、IDG、Monolith;产业资本包括北汽集团和宁德时代;金融机构投资人则有工商银行、农业银行、建设银行、中信和中金券商直投;此外,国际和香港投资人则有凯辉基金、Granite Asia、Orix、未来资产、HKIC(香港投资管理有限公司)和周大福家族等。
月之暗面正在拆除其VIE(可变利益实体)架构。据财新了解,杨植麟目前在月之暗面占股近半,仍是单一大股东,而阿里巴巴是月之暗面第一大外部投资人。
月之暗面的收入也飞速增长。投资人王捷称,月之暗面截至2026年2月的年度经常性收入(ARR)为1亿美元;3月达到2亿美元,单月实现收入翻倍。另据财新了解,到6月,Kimi的ARR达3亿美元。
目前,市场普遍以ARR为基数测算高增长科技公司的估值。以目前500亿美元估值计算,月之暗面的估值相对ARR倍数为167倍;而作为对比,Anthropic在5月融资后估值达到9650亿美元,摩根大通研报显示其7月ARR为690亿美元,估值相对ARR倍数仅为14倍。
另外两家大模型上市公司——智谱和MiniMax都是在ARR快速增长的同时遭遇股价剧烈调整。智谱7月上旬ARR为10亿美元,到8月增至16亿美元,公司市值却从6月高峰的1.3万亿港元回落至目前的5100亿港元左右,两个月市值缩水近六成;MiniMax 4月ARR为3亿美元,8月ARR涨至8亿美元,但市值从3月高点的4100亿港元回落至目前1200亿港元,跌幅深至七成。
前述香港地区券商人士指出,月之暗面港股上市将进一步吸纳市场资金,定价策“如果企业级收入增长能体现出模型的变现能力,市场对于Kimi、智谱等的价值判断还将提升,但短期较难复现万亿港元市值的盛况。” 一、二级市场之所以对大模型公司的估值一再调整,缘于模型能力仍在探索上限的过程中,意味着规模化落地的2B(面向企业)业务的市场增长速率尚未明晰。
刘高畅告诉财新,一是长上下文能力;二是用户可感知的前端能力和多模态能力,无论文生视频还是视频理解都表现不错,Kimi K3的多模态能力强,也是月之暗面发展路径选择的结果。
发布后24小时内,第三方测评平台Artificial Analysis的数据显示,Kimi K3综合性能仅次于Anthropic和OpenAI旗下旗舰模型Claude Fable 5和GPT-5.6 Sol,排名全球第三;在另一第三方评估平台Code Arena上,Kimi K3的前端开发能力超越Claude Fable 5,跃居全球第一。这是首个中国大模型在海外前端开发模型能力榜单中冲上第一位置。
孙威对财新分析称,除2.8万亿参数外,Kimi K3值得注意的技术细节还包括处理每个词元(Token)仅激活1040亿参数,每一词元会路由至896个专家中的16个;其机制分别在序列长度、模型深度两个维度提升了运行效率。同时,Kimi K3不采取MIT协议(常见的宽松开源模型许可协议),而是采用定制化的开放权重许可协议,对规模化商业使用设置附加条件。
Kimi K3的火爆使得月之暗面不得不暂停新用户订阅,截至9月4日仍未全面恢复。Kimi K3的发布直接造成智谱和MiniMax股价下跌,亦让美国两大模型厂商感到焦虑。Kimi K3每百万Token输入价格为3美元、输出价格为15美元。尽管该价格在主流国产模型中最高,但输出价格仍较Anthropic旗下最强模型Fable 5低70%,较OpenAI旗舰模型GPT-5.6 Sol低至少50%。研究机构伯恩斯坦表示,Kimi K3的定价策略对Anthropic、OpenAI形成冲击;同时,前沿领域推理能力的趋同,对模型层利润率而言是负面信号。
美国国家AI事务前负责人、现任总统科技顾问委员会联席主席大卫·塞克斯(David Sacks)甚至发文表示,Kimi K3的出现使中国模型第一次在前端编程赛道拿下第一,而美国在用更多法规给自己套上枷锁,这样下去,美国将输掉AI竞赛。
孙威告诉财新,前沿开源模型由中国主导,Kimi K3的发布扭转了全球讨论的议题,将“中国大模型能否追上国际前沿水平”转向了“中国是否正在成为前沿开放智能的核心供给方”。全球开发者、实验室以及政策制定者,将中国大模型视作战略性基础设施,而非简单的低成本替代品。Kimi K3的发布,还引发了又一场开源与闭源的纷争。
美国政界在Kimi K3发布后不久威胁制裁中国的开源模型,但很快激发硅谷抗议。先是近200家硅谷公司组成的“小型科技协会”致信美国总统特朗普等官员,呼吁不要限制美国获取中国的开放权重AI模型;此后,英伟达创始人黄仁勋在7月24日与包括Meta、微软和戴尔在内的25家企业或机构发布联名信,强调开源模型的重要性。该联名信发布后,参与签署的企业和机构数量逐步增加,截至8月3日,超过270个公司和机构签署了该联名信,其中包括OpenAI和谷歌,二者目前的旗舰级大模型都为闭源。
不过,Anthropic拒绝签署该联名信。该公司CEO达里奥·阿莫迪(Dario Amodei)表示,他认同黄仁勋牵头签署的支持开源模型联名信中的大部分观点,Anthropic从未主张禁止开放权重模型,但并不认同信中关于开放权重必然会降低安全防护机制的研发难度,以及技术能力的全面普及必然会让防御方比攻击方占据更多优势的论断;并称在他看来,情况正好相反。
值得注意的是,Harvey的主要投资者之一是OpenAI创业基金。在Harvey Tenet发布前,公司主要调用Anthropic和OpenAI旗下的闭源模型。Harvey Tenet的发布,让Harvey从调用闭源模型,转向依托开放权重模型进而拥有自己的专属模型及智能资产。
刘高畅告诉财新,海外对Kimi K3的另一个震撼点是认识到中国有如此强劲的人才储备、数据处理团队、各类数据等资源,在一定算力基础上,叠加机制、框架创新和调优能力,让海外顶尖模型的发展无法甩开国产模型;同时,国产模型在少数领域做到SOTA也是可能的。
受制于算力紧张和价格较高等因素,Kimi K3发布后在全球最大的I(应用程序编程接口)聚合平台OpenRouter上的调用量过去四周并未进入前十名。以9月4日之前七天的数据来看,Kimi K3的调用量为1.81T,比上周上涨21%,排在全球第14名。榜单的前13名分别是GLM-5.3-Flash、GPT-5.6-Luna、DeepSeek-V4-Flash正式版、腾讯Hy4 preview、Hy3、DeepSeek-V4-Flash预览版、MiniMax-M3、小米MiMo-2.5、英伟达Nemotron 3 Ultra、谷歌Gemini 3.7 Flash、GLM-5.3、GLM-5.2和GPT-5.6 Sol。此外,在包括OpenCode和Vercel AI Gateway在内的其他聚合平台的用量统计中,Kimi K3也鲜少跻身调用量前五名。
目前,月之暗面的海外客户和企业级客户在增多,也在通过积极合作快速拓展国内企业生态。
月之暗面B端负责人黄震昕在6月25日举行的2026亚马逊云科技中国峰会上表示,Kimi上一代模型K2.6让海外付费用户增长4倍、I收入增长400%、产品进入200多个国家和地区。7月21日,黄震昕又在采访中表示,当前B端收入中,I调用业务占比达到70%,现阶段不提供私有化部署。
财新了解到,Kimi K3发布后,月之暗面新增用户超过七成来自海外,海外会员订阅收入翻14倍、I收入翻10倍。
这意味着,月之暗面的商业模式,从最开始的面向消费者(To C)发生了改变。孙威告诉财新,月之暗面本质是以C端产品为牵引、依靠企业业务变现的AI平台,而非纯粹的To B或To C企业。但基于Kimi K3定制开放权重协议设置的商业门槛,以及超大模型体量,Kimi K3现阶段更侧重拓展企业客户群体。
实际上,员工数量仅300人的月之暗面已开始通过和传统软件商合作快速拓展企业客户,并和海外云厂商讨论Token销售的分成模式。
7月20日,中国软件国际(00354.HK)公告称,与月之暗面签署Token分成及联合创新合作协议,推进企业级智能体技术、产品与解决方案在能源电力、金融等行业落地,共建FDE(前端部署工程师)创新实验室,重点布局能源电力行业。中国软件国际当天股价一度拉升超过37%,收盘涨22.97%至3.64港元/股。
目前,月之暗面正与微软、亚马逊和谷歌洽谈最新旗舰模型Kimi K3的云平台托管,可收取15%到30%的分成。
随着大模型竞争全线白热化,从参数性能到价格,月之暗面都面临诸多对手。
在Kimi K3发布后一个月,海外闭源模型也快速迭代。Anthropic于9月1日迭代旗下的最强模型Fable至5.1,称是当前全球面向编程与知识工作领域能力最强的模型。Fable 5.1推出后在Artificial Analysis的智能性得分为66分,成为新的全球第一。
此外,7月25日,Anthropic发布Opus 5,智能水平接近Claude Fable 5,而价格仅为后者的一半。马斯克在评论Kimi K3“令人印象深刻”之后,旗下SpaceX于8月12日发布Grok 4.6大模型。9月3日,OpenAI发布GPT-6 Astra模型。Opus 5、Grok 4.6和GPT-6 Astra在Artificial Analysis的得分分别为63分、61分、61分,均高于Kimi K3的60分。
Meta和谷歌也分别在8月5日和13日,推出新模型Muse Spark 1.2和Gemini-3.7-Flash,随后又在9月2日推出Muse Spark 1.3和Gemini-3.8-Flash,智能性评分与Kimi K3接近。
模型推出速度仍在加快。马斯克预告Grok下一代模型参数量将达到2万亿,目前已经完成初步训练,将在9月中旬前发布。Meta首席AI官亚历山大·王(Alexandr Wang)也称Meta正在训练大参数模型“Watermelon”,并称相信该模型会极具竞争力。
海外模型也开始回应中国模型带来的价格压力。7月30日,OpenAI宣布GPT-5.6系列主打快响应速度和高性价比的Luna模型降价80%,中端模型GPT-5.6 Terra降价20%。降价后,GPT-5.6 Terra的I价格已经低于Kimi K3;GPT-5.6 Luna完成每项任务的花费更下降到输入0.05美元,低于众多国产旗舰模型。
刘高畅告诉财新,未来模型参数的提升将带来成本的提升,目前国产模型获取算力的成本都很高,优化空间在变小,定价将很难有下降空间。
从Kimi K3发布后的国产模型迭代来看,国产模型在追逐智能性的同时,性价比小模型。
率先出招的是DeepSeek,其在7月底发布了DeepSeek-V4-Flash的正式版。V4-Flash正式版虽比预告晚了两周上线,但其智能体能力大幅增强,基准测试远超V4-Pro预览版。DeepSeek在公告中表示,DeepSeek-V4-Flash正式版的模型结构、尺寸和DeepSeek-V4-Flash-Preview保持一致,仅重新进行了后训练。
Artificial Analysis为DeepSeek-V4-Flash正式版智能性打分52分,与GPT-5.6 Luna和GLM-5.2一致。V4-Flash正式版一度在全球创造出“DeepSeek斩杀线”的概念,即一个模型要么在智能性上超越DeepSeek-V4-Flash正式版,要么比其更便宜,否则就会面临被市场淘汰的风险。
Qwen3.8-Max于Artificial Analysis上得分58,发布时仅落后于Opus 5、Fable 5、GPT-5.6 Sol和Kimi K3。阿里巴巴同时宣布Qwen3.8-Max会开放权重,这也成为千问系列首个开源的旗舰模型。
和Qwen3.8-Max同时推出的,还有小参数模型Qwen3.8 27B(10亿)。该模型参数270亿,I价格也低于前者。
更值得关注的是,DeepSeek在V4-Pro正式版发布后大幅上调了I调用价格,且开始采取峰谷定价,最高涨幅达到1100%。不过,由于DeepSeek目前缓存命中的价格仍较大部分国产旗舰模型低,仍维持着一定的价格优势。
8月14日,智谱发布最新模型GLM-5.3,价格相较上一代模型GLM-5.2未变,并强调新模型的编程和网络安全能力。智谱称,与GLM-5.2相比,GLM-5.3的基座模型没有改变,但通过极致的后训练Scaling(规模)大大提高了模型的智能上限。GLM-5.3在Artificial Analysis上得分60分,与Kimi K3得分一致。
智谱随后在8月26日上线并开源GLM-5.3-Flash,该模型参数320B,价格仅为GLM-5.3的十分之一,且智能性强于GLM-5.2,让前沿模型价格再一步下探。
同一天,阿里也发布小参数模型Qwen 3.8-Flash。阿里称,该模型采用全新下一代架构,主模型参数量为125B;得益于架构和训练的全面革新,Qwen 3.8-Flash训练成本较Qwen3.7-Plus降近90%,推理成本同样大幅下降。
在Artificial Analysis上,DeepSeek-V4-Flash正式版、Qwen 3.8-Flash和GLM-5.3-Flash完成每项任务的平均开销分别为0.11、0.10和0.09美元,远低于Anthropic旗下最强模型Fable 5.1的3.69美元。而三款模型的智能性,也支撑它们落在了综合价格和智能水平测试集中的“最具吸引力象限”内。
智谱董事长刘德兵在8月31日的业绩交流会上明确表示,未来将会有两条价格曲线,同等智能的价格一定会持续下降,GLM-5.3-Flash就是这一方向的产物。他同时表示,对于真正能够打开新的任务边界、显著提高任务成功率的前沿模型,仍然会有溢价和提价的空间。
孙威对财新分析称,预计未来12个月,中国大模型的竞争重心将从基准测评分数转向Token与成功任务的产出比,也就是模型能以怎样的稳定性落地真实业务、成本水平、适配怎样的部署环境等。同时,国产模型将持续推进开放权重模型的前沿探索,市场格局则会逐步向少数头部模型平台集中,胜出者需要同时兼顾快速迭代、国产芯片适配、渠道分发以及可持续商业化收入。
从Kimi K3的表现来看,目前扩大参数量仍是模型厂商提高智能性的主要选择。
腾讯在8月28日发布并开源新一代大语言模型Hy4 preview,总参数7700亿,较上一代Hy3模型2950亿的参数量大幅提升。
MiniMax CEO闫俊杰在8月26日的业绩交流会上预告,下一代模型MiniMax M3 Pro将是3万亿参数级别。唐杰也在智谱的业绩交流会上表示,将提高接下来基座模型的参数量。字节跳动则在8月传出在训练10万亿级别参数模型的消息。
“市场在Kimi K3发布后对智谱、MiniMax的反馈有些过激,当前大模型的市场空间仍非常大。”刘高畅认为,智谱在“1T时代”是开源模型的SOTA,说明其在预训练、CPT(继续预训练)与后训练处理的水平很高。而用智谱7440亿参数规模的大模型对比2.8万亿参数规模的Kimi K3并不公平。
刘高畅称,通过其团队调研,不管是DeepSeek、智谱还是MiniMax,其硬件储备训练出总参数量3T级别的模型都没有太大问题。在3T时代大家会重新竞争,也有可能复现1T时代的竞争格局。在未来一年半,头部大模型厂商仍会专攻模型能力,大模型还会持续迭代。
屈运栩、王智翔对此文亦有贡献本文选自即将于09月07日出版的《财新周刊》,原标题《“Kimi时刻”来临》