【财新网】国产芯片需求快速放量,推理芯片赛道获资本押注。财新从多市场人士处了解到,近日,AI推理芯片公司浙江曦望智能科技股份有限公司(下称“曦望”)完成新一轮20亿元人民币融资,投后估值约200亿元,较今年4月完成的上轮融资估值接近翻倍。而即将于9月登陆科创板的燧原,在2025年完成的最后一轮融资估值为182亿元。
据了解,曦望本轮投资方包括人保股权、建信股权、东方国际资产、Janchor Partners、中科创星、同创伟业、进化论资本、临芯投资、毅达资本、湖畔基金、弘晖基金等投资机构,以及正大集团、九安医疗、盈峰环境、三七互娱、同程旅行等产业资本。
今年以来,人工智能(AI)算力需求暴增,AI企业排队等“芯”,中国国产AI芯片迎来一轮发展红利。“全国算力需求爆发式增长,高端卡一卡难求,变成完全的卖方市场,价格不断抬升,涨幅远超市场预期。”杭州市算力资源调度服务平台浙江算力科技有限公司业务负责人告诉财新。
摩根大通预测,考虑到美国AI芯片供应的不确定性,预计到2030年,中国本土AI芯片的需求量将实现40%的五年复合增长率。另一名中型云厂商人士对财新指出,从中期来看,GPU产能存在缺口,因此只要提供的产品能出货、具备一定竞争性,哪怕性价比略低,也有客户愿意买。
旺盛需求吸引资本加速涌入。一名曦望早期投资人告诉财新,一年内公司估值翻了四倍。事实上,曦望从商汤独立分拆一年多以来,已完成八轮融资,总融资额57亿元,投资方包括三一集团旗下华胥基金、第四范式(06682.HK)、游族网络(002174.SZ)、北京利尔(002392.SZ)、杭州数据集团、正大机器人、协鑫科技(03800.HK)等产业投资方,也包括IDG资本、高榕创投、松禾资本、中金资本等投资机构,和诚通混改基金等国资背景资本。
“曦望会优先拿产业侧的钱”,一名接近曦望的人士告诉财新,产业方自身也有尝试AI应用的需求,能够帮助公司产品在真实场景落地迭代。
曦望前身是商汤科技的大芯片部门,2024年底从商汤拆分独立。曦望董事长为徐冰、商汤联合创始人;联席CEO王勇主要负责技术研发,曾在AMD从事芯片业务,后加入百度昆仑芯担任核心架构师,2020年加入商汤组建大芯片部门;另一名联席CEO王湛曾是百度副总裁,参与建立百度搜索推广系统“凤巢”,2025年加入曦望,负责商业化。
据悉,本轮20亿元融资将主要用于新一代产品的研发迭代与规模化交付。曦望已分别于2021年、2024年完成两款GPU产品流片,均实现规模化量产。不过,曦望2026年1月发布的新产品推理GPU启望S3则精简了训练能力,聚焦推理赛道,目前正按节奏推进设计流片。
“2024年量产S2的时候发现,大模型预训练通常需要万卡到十万卡级别,已经成为寡头游戏,S2落地的场景大多是推理业务”,王勇此前告诉财新,公司意识到应该把云端训练和推理分开,且预见到推理应用将很快超过训练“。
德意志银行7月发布的调研报道显示,中国国产AI芯片的装机量明显偏向推理工作负载,1。
“训练对芯片的要求是高性能,推理则需要极致性价比,所以曦望2025年提出‘百万token一分钱’的长期目标,希望推动全行业持续降低Token生产成本。”王勇说。在产品定义上,启望S3不再追求训推一体,而是围绕推理负载进行针对性优化。据曦望测算,S3的推理性能约为上一代产品S2的5倍。
与此同时,S3舍弃了HBM方案,转而采用LPDDR,本土供应链更为成熟,有利于快速流片出货。王勇介绍,启望S3是国内首款搭载LPDDR6(第六代低功耗内存)且兼容LPDDR5X内存的推理GPU。
王勇对财新表示,采用LPDDR路线而非传统的HBM(高带宽内存)配置的原因之一是服务于降本。“H逻辑部分约占三分之一,存储部分约占三分之一,封装及测试占三分之一。采用LPDDR后,理论上成本可以降至原来的三分之一。”王勇称,即使受近期内存价格上涨影响,当前测算成本仍可较原方案降低一半以上。
王勇说,LPDDR路线的另一项优势是在保证推理带宽的前提下,可以有更大的显存容量,从而更好地适配MoE架构下模型参数规模不断扩大的趋势。
同时,长鑫科技 LPDDR5X 已经量产,下一代 LPDDR6 研发接近尾声,国产存储具备初步供给能力,采用LPDDR 方案意味着在存储环节不必完全依赖海外供应链。
不过,业内人士对财新指出,LPDDR在带宽上与HBM仍有数十倍差距,带来一定应用场景限制。另一边,通过优化数据传输速率,也可以将带宽差距缩小,满足一些中小规模推理场景的需求。
随着AI推理需求快速增长,海外厂商也在加速探索针对推理场景优化的专用芯片。8月25日,北美大模型企业OpenAI公布旗下首款定制推理芯片Jalapeño的性能,称相比GPU龙头英伟达的旗舰AI服务器GB200和GB300等,Jalapeño能够以更低的单位功耗处理更多AI工作负载,同时更快响应。不过,值得注意的是,Jalapeño还未进行量产验证。(详见财新网报道《OpenAI展示自研推理芯片成果 与英伟达比高低》)英伟达在8月27日举行的财报会上表示,预计将在本季度晚些时候向早期合作者批量出货推理专用芯片Groq 3 LPX,NeoClouds(新云)厂商Nebius将成为首家客户。2025年12月,英伟达斥资200亿美元与Groq达成非独家授权合作,并从Groq团队中聘用工程人才。(详见财新网报道《英伟达否认收购Groq 称仅获取人才和技术授权》)8月7日,另一GPU企业AMD也宣布收购人工智能推理芯片企业Taalas。