搜索结果
硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响
2.8万亿参数的大模型,究竟要怎么跑快?近日,海内外团队盯上了全球最大参数量的开源模型——Kimi K3。K3凭借2.8万亿总参数、104B激活参数,刷新了开源模型的性能上限。但普通的AI服务器难以承载这么大参数量的模型,Kimi官方推荐64卡甚至更大规模的AI服务器才能装得下。有业内人士表示,一般未经优化的超节点跑Kimi K3,初始性能可能仅在10 tokens/s左右。 面对如何让2.8万亿
【市场洞察】瑞银:中国AI模型性价比突出 中美差距缩窄至3到6个月
【财新数据专稿】“中国模型在成本优势上面展现出的全球竞争力。中国的模型无论是前期的训练研发阶段,还是后期的推理、使用阶段,展现出来的性价比或者绝对的成本都还是比国外的竞品是显著低的。”瑞银互联网分析师熊玮在瑞银近期举办的2026年A股研讨会上表示。熊玮对中国模型在全球市场获取更多份额保持乐观。 模型能力持续提升,中美差距缩窄至3至6个月过去两三个月间,国内多家领先模型厂商密集发布了新一代产品。其中
8万亿,梁文锋也开始卷“超大”
DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。
对话比尔·盖茨:中美大模型各有4家 能够保持最先进水平
今日,盖茨基金会掏出 10 亿美元“砸”向人工智能,宣布将在未来两年花费重金,推动这项前沿技术不只为富人服务,也能帮最贫困的人改变命运。在交流中,盖茨不仅高度评价“中国大模型表现非常出色”,剖析开源技术对于全球贫困地区的重要意义,还就外界关心的“数据中心耗电与环保焦虑”“AI 对就业市场的冲击”以及“中国人形机器人发展”等热点话题分享了观点。 他曾直言,商业资本容易忽略市场失灵与社会隐患,“AI
Mozilla最新报告揭示前沿AI代差收窄:中国开源模型性能差距缩至4.4个月
国际非营利技术机构 Mozilla 近日发布最新一期《开源人工智能现状报告》(State of Open Source AI)显示,美国硅谷顶尖科技巨头的闭源前沿 AI 模型与来自中国科技企业的顶尖开源权重模型之间的性能代差已大幅缩窄至仅约 4.4 个月。这一极小的时间差距与巨大的使用成本反差,正在促使全球越来越多企业在处理日常业务时,将高性价比的开源模型作为首选生产力工具。 该报告系统性比对了全
“灵晟”超算全球第一,日媒:中国向世界证明,即便在制裁下也能胜出
据日本“AMP”网站9月2日报道,中国超级计算机“灵晟(LineShine)”夺得全球算力榜首。不少人或许只将其视作“中国技术实力又取得进步”的普通消息,但这件事绝非单纯的超算性能竞赛,它是AI时代国家竞争格局正在发生转变的标志性事件。 在衡量超算算力的LINPACK基准测试中,“灵晟”跑出2.198百亿亿次浮点运算/秒(Exaflops)的成绩,超越此前位居首位的美国超算“埃尔卡皮坦(El Ca
谁拿走了国产算力的利润?
中国算力产业正经历一场深层次的利润重分配。随着全国一体化算力网升格为国家级基础设施,计费逻辑从"卖机柜"转向"卖词元",产业价值链的利润重心正加速从上游硬件制造商向中游调度运营商和下游应用服务商迁移,传统以机柜规模和GPU库存为核心的竞争逻辑正在失效。 国金证券在最新产业研究报告中指出,中国日均词元调用量从2024年初的1000亿跃升至2026年3月的140万亿,两年增长超1000倍;三大运营商已
阿里巴巴发布号称性能最强AI晶片 加码数据中心建设
中国科技巨头阿里巴巴星期二(9月22日)推出一款号称“算力性能最强”的人工智能(AI)晶片,并宣布进一步扩大AI基础设施投入。(彭博社档案照片) 中国科技巨头阿里巴巴推出一款号称“算力性能最强”的人工智能(AI)晶片,并宣布进一步扩大AI基础设施投入,力争到2032年将阿里云全球数据中心规模提升至20吉瓦以上。综合彭博社、第一财经和每日经济新闻报道,阿里巴巴集团首席执行官吴泳铭星期二(9月22日)
三张图看懂中美AI主导权之争
围绕快速发展的人工智能(AI),美国和中国正在席卷全球。在最尖端AI模型的开发方面,美国IT企业一直占据压倒性优势,但最近中国企业正在迅速追赶,中美AI性能差距正逐渐消失。AI主导权之争的最终走向有可能决定未来的经济增长乃至国际秩序。 (注)性能评估数据来自美国斯坦福大学《AI Index》。雷达图以美国Artificial Analysis截至8月底的数据为基础,将100作为最高值进
胡锡进:美方是真急了,拿出要在AI领域“拼命”的那股邪劲
华盛顿对中国人工智能的快速发展是真的惊慌了,史无前例的惊慌。美国财长贝森特周二在华盛顿布莱巴特新闻活动上公开放出极端警告,“如果中国在人工智能领域获胜,明天就什么都没有了。”“如果他们在人工智能领域领先于我们,那么其他一切都将毫无意义。”他把一个意思刻意说了两遍。 外界有人分析,贝森特如此极端的表态,一部分用意是试图说服美国国内民众,消解各地居民反对在家门口兴建大型AI数据中心的抵触。美国媒体多次
马斯克:中国AI大模型单位算力产出近全球顶尖,2-3年补齐算力缺口
原标题:马斯克惊叹中国AI大模型“单位算力产出性能几乎是全球顶尖水平”,预计两到三年内就能靠光刻技术与芯片制造补齐算力缺口IT之家 9 月 23 日消息,特斯拉 CEO 埃隆 · 马斯克今日接受了央视财经专访。 当谈及 AI,他表示中国的 AI 大模型整体而言非常出色,单位算力产出的性能几乎全球顶尖。 他认为,中国解决算力问题的速度会比大多数人预想更快。粗略估计,大概两到三年内,中国就能依靠光刻技
订单狂翻几十倍:全世界搞AI的,为啥都在抢中国电池?
这两年,AI军备竞赛打得那叫一个昏天黑地,在中美都是拉动投资的主力。 GPU、存储、光模块、液冷,算力基建的市场热点一轮接一轮地爆发。 另外,GPU芯片非常吃电,一座大型AI算力中心一年电费动辄几十个亿,顶得上一座小城市。即便你掏得出几十亿,也不一定能抢到电。 在美国一些地区,AI算力中心接入电网要排队3到7年。于是马斯克、扎克伯格这些人都等不及了,纷纷开始购买燃气轮机自建电厂。 这使得跟AI算力
中国算力崛起.二|每秒5000P的算力——算多还是少?算强还是弱?
近年国家智算产业全面崛起——论资源,西部有源源不绝的绿电与建设算力中心所需的优越自然条件,撑起「东数西算」大布局;论产业生态,主打创科的城市早已孕育出月之暗面、DeepSeek等成熟大模型企业。反观香港,不仅缺乏成熟的AI产业链,更面临昂贵电价与成本负担。尽管如此,刚刚发表的《「一五」规划》和《2026年施政报告》表明将会「强化算力基础设施」,「打造香港成为区域先进数据及算力枢纽」。那么,香港的智
以小博大:中国AI巨头如何在算力竞赛中让每一美元发挥最大价值
穆迪评级的一份新报告指出,美国和中国科技巨头在人工智能支出上的巨大差距,可能并不会为美国巨头带来预期的优势,因为中国国内成本较低且获得大量政府支持,使得中国企业每美元能获得远更多的计算能力。 报告称,虽然美国超大规模企业在支出上远超中国同行,但实际计算能力的差距远没有这些巨额预算所暗示的那么大。 穆迪指出,较低的建造成本、有针对性的政策激励以及更便宜的绿色能源获取渠道,意味着中国科技企业正在超越其
有望对标Databricks,OceanBase押注AI数据底座的万亿市场
AI落地的真正拐点,已经不在模型本身。当通用大模型足够强、足够便宜之后,真正卡脖子的,是自己的数据。散落在各处的交易记录、文档、图片、日志,以及那些还没被整理的向量,能不能被Agent真正用起来? 正是这一问,把数据层推到了台前。当数据库的使用主体从人变成了海量Agent,数据类型从结构化扩展到多模态,要求也从“存得下”变成了统一管理、实时检索、语义理解与安全合规。这些变化正在重写整个数据市场的边
马斯克:中国解决算力问题的速度,会比大多数人预想得更快
9月25日晚,微信公众号“央视财经”发布对美国特斯拉CEO埃隆·马斯克的专访。马斯克就中国人工智能(AI)大模型、电力与算力基础设施、全球AI安全监管、商业航天合作以及中国制造业的独特优势等议题分享见解。“央视财经”截图对于中国大模型的发展,马斯克不吝赞美。他表示,中国AI大模型“整体而言非常出色”,尤其在考虑到中国AI企业可用算力有限的情况下,大模型表现堪称优秀,单位算力产出的性能几乎是全球顶尖
“你想毁掉自己的职业生涯吗?”
当地时间9月11日,包括陶哲轩、邓煜在内的25位菲尔兹奖得主联合发表《人工智能在数学中的严重错位》的声明(以下称“联合声明”),将OpenAI、Anthropic等AI公司与数学界的一场“大战”推向高潮。联合声明称,AI公司将解决数学难题作为模型能力基准的做法,对数学科学本身及数学界造成了损害,与数学共同体追求概念理解的根本目标产生了显著分歧。这一分歧近期越发明显。9月8日,OpenAI宣称其未公
一文看懂升腾超节点:AI Infra已进入系统工程阶段
AI大模型竞赛,正在进入新的量级。海外,十万亿参数的大模型已经逐步变成现实;国内,数万亿参数的大模型也在加速追赶。为了训出真正的SOTA模型,算力集群从万卡走向10万卡已成为标配。 然而,卡越堆越多,真正被利用起来的算力,却没有同步增长。华为的仿真数据显示,在10万卡集群中,卡间通信可能消耗了40%以上的训练时间,算力利用率往往不到30%。也就是说,大量昂贵的算力,并没有真正用于计算。 对于训练周
中国拟有序部署十万卡级智算集群 加大国产晶片适配力度
中国官方提出未来五年要“适度超前”建设信息基础设施,有序部署万卡、十万卡及以上规模的智能算力集群,按应用场景需求建设推理算力设施,并加大国产算力晶片适配力度。 中国工业和信息化部星期一(9月7日)发布《信息通信行业发展“十五五”规划》,提出“十五五”时期信息基础设施累计投资达到3.8万亿元人民币(7172亿新元),推动智能算力规模从2025年的1590 EFLOPS(每秒百万万亿次)提升至2030
阿里拟推5万亿至10万亿参数超大模型 并发布新一代自研AI芯片
阿里巴巴在杭州举行的2026云栖大会上公布了迄今最为激进的人工智能发展计划。公司首席执行官吴泳铭宣布,阿里巴巴正准备训练参数规模介于5万亿至10万亿之间的新一代人工智能模型,进一步扩大其在大模型、AI芯片和云计算基础设施领域的布局。 按照阿里巴巴披露的信息,正在研发的新模型将成为通义千问(Qwen)系列的重要后续产品。公司表示,Qwen团队目前正持续推进模型架构创新和数据优化研究,希望未来模型能够
刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格
就在昨天凌晨,一个320B的开源大模型横空出世,权重连同blog,一口气全丢了出来。这匹「黑马」叫IQuest-Q1。 九月这个赛道有多卷,你看看就知道了:月初GPT-6 Astra、Fable 5.1、Gemini 3.8 Flash连着三天扎堆发布,国产阵营Qwen3.8、GLM-5.3轮番上阵。 在这帮「卷王」里,一个名叫「至知」的团队突然交出了一张320B的开源答卷,而且一上来就在写代码库
把时间还给科学家:华为如何筑牢AI科研底座
真正进入具体研究场景,AI科研的价值才开始变得具体。凤凰网科技 出品作者|杨乐拿到诺贝尔奖的,永远是科学家。很少有人会注意,科学家身后站着什么。 2024年诺贝尔化学奖授予蛋白质结构预测领域的科学家,AlphaFold由此成为AI进入基础科学的标志性案例。但一个模型能够预测蛋白质结构,只是故事的开始。 一篇论文可以在几个月里完成,一套科研基础设施却可能需要几年、十几年。 AI for Scienc
当算力开始按“瓦”计价
SEMICON 一个穿无尘服的人,双手捧着一片晶圆。这大概是半导体行业最经典的自我形象——干净、精密、以晶圆为中心。 但在会场里待满三天之后,大家谈论的东西,已经不太是他手里那片晶圆了。今年被念得最多的词,不是纳米,不是光刻机,是Token。 英伟达首席技术官在大会主旨演讲里给出的比喻,是理解这一变化的入口。他说,类比传统工厂,投入的是电力、资本和数据,产出的是token。一开始,大家用token
被中国车企逼到墙角!通用汽车高管开始每月比拼谁更会用AI
通用汽车高管团队正在以一种不同寻常的方式加速AI转型:每月比拼AI使用率。 通用汽车CFO保罗·雅各布森本周在伦敦举行的摩根大通美国全明星大会上透露,向CEO玛丽·博拉汇报的高管们每个月都会按部门和职能对比AI使用数据,形成内部竞争排名。 雅各布森表示,在玛丽的高管团队中存在一种良性的竞争氛围,每个月大家会展示各部门和职能的AI使用情况。他坦言自己的财务团队目前排在中游,还在追赶其他部门。 这番表