字号 ·· | 护眼

搜索结果

「单机跑Kimi K3首破5.85毫秒,同等投资Token产能提升10倍!浪潮信息破局Agent算力难题」共 40 条 · 第 1 页
凤凰网科技

单机跑Kimi K3首破5.85毫秒,同等投资Token产能提升10倍!浪潮信息破局Agent算力难题

2026年,Agent的火爆程度空前。而同期Token消耗量的增长更为惊人:从2026年的0.026Peta(千万亿),增长到2030年的152667Peta。Agent数量增长约28倍,Token消耗却增长数百万倍。需求侧增长如此之快,算力供给能接住吗?今年有两个案例十分典型:一是Kimi K3。这个总参数量2.8万亿的模型,权重文件达到1.56TB,普通AI服务器的GPU显存连权重都装不下,官

09/22
日经

AI处理速度受到云平台左右

即使以“Kimi K3”作为AI模型,不同云平台的处理时间相差7倍(Reuters)   德国公司的一项调查显示,即使是相同的人工智能(AI),由于所使用的云服务的性能不同,处理时间最多相差7倍。不同云平台采用的半导体和软件各不相同,这影响了AI的能力。   随着任何人都可以使用的中国开源AI普及,云平台的重要性正在提高。   美国亚马逊、微软等科技巨头为AI开发企业提供云服务。相比之下,被

09/22
凤凰网科技

打破“算力存储通信”三堵墙,升腾超节点给出十万亿大模型训推“最优解”

如果说2026年的AI圈只有一个关键词,那必然会是“智能体(Agentic AI)”。 从能聊到能干,智能体浪潮下,AI在各领域开始加速赋能,AI编程的爆发进一步带来生产力的质变,在各行各业掀起变革。 随之而来的是AI推理需求呈指数级爆发,2030预计全球每月Token消耗数将超过120千万亿,暴涨24倍。 为了支撑更强的Agent处理更复杂的任务,模型也越来越大,顶级MoE模型参数量直接来到“十

09/25
凤凰网科技

通信墙不破,AI Agent算力不立!华为超节点“黑科技”详解

智东西9月19日报道,在9月17日‑19日举办的华为2026年全联接大会上,华为围绕灵衢互联超节点集群升腾960芯片、升腾960超节点、OceanStor M900 AI记忆存储等一系列AI基础设施新品,引起产业多方其中,“灵衢”成为贯穿所有发布、高频出现的关键词,引起了很多人的好奇。灵衢是什么?有什么过人之处? 华为常务董事、ICT BG CEO杨超斌在主题为“灵衢互联,架构创新,构建Agent

09/19
凤凰网科技

月之暗面推出Kimi金融行业解决方案:首批落地工商银行、中信建投等

涵盖10+权威数据源、9项金融技能和5项合规安全措施,以及机构级的数据建模和报告交付能力。目前,中国工商银行、中信建投证券、易方达、红杉中国、真格基金等数十家机构已采用该方案。 据官方介绍,该解决方案提供持仓早报、财报点评、项目筛选、深度研究和组合复盘等功能,将数据获取、专业分析与成果交付连接起来。该方案可将此前以天计的资料处理和初稿制作压缩到小时级,帮助交易员减少工作压力。 数据源方面,该方案内

09/18
凤凰网科技

刚刚,智谱首个 RSI 成果发布,10 万国产卡用 GLM 造 GLM

两周时间,10 万颗国产 AI 加速器,一个开始优化自己的模型。 就在刚刚,智谱 GLM 首席科学家唐杰在 X 平台分享了一项关于 GLM-5.3-Flash 推理系统优化的研究。 他透露,从 GLM-5.3-Flash 首次运行在国产 AI 加速器上,到完成全部生产流量承载,仅用了两周时间。在这个过程中,系统端到端吞吐能力提升了 3.2 倍。 最让唐杰印象深刻的是,完成大量优化工作的并非只有基础

09/17
凤凰网科技

消息称Kimi或入局具身智能领域

一位曾参与Kimi具身智能方向面试的人士表示,早在GPT-6发布之前,Kimi便已关注这一领域,并对“Agentic Robotics”(智能体机器人)的技术路线持保留态度。 GPT-6发布后,Sam Altman曾明确表示OpenAI“一定会做人形机器人”,6月启动的机器人团队已演变为OpenAI Robotics。 据iiMedia Research(艾媒咨询)数据显示,具身智能主题融资金额T

09/18
凤凰网科技

智谱GLM-5.3-FlashX模型上线:进一步形成智能、价格、速度的全面竞争力

凤凰网科技讯 9月18日,智谱宣布推出GLM-5.3-FlashX(最高200tokens/s),为企业与开发者带来更快、更流畅的模型体验。 智谱官方表示,GLM-5.3-Flash此前以“Ox Alpha”之名与全球开发者见面,调用量持续攀升。面对快速增长的需求,智谱在10万张国产芯片提供的推理算力基础上,进一步加大对Infra侧的投入与推理优化。GLM-5.3-Flash 长期保持同尺寸最强智

09/18
华尔街见闻

顶尖风投a16z:顶尖人才涌向AI基建,基础设施设计将“推倒重来”

需求以千倍速扩张,而芯片、内存、电力、数据中心的供给最快也要三到五年才能跟上——顶尖风投a16z认为,在需求呈现指数级增长、核心组件订单已排至数年后的背景下,传统的计算堆栈已被推至物理极限,一场围绕AI时代的基础设施重构正在全面开启。 近日,硅谷顶级风险投资机构a16z(Andreessen Horowitz)正式宣布推出"机器时代基金"(Machine Age Fund),专注投资AI基础设施领

08/30
华尔街见闻

Kimi向微软、亚马逊、谷歌要30%分成,开源模型开始“海外收租”了

近日,外媒披露,月之暗面正在与微软、亚马逊和谷歌谈判,希望让Kimi K3进入Azure、AWS和Google Cloud,并从这些平台销售K3相关服务获得的收入中拿走最高30%的分成。如果最终达成,这可能成为中国AI公司与美国大型云厂商之间第一批重要的模型收入分成协议。 双方还没有完全谈妥收入按照什么口径分、月之暗面能够获得哪些使用数据,以及云厂商销售出去的Token如何审计。三家云厂商和月之暗

08/31
cnbeta

美光推出全球首款512GB DDR5内存条 单台服务器内存容量可突破12TB

人工智能与超大规模数据处理需求正不断推高服务器内存容量的发展速度。存储芯片巨头美光日前宣布,已成功演示全球首款容量达到512GB的DDR5服务器内存模块,标志着企业级内存技术迈入新的密度时代。该产品不仅刷新了单条DDR5内存容量纪录,也为未来人工智能服务器和云计算基础设施提供了更大的扩展空间。 据介绍,这款512GB DDR5 RDIMM模块传输速率最高可达9200MT/s,属于目前性能最强、容量

09/16
财新

Kimi布局企业业务 和IT服务商共推AI前端部署

【财新网】Kimi K3实现技术突破后,月之暗面(Kimi)发力企业级业务。9月10日,月之暗面宣布启动 “Kimi企业合作伙伴计划”,与不同行业的IT服务商、集成商共同组建前线部署工程师(Forward Deployed Engineer,FDE),帮助企业把AI部署到核心业务中。 首批合作企业包括华胜天成( 600410.SH )、金山云(03896.HK)、亚康股份(301085.SZ)、亚

09/10
凤凰网科技

月之暗面最强AI:消息称Kimi K3.1下月登场

IT之家 9 月 24 日消息,科技媒体 Wccftech 昨日(9 月 23 日)发布博文,报道称月之暗面(Moonshot)正酝酿推出 Kimi K3.1 模型,并将提供 Low、High、Max 共 3 档推理强度,预估会在下月(2026 年 10 月)登场。消息源 @MaxForAI 昨日在 X 平台发布推文,发现月之暗面内部 JSON / API 响应中,出现 Kimi K3.1 相关标

09/24
财新

ARM的自研AI CPU获联想、字节跳动两大中国客户 智能体时代CPU格局如何变化?

【财新网】9月8日Arm Everywhere China 年度大会上,ARM)宣布,已引入联想集团(00992.HK)和字节跳动火山引擎两家新合作伙伴,后续将在中国市场部署ARM自研芯片AGI CPU(通用人工智能中央处理器),其中,火山引擎已将首批基于该平台的智能体沙箱推向市场。不过,ARM在采访中并未透露具体合作细节和时间规划。 “我们对 Arm AGI CPU 的早期评估表明,其在主流云工

09/09
财新

【市场洞察】瑞银:中国AI模型性价比突出 中美差距缩窄至3到6个月

【财新数据专稿】“中国模型在成本优势上面展现出的全球竞争力。中国的模型无论是前期的训练研发阶段,还是后期的推理、使用阶段,展现出来的性价比或者绝对的成本都还是比国外的竞品是显著低的。”瑞银互联网分析师熊玮在瑞银近期举办的2026年A股研讨会上表示。熊玮对中国模型在全球市场获取更多份额保持乐观。 模型能力持续提升,中美差距缩窄至3至6个月过去两三个月间,国内多家领先模型厂商密集发布了新一代产品。其中

09/06
cnbeta

高通下一代旗舰芯片曝光:主频冲击5.4GHz 继续采用台积电2纳米N2P工艺

高通刚刚发布骁龙8 Elite Gen 6和骁龙8 Elite Extreme Gen 6不久,外界关于下一代旗舰移动平台的传闻已经开始浮现。最新消息显示,高通正在开发代号为“Honu”的全新旗舰SoC,预计将继续采用台积电2纳米N2P工艺,并将CPU主频进一步提升至5.3GHz至5.4GHz区间。 根据爆料信息,这款芯片可能被命名为骁龙8 Elite Extreme Gen 7,内部型号为SM8

09/26
凤凰网科技

中科曙光发布AI推理原生存储FN Neo:Token吞吐能力提升150%

快科技9月21日消息,中科曙光发布全新迭代AI推理原生存储FN TTFT缩减73%,Token吞吐提升150%中科曙光发布全新迭代升级的AI推理原生存储FN Neo。该产品可将分散在不同计算节点的推理缓存统一管理、共享复用,应对长文本、多用户同时访问带来的压力,让已有计算成果得到更充分利用。 实测数据显示,FN Neo可实现模型首词出现时间缩减73%,较本地NVMe更快;延迟表现、吞吐量和多请求并

09/21
财新

T早报|苹果、三星、谷歌被美国国际贸易委员会调查;脉脉称今年前7月新发AI岗位数量增长790%;Kimi发布金融行业解决方案

美国纽约,中央公园附近的苹果第五大道门店。图:视觉中国  【财新网】  腾讯WorkBuddy上线全栈“应用”生成能力  9月17日 ,腾讯WorkBuddy上线全栈“应用”生成能力。该能力首期支持全栈“网页应用”生成,用户只需用自然语言描述需求,即可生成自带云数据库、文件存储、用户注册登录与AI调用能力的完整网站应用,并可一键发布上线,获得可直接分享的访问链接。  MiniMax参与新加坡AI技

09/18
凤凰网科技

AI将改变所有交互方式,这一次轮到了3D

硅星人下载客户端 独家抢先看2026年09月22日 15:10:18 来自北京 作者|周一笑微信|smiletalker过去一年,Agent(能自己拆解任务、调用软件的 AI 系统)开始越来越频繁地进入专业软件。写代码只是最早的一站,Blender、CAD、游戏引擎也逐渐变成大模型可以直接操作的工具。GPT-6 Astra 最近展示的 3D 能力,又把这种变化推到了台前。对 3D 生成大模型公司来

09/22
thenextweb

骁龙峰会:高通5GHz手机芯片、AI耳机和Linux个人电脑

高通本周在毛伊岛举行的骁龙峰会上,将其芯片定位为人工智能代理(AI agents)的硬件基础。在为期三天的活动中,高通发布了两款旗舰手机芯片以及一款用于AI耳机和眼镜的芯片,同时为X2笔记本电脑处理器引入了Linux支持。 据CNBC记者基夫·莱斯维ング(Kif Leswing)报道,首席执行官克里斯蒂亚诺·阿蒙(Cristiano Amon)于周二发表了峰会开幕演讲。另据The Elec报道,阿

09/25
华尔街见闻

智谱悄悄上架天猫:Token越来越便宜,为什么AI公司反而开始限量了

最近,有读者发来一条智谱的公告。用了几个月的老套餐,要没了。 此前那个“不限周额度”的GLM Coding Plan,将停止自动续订,智谱给老用户补偿两个月新套餐。 几个月前,AI编程市场还在比谁家套餐更便宜;到了现在,你到底能用多少Token。 这意味着,一件过去听起来非常“技术”的东西,AI的使用额度,可以像手机流量一样被直接购买。 但这里真正值得关注的,并不是“智谱上天猫卖Token”这件事

09/05
财新

【周刊提前读】AI竞争白热化、模型超速迭代 “Kimi时刻”已来

从2月到8月底,中国AI(人工智能)大模型公司月之暗面(Kimi)在私募市场的投前估值从100亿美元涨了4倍至500亿美元;而其7月末开始的350亿美元估值的上轮融资刚刚交割,募资额35亿美元——这意味着,仅仅一个月,月之暗面的估值又涨了150亿美元。 另一家中国大模型公司DeepSeek(深度求索)更是抢手,其在7、8月间启动的第二轮融资谈判,放出的投前估值接近5000亿元人民币。“一级市场能投

09/05
华尔街见闻

“Agent vs 美债”——谁将主导美股?

AI Agent浪潮与美债利率上行的对峙,正将美股撕裂成两个截然不同的世界。 本周,Meta发布旗下Agentic AI模型Muse,单周市值暴增2200亿美元,推动纳斯达克100指数成为表现最强的主要股指。但与此同时,美债收益率持续走高,将利率敏感型资产打入低谷——罗素2000指数显著落后,标普500指数在7700点附近反复拉锯,始终无法实现有效突破。 市场的内部分化已达到极端程度。若剔除AI相

09/26
凤凰网科技

8万亿,梁文锋也开始卷“超大”

DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。

09/22
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…