搜索结果
中科曙光发布AI推理原生存储FN Neo:Token吞吐能力提升150%
快科技9月21日消息,中科曙光发布全新迭代AI推理原生存储FN TTFT缩减73%,Token吞吐提升150%中科曙光发布全新迭代升级的AI推理原生存储FN Neo。该产品可将分散在不同计算节点的推理缓存统一管理、共享复用,应对长文本、多用户同时访问带来的压力,让已有计算成果得到更充分利用。 实测数据显示,FN Neo可实现模型首词出现时间缩减73%,较本地NVMe更快;延迟表现、吞吐量和多请求并
Token效能提升120%!这家国产AI存储厂商拿下多项“全球第一”,凭什么?
智东西9月17日报道,9月1日,全球权威AI性能评测组织MLCommons发布MLPerf Storage v3.0基准测试榜单。焱融全闪AI存储F9000X在多项基准测试中拿下第一,充分验证其在极限AI训练负载下对高速网络带宽的高效利用能力。 2026随着AI产业从模型训练走向规模化推理,存储系统需要处理的数据和承担的任务也在增加。训练阶段,存储要持续向GPU供给海量数据,还要快速保存和恢复模型
英伟达展示DSX MaxLPS技术,AI工厂每兆瓦token吞吐量最高提升40%
IT之家 9 月 17 日消息,科技媒体 Wccftech 昨日(9 月 16 日)发布博文,报道称在 AI 基础设施峰会上,英伟达展示了面向 AI 工厂的 DSX MaxLPS 功耗调度系统,每兆瓦 token 吞吐量最高提升 40%。 每兆瓦 token 吞吐量是指数据中心每消耗 1 MW 电力时,AI 系统每秒能够生成或处理多少个 token。该指标把功耗纳入计算,因此更适合衡量 AI 数据
高通详解下一代骁龙旗舰NPU升级:更强AI推理能力将降低对内存的依赖
高通近日进一步公布了骁龙8 Elite Gen 6 Pro的AI处理能力细节,其中最值得关注的是全新Hexagon NPU的升级。与过去单纯追求AI算力增长不同,高通此次更加重视AI模型运行效率、内存访问以及功耗控制,希望让下一代旗舰手机能够在本地运行规模更大的生成式AI模型和AI智能体。 高通表示,随着生成式AI逐渐成为智能手机的重要功能,AI模型本身也在不断变得更加庞大和复杂。对于移动设备而言
AI吞噬海量数据引爆“复古”需求 磁带存储出货量暴涨57%再迎繁荣
据近乎贪婪的需求推动下,诞生于上世纪90年代的传统存储介质——磁带,如今不仅没有被淘汰,反而迎来了强劲的复兴热潮。此前,已停摆的DOGE项目曾试图以所谓“效率”为由全面淘汰磁带存储,然而市场的实际走向却给出了截然相反的答案。 由慧与(HPE)、IBM和昆腾(Quantum)组成的LTO技术联盟(LTO Consortium)最新数据显示,2026年第一季度LTO兼容磁带介质的总体出货容量同比大幅增
闪迪暴涨11%,存储和芯片股“短期期权”爆巨量,“AI股神”又出手了?
周五,约9600万美元短期看涨期权集中涌入闪迪(SanDisk)、美光(Micron)、英特尔(Intel)和Marvell四只AI芯片股。盘中,闪迪涨幅一度暴涨11%。 看着这波“爆巨量”的短期期权交易流,CNBC主持人Jim Cramer在社交平台X上发文感叹道:“看这架势,活脱脱Leopold杀回来了!” 如果你一直在关注全球AI算力和大模型赛道的投资机会,你一定不会对Leopold As
五项第一!纯国产AI存储首次杀入全球第一梯队:中国芯+中国存储
快科技9月17日消息,据MLCommons官方公布的最新结果,基于兆芯开胜KH-50000处理器的纯国产AI存储方案AS13000G7,在全球权威AI存储基准测试MLPerf Storage V3.0中斩获五项第一,成为业界首个闯入全球第一梯队的全国产AI存储方案。 本次测试覆盖大模型训练Checkpointing、大模型推理KVCache、高性能计算UNet3D三大核心场景,AS13000G7参
AI利润格局:模型公司每100美元收入,35-40美元流向云厂,为其带来10-20美元营业利润
AI模型公司每赚100美元,约35-40美元以推理计算费用的形式流向AWS、Azure、GCP三大云厂商。云厂商从这笔收入中赚取10-20美元营业利润,对应营业利润率约35%-45%。 这是巴克莱在8月28日发布的AI行业单位经济学研报中的核心发现。 与此同时,AI实验室的付费推理利润率已从2025年的十几个百分点飙升至2026年的50%-65%以上,调整后毛利率同比提升30-50个百分点。驱动力
高通公布新一代Adreno GPU:矩阵核心强化AI算力、更高频率更低功耗
高通公布了下一代骁龙顶级移动平台所搭载的新一代Adreno GPU的部分技术细节。新GPU在延续三切片架构的基础上,进一步提升了运行频率,并首次引入片上高性能缓存、Matrix Cores专用AI计算单元及Adreno Neural Fusion融合架构,旨在从架构层面优化持续图形性能与功耗效率。 新一代Adreno GPU继续采用三切片架构设计,每个切片的运行频率较上一代提升250MHz,由1.
顶尖风投a16z:顶尖人才涌向AI基建,基础设施设计将“推倒重来”
需求以千倍速扩张,而芯片、内存、电力、数据中心的供给最快也要三到五年才能跟上——顶尖风投a16z认为,在需求呈现指数级增长、核心组件订单已排至数年后的背景下,传统的计算堆栈已被推至物理极限,一场围绕AI时代的基础设施重构正在全面开启。 近日,硅谷顶级风险投资机构a16z(Andreessen Horowitz)正式宣布推出"机器时代基金"(Machine Age Fund),专注投资AI基础设施领
中科曙光预告全球首款64线程移动工作站笔记本
中国高性能计算巨头中科曙光(Sugon)近日对外预热了一款开创性的移动工作站产品,官方称其为全球首款具备64线程计算能力的笔记本电脑。在传统PC芯片巨头英特尔与AMD尚未将移动平台多线程规格推向此种量级的背景下,这一举措直接打破了当前移动计算设备的规格上限,引发了全球硬件产业与技术圈的广泛讨论。 从目前公布的设备参数来看,这款移动工作站并未采用笨重如“箱式台式机”的伪便携形态,而是保持了标准笔记本
把时间还给科学家:华为如何筑牢AI科研底座
真正进入具体研究场景,AI科研的价值才开始变得具体。凤凰网科技 出品作者|杨乐拿到诺贝尔奖的,永远是科学家。很少有人会注意,科学家身后站着什么。 2024年诺贝尔化学奖授予蛋白质结构预测领域的科学家,AlphaFold由此成为AI进入基础科学的标志性案例。但一个模型能够预测蛋白质结构,只是故事的开始。 一篇论文可以在几个月里完成,一套科研基础设施却可能需要几年、十几年。 AI for Scienc
美光推出全球首款512GB DDR5内存条 单台服务器内存容量可突破12TB
人工智能与超大规模数据处理需求正不断推高服务器内存容量的发展速度。存储芯片巨头美光日前宣布,已成功演示全球首款容量达到512GB的DDR5服务器内存模块,标志着企业级内存技术迈入新的密度时代。该产品不仅刷新了单条DDR5内存容量纪录,也为未来人工智能服务器和云计算基础设施提供了更大的扩展空间。 据介绍,这款512GB DDR5 RDIMM模块传输速率最高可达9200MT/s,属于目前性能最强、容量
【周刊提前读】中国AI应用催生海量算力需求 国产芯片你追我赶崛起中
人工智能(AI)算力需求暴增,中国产AI芯片则迎来一轮发展红利,“得产能者得客户”。 “今年全国算力需求爆发式增长,高端卡一卡难求,变成完全的卖方市场,价格不断抬升,涨幅十分惊人。”杭州市算力资源调度服务平台浙江算力科技有限公司(下称“浙江算力科技”)业务负责人告诉财新,其平台算力已租赁一空,大集群算力产品出现多家客户排队等候的情况。 浙江算力科技为杭州国资企业,通过自建和集中社会闲置算力,统一管
2026年AI推理硬件革命:从训练转向部署
从训练转向部署2026年AI推理硬件革命:从训练转向部署到部署2026年,人工智能行业已从专注于模型训练转向人工智能推理,这得益于推理模型和代理式人工智能的兴起。 这一转变暴露了传统GPU的内存带宽瓶颈,催生了新的硬件策略。 英伟达和亚马逊等行业领导者正在采取“系统方法”,将用于预填充阶段的计算密集型芯片(例如英伟达的Vera Rubin GPU、亚马逊的Trainium)与用于解码阶段的以内存为
打破“算力存储通信”三堵墙,升腾超节点给出十万亿大模型训推“最优解”
如果说2026年的AI圈只有一个关键词,那必然会是“智能体(Agentic AI)”。 从能聊到能干,智能体浪潮下,AI在各领域开始加速赋能,AI编程的爆发进一步带来生产力的质变,在各行各业掀起变革。 随之而来的是AI推理需求呈指数级爆发,2030预计全球每月Token消耗数将超过120千万亿,暴涨24倍。 为了支撑更强的Agent处理更复杂的任务,模型也越来越大,顶级MoE模型参数量直接来到“十
机器人也要有超脑了!联发科Genio Pro 5100芯片发布:3nm制程+106 TOPS算力
在第九届中国机器人峰会期间,联发科正式发布了专为具身智能打造的旗舰级SoC——Genio Pro 5100。 与此同时,合作伙伴华睿智普也推出了搭载该芯片的Praxis One具身智能超脑算力底座,旨在通过强大的端侧算力破解机器人规模化落地的痛点。 当前,AI正在从数字世界走进现实物理世界,具身智能成为行业公认的发展方向,但机器人要真正落地,不能只依靠云端大模型。 一台实体机器人的核心,是“感知-
刚刚,智谱首个 RSI 成果发布,10 万国产卡用 GLM 造 GLM
两周时间,10 万颗国产 AI 加速器,一个开始优化自己的模型。 就在刚刚,智谱 GLM 首席科学家唐杰在 X 平台分享了一项关于 GLM-5.3-Flash 推理系统优化的研究。 他透露,从 GLM-5.3-Flash 首次运行在国产 AI 加速器上,到完成全部生产流量承载,仅用了两周时间。在这个过程中,系统端到端吞吐能力提升了 3.2 倍。 最让唐杰印象深刻的是,完成大量优化工作的并非只有基础
单机跑Kimi K3首破5.85毫秒,同等投资Token产能提升10倍!浪潮信息破局Agent算力难题
2026年,Agent的火爆程度空前。而同期Token消耗量的增长更为惊人:从2026年的0.026Peta(千万亿),增长到2030年的152667Peta。Agent数量增长约28倍,Token消耗却增长数百万倍。需求侧增长如此之快,算力供给能接住吗?今年有两个案例十分典型:一是Kimi K3。这个总参数量2.8万亿的模型,权重文件达到1.56TB,普通AI服务器的GPU显存连权重都装不下,官
戴尔电话会:“缺的就是DRAM、DRAM、DRAM!” ,AI积压订单逼近千亿,全年指引大幅上调
戴尔2027财年第二季度业绩全面爆发,AI服务器订单创下历史新高,强劲的落地需求促使公司大幅上调全年营收指引,并揭示了当前AI供应链面临的极限施压状态。 华尔街见闻提及,9月1日美股盘后,戴尔公布截至7月31日的2027财年第二季度业绩。公司当季营收达到470亿美元,同比增长58%,创历史新高,高于市场预期的448亿美元;按非GA口径计算,每股收益为7.04美元,同比增长203%,远高于市场预期的
富士通2027年起出口AI半导体
富士通将开始出口面向人工智能的半导体。该公司利用超级计算机“富岳”的技术开发了用于计算的逻辑半导体,计划从2027年起在日本国内以及美国、亚洲销售。富士通将扩大在全球的供应规模,以此作为日本先进逻辑半导体重新崛起的起点。 随着AI迅速普及,利用大量信息快速得出正确答案的AI推理需求不断增长。AI推理主要使用作为逻辑半导体的CPU(中央处理器)。日本企业过去也曾参与CPU的开发和生产,但多数已经退出
三星公布下一代存储器战略:HBM5性能目标提升至HBM4E两倍
三星电子计划将下一代高带宽存储器(HBM)HBM5的性能提升至HBM4E的2倍,而后续一代产品zHBM的性能目标则达到HBM4E的8倍。三星将以3D结构创新为核心,争夺下一代存储器市场的主导权。 三星电子DS部门存储器事业部产品企划团队负责人崔长锡1日公布了三星下一代存储器战略。 三星电子目前正在开发HBM5,目标是相比HBM4E将性能提升2倍、每瓦性能提升20%,同时将热阻降低20%,以满足AI
阿里发布新一代AI芯片 性能是上一代的三倍
凤凰网科技讯 9月22日,据第一财经报道,2026云栖大会上,阿里发布新一代AI芯片真武V900,阿里巴巴CEO吴泳铭表示,这是目前真武算力性能最强的AI芯片,性能达到m890的三倍。据悉,平头哥AI芯片的年出货量将大幅提升。 目前,平头哥已对数据中心芯片进行全面布局,包括真武系列GPU、倚天系列CPU、磐脉系列智能网卡,以及ICN互联芯片。组建超大规模AI集群所需的核心芯片已全面覆盖。 此外,阿
AI 想包办你的一切,高通想包办你的 AI
手机里的 AI 已经能写总结、修照片、陪你聊天,可当你想真正把一件事交给它——安排一次出差、跟进一个项目、订下一场聚会——它常常又把问题原样还给你:我好像不明白。 2026 年,AI 正在从「回答问题」走向「执行任务」,而真正的智能体,不会只活在某一台设备里:电脑上开好的头,手机应该接得上;耳机听到的吩咐,手机应该办得成。 设备各有各的聪明,人却还得负责穿针引线——这正是高通想解决的问题。 今年骁