搜索结果
英伟达展示DSX MaxLPS技术,AI工厂每兆瓦token吞吐量最高提升40%
IT之家 9 月 17 日消息,科技媒体 Wccftech 昨日(9 月 16 日)发布博文,报道称在 AI 基础设施峰会上,英伟达展示了面向 AI 工厂的 DSX MaxLPS 功耗调度系统,每兆瓦 token 吞吐量最高提升 40%。 每兆瓦 token 吞吐量是指数据中心每消耗 1 MW 电力时,AI 系统每秒能够生成或处理多少个 token。该指标把功耗纳入计算,因此更适合衡量 AI 数据
马斯克押注超大规模AI算力 xAI计划部署逾120万颗英伟达GPU
埃隆·马斯克旗下人工智能公司xAI正在进一步扩大数据中心规模,并计划在未来几年部署超过120万颗英伟达AI GPU。随着Colossus数据中心持续扩建,xAI希望通过大规模算力基础设施训练和运行下一代Grok模型,与OpenAI等竞争对手展开更加激烈的AI基础设施竞争。 xAI目前最大的AI基础设施项目是位于美国田纳西州孟菲斯的Colossus数据中心。该项目从2024年开始建设,第一阶段Col
马斯克放下豪言:SpaceX数据中心项目GPU数量到年底将翻一倍
马斯克周四表示,SpaceX的人工智能超级计算机Colossus 2项目计划大规模扩张,到今年年底其使用的英伟达芯片数量将较目前翻一倍以上。 马斯克在X上表示,Colossus 2数据中心目前已搭载11万颗Nvidia GB200芯片和44万颗GB300芯片。下周将有22万颗GB300芯片投入使用,预计11月还将有22万颗投入使用。如果运气好的话,12月底可能还会有22万颗芯片上线。 他补充称,英
Nvidia走向绿色环保以防止电网容量流失其收入
英伟达销售图形处理器的能力最终受到电网可以提供多少电力的限制。随着折旧周期的不断增长,数据中心需要数年时间才能退役老化的Hopper或Blackwell系统。更多的图形处理器意味着从电网中汲取更多的电力。英伟达无法完全迫使电网运营商更快地增加容量,但它可以让其客户更容易地建造更智能、更高效的比特谷仓。“在数据中心规模和人工智能工厂规模上,我们实际上正在努力思考如何才能提高每千兆瓦的效率,以提高每千
84GB GDDR7 英伟达RTX PRO 5500 Blackwell专业显卡登场
英伟达官网正式发布RTX PRO 5500 Blackwell专业工作站显卡。RTX PRO 5500采用Blackwell架构,最引人注目的特性是84GB GDDR7显存。该显存支持错误校正码,带宽高达1398 GB/秒,可运行更大AI模型、支持更长上下文窗口,并同时运行多个模型而无需卸载到系统内存。 核心架构层面,RTX PRO 5500基于NVIDIA Blackwell打造,搭载第五代Te
当算力开始按“瓦”计价
SEMICON 一个穿无尘服的人,双手捧着一片晶圆。这大概是半导体行业最经典的自我形象——干净、精密、以晶圆为中心。 但在会场里待满三天之后,大家谈论的东西,已经不太是他手里那片晶圆了。今年被念得最多的词,不是纳米,不是光刻机,是Token。 英伟达首席技术官在大会主旨演讲里给出的比喻,是理解这一变化的入口。他说,类比传统工厂,投入的是电力、资本和数据,产出的是token。一开始,大家用token
传台积电计划到2028年将CoWoS先进封装产能再翻倍
随着全球人工智能与高性能计算芯片需求呈现持续失控式增长,全球晶圆代工龙头台积电正面临空前严峻的交付瓶颈。据半导体供应链与权威行业最新分析报告披露,台积电计划在未来数年内展开新一轮激进扩产,目标是到2028年将其核心的CoWoS先进封装产能提升一倍以上;与此同时,由于现有产能早已被英伟达等巨头提前包圆且供不应求,大量AI芯片先进封装订单正加速向英特尔及台系封测代工企业发生大规模外溢。 在当前大模型基
DLSS5锁定RTX50独占 4090对5080领先优势保不住
英伟达此前在SIGGRH 2026大会上确认,DLSS 5包含的三套AI模型需依赖Blackwell架构特有的硬件调度单元,只有RTX 50系列才支持,RTX 4090则无缘此技术。 而根据海外媒体Tech-Insider的最新实测对比,RTX 4090与RTX 5080的竞争格局已经发生改变,不再是单纯的跑分博弈。 从底层规格来看,RTX 4090虽然拥有16384个CUDA核心和24GB显存,
三星最新愿景:将AI系统的响应速度提升10倍
IT之家 9 月 17 日消息,据韩媒《The Chosun Daily》报道,日,在美国加州圣克拉拉会议中心举行的“AI 基础设施峰会”上,AI 内存的未来成为讨论话题。 半导体企业还在峰会上公布了新产品路线图。三星电子希望借助上个月发布的下一代 AI 内存 zHBM,将 AI 加速器的响应速度提升 10 倍。 三星电子美国公司“现有对话式 AI 系统每秒为每位用户处理 100 个词元(Toke
NVIDIA DLSS 5未来将支持RTX 40系列 但玩家无法获得完整控制权限
在DLSS 5正式上线仅数小时后,英伟达对这项备受争议的新一代AI渲染技术作出了重要调整。公司确认,虽然DLSS 5目前仍将优先面向GeForce RTX 50系列显卡推出,但未来也将正式支持上一代RTX 40系列产品,结束了外界此前对于该技术将永久限定于新硬件平台的猜测。 按照英伟达最初公布的计划,DLSS 5首发仅支持RTX 50系列显卡,并由开发者决定该技术在游戏中的具体呈现方式。然而在正式
玩家自制Mod复活多GPU架构 实现最高127%帧率暴涨
随着英伟达新一代DLSS 5神经渲染技术的问世,PC游戏硬件社区再度展现了令人惊叹的民间技术创造力。一名开发者近日打造出了一款突破性的ReShade插件Mod,成功让沉寂已久的多显卡并行(Multi-GPU)运行模式重回主流玩家视野。 该方案将极度消耗硬件性能的DLSS 5神经后期处理任务完全剥离并转移至第二块独立显卡上运行,不仅大幅解放了主渲染显卡的负担,在部分测试场景下更实现了高达127%的显
英伟达据报重启“Rubin CPX”AI加速器项目 改用168GB HBM4内存
据供应链分析师郭明𫓹透露,英伟达此前一度搁置的“Rubin CPX”AI加速器项目如今重新启动,并对内存架构进行了重新设计。该产品原计划搭载128GB GDDR7显存,如今改为配备168GB HBM4高带宽内存。 英伟达在去年年底曾宣布,计划基于Rubin GPU家族开发一款专用加速器,主要面向大规模智能体人工智能工作负载。项目公布后曾被报道暂时搁置,但英伟达目前似乎已经完成重新规划。Rubin
马斯克:明年底AI能“完成所有数字领域工作”,10年内机器人超越人类生产力总和
特斯拉和SpaceX的首席执行官埃隆·马斯克很少回避对新技术做出大胆预测。他在北卡罗来纳州阿什维尔市举行的G20央行行长与财长峰会上的言论同样如此。 “事实上,我们已经看到,并且还将继续看到人工智能带来显著的生产力提升,而机器人技术将带来生产力的飞跃式增长。” “为了让大家对这个规模有个直观感受,我认为AI可能会使全球经济规模增长20%到30%,这是我粗略的估计,这意味着每年大约能增加20万亿至3
开启AIDC建设新范式,深度拆解华为全球首个3D数据中心
智东西9月22日报道,近日,华为发布全球首个3D数据中心,以工程创新重塑AIDC基础设施架构,以“立体堆叠”取代“平面铺开”,将供冷、供电、备电与IT设备分层解耦,推动AIDC建设从“定制工程”向“产品化交付”转变,为破解AI算力时代“空间、供电、散热”三大瓶颈提供新路径,引领新一代AIDC建设新范式。 ▲华为发布全球首个3D数据中心3D数据中心借鉴芯片工厂“动力层”与“IT层”严格分离的理念,通
中国AI大模型调用量连续十九周领跑 环比增长379%
根据OpenRouter最新数据测算,上周(8月31日至9月6日)全球AI大模型总调用量为115万亿Token,环比增长1.77%。其中,上榜的AI大模型中,中国AI大模型周调用量达56.72万亿Token,环比增长2.83%;同期美国AI大模型周调用量为16.54万亿Token,环比下滑3.1%。中国大模型周调用量连续十九周超过美国,稳居全球首位。 《每日经济新闻》注意到,上周,全球调用量排名前
分析师解读英伟达35亿美元投资联发科:从AI芯片到系统,双方各取所需
英伟达、联发科宣布合作郭明𫓹周二在X上发文称,联发科最新公告宣布深化与英伟达的长期合作,其中反复出现的“机架级”(rack-scale),正是理解这份公告的关键,联发科内部已将AI业务的战略定位,从“IC/ASIC(集成电路和专用集成电路)设计”提升至“系统级设计”。 他指出,这份公告也进一步说明,通过与英伟达合作,把定制化芯片/XPU(各种处理器)导入英伟达已经成熟的机架级生态,让定制化芯片在完
2026 AIDC产业发展大会暨3D数据中心现场会在安徽芜湖举行。
“十万亿参数大模型和高速增长的Token需求对AI基础设施提出更高要求,十万卡以上的升腾超节点集群将成为基础配置。 3D数据中心通过分层解耦、立体堆叠支撑‘升腾超节点集群的超级算力工厂。” 汪涛表示,华为发布的3D数据中心架构可以作为全行业建设超节点集群的参考架构,华为通过开放机房模型、标准化图纸与方案,携手业界伙伴共筑开放的AI基础设施生态,共建智能世界的坚实算力底座。 当天,华为在现场正式发布
台积电历史性扩张:全球在建晶圆工厂接近20座 设备采购预估值翻倍
台积电正在积极扩张其产能,目前在台湾地区同时建设13座晶圆厂,在海外建设5至6座晶圆厂,这一规模前所未有。台积电高级副总裁侯永清周三在2026台湾半导体产业论坛上指出,台积电对芯片制造工具的需求自去年年底以来几乎翻了一番,季度设备采购预估值在7月上调至去年12月预测的约1.9倍,这是他30年来从未见过的增长速度。 他补充称,人工智能正在催生巨大的产能需求,整个台湾地区的半导体生态系统必须在短短六个
英伟达与澳大利亚合作伙伴联手打造AI工厂产能
传下一代Xbox理论性能比PS6高40% 2027年底发售
据AMD爆料人Kepler_L2称,AMD为PS6和Xbox Helix游戏主句设计的芯片组已经完成流片,这意味着发布时间可能在2027年底,而非此前一些传言所说的2028年。Kepler和MLID都对此说法提出异议,他们认为芯片制造合同已经生效,芯片生产据称计划于2027年第二季度开始,推迟生产的成本甚至会超过内存价格上涨带来的损失。完成流片与这一时间表相符。 Kepler_L2还确认了各款主机
智谱GLM-5.3-FlashX模型上线:进一步形成智能、价格、速度的全面竞争力
凤凰网科技讯 9月18日,智谱宣布推出GLM-5.3-FlashX(最高200tokens/s),为企业与开发者带来更快、更流畅的模型体验。 智谱官方表示,GLM-5.3-Flash此前以“Ox Alpha”之名与全球开发者见面,调用量持续攀升。面对快速增长的需求,智谱在10万张国产芯片提供的推理算力基础上,进一步加大对Infra侧的投入与推理优化。GLM-5.3-Flash 长期保持同尺寸最强智
英伟达与八家澳大利亚数据中心合作伙伴签约,到2027年将提供高达2GW的AI算力
英伟达已与八家澳大利亚数据中心和云公司签约,以建设其所谓的AI工厂产能,这家芯片制造商表示,该安排到2027年可支持澳大利亚高达2吉瓦的AI计算。 公告中提到的合作伙伴包括Firmus、Sharon AI、IREN、Megaport、ResetData、CDC、NextDC和AirTrunk。IREN的Bundey园区
高通宣布与亚马逊AWS 建立数据中心基础设施合作伙伴关系
高通股价周二上涨4%,此前该公司宣布与亚马逊网络服务(AWS) 建立数据中心基础设施合作伙伴关系。这家芯片制造商试图在人工智能市场挑战英伟达,此举是一次重大胜利。 作为协议的一部分,高通在提交给美国证券交易委员会的一份文件中表示,已授予亚马逊认股权证,允许其以每股161.26美元的价格购买该公司2500万股股票,总投资额为40亿美元。 根据关于这项技术合作协议的新闻稿,高通正与亚马逊在“多代定制化
Token效能提升120%!这家国产AI存储厂商拿下多项“全球第一”,凭什么?
智东西9月17日报道,9月1日,全球权威AI性能评测组织MLCommons发布MLPerf Storage v3.0基准测试榜单。焱融全闪AI存储F9000X在多项基准测试中拿下第一,充分验证其在极限AI训练负载下对高速网络带宽的高效利用能力。 2026随着AI产业从模型训练走向规模化推理,存储系统需要处理的数据和承担的任务也在增加。训练阶段,存储要持续向GPU供给海量数据,还要快速保存和恢复模型