1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「英伟达据报重启“Rubin CPX”AI加速器项目 改用168GB HBM4内存」共 35 条 · 第 1 页
cnbeta

英伟达据报重启“Rubin CPX”AI加速器项目 改用168GB HBM4内存

据供应链分析师郭明𫓹透露,英伟达此前一度搁置的“Rubin CPX”AI加速器项目如今重新启动,并对内存架构进行了重新设计。该产品原计划搭载128GB GDDR7显存,如今改为配备168GB HBM4高带宽内存。 英伟达在去年年底曾宣布,计划基于Rubin GPU家族开发一款专用加速器,主要面向大规模智能体人工智能工作负载。项目公布后曾被报道暂时搁置,但英伟达目前似乎已经完成重新规划。Rubin

09/01
凤凰网科技

马斯克放下豪言:SpaceX数据中心项目GPU数量到年底将翻一倍

马斯克周四表示,SpaceX的人工智能超级计算机Colossus 2项目计划大规模扩张,到今年年底其使用的英伟达芯片数量将较目前翻一倍以上。 马斯克在X上表示,Colossus 2数据中心目前已搭载11万颗Nvidia GB200芯片和44万颗GB300芯片。下周将有22万颗GB300芯片投入使用,预计11月还将有22万颗投入使用。如果运气好的话,12月底可能还会有22万颗芯片上线。 他补充称,英

20小时前
凤凰网科技

英伟达展示DSX MaxLPS技术,AI工厂每兆瓦token吞吐量最高提升40%

IT之家 9 月 17 日消息,科技媒体 Wccftech 昨日(9 月 16 日)发布博文,报道称在 AI 基础设施峰会上,英伟达展示了面向 AI 工厂的 DSX MaxLPS 功耗调度系统,每兆瓦 token 吞吐量最高提升 40%。 每兆瓦 token 吞吐量是指数据中心每消耗 1 MW 电力时,AI 系统每秒能够生成或处理多少个 token。该指标把功耗纳入计算,因此更适合衡量 AI 数据

09/17
cnbeta

英伟达投资联发科35亿美元 双方携手推进NVLink Fusion合作

英伟达于当地时间8月31日宣布,将向联发科投资35亿美元,并进一步深化双方在芯片领域的合作。英伟达与联发科此前已经展开合作,联发科曾设计GB10系统级芯片,为英伟达RTX Spark消费级产品和DGX Spark迷你工作站提供动力。 双方确认,未来将围绕英伟达NVLink Fusion生态系统推进合作。NVLink Fusion是一套结合知识产权与芯粒技术的框架,旨在让非英伟达处理器和加速器成为英

08/31
cnbeta

三星开发8层HBM4E产品 瞄准英伟达NVHBM供应

三星电子正在开发一款符合英伟达要求的8层HBM4E产品,力求在其定制化高带宽内存NVHBM的供应中争取关键角色。该产品将堆叠高度从最初规划的12层和16层版本降低,而英伟达的目标速度规格为17-18Gbps,比三星最初HBM4E样品14.4Gbps的速度高出约20%。 据ChainCatcher报道,8层设计专为英伟达公开的NVLink优化型NVHBM而打造,此举被视为一种降低制造难度和良率压力的

08/31
凤凰网科技

三星最新愿景:将AI系统的响应速度提升10倍

IT之家 9 月 17 日消息,据韩媒《The Chosun Daily》报道,日,在美国加州圣克拉拉会议中心举行的“AI 基础设施峰会”上,AI 内存的未来成为讨论话题。 半导体企业还在峰会上公布了新产品路线图。三星电子希望借助上个月发布的下一代 AI 内存 zHBM,将 AI 加速器的响应速度提升 10 倍。 三星电子美国公司“现有对话式 AI 系统每秒为每位用户处理 100 个词元(Toke

09/17
华尔街见闻

为了把更多HBM塞进芯片,英伟达加速布局下一代玻璃基板

英伟达正联合产业链企业推进新一代玻璃基板技术落地,以应对AI芯片封装在尺寸、散热和互连方面日益突出的物理限制。若技术实现突破,玻璃基板有望支持更大规模的HBM集成,为下一代GPU提升封装密度和数据传输能力。 据报道,德国设备厂商SCHMID在近期上半年业绩发布会上披露,公司正与英特尔、英伟达、AMD各自供应链中的核心企业合作,共同推进玻璃芯核基板设备研发。SCHMID首席战略官Roland Ret

09/25
cnbeta

马斯克押注超大规模AI算力 xAI计划部署逾120万颗英伟达GPU

埃隆·马斯克旗下人工智能公司xAI正在进一步扩大数据中心规模,并计划在未来几年部署超过120万颗英伟达AI GPU。随着Colossus数据中心持续扩建,xAI希望通过大规模算力基础设施训练和运行下一代Grok模型,与OpenAI等竞争对手展开更加激烈的AI基础设施竞争。 xAI目前最大的AI基础设施项目是位于美国田纳西州孟菲斯的Colossus数据中心。该项目从2024年开始建设,第一阶段Col

09/25
cnbeta

SpaceX重整AI数据中心建设:补强供电和冷却冗余 扩张速度或放缓

SpaceX正在调整旗下AI数据中心的建设方式,将供电、冷却系统的可靠性和投运前测试置于更优先位置。新方案可能延长数据中心的建设周期,反映公司在xAI并入后开始修正此前以速度和算力为核心的扩张模式。 从快速投运转向可靠性建设SpaceX计划在数据中心启用前完成更多备用供电和冷却系统,并进行更全面的测试,同时减少临时电源及制冷设备的使用。部分既有设施也可能重新设计。 这一调整与xAI建设孟菲斯Col

09/10
cnbeta

英伟达和AMD下一代游戏显卡或推迟至2028年 AI需求严重挤压消费级市场

英伟达和AMD下一代游戏显卡的发布时间可能再次推迟。最新爆料称,英伟达基于Rubin架构的GeForce RTX 60系列,以及AMD基于RDNA 5架构的大部分新一代Radeon游戏显卡,都可能推迟到2028年上市。背后的主要原因并非单纯的研发进度问题,而是持续旺盛的AI需求正在不断吞噬芯片、封装以及显存等关键资源,而数据中心产品能够为两家公司带来远高于消费级游戏显卡的利润。 这一消息来自长期关

09/17
大纪元

美管制致HBM短缺 传中国AI芯片厂大幅涨价

在美国收紧高带宽内存(HBM)对华出口管制、全球供应短缺持续紧张之际,中国人工智能(AI)芯片厂开始大幅调价。

09/11
cnbeta

英伟达公布RTX Spark“N1X”芯片规格 20核与18核双版本

在柏林国际电子消费品展览会(IFA)上,英伟达正式公布了面向消费级RTX Spark PC平台的首款高整合SoC——“N1X”的详细规格与上市计划。作为英伟达进军完整个人电脑计算平台的核心产品,N1X将基于Arm架构的Grace CPU与最新的Blackwell RTX GPU架构融为一体,并计划于今年10月通过各大OEM合作伙伴正式上市。 英伟达确认,N1X芯片首发将提供两种不同规格的SKU配置

09/04
thenextweb

英伟达与八家澳大利亚数据中心合作伙伴签约,到2027年将提供高达2GW的AI算力

英伟达已与八家澳大利亚数据中心和云公司签约,以建设其所谓的AI工厂产能,这家芯片制造商表示,该安排到2027年可支持澳大利亚高达2吉瓦的AI计算。 公告中提到的合作伙伴包括Firmus、Sharon AI、IREN、Megaport、ResetData、CDC、NextDC和AirTrunk。IREN的Bundey园区

09/10
cnbeta

84GB GDDR7 英伟达RTX PRO 5500 Blackwell专业显卡登场

英伟达官网正式发布RTX PRO 5500 Blackwell专业工作站显卡。RTX PRO 5500采用Blackwell架构,最引人注目的特性是84GB GDDR7显存。该显存支持错误校正码,带宽高达1398 GB/秒,可运行更大AI模型、支持更长上下文窗口,并同时运行多个模型而无需卸载到系统内存。 核心架构层面,RTX PRO 5500基于NVIDIA Blackwell打造,搭载第五代Te

09/14
cnbeta

高带宽内存短缺冲击供应链 中国本土AI芯片厂商集体大幅上调加速卡售价

据报道,随着全球高带宽内存(HBM)供应短缺持续加剧并抬高生产成本,包括华为和寒武纪在内的中国领先人工智能芯片制造商正大幅上调现有及下一代AI处理器的报价。这一成本压力不仅直接冲击了中国本土科技企业构建英伟达替代方案的努力,也使得中国算力基础设施扩容面临更高的资金门槛。 知情人士透露,华为技术有限公司已将其升腾950DT(Ascend 950DT)算力加速卡的指导报价上调至超过25万元人民币(约合

09/10
连线

一家保密初创公司认为它刚刚破解了内存短缺难题

一家雄心勃勃的芯片初创公司花费了七年多的时间默默重新设计计算机内存架构,该公司刚刚结束隐身模式,并相信其新方法有助于缓解全球内存芯片短缺问题——前提是能够实现规模化生产。 Kepler Computing 是一家总部位于加利福尼亚州圣何塞的初创公司,由一群物理学家和计算机科学家于 2018 年创立。该公司表示,它已经为高带宽内存(HBM)开发了一种新架构,直接解决了一些正在制约计算市场的芯片供应链

09/09
cnbeta

创见推出64GB DDR5-6400 CUDIMM与CSODIMM内存模块

创见近日推出新一代64GB DDR5-6400 CUDIMM和CSODIMM嵌入式内存模块,在保持DDR5高频传输能力的同时,将单条模块容量进一步提升至64GB,为工业计算、边缘计算以及其他对大容量内存有较高需求的嵌入式设备提供新的选择。 此次推出的产品采用DDR5-6400规格,工作电压为1.1V,并同时提供CUDIMM和CSODIMM两种形态。其中,CUDIMM主要面向采用标准台式机内存插槽的

09/15
cnbeta

美光计划将HBM产能扩大一倍 到今年年末将月产约10万片

美光计划将高带宽内存(HBM)产能较去年扩大一倍。公司将在年底前推进激进的设备投资,强化新一代HBM——HBM4 12层产品的供货能力。此举意在补齐相较于三星电子、SK海力士的HBM产能短板,提升市场份额。 据3日业内消息,美光计划至今年年底,HBM产能(以晶圆为统计口径)最多每月新增6万片。美光去年HBM月产量维持在4‑5万片的水平,今年的净增量将超过去年的原有产能。 “美光正在开展大规模设备投

09/03
theregister

华为的下一代 Ascend NPU 可能会成为中国在该领域最好的选择。

在年度 Connect 大会上,华为发布了新一代人工智能加速器,其性能表现有望远超英伟达目前在中国市场所能提供的任何产品。对于习惯了从这家全球最热门的 AI 军火商那里购买“缩水版”产品的中国开发者来说,这无疑是一个利好消息。不仅如此,这款代号为“升腾 960DT”(其中 DT 显然代表解码/训练)的芯片预计将提前三个季度问世,于 2027 年第一季度正式发布。该加速器配备了高达 288 GB 的

09/18
cnbeta

NVIDIA或为RTX 5070引入全新核心版本 GB203芯片有望下放至主流市场

英伟达正在为GeForce RTX 5070准备一个新的硬件版本。与目前采用GB205核心的标准型号不同,新版本可能改用面积更大、定位更高的GB203图形核心。这意味着RTX 5070未来可能出现两种不同GPU版本并行销售的情况。 实际上,英伟达在本世代Blackwell显卡上已经开始采用类似做法。此前部分厂商推出的新批次RTX 5060产品,就从原本的GB206核心改为使用规格更高的GB205核

09/08
罗塞塔简报

2026年AI推理硬件革命:从训练转向部署

从训练转向部署2026年AI推理硬件革命:从训练转向部署到部署2026年,人工智能行业已从专注于模型训练转向人工智能推理,这得益于推理模型和代理式人工智能的兴起。 这一转变暴露了传统GPU的内存带宽瓶颈,催生了新的硬件策略。 英伟达和亚马逊等行业领导者正在采取“系统方法”,将用于预填充阶段的计算密集型芯片(例如英伟达的Vera Rubin GPU、亚马逊的Trainium)与用于解码阶段的以内存为

09/16
cnbeta

AMD发布EPYC Venice性能白皮书 宣称较英伟达Vera最高快2.24倍

AMD近日发布了一份围绕第六代EPYC 9006“Venice”服务器处理器的最新技术白皮书,重点展示了其在数据中心、云计算、高性能计算以及代理式人工智能(Agentic AI)场景下的性能表现。 白皮书中的多项测试结果直接将矛头对准英伟达最新的Vera服务器CPU平台,同时也将英特尔Xeon 6980P纳入比较对象。不过,由于所有数据均来自AMD自身或引用竞争对手公开资料,因此相关结论仍需等待第

09/20
风向旗参考快讯

英伟达明年芯片销量将是今年的两倍

9月17日,英伟达CEO黄仁勋在英国的一场人工智能活动中表示,。 近期一些业界人士主张放缓AI开发进度,以便让安全措施跟上步伐。 黄仁勋表示,AI安全至关重要,企业应继续快速推进,如果认为某些产品存在安全隐患,就暂缓推出这些产品。截至记者发稿,英伟达股价涨超2%。第一财经

09/17 全文见 cnbeta
cnbeta

分析师解读英伟达35亿美元投资联发科:从AI芯片到系统,双方各取所需

英伟达、联发科宣布合作郭明𫓹周二在X上发文称,联发科最新公告宣布深化与英伟达的长期合作,其中反复出现的“机架级”(rack-scale),正是理解这份公告的关键,联发科内部已将AI业务的战略定位,从“IC/ASIC(集成电路和专用集成电路)设计”提升至“系统级设计”。 他指出,这份公告也进一步说明,通过与英伟达合作,把定制化芯片/XPU(各种处理器)导入英伟达已经成熟的机架级生态,让定制化芯片在完

09/01
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…