字号 ·· | 护眼

搜索结果

「DeepSeek开源升腾基础组件:与英伟达平台一一对应」共 52 条 · 第 1 页
凤凰网科技

DeepSeek开源升腾基础组件:与英伟达平台一一对应

凤凰网科技讯 9月30日,DeepSeek宣布正式开源面向华为升腾算力平台的基础设施组件,涵盖TileLang高级语言编译工具、计算库及分布式通信库。所有组件与此前面向英伟达平台的开源组件一一对应。 其中,TileLang升腾版本对升腾Ascend C底层指令进行封装,提供高级语言编程方式,同时不损失硬件性能。DeepSeek称,其训练中用到的每一个TileLang算子,在升腾上都有对应的高性能实

18小时前
华尔街见闻

对标英伟达CUDA!DeepSeek开源升腾版“AI工具箱”,性能接近硬件上限

9月30日,DeepSeek在其官方微信公众号宣布,正式开源面向华为升腾算力平台的基础设施组件,涵盖TileLang高级语言编译工具、计算库及分布式通信库。 DeepSeek在公告中明确表示:“所有组件与此前面向英伟达平台的开源组件一一对应。” 据分析,相关工具被视为可能替代英伟达软件产品的潜在方案。 TileLang:国产版CUDA,编程更简单、性能不打折 此次开源的核心是TileLang——

13小时前
罗塞塔简报

DeepSeek与华为合作,为升腾AI芯片开发开源编程工具

中国人工智能公司DeepSeek于2026年9月30日宣布,与华为技术有限公司合作开发专为华为Ascend处理器设计的编程工具。 通过官方微信公告,DeepSeek透露将把包括计算和通信库在内的编程基础设施开源,用于华为的Ascend平台。 两家公司还共同开发了一个由128个Ascend 950芯片驱动的超节点解决方案。 DeepSeek重点介绍了TileLang这一开源编程语言,它旨在提供比Nv

15小时前
联合早报

DeepSeek据报在内蒙古数据中心部署16万片华为晶片

美国媒体报道,中国人工智能(AI)初创企业深度求索(DeepSeek)将在内蒙古数据中心部署至少16万片华为高端加速晶片。 彭博社星期五(9月4日)引述知情人士透露,深度求索计划使用华为新一代升腾950DT晶片操作旗下模型,但部署时间表将根据华为的产能而定。 其中一名知情者称,尽管华为升腾950DT晶片是为训练模型而研发,但深度求索目前暂未有这方面的用途。深度求索过往也用华为AI晶片训练之前的模型

09/05
凤凰网科技

Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑

快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS

09/24
联合早报

美媒:DeepSeek押注华为晶片训练大模型

中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向。图为DeepSeek位于北京的办公室。(路透社档案照片) 美国媒体报道,中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向,以降低对英伟达的依赖,应对美国先进晶片出口管制带来的限制。路透社转引美国科技媒体The Information星期一(9月2

09/22
亚洲新闻台

DeepSeek与华为合作开发芯片编程工具,以减少对英伟达的依赖

北京/香港,9月30日:中国人工智能公司DeepSeek周三表示,已与华为技术有限公司合作,为华为升腾芯片开发优化编程工具。这是中国科技公司在寻求英伟达生态系统替代方案的过程中,加深合作的最新迹象。 DeepSeek在其官方微信公众号发文称,将开源华为升腾平台的编程基础设施,包括计算和通信库。 此前两周,华为发布了新一代人工智能处理器和超级节点计算系统,并表示预计其人工智能系统明年将广泛用于模型训

17小时前
凤凰网科技

DeepSeek V4.1 Pro或为2万亿参数:未来还有8万亿版、押注国产芯片

快科技9月21日消息,此前我们分析了中秋国庆双节前后国内外要发的10多款大模型,其中最受期待的还得是DeepSeek V4.1 Pro。 跑得比较快的Theinformation网站又爆料了新的消息,DeepSeek正在训练2万亿参数量的大模型,未来还会扩展到8万亿参数量。 而且DeepSeek的大模型训练未来会押注国产AI芯片,尤其是华为的升腾系列,不过具体情况就没有细节流出了。 未来的8万亿参

09/21
LoopDNS 资讯播报

↩️ 据科技媒体 The Information 报道,DeepSeek 创始人梁文锋向投资者表示,采用华为芯片进行训练是 DeepSeek 最核心的战略赌注之一,预计华为最早将于 2026 ...

LoopDNS资讯播报: 中国国产AI芯片迈入大模型训练与海外输出阶段 国产AI芯片正打破“只能推理、无法训练”的认知:美团万亿参数模型“LongCat-2.0”已成功在5万颗国产芯片集群上完成预训练,表明国产硬件已具备大规模训练能力;同时,华为正向中东及中亚客户销售搭载DeepSeek-V4模型的升腾950DT系统。美国旨在限制中国AI芯片能力的出口管制,反而促使部分同样面临英伟达供应限制的国家

09/22 全文见 凤凰网科技
cnbeta

DeepSeek 开口说话了:灰度测试上线,支持四种音色

同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De

09/12
cnbeta

DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持

9月8日,DeepSeek今日在官方交流群内发布通知,DeepSeek V4.1 Flash的中间版本内测。据介绍,模型采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。模型的base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费与deepseek-v4-flash相同,每账号限流20并发。 据了解,DeepS

09/08
彭博社

DeepSeek发布华为AI芯片编程工具,或可替代英伟达产品

Luz Ding报道,DeepSeek已公开发布与华为技术有限公司合作开发的AI芯片编程软件,展现了双方密切的合作关系。华为正致力于开发可替代英伟达公司的技术。 这家初创公司周三在微信公众号上表示,正将其面向华为升腾加速器的软件工具包开源,并免费供人下载。这些工具包括TileLang——中国对标英伟达CUDA的软件平台,而CUDA被认为是全球AI开发的标准。 此举反映出中国两家领先AI企业之间日益

15小时前
cnbeta

英伟达显卡底层细节揭秘:包含数十个RISC-V核心 甚至已接管图形驱动执行

在现代个人电脑中,显卡通常被视为由数千个流处理器组成、专用于高并行度图形渲染与人工智能计算的庞大算力引擎。然而,根据硬件开发社区及底层技术人员的最新深度分析,现代英伟达(NVIDIA)GPU 内部实际上隐匿着数十个基于开放指令集架构的 RISC-V 处理器核心。 这些低功耗核心在显卡芯片内部扮演着极其关键的“微型中央处理器”角色,甚至已经全面接管了原本需要主系统 CPU 执行的显卡驱动管理与硬件调

09/21
凤凰网科技

阶跃发布旗舰模型Step 5 Preview:跻身全球权威榜单开源前三

凤凰网科技讯 9月20日,阶跃StepFun正式发布新一代旗舰基座模型Step 5 Preview,面向真实世界Agentic任务设计。该模型采用稀疏MoE架构,总参数量600B、激活参数仅27B,支持100万Token上下文窗口,原生支持文本与视觉输入。即日起全量开放I,模型权重将于10月15日开源释放。 在全球权威的Artificial Analysis Intelligence Index中

09/20
凤凰网科技

刚刚,DeepSeek Harness桌面端上线,梁文锋开送Token了

智东西9月29日报道,今日,DeepSeek正式推出DeepSeek Harness v0.2预览版,并提供开箱即用的macOS和Windows桌面端安装包。 ▲DeepSeek Harness v0.2预览版界面用户前往DeepSeek Harness官网下载安装后,按照引导即可直接使用,无需再自行配置开发环境。 这是DeepSeek Harness自8月13日晚推出开发者预览版v0.1并同步开

09/29
theregister

DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板

中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe

09/11
凤凰网科技

GPT-6新模型掀桌 “白菜价”杀进DeepSeek腹地

DeepSeek 快醒醒,ChatGPT 要打到家门口了。就在刚刚,OpenAI 正式发布 GPT-6 Sol 和 GPT-6 Luna,API 价格降至上一代的一半左右。其中,Luna 每百万 Token 输入 0.1 美元、输出 0.5 美元,约合人民币 0.7 元和 3.5 元。 作为对照,DeepSeek V4.1 Flash 闲时的缓存未命中输入价为每百万 Token 1 元,输出价为

09/23
cnbeta

NVIDIA或为RTX 5070引入全新核心版本 GB203芯片有望下放至主流市场

英伟达正在为GeForce RTX 5070准备一个新的硬件版本。与目前采用GB205核心的标准型号不同,新版本可能改用面积更大、定位更高的GB203图形核心。这意味着RTX 5070未来可能出现两种不同GPU版本并行销售的情况。 实际上,英伟达在本世代Blackwell显卡上已经开始采用类似做法。此前部分厂商推出的新批次RTX 5060产品,就从原本的GB206核心改为使用规格更高的GB205核

09/08
cnbeta

英伟达投资联发科35亿美元 双方携手推进NVLink Fusion合作

英伟达于当地时间8月31日宣布,将向联发科投资35亿美元,并进一步深化双方在芯片领域的合作。英伟达与联发科此前已经展开合作,联发科曾设计GB10系统级芯片,为英伟达RTX Spark消费级产品和DGX Spark迷你工作站提供动力。 双方确认,未来将围绕英伟达NVLink Fusion生态系统推进合作。NVLink Fusion是一套结合知识产权与芯粒技术的框架,旨在让非英伟达处理器和加速器成为英

08/31
日经

DeepSeek涨价不足1月又宣布最高降价6成

| 围绕AI模型使用费,价格竞争越来越激烈 |中国AI初创企业DeepSeek于9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费,最高降幅达60%。该公司在8月中旬才刚刚上调过价格。此次降价意在通过价格战对抗竞争对手。 V4系列包含主打响应速度的“V4-Flash”以及擅长更复杂任务处理的“V4-Pro”等版本。本次的降价对象为V4-Flash。输入、输出每100万token的单价下调

09/10
cnbeta

Valve推进SteamOS的NVIDIA显卡支持 部分GPU已能点亮

Valve正在加速为SteamOS加入英伟达GeForce显卡支持,目前相关工作已经取得实质性进展。Valve软件开发人员Pierre-Loup Griffais透露,英伟达驱动已经被加入SteamOS的主开发分支,部分代际的GeForce GPU已经能够在系统中完成初始化并输出画面。不过,要达到真正适合游戏的完整支持水平仍需要大量工作,整个过程甚至可能还要持续数年。 Griffais表示,Val

09/17
cnbeta

DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8

在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn

09/01
𝕏 @fxtrader

DeepSeek下调flash系列模型定价,降幅11%-60%

DeepSeek开放平台今日公告,00起,空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。 00(其余为空闲时段)。据悉,缓存命中、缓存未命中及输出价格最高降幅分别为60%、33.33%和11.11%。

09/09
凤凰网科技

英伟达展示DSX MaxLPS技术,AI工厂每兆瓦token吞吐量最高提升40%

IT之家 9 月 17 日消息,科技媒体 Wccftech 昨日(9 月 16 日)发布博文,报道称在 AI 基础设施峰会上,英伟达展示了面向 AI 工厂的 DSX MaxLPS 功耗调度系统,每兆瓦 token 吞吐量最高提升 40%。 每兆瓦 token 吞吐量是指数据中心每消耗 1 MW 电力时,AI 系统每秒能够生成或处理多少个 token。该指标把功耗纳入计算,因此更适合衡量 AI 数据

09/17
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…