搜索结果
DeepSeek与华为合作,为升腾AI芯片开发开源编程工具
中国人工智能公司DeepSeek于2026年9月30日宣布,与华为技术有限公司合作开发专为华为Ascend处理器设计的编程工具。 通过官方微信公告,DeepSeek透露将把包括计算和通信库在内的编程基础设施开源,用于华为的Ascend平台。 两家公司还共同开发了一个由128个Ascend 950芯片驱动的超节点解决方案。 DeepSeek重点介绍了TileLang这一开源编程语言,它旨在提供比Nv
DeepSeek与华为合作开发芯片编程工具,以减少对英伟达的依赖
北京/香港,9月30日:中国人工智能公司DeepSeek周三表示,已与华为技术有限公司合作,为华为升腾芯片开发优化编程工具。这是中国科技公司在寻求英伟达生态系统替代方案的过程中,加深合作的最新迹象。 DeepSeek在其官方微信公众号发文称,将开源华为升腾平台的编程基础设施,包括计算和通信库。 此前两周,华为发布了新一代人工智能处理器和超级节点计算系统,并表示预计其人工智能系统明年将广泛用于模型训
DeepSeek发布华为AI芯片编程工具,或可替代英伟达产品
Luz Ding报道,DeepSeek已公开发布与华为技术有限公司合作开发的AI芯片编程软件,展现了双方密切的合作关系。华为正致力于开发可替代英伟达公司的技术。 这家初创公司周三在微信公众号上表示,正将其面向华为升腾加速器的软件工具包开源,并免费供人下载。这些工具包括TileLang——中国对标英伟达CUDA的软件平台,而CUDA被认为是全球AI开发的标准。 此举反映出中国两家领先AI企业之间日益
DeepSeek开源升腾基础组件:与英伟达平台一一对应
凤凰网科技讯 9月30日,DeepSeek宣布正式开源面向华为升腾算力平台的基础设施组件,涵盖TileLang高级语言编译工具、计算库及分布式通信库。所有组件与此前面向英伟达平台的开源组件一一对应。 其中,TileLang升腾版本对升腾Ascend C底层指令进行封装,提供高级语言编程方式,同时不损失硬件性能。DeepSeek称,其训练中用到的每一个TileLang算子,在升腾上都有对应的高性能实
美媒:DeepSeek押注华为晶片训练大模型
中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向。图为DeepSeek位于北京的办公室。(路透社档案照片) 美国媒体报道,中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向,以降低对英伟达的依赖,应对美国先进晶片出口管制带来的限制。路透社转引美国科技媒体The Information星期一(9月2
↩️ 据科技媒体 The Information 报道,DeepSeek 创始人梁文锋向投资者表示,采用华为芯片进行训练是 DeepSeek 最核心的战略赌注之一,预计华为最早将于 2026 ...
LoopDNS资讯播报: 中国国产AI芯片迈入大模型训练与海外输出阶段 国产AI芯片正打破“只能推理、无法训练”的认知:美团万亿参数模型“LongCat-2.0”已成功在5万颗国产芯片集群上完成预训练,表明国产硬件已具备大规模训练能力;同时,华为正向中东及中亚客户销售搭载DeepSeek-V4模型的升腾950DT系统。美国旨在限制中国AI芯片能力的出口管制,反而促使部分同样面临英伟达供应限制的国家
DeepSeek据报在内蒙古数据中心部署16万片华为晶片
美国媒体报道,中国人工智能(AI)初创企业深度求索(DeepSeek)将在内蒙古数据中心部署至少16万片华为高端加速晶片。 彭博社星期五(9月4日)引述知情人士透露,深度求索计划使用华为新一代升腾950DT晶片操作旗下模型,但部署时间表将根据华为的产能而定。 其中一名知情者称,尽管华为升腾950DT晶片是为训练模型而研发,但深度求索目前暂未有这方面的用途。深度求索过往也用华为AI晶片训练之前的模型
DeepSeek的烦恼:任务越来越多,人不够用了
以“小团队、高人才密度”著称的DeepSeek,开始大规模补充工程人员。9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。他称,这是“前所未有的150个HC的招聘需求”,公司目前有“很多新方向、新系统、新需求需要搞”。 崔添翼贴文截图两天后,DeepSeek又宣布下调Flash系列I价格,缓存命中输入价格最高下降60%。相比价格变化,此次招聘
Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑
快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS
独家:消息人士称DeepSeek本周将向联合国安理会通报人工智能情况
DeepSeek以及包括Moonshot在内的其他中国人工智能公司已受邀发表声明。
DeepSeek被以色列用于操控上千虚假社交账号
人工智能正在把网络舆论操纵从“AI帮助人生成内容”,推进到“AI自己运营整套虚假账号网络”。 《纽约时报》9月18日报道,美国情报官员、科技公司和网络安全研究人员近期发现,伊朗和中国支持的行动,以及两家以色列私人公司的项目,已经开始利用中国开源人工智能模型建立自主AI智能体,在Facebook、Instagram、X和TikTok等平台自动创建和经营虚假账号。 其中,一项来自以色列的行动,已经明
DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板
中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe
DeepSeek招150人,全部押注工程岗
DeepSeek的人才扩张还在继续,但枪口已经调转方向。9月8日,DeepSeek启动新一轮招聘,计划招募约150名工程师,岗位全部集中于服务端开发工程师与Agent弹性计算研发工程师两个方向,重点面向2至10年经验的资深后端工程师,未设AI研究类岗位。 这是DeepSeek在两个多月内的第二次大规模招贤。6月25日,DeepSeek曾在官方公众号宣布“随着技术演进,正努力将所有部门的规模扩大至少
DeepSeek涨价不足1月又宣布最高降价6成
| 围绕AI模型使用费,价格竞争越来越激烈 |中国AI初创企业DeepSeek于9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费,最高降幅达60%。该公司在8月中旬才刚刚上调过价格。此次降价意在通过价格战对抗竞争对手。 V4系列包含主打响应速度的“V4-Flash”以及擅长更复杂任务处理的“V4-Pro”等版本。本次的降价对象为V4-Flash。输入、输出每100万token的单价下调
DeepSeek披露智能体训练平台 提升效率并降低失控风险
中国人工智能公司深度求索(DeepSeek)最近发表一篇新论文,披露了一套面向大规模人工智能(AI)智能体训练的新型基础设施。图为DeepSeek位于北京的办公室。(路透社档案照片) 中国人工智能公司深度求索(DeepSeek)披露一套面向大规模人工智能(AI)智能体训练的新型基础设施,可提高训练资源利用效率,并通过加强监测和访问控制,应对智能体“作弊”、破坏执行环境等失控行为。综合路透社和澎湃新
刚刚,DeepSeek Harness桌面端上线,梁文锋开送Token了
智东西9月29日报道,今日,DeepSeek正式推出DeepSeek Harness v0.2预览版,并提供开箱即用的macOS和Windows桌面端安装包。 ▲DeepSeek Harness v0.2预览版界面用户前往DeepSeek Harness官网下载安装后,按照引导即可直接使用,无需再自行配置开发环境。 这是DeepSeek Harness自8月13日晚推出开发者预览版v0.1并同步开
↩️ 9月21日,原高瓴创投合伙人严文韬正式入职DeepSeek,至此该公司成立三年来CFO长期空缺的局面宣告结束,这也是这家AI公司迄今为止最重要的一次非技术高管引...
LoopDNS资讯播报: 路透:据两位知情人士透露,中国人工智能初创公司深度求索(DeepSeek)已选定中信证券为其在上海科创板进行首次公开募股(IPO)做准备。 9月21日,原高瓴创投合伙人严文韬正式入职DeepSeek,至此该公司成立三年来CFO长期空缺的局面宣告结束,这也是这家AI公司迄今为止最重要的一次非技术高管引进。严文韬将带领DeepSeek冲刺首次公开募股,此前该公司已选定中信证券
DeepSeek V4.1 Pro或为2万亿参数:未来还有8万亿版、押注国产芯片
快科技9月21日消息,此前我们分析了中秋国庆双节前后国内外要发的10多款大模型,其中最受期待的还得是DeepSeek V4.1 Pro。 跑得比较快的Theinformation网站又爆料了新的消息,DeepSeek正在训练2万亿参数量的大模型,未来还会扩展到8万亿参数量。 而且DeepSeek的大模型训练未来会押注国产AI芯片,尤其是华为的升腾系列,不过具体情况就没有细节流出了。 未来的8万亿参
中国DeepSeek发布V4.1-Flash模型
据一份声明,中国人工智能初创公司DeepSeek周四推出了DeepSeek-V4.1-Flash,该公司称这是其新架构系列中规模最小的模型。
DeepSeek Harness v0.2预览版发布:上线桌面端安装包,新增插件管理
凤凰网科技讯 9月29日,DeepSeek Harness v0.2预览版正式发布,并提供开箱即用的macOS和Windows桌面端安装包,已上线DeepSeek官网。新版本预置了面向日常办公和开发的常用功能,并新增插件安装与管理页面,提供更多灵活配置选项。 本次更新优化了文件展示、内容预览和代码变更展示体验,完善了自动化任务的设置与管理,并提供多种工作过程展示方式。用户可提供文档、表格或PDF文
DeepSeek测试高效、更安全的AI代理训练方法
原文内容:根据彼得·埃尔斯特罗姆(Peter Elstrom)的报道,中国的 DeepSeek 公司提出了一种创新的人工智能训练方法,该方法有望让人工智能代理更高效地学习,同时最大限度地减少那些引发全球关注的不良行为。 这家总部位于杭州的公司在一篇长达 1 万字的论文中详细介绍了其“DeepSeek Elastic Compute”(简称 DSec)技术。该论文共有约 130 位合著者,其中包括公
DeepSeek 开口说话了:灰度测试上线,支持四种音色
同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De
8万亿,梁文锋也开始卷“超大”
DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。
DeepSeek据报聘中信证券筹备科创板上市
中国人工智能(AI)初创企业深度求索(DeepSeek)据报已聘请中信证券,为在上海科创板首次公开募股(IPO)做准备。 星期三(9月9日)引述知情人士报道,这家总部位于杭州的公司计划今年启动IPO程序。拟在中国上市的企业,通常会在正式提交申请前聘请证券公司进行上市辅导。 但知情人士说,DeepSeek上市的具体时间、募资规模和目标估值目前均未确定。 在中美头部AI企业竞争日趋激烈之际,DeepS