1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「DeepSeek据报在内蒙古数据中心部署16万片华为晶片」共 37 条 · 第 1 页
联合早报

DeepSeek据报在内蒙古数据中心部署16万片华为晶片

美国媒体报道,中国人工智能(AI)初创企业深度求索(DeepSeek)将在内蒙古数据中心部署至少16万片华为高端加速晶片。 彭博社星期五(9月4日)引述知情人士透露,深度求索计划使用华为新一代升腾950DT晶片操作旗下模型,但部署时间表将根据华为的产能而定。 其中一名知情者称,尽管华为升腾950DT晶片是为训练模型而研发,但深度求索目前暂未有这方面的用途。深度求索过往也用华为AI晶片训练之前的模型

09/05
联合早报

美媒:DeepSeek押注华为晶片训练大模型

中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向。图为DeepSeek位于北京的办公室。(路透社档案照片) 美国媒体报道,中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向,以降低对英伟达的依赖,应对美国先进晶片出口管制带来的限制。路透社转引美国科技媒体The Information星期一(9月2

09/22
LoopDNS 资讯播报

↩️ 据科技媒体 The Information 报道,DeepSeek 创始人梁文锋向投资者表示,采用华为芯片进行训练是 DeepSeek 最核心的战略赌注之一,预计华为最早将于 2026 ...

LoopDNS资讯播报: 中国国产AI芯片迈入大模型训练与海外输出阶段 国产AI芯片正打破“只能推理、无法训练”的认知:美团万亿参数模型“LongCat-2.0”已成功在5万颗国产芯片集群上完成预训练,表明国产硬件已具备大规模训练能力;同时,华为正向中东及中亚客户销售搭载DeepSeek-V4模型的升腾950DT系统。美国旨在限制中国AI芯片能力的出口管制,反而促使部分同样面临英伟达供应限制的国家

09/22 全文见 凤凰网科技
加美财经

DeepSeek被以色列用于操控上千虚假社交账号

人工智能正在把网络舆论操纵从“AI帮助人生成内容”,推进到“AI自己运营整套虚假账号网络”。 《纽约时报》9月18日报道,美国情报官员、科技公司和网络安全研究人员近期发现,伊朗和中国支持的行动,以及两家以色列私人公司的项目,已经开始利用中国开源人工智能模型建立自主AI智能体,在Facebook、Instagram、X和TikTok等平台自动创建和经营虚假账号。 其中,一项来自以色列的行动,已经明

09/18
凤凰网科技

DeepSeek V4.1 Pro或为2万亿参数:未来还有8万亿版、押注国产芯片

快科技9月21日消息,此前我们分析了中秋国庆双节前后国内外要发的10多款大模型,其中最受期待的还得是DeepSeek V4.1 Pro。 跑得比较快的Theinformation网站又爆料了新的消息,DeepSeek正在训练2万亿参数量的大模型,未来还会扩展到8万亿参数量。 而且DeepSeek的大模型训练未来会押注国产AI芯片,尤其是华为的升腾系列,不过具体情况就没有细节流出了。 未来的8万亿参

09/21
凤凰网科技

8万亿,梁文锋也开始卷“超大”

DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。

09/22
财新

T早报|DeepSeek扩招150人;Meta发布个人AI智能体Muse;华为“韬定律”芯片麒麟9050 Pro首现身

DeepSeek扩招150人 为史上单次最大规模招聘9月8日,DeepSeek发布招聘信息,招聘人数达到150人。招聘包含两大方向,一类是服务端开发工程师,覆盖大模型研究平台、Agent框架组件、研发效率基建、DeepSeek I、线上服务、数据工程六大方向;另一类则是Agent弹性计算研发工程师,涉及平台开发和底层系统。DeepSeek Harness团队负责人崔添翼在社交平台称,这个计算机领域

09/09
香港01

DeepSeek年化收入据报达10亿美元 梁文锋:加价未造成客户流失

美国科技媒体《The Information》报道,DeepSeek行政总裁梁文锋在近期投资者会议上披露,公司最新的年化收入由数月前的不足5亿美元大增至10亿美元(约78亿港元),受惠于近期上调API定价,以及其大模型持续受到市场追捧。 《The Information》分析,此次营收大幅跃升,部分原因在于公司将旗下模型的定价提高了2.3至4.5倍。梁文锋在会上表示,加价并未造成客户流失,用户需求

09/25
cnbeta

DeepSeek的烦恼:任务越来越多,人不够用了

以“小团队、高人才密度”著称的DeepSeek,开始大规模补充工程人员。9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。他称,这是“前所未有的150个HC的招聘需求”,公司目前有“很多新方向、新系统、新需求需要搞”。 崔添翼贴文截图两天后,DeepSeek又宣布下调Flash系列I价格,缓存命中输入价格最高下降60%。相比价格变化,此次招聘

09/09
cnbeta

中国在远离大城市的地方构建AI未来

乌兰察布位于草原之上,看起来不太像典型的科技中心城市。但这座位于中国内蒙古自治区的城市,已置身于中国将算力从拥挤的东部大城市迁往西部地区的行动最前线,因为西部地区拥有广阔空间和低价绿色能源。 一个周五的午餐时分,工人们从该市城区东侧的数据中心建筑工地涌向一个十字路口,连片的建筑群彰显这场行动的庞大规模。这里位于北京西北约350公里处。工人们戴着安全帽聚集到一排售卖实惠饭菜、啤酒和香烟的餐车旁。“每

09/11
联合早报

DeepSeek披露智能体训练平台 提升效率并降低失控风险

中国人工智能公司深度求索(DeepSeek)最近发表一篇新论文,披露了一套面向大规模人工智能(AI)智能体训练的新型基础设施。图为DeepSeek位于北京的办公室。(路透社档案照片) 中国人工智能公司深度求索(DeepSeek)披露一套面向大规模人工智能(AI)智能体训练的新型基础设施,可提高训练资源利用效率,并通过加强监测和访问控制,应对智能体“作弊”、破坏执行环境等失控行为。综合路透社和澎湃新

09/24
英国广播公司

草原上的数据中心:中国AI雄心背后的算力前线

在中国内蒙古辽阔的草原上,数十座数据中心正以惊人速度拔地而起。曾经的农田与草原,正在快速转变为支撑中国AI雄心的“引擎”,以满足狂飙的算力需求。 随着中国加速与美国展开AI竞逐,这一行业也在改变当地人的生活。BBC记者碧嘉兰(Laura Bicker)从乌兰察布发来报导。

09/23
凤凰网科技

马斯克放下豪言:SpaceX数据中心项目GPU数量到年底将翻一倍

马斯克周四表示,SpaceX的人工智能超级计算机Colossus 2项目计划大规模扩张,到今年年底其使用的英伟达芯片数量将较目前翻一倍以上。 马斯克在X上表示,Colossus 2数据中心目前已搭载11万颗Nvidia GB200芯片和44万颗GB300芯片。下周将有22万颗GB300芯片投入使用,预计11月还将有22万颗投入使用。如果运气好的话,12月底可能还会有22万颗芯片上线。 他补充称,英

09/26
日经

DeepSeek涨价不足1月又宣布最高降价6成

| 围绕AI模型使用费,价格竞争越来越激烈 |中国AI初创企业DeepSeek于9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费,最高降幅达60%。该公司在8月中旬才刚刚上调过价格。此次降价意在通过价格战对抗竞争对手。 V4系列包含主打响应速度的“V4-Flash”以及擅长更复杂任务处理的“V4-Pro”等版本。本次的降价对象为V4-Flash。输入、输出每100万token的单价下调

09/10
thenextweb

据报道,DeepSeek 的年化收入运行率已达到 10 亿美元

据《The Information》报道,中国人工智能实验室 DeepSeek 目前的年化收入运行率已达到 10 亿美元,是几个月前不到 5 亿美元的两倍多。 该报告援引了两名直接知情人士的消息,DeepSeek 尚未对此置评。收入的激增归因于近期价格的上涨以及对其模型持续稳定的需求。 据《南华早报》当时报道,DeepSeek 在 8 月份曾警告开发者其 API 价格即将大幅上涨。 据《The I

09/24
theregister

DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板

中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe

09/11
cnbeta

DeepSeek招150人,全部押注工程岗

DeepSeek的人才扩张还在继续,但枪口已经调转方向。9月8日,DeepSeek启动新一轮招聘,计划招募约150名工程师,岗位全部集中于服务端开发工程师与Agent弹性计算研发工程师两个方向,重点面向2至10年经验的资深后端工程师,未设AI研究类岗位。 这是DeepSeek在两个多月内的第二次大规模招贤。6月25日,DeepSeek曾在官方公众号宣布“随着技术演进,正努力将所有部门的规模扩大至少

09/08
信报财经

中国据报就数据泄漏调查DeepSeek和月之暗面

据美国科技媒体The Information引述知情人士报道,中国网络监管部门正在调查DeepSeek和月之暗面。此前Anthropic指称,这两家公司曾将敏感用户数据转送至Claude模型进行处理。 报道指出,中国国家互联网信息办公室已派官员前往DeepSeek和月之暗面办公地点,约谈公司高层和员工。 Anthropic在9月10日发布的一份154页的报告中称,有7家中国公司大规模违规使用旗下C

09/22 全文见 法国国际广播电台
彭博社

DeepSeek测试高效、更安全的AI代理训练方法

原文内容:根据彼得·埃尔斯特罗姆(Peter Elstrom)的报道,中国的 DeepSeek 公司提出了一种创新的人工智能训练方法,该方法有望让人工智能代理更高效地学习,同时最大限度地减少那些引发全球关注的不良行为。 这家总部位于杭州的公司在一篇长达 1 万字的论文中详细介绍了其“DeepSeek Elastic Compute”(简称 DSec)技术。该论文共有约 130 位合著者,其中包括公

09/24
凤凰网科技

Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑

快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS

09/24
凤凰网科技

DeepSeek被曝冲刺5000亿元估值!年化营收达67亿

智东西9月24日消息,据外媒The Information今日报道,两名直接知情人士透露,DeepSeek目前的年化营收运行率已经达到10亿美元(约合人民币67.13亿元),较几个月前不足5亿美元的水平翻了一倍以上。 这一最新数据被曝是由DeepSeek创始人兼CEO梁文锋在近期一次投资者会议上披露。近期模型涨价叠加持续增长的市场需求,共同推动了DeepSeek营收提升。 与此同时在敲定新一轮融资

09/24
cnbeta

马斯克押注超大规模AI算力 xAI计划部署逾120万颗英伟达GPU

埃隆·马斯克旗下人工智能公司xAI正在进一步扩大数据中心规模,并计划在未来几年部署超过120万颗英伟达AI GPU。随着Colossus数据中心持续扩建,xAI希望通过大规模算力基础设施训练和运行下一代Grok模型,与OpenAI等竞争对手展开更加激烈的AI基础设施竞争。 xAI目前最大的AI基础设施项目是位于美国田纳西州孟菲斯的Colossus数据中心。该项目从2024年开始建设,第一阶段Col

09/25
路透社

独家:消息人士称DeepSeek本周将向联合国安理会通报人工智能情况

DeepSeek以及包括Moonshot在内的其他中国人工智能公司已受邀发表声明。

09/22 全文见 凤凰网科技
thenextweb

据路透社报道,DeepSeek本周将向联合国安理会通报人工智能风险

根据路透社今天发布的独家报道(该报道引用了两位了解内情的人士的说法),DeepSeek预计将在本周与联合国安理会会面,讨论人工智能所带来的风险;同时,多家美国公司也将参与此次讨论。 这个由15名成员组成的安理会将于周三召开会议,而世界各国领导人此时正在纽约参加联合国大会。 DeepSeek以及另一家中国人工智能公司Moonshot尚未对路透社的采访请求作出回应;其中一位消息人士警告称,相关计划仍有

09/22
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…