字号 ·· | 护眼

搜索结果

「DeepSeek发布华为AI芯片编程工具,或可替代英伟达产品」共 100 条 · 第 2 页
theregister

DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板

中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe

09/11
南华早报

深度求索称新款 Flash 人工智能模型在网络安全和编程基准测试中击败 Kimi K3

深度求索(DeepSeek)发布了 V4.1 Flash 模型,宣称其性能超越了上一代旗舰产品,同时降低了推理成本并提升了运行速度——这是中国激烈的价格与性能大战中的又一最新举措。 这家中国人工智能开发商周四表示,V4.1 Flash 采用了全新的“因果-编码器-解码器”(Causal-Encoder-Decoder)架构。尽管它构建于 5520 亿参数的大规模框架之上,但采用了混合专家(MoE)

09/10
凤凰网科技

8万亿,梁文锋也开始卷“超大”

DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。

09/22
朝鲜日报

美:DeepSeek等6家中企,擅自蒸馏美尖端AI

▲ 美国与中国国旗。/,韩联社美国政府正式宣布,中国DeepSeek、阿里巴巴等人工智能(AI)企业迂回接入OpenAI、Anthropic等的AI模型,大量收集回答并用于开发自研模型。也就是说,中国企业把美国的尖端AI当作“课外老师”,以缩减研究、开发的成本与时间。 8日,美国国家安全局(NSA)、联邦调查局(FBI)、网“中国AI企业正在开展产业规模的、带有攻击性的恶意‘蒸馏(distilla

09/10
cnbeta

DeepSeek招150人,全部押注工程岗

DeepSeek的人才扩张还在继续,但枪口已经调转方向。9月8日,DeepSeek启动新一轮招聘,计划招募约150名工程师,岗位全部集中于服务端开发工程师与Agent弹性计算研发工程师两个方向,重点面向2至10年经验的资深后端工程师,未设AI研究类岗位。 这是DeepSeek在两个多月内的第二次大规模招贤。6月25日,DeepSeek曾在官方公众号宣布“随着技术演进,正努力将所有部门的规模扩大至少

09/08
time

如何让美中人工智能竞赛不那么危险

2026年1月14日,在中国东部浙江省杭州市,中国人工智能初创公司DeepSeek总部所在的大楼。

09/18 受限
路透社

中国DeepSeek发布V4.1-Flash模型

据一份声明,中国人工智能初创公司DeepSeek周四推出了DeepSeek-V4.1-Flash,该公司称这是其新架构系列中规模最小的模型。

09/10
凤凰网

安理会本周开会讨论AI和国际安全问题,DeepSeek公司被曝将作通报

【文/观察者网 熊超然】9月22日,路透社援引两名知情人士独家报道称,随着各国领导人近期齐聚纽约参加第81届联合国大会,中国人工智能(AI)初创企业深度求索(DeepSeek)将与其他公司一道,在本周向联合国安理会介绍AI带来的风险情况。安理会定于9月23日开会讨论AI与国际安全问题。此前,多名AI行业的重要人物曾呼吁协同放缓日益强大的AI系统开发速度,并警告称,这些系统可能很快具备自我改进能力,

09/22
凤凰网科技

GPT-6新模型掀桌 “白菜价”杀进DeepSeek腹地

DeepSeek 快醒醒,ChatGPT 要打到家门口了。就在刚刚,OpenAI 正式发布 GPT-6 Sol 和 GPT-6 Luna,API 价格降至上一代的一半左右。其中,Luna 每百万 Token 输入 0.1 美元、输出 0.5 美元,约合人民币 0.7 元和 3.5 元。 作为对照,DeepSeek V4.1 Flash 闲时的缓存未命中输入价为每百万 Token 1 元,输出价为

09/23
凤凰网

网友爆料DeepSeek仍可生成涉黄内容,闲鱼平台有人低价售卖“教程”

近日,不少网友在社交媒体发帖称,DeepSeek更新下架“专家模式”后,此前被曝光的涉黄色情角色扮演对话现象仍存在。记者调查发现,部分社交媒体以及闲鱼等平台甚至存在教用户使用DeepSeek开展涉黄角色扮演对话的教程帖,且对外出售。不少网友称通过网传教程DeepSeek生成了涉黄内容,并质疑平台审核机制存在漏洞。 DeepSeek仍能生成涉黄短文,部分社交平台存“教程”近期,有网友向新黄河记者反映

09/16
thenextweb

据报道,DeepSeek 的年化收入运行率已达到 10 亿美元

据《The Information》报道,中国人工智能实验室 DeepSeek 目前的年化收入运行率已达到 10 亿美元,是几个月前不到 5 亿美元的两倍多。 该报告援引了两名直接知情人士的消息,DeepSeek 尚未对此置评。收入的激增归因于近期价格的上涨以及对其模型持续稳定的需求。 据《南华早报》当时报道,DeepSeek 在 8 月份曾警告开发者其 API 价格即将大幅上涨。 据《The I

09/24
路透社

中国DeepSeek聘请交易高手担任CFO,为可能的IPO做准备

据两位知情人士透露,DeepSeek计划聘请风险投资公司GL Ventures的合伙人闫文涛担任其首任首席财务官,这家中国AI初创公司正在为潜在的首次公开募股做准备。

09/15
凤凰网科技

DeepSeek Harness v0.2预览版发布:上线桌面端安装包,新增插件管理

凤凰网科技讯 9月29日,DeepSeek Harness v0.2预览版正式发布,并提供开箱即用的macOS和Windows桌面端安装包,已上线DeepSeek官网。新版本预置了面向日常办公和开发的常用功能,并新增插件安装与管理页面,提供更多灵活配置选项。 本次更新优化了文件展示、内容预览和代码变更展示体验,完善了自动化任务的设置与管理,并提供多种工作过程展示方式。用户可提供文档、表格或PDF文

09/29
商业内幕

DeepSeek一名工程师关于人才、权力与人性的刷屏帖文,罕见地展现了中国前沿人工智能实验室的工作图景。

一名曾参与编写深度求索(DeepSeek)最新模型核心组件的工程师,让读者得以罕见地一窥这家中国前沿实验室的工作状态,以及中国劳动者如何应对人工智能带来的风险。 在这篇以中文发表在其微信公众号上、题为《我别无选择,只能将天赋埋葬在昨天》的博文中,DeepSeek的人工智能开发人员刘圣宇(音)反思了一种奇异的现实:他正在协助构建的人工智能,最终可能会让其自身的专业技能变得过时。刘圣宇向《商业内幕》证

09/15
凤凰网科技

消息称DeepSeek等公司将就AI风险向联合国安理会作简报

凤凰网科技讯月22日,据路透社报道,两位知情人士透露,DeepSeek等公司将于本周就AI带来的风险向联合国安理会作简报。眼下,世界各国领导人正齐聚纽约,出席一年一度的联合国大会。 联合国安理会定于周三开会讨论AI与国际安全。几周前,多家AI行业领袖呼吁协调放缓日益强大的AI系统的开发,警告这些系统可能很快将自行改进并脱离人类控制。联合国安理会由15个成员国组成。 一位知情人士称,DeepSeek

09/22
凤凰网科技

刚刚,DeepSeek Harness桌面端上线,梁文锋开送Token了

智东西9月29日报道,今日,DeepSeek正式推出DeepSeek Harness v0.2预览版,并提供开箱即用的macOS和Windows桌面端安装包。 ▲DeepSeek Harness v0.2预览版界面用户前往DeepSeek Harness官网下载安装后,按照引导即可直接使用,无需再自行配置开发环境。 这是DeepSeek Harness自8月13日晚推出开发者预览版v0.1并同步开

23小时前
𝕏 @fxtrader

华为轮值董事长汪涛今日介绍华为面向智能时代的重要部署:一是华为AI战略的核心是算力,坚持硬件变现;

二是“超节点+集群”,打造中国坚实算力底座,为世界构建新的选择;三是构建开源开放的算力生态,支持主流大模型原生训练、积极拥抱“百模千态”;四是盘古大模型聚焦华为产品智能化,增强自身产品竞争力;五是提供线下+线上的灵活算力方案,加速行业智能化;六是创新多样性算力,推进AI入端、上车,智能无所不及;七是围绕“用算”构筑新一代通信网络,把智能传递给每个人、家庭和企业。

09/17 全文见 华尔街见闻
联合早报

DeepSeek据报聘高瓴创投合伙人严文韬任首席财务官

在公司准备上市之际,中国人工智能(AI)初创企业深度求索(DeepSeek)据报聘请高瓴创投合伙人严文韬出任首席财务官(CFO)。星期一(9月14日)引述两名知情者报道上述消息。 另据IT之家同日消息,凤凰网科技引述多个独立信源称,深度求索的首席财务官即将到岗,最终人选是高瓴创投合伙人严文韬,后者目前已在走离职程序中。 另有信源称,五源资本、红杉资本、龙珠资本等中国多家头部投资机构的负责人都就上述

09/15
凤凰网科技

聊聊天就能调GPU!英伟达AI新专利:自动写脚本定位性能问题

快科技9月27日消息,近日英伟达提交了一项专利申请,计划打造一个AI助手,让开发者能够用自然语言询问GPU性能问题。 该系统可以读取性能报告、生成脚本提取所需数据,进而解释程序在哪些环节浪费了GPU资源,或为何运行速度低于预期。 根据专利描述,这是一套基于大语言模型的“聊天界面”,与GPU性能分析工具相连接。开发者可以直接询问某个工作负载为何运行缓慢、哪一部分构成了性能瓶颈,或者同一程序两个版本的

09/27
彭博社

华为将揭晓中国对Nvidia AI芯片统治的最佳答案

华为技术有限公司将于本周推出新的人工智能技术,无视美国的出口管制限制,推进其在中国取代英伟达公司并在全球舞台上竞争的雄心。 华为轮值董事长汪涛将于周四在上海举行的公司年度峰会上展示即将推出的Ascend 960 AI芯片,该芯片将于2027年上市。 分析师将关注的一些关键细节包括新组件是否足够强大来训练前沿人工智能模型。 华为监事会主席郭平在本月早些时候的一次内部会议上告诉新员工,华为的目标是确保

09/17
财新

T早报|OpenAI、Anthropic、DeepMind合作AI安全工作;外交部回应AI风险焦虑;梁汝波称字节跳动将加大投资企业市场

阶跃发布语音大模型StepAudio 3 9月15日,阶跃星辰发布 Step Audio 3 系列模型,包括 StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen 和 StepAudio 3 Music。该系列模型主要面向真人级语音生成、完整音频内容生成、实时语音交互、复杂场景语音理解和音乐创作等场景。 腾讯会议联

09/16
cnbeta

DeepSeek 开口说话了:灰度测试上线,支持四种音色

同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De

09/12
凤凰网科技

华为推出OceanStor M900 AI记忆存储

《科创板日报》17日讯,在今日的华为全联接大会2026上,华为推出基于灵衢打造AI记忆存储-OceanStor M900。Agent与长序列需要多层次KV Cache架构,面向Agent推理系统,华为提出了多层KV缓存架构,推出基于灵衢UnifiedBus、支持“一跳直连”的华为L3.5层PB级KV缓存——OceanStor M900集群。同时,M900采用混合介质加优化Retention算法,可

09/17
𝕏 @fxtrader

DeepSeek下调flash系列模型定价,降幅11%-60%

DeepSeek开放平台今日公告,00起,空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。 00(其余为空闲时段)。据悉,缓存命中、缓存未命中及输出价格最高降幅分别为60%、33.33%和11.11%。

09/09
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…