搜索结果
DeepSeek V4.1 Pro或为2万亿参数:未来还有8万亿版、押注国产芯片
快科技9月21日消息,此前我们分析了中秋国庆双节前后国内外要发的10多款大模型,其中最受期待的还得是DeepSeek V4.1 Pro。 跑得比较快的Theinformation网站又爆料了新的消息,DeepSeek正在训练2万亿参数量的大模型,未来还会扩展到8万亿参数量。 而且DeepSeek的大模型训练未来会押注国产AI芯片,尤其是华为的升腾系列,不过具体情况就没有细节流出了。 未来的8万亿参
8万亿,梁文锋也开始卷“超大”
DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。
DeepSeek据报在内蒙古数据中心部署16万片华为晶片
美国媒体报道,中国人工智能(AI)初创企业深度求索(DeepSeek)将在内蒙古数据中心部署至少16万片华为高端加速晶片。 彭博社星期五(9月4日)引述知情人士透露,深度求索计划使用华为新一代升腾950DT晶片操作旗下模型,但部署时间表将根据华为的产能而定。 其中一名知情者称,尽管华为升腾950DT晶片是为训练模型而研发,但深度求索目前暂未有这方面的用途。深度求索过往也用华为AI晶片训练之前的模型
DeepSeek V4.1 Flash预计9月10日前后发布
DeepSeek开放平台发布通知,计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。 据官方介绍,经内部及外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。 昨日,DeepSeek已在官方交流群内开启V4.1 Flash中间版本内测。据参与内测的用户反馈,新模型采用了全新模型结构,原生支持多模态,能力更强、速度更快、成本更低。凤凰
美媒:DeepSeek押注华为晶片训练大模型
中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向。图为DeepSeek位于北京的办公室。(路透社档案照片) 美国媒体报道,中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向,以降低对英伟达的依赖,应对美国先进晶片出口管制带来的限制。路透社转引美国科技媒体The Information星期一(9月2
DeepSeek被曝冲刺5000亿元估值!年化营收达67亿
智东西9月24日消息,据外媒The Information今日报道,两名直接知情人士透露,DeepSeek目前的年化营收运行率已经达到10亿美元(约合人民币67.13亿元),较几个月前不足5亿美元的水平翻了一倍以上。 这一最新数据被曝是由DeepSeek创始人兼CEO梁文锋在近期一次投资者会议上披露。近期模型涨价叠加持续增长的市场需求,共同推动了DeepSeek营收提升。 与此同时在敲定新一轮融资
DeepSeek涨价不足1月又宣布最高降价6成
| 围绕AI模型使用费,价格竞争越来越激烈 |中国AI初创企业DeepSeek于9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费,最高降幅达60%。该公司在8月中旬才刚刚上调过价格。此次降价意在通过价格战对抗竞争对手。 V4系列包含主打响应速度的“V4-Flash”以及擅长更复杂任务处理的“V4-Pro”等版本。本次的降价对象为V4-Flash。输入、输出每100万token的单价下调
DeepSeek 开口说话了:灰度测试上线,支持四种音色
同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De
DeepSeek据报聘中信证券筹备科创板上市
中国人工智能(AI)初创企业深度求索(DeepSeek)据报已聘请中信证券,为在上海科创板首次公开募股(IPO)做准备。 星期三(9月9日)引述知情人士报道,这家总部位于杭州的公司计划今年启动IPO程序。拟在中国上市的企业,通常会在正式提交申请前聘请证券公司进行上市辅导。 但知情人士说,DeepSeek上市的具体时间、募资规模和目标估值目前均未确定。 在中美头部AI企业竞争日趋激烈之际,DeepS
Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑
快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS
↩️ 据科技媒体 The Information 报道,DeepSeek 创始人梁文锋向投资者表示,采用华为芯片进行训练是 DeepSeek 最核心的战略赌注之一,预计华为最早将于 2026 ...
LoopDNS资讯播报: 中国国产AI芯片迈入大模型训练与海外输出阶段 国产AI芯片正打破“只能推理、无法训练”的认知:美团万亿参数模型“LongCat-2.0”已成功在5万颗国产芯片集群上完成预训练,表明国产硬件已具备大规模训练能力;同时,华为正向中东及中亚客户销售搭载DeepSeek-V4模型的升腾950DT系统。美国旨在限制中国AI芯片能力的出口管制,反而促使部分同样面临英伟达供应限制的国家
美媒:DeepSeek年化营收达10亿美元
美国媒体报道,中国人工智能(AI)初创公司深度求索(DeepSeek)的年化营收已达10亿美元。 (路透社档案照片)美国媒体报道,中国人工智能(AI)初创公司深度求索(DeepSeek)的年化营收已达10亿美元(12.8亿新元),较数月前不足5亿美元的水平增长逾一倍。据路透社报道,美国科技媒体The Information星期四(9月24日)引述两名直接知情人士披露上述数据。目前,DeepSeek
DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板
中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe
DeepSeek年化收入据报达10亿美元 梁文锋:加价未造成客户流失
美国科技媒体《The Information》报道,DeepSeek行政总裁梁文锋在近期投资者会议上披露,公司最新的年化收入由数月前的不足5亿美元大增至10亿美元(约78亿港元),受惠于近期上调API定价,以及其大模型持续受到市场追捧。 《The Information》分析,此次营收大幅跃升,部分原因在于公司将旗下模型的定价提高了2.3至4.5倍。梁文锋在会上表示,加价并未造成客户流失,用户需求
T早报|DeepSeek扩招150人;Meta发布个人AI智能体Muse;华为“韬定律”芯片麒麟9050 Pro首现身
DeepSeek扩招150人 为史上单次最大规模招聘9月8日,DeepSeek发布招聘信息,招聘人数达到150人。招聘包含两大方向,一类是服务端开发工程师,覆盖大模型研究平台、Agent框架组件、研发效率基建、DeepSeek I、线上服务、数据工程六大方向;另一类则是Agent弹性计算研发工程师,涉及平台开发和底层系统。DeepSeek Harness团队负责人崔添翼在社交平台称,这个计算机领域
The Information:DeepSeek完成75亿美元融资,估值达到750亿美元。
DeepSeek年化营收达10亿美元,拟融资75亿美元
。DeepSeek的年化营收运行率已达到10亿美元,较几个月前的不到5亿美元翻了一番以上。这一增长归因于近期的提价及其AI模型的持续受欢迎。 据两位直接知情人士透露,这家初创公司正致力于在2026年10月底前完成约75亿美元的融资轮。
中国AI加码价格竞争
中国的人工智能(AI)新兴企业正推出低价格的AI模型。低于美国AI产品,甚至低于中国知名AI企业DeepSeek(深度求索),希望抓住DeepSeek8月中旬大幅提价的机会扩大份额。 中国AI新兴企业北京智谱华章科技(智谱)9月26日透露,Ox-Alpha的真实身份是该公司的“GLM-5.3-Flash”。每token的价格比提价后的DeepSeek便宜20%~70%。 性能也表现出色。专注于AI
据报道,DeepSeek 的年化收入运行率已达到 10 亿美元
据《The Information》报道,中国人工智能实验室 DeepSeek 目前的年化收入运行率已达到 10 亿美元,是几个月前不到 5 亿美元的两倍多。 该报告援引了两名直接知情人士的消息,DeepSeek 尚未对此置评。收入的激增归因于近期价格的上涨以及对其模型持续稳定的需求。 据《南华早报》当时报道,DeepSeek 在 8 月份曾警告开发者其 API 价格即将大幅上涨。 据《The I
深度求索称新款 Flash 人工智能模型在网络安全和编程基准测试中击败 Kimi K3
深度求索(DeepSeek)发布了 V4.1 Flash 模型,宣称其性能超越了上一代旗舰产品,同时降低了推理成本并提升了运行速度——这是中国激烈的价格与性能大战中的又一最新举措。 这家中国人工智能开发商周四表示,V4.1 Flash 采用了全新的“因果-编码器-解码器”(Causal-Encoder-Decoder)架构。尽管它构建于 5520 亿参数的大规模框架之上,但采用了混合专家(MoE)
GPT-6新模型掀桌 “白菜价”杀进DeepSeek腹地
DeepSeek 快醒醒,ChatGPT 要打到家门口了。就在刚刚,OpenAI 正式发布 GPT-6 Sol 和 GPT-6 Luna,API 价格降至上一代的一半左右。其中,Luna 每百万 Token 输入 0.1 美元、输出 0.5 美元,约合人民币 0.7 元和 3.5 元。 作为对照,DeepSeek V4.1 Flash 闲时的缓存未命中输入价为每百万 Token 1 元,输出价为
DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8
在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn
DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持
9月8日,DeepSeek今日在官方交流群内发布通知,DeepSeek V4.1 Flash的中间版本内测。据介绍,模型采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。模型的base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费与deepseek-v4-flash相同,每账号限流20并发。 据了解,DeepS
DeepSeek的烦恼:任务越来越多,人不够用了
以“小团队、高人才密度”著称的DeepSeek,开始大规模补充工程人员。9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。他称,这是“前所未有的150个HC的招聘需求”,公司目前有“很多新方向、新系统、新需求需要搞”。 崔添翼贴文截图两天后,DeepSeek又宣布下调Flash系列I价格,缓存命中输入价格最高下降60%。相比价格变化,此次招聘