字号 ·· | 护眼

搜索结果

「有望国庆发布 DeepSeek V4.1 Pro已开始测试:性能值得期待」共 99 条 · 第 1 页
凤凰网科技

有望国庆发布 DeepSeek V4.1 Pro已开始测试:性能值得期待

快科技9月28日消息,9月10日发布DeepSeek V4.1 Flash之后,DeepSeek提到后续还有V4.1 Pro,但没有给出明确的日期,现在马上国庆节了,V4.1 Pro已曝出正在测试中。 从网友分析出来的结果看,V4.1 Pro目前的状态还是Early access,也就是早期接入,默认High级别推理强度。 目前是按账号灰度测试,大部分人还看不到列表,不过一旦有了权限就能一直用。

09/28
风向旗参考快讯

DeepSeek V4.1 Flash预计9月10日前后发布

DeepSeek开放平台发布通知,计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。 据官方介绍,经内部及外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。 昨日,DeepSeek已在官方交流群内开启V4.1 Flash中间版本内测。据参与内测的用户反馈,新模型采用了全新模型结构,原生支持多模态,能力更强、速度更快、成本更低。凤凰

09/09
cnbeta

DeepSeek 开口说话了:灰度测试上线,支持四种音色

同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De

09/12
凤凰网科技

DeepSeek V4.1 Pro或为2万亿参数:未来还有8万亿版、押注国产芯片

快科技9月21日消息,此前我们分析了中秋国庆双节前后国内外要发的10多款大模型,其中最受期待的还得是DeepSeek V4.1 Pro。 跑得比较快的Theinformation网站又爆料了新的消息,DeepSeek正在训练2万亿参数量的大模型,未来还会扩展到8万亿参数量。 而且DeepSeek的大模型训练未来会押注国产AI芯片,尤其是华为的升腾系列,不过具体情况就没有细节流出了。 未来的8万亿参

09/21
cnbeta

DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持

9月8日,DeepSeek今日在官方交流群内发布通知,DeepSeek V4.1 Flash的中间版本内测。据介绍,模型采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。模型的base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费与deepseek-v4-flash相同,每账号限流20并发。 据了解,DeepS

09/08
cnbeta

DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8

在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn

09/01
日经

DeepSeek涨价不足1月又宣布最高降价6成

| 围绕AI模型使用费,价格竞争越来越激烈 |中国AI初创企业DeepSeek于9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费,最高降幅达60%。该公司在8月中旬才刚刚上调过价格。此次降价意在通过价格战对抗竞争对手。 V4系列包含主打响应速度的“V4-Flash”以及擅长更复杂任务处理的“V4-Pro”等版本。本次的降价对象为V4-Flash。输入、输出每100万token的单价下调

09/10
凤凰网科技

Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑

快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS

09/24
凤凰网科技

8万亿,梁文锋也开始卷“超大”

DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。

09/22
凤凰网科技

DeepSeek Harness v0.2预览版发布:上线桌面端安装包,新增插件管理

凤凰网科技讯 9月29日,DeepSeek Harness v0.2预览版正式发布,并提供开箱即用的macOS和Windows桌面端安装包,已上线DeepSeek官网。新版本预置了面向日常办公和开发的常用功能,并新增插件安装与管理页面,提供更多灵活配置选项。 本次更新优化了文件展示、内容预览和代码变更展示体验,完善了自动化任务的设置与管理,并提供多种工作过程展示方式。用户可提供文档、表格或PDF文

2小时前
cnbeta

深度求索推迟DS V4 Pro下线时间 但也只延迟到9月14日

昨天深度求索已经预告将在今天上线 DS V4.1 Flash 模型,深度求索经过内部和外部评测后认为 DS V4.1 Flash 能力和响应速度都远超 DS V4 Pro,所以深度求索计划在 DS V4.1 Flash 上线后,直接将现有的 DS V4 Pro 请求全部自动路由到 DS V4.1 Flash。 按照深度求索所说,新模型性能好、能力高、价格也更便宜,所以直接路由应该是好事情才对。然而

09/10
theregister

DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板

中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe

09/11
路透社

中国DeepSeek发布V4.1-Flash模型

据一份声明,中国人工智能初创公司DeepSeek周四推出了DeepSeek-V4.1-Flash,该公司称这是其新架构系列中规模最小的模型。

09/10
LoopDNS 资讯播报

↩️ 据科技媒体 The Information 报道,DeepSeek 创始人梁文锋向投资者表示,采用华为芯片进行训练是 DeepSeek 最核心的战略赌注之一,预计华为最早将于 2026 ...

LoopDNS资讯播报: 中国国产AI芯片迈入大模型训练与海外输出阶段 国产AI芯片正打破“只能推理、无法训练”的认知:美团万亿参数模型“LongCat-2.0”已成功在5万颗国产芯片集群上完成预训练,表明国产硬件已具备大规模训练能力;同时,华为正向中东及中亚客户销售搭载DeepSeek-V4模型的升腾950DT系统。美国旨在限制中国AI芯片能力的出口管制,反而促使部分同样面临英伟达供应限制的国家

09/22 全文见 凤凰网科技
南华早报

深度求索称新款 Flash 人工智能模型在网络安全和编程基准测试中击败 Kimi K3

深度求索(DeepSeek)发布了 V4.1 Flash 模型,宣称其性能超越了上一代旗舰产品,同时降低了推理成本并提升了运行速度——这是中国激烈的价格与性能大战中的又一最新举措。 这家中国人工智能开发商周四表示,V4.1 Flash 采用了全新的“因果-编码器-解码器”(Causal-Encoder-Decoder)架构。尽管它构建于 5520 亿参数的大规模框架之上,但采用了混合专家(MoE)

09/10
cnbeta

DeepSeek的烦恼:任务越来越多,人不够用了

以“小团队、高人才密度”著称的DeepSeek,开始大规模补充工程人员。9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。他称,这是“前所未有的150个HC的招聘需求”,公司目前有“很多新方向、新系统、新需求需要搞”。 崔添翼贴文截图两天后,DeepSeek又宣布下调Flash系列I价格,缓存命中输入价格最高下降60%。相比价格变化,此次招聘

09/09
罗塞塔简报

DeepSeek年化营收达10亿美元,拟融资75亿美元

。DeepSeek的年化营收运行率已达到10亿美元,较几个月前的不到5亿美元翻了一番以上。这一增长归因于近期的提价及其AI模型的持续受欢迎。 据两位直接知情人士透露,这家初创公司正致力于在2026年10月底前完成约75亿美元的融资轮。

09/24
𝕏 @fxtrader

The Information:DeepSeek完成75亿美元融资,估值达到750亿美元。

09/24 全文见 thenextweb
财新

T早报|DeepSeek扩招150人;Meta发布个人AI智能体Muse;华为“韬定律”芯片麒麟9050 Pro首现身

DeepSeek扩招150人 为史上单次最大规模招聘9月8日,DeepSeek发布招聘信息,招聘人数达到150人。招聘包含两大方向,一类是服务端开发工程师,覆盖大模型研究平台、Agent框架组件、研发效率基建、DeepSeek I、线上服务、数据工程六大方向;另一类则是Agent弹性计算研发工程师,涉及平台开发和底层系统。DeepSeek Harness团队负责人崔添翼在社交平台称,这个计算机领域

09/09
凤凰网科技

刚刚,DeepSeek Harness桌面端上线,梁文锋开送Token了

智东西9月29日报道,今日,DeepSeek正式推出DeepSeek Harness v0.2预览版,并提供开箱即用的macOS和Windows桌面端安装包。 ▲DeepSeek Harness v0.2预览版界面用户前往DeepSeek Harness官网下载安装后,按照引导即可直接使用,无需再自行配置开发环境。 这是DeepSeek Harness自8月13日晚推出开发者预览版v0.1并同步开

1小时前
联合早报

DeepSeek据报在内蒙古数据中心部署16万片华为晶片

美国媒体报道,中国人工智能(AI)初创企业深度求索(DeepSeek)将在内蒙古数据中心部署至少16万片华为高端加速晶片。 彭博社星期五(9月4日)引述知情人士透露,深度求索计划使用华为新一代升腾950DT晶片操作旗下模型,但部署时间表将根据华为的产能而定。 其中一名知情者称,尽管华为升腾950DT晶片是为训练模型而研发,但深度求索目前暂未有这方面的用途。深度求索过往也用华为AI晶片训练之前的模型

09/05
LoopDNS 资讯播报

↩️ 9月21日,原高瓴创投合伙人严文韬正式入职DeepSeek,至此该公司成立三年来CFO长期空缺的局面宣告结束,这也是这家AI公司迄今为止最重要的一次非技术高管引...

LoopDNS资讯播报: 路透:据两位知情人士透露,中国人工智能初创公司深度求索(DeepSeek)已选定中信证券为其在上海科创板进行首次公开募股(IPO)做准备。 9月21日,原高瓴创投合伙人严文韬正式入职DeepSeek,至此该公司成立三年来CFO长期空缺的局面宣告结束,这也是这家AI公司迄今为止最重要的一次非技术高管引进。严文韬将带领DeepSeek冲刺首次公开募股,此前该公司已选定中信证券

09/22 全文见 凤凰网科技
凤凰网科技

DeepSeek被曝冲刺5000亿元估值!年化营收达67亿

智东西9月24日消息,据外媒The Information今日报道,两名直接知情人士透露,DeepSeek目前的年化营收运行率已经达到10亿美元(约合人民币67.13亿元),较几个月前不足5亿美元的水平翻了一倍以上。 这一最新数据被曝是由DeepSeek创始人兼CEO梁文锋在近期一次投资者会议上披露。近期模型涨价叠加持续增长的市场需求,共同推动了DeepSeek营收提升。 与此同时在敲定新一轮融资

09/24
联合早报

DeepSeek据报聘中信证券筹备科创板上市

中国人工智能(AI)初创企业深度求索(DeepSeek)据报已聘请中信证券,为在上海科创板首次公开募股(IPO)做准备。 星期三(9月9日)引述知情人士报道,这家总部位于杭州的公司计划今年启动IPO程序。拟在中国上市的企业,通常会在正式提交申请前聘请证券公司进行上市辅导。 但知情人士说,DeepSeek上市的具体时间、募资规模和目标估值目前均未确定。 在中美头部AI企业竞争日趋激烈之际,DeepS

09/09
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…