1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持」共 34 条 · 第 1 页
cnbeta

DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持

9月8日,DeepSeek今日在官方交流群内发布通知,DeepSeek V4.1 Flash的中间版本内测。据介绍,模型采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。模型的base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费与deepseek-v4-flash相同,每账号限流20并发。 据了解,DeepS

09/08
风向旗参考快讯

DeepSeek V4.1 Flash预计9月10日前后发布

DeepSeek开放平台发布通知,计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。 据官方介绍,经内部及外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。 昨日,DeepSeek已在官方交流群内开启V4.1 Flash中间版本内测。据参与内测的用户反馈,新模型采用了全新模型结构,原生支持多模态,能力更强、速度更快、成本更低。凤凰

09/09
cnbeta

DeepSeek 开口说话了:灰度测试上线,支持四种音色

同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De

09/12
cnbeta

DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8

在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn

09/01
theregister

DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板

中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe

09/11
路透社

中国DeepSeek发布V4.1-Flash模型

据一份声明,中国人工智能初创公司DeepSeek周四推出了DeepSeek-V4.1-Flash,该公司称这是其新架构系列中规模最小的模型。

09/10
南华早报

深度求索称新款 Flash 人工智能模型在网络安全和编程基准测试中击败 Kimi K3

深度求索(DeepSeek)发布了 V4.1 Flash 模型,宣称其性能超越了上一代旗舰产品,同时降低了推理成本并提升了运行速度——这是中国激烈的价格与性能大战中的又一最新举措。 这家中国人工智能开发商周四表示,V4.1 Flash 采用了全新的“因果-编码器-解码器”(Causal-Encoder-Decoder)架构。尽管它构建于 5520 亿参数的大规模框架之上,但采用了混合专家(MoE)

09/10
日经

DeepSeek涨价不足1月又宣布最高降价6成

| 围绕AI模型使用费,价格竞争越来越激烈 |中国AI初创企业DeepSeek于9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费,最高降幅达60%。该公司在8月中旬才刚刚上调过价格。此次降价意在通过价格战对抗竞争对手。 V4系列包含主打响应速度的“V4-Flash”以及擅长更复杂任务处理的“V4-Pro”等版本。本次的降价对象为V4-Flash。输入、输出每100万token的单价下调

09/10
cnbeta

DeepSeek的烦恼:任务越来越多,人不够用了

以“小团队、高人才密度”著称的DeepSeek,开始大规模补充工程人员。9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。他称,这是“前所未有的150个HC的招聘需求”,公司目前有“很多新方向、新系统、新需求需要搞”。 崔添翼贴文截图两天后,DeepSeek又宣布下调Flash系列I价格,缓存命中输入价格最高下降60%。相比价格变化,此次招聘

09/09
𝕏 @fxtrader

DeepSeek下调flash系列模型定价,降幅11%-60%

DeepSeek开放平台今日公告,00起,空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。 00(其余为空闲时段)。据悉,缓存命中、缓存未命中及输出价格最高降幅分别为60%、33.33%和11.11%。

09/09
cnbeta

深度求索推迟DS V4 Pro下线时间 但也只延迟到9月14日

昨天深度求索已经预告将在今天上线 DS V4.1 Flash 模型,深度求索经过内部和外部评测后认为 DS V4.1 Flash 能力和响应速度都远超 DS V4 Pro,所以深度求索计划在 DS V4.1 Flash 上线后,直接将现有的 DS V4 Pro 请求全部自动路由到 DS V4.1 Flash。 按照深度求索所说,新模型性能好、能力高、价格也更便宜,所以直接路由应该是好事情才对。然而

09/10
凤凰网科技

突发:DeepSeek Harness出桌面版了

我们打开链接,下载、安装了一下,发现确实能用。从界面来看,它已经是一套相当完整的 GUI:打开 App,登录 DeepSeek 账号或者添加 API Key,选一个本地文件夹作为工作区,接下来就可以像使用普通桌面 AI 应用一样,直接给 Agent 布置任务。 随后,Harness 会让用户选择自己的使用方向。它把需求粗略分成了办公科研、代码开发等类别。接下来,它还会询问用户更倾向于哪种工作流程。

09/25
日经

中国AI加码价格竞争

中国的人工智能(AI)新兴企业正推出低价格的AI模型。低于美国AI产品,甚至低于中国知名AI企业DeepSeek(深度求索),希望抓住DeepSeek8月中旬大幅提价的机会扩大份额。 中国AI新兴企业北京智谱华章科技(智谱)9月26日透露,Ox-Alpha的真实身份是该公司的“GLM-5.3-Flash”。每token的价格比提价后的DeepSeek便宜20%~70%。 性能也表现出色。专注于AI

09/08
凤凰网科技

Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑

快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS

09/24
凤凰网科技

DeepSeek V4.1 Pro或为2万亿参数:未来还有8万亿版、押注国产芯片

快科技9月21日消息,此前我们分析了中秋国庆双节前后国内外要发的10多款大模型,其中最受期待的还得是DeepSeek V4.1 Pro。 跑得比较快的Theinformation网站又爆料了新的消息,DeepSeek正在训练2万亿参数量的大模型,未来还会扩展到8万亿参数量。 而且DeepSeek的大模型训练未来会押注国产AI芯片,尤其是华为的升腾系列,不过具体情况就没有细节流出了。 未来的8万亿参

09/21
cnbeta

玩家自制Mod复活多GPU架构 实现最高127%帧率暴涨

随着英伟达新一代DLSS 5神经渲染技术的问世,PC游戏硬件社区再度展现了令人惊叹的民间技术创造力。一名开发者近日打造出了一款突破性的ReShade插件Mod,成功让沉寂已久的多显卡并行(Multi-GPU)运行模式重回主流玩家视野。 该方案将极度消耗硬件性能的DLSS 5神经后期处理任务完全剥离并转移至第二块独立显卡上运行,不仅大幅解放了主渲染显卡的负担,在部分测试场景下更实现了高达127%的显

09/08
凤凰网科技

小米刷新AI大模型斩杀线,罗福莉:技术难度超过DeepSeek R1

就在刚刚,小米正式发布并开源 MiMo-V2.6 系列模型。 此次发布包含两款原生全模态模型。MiMo-V2.6-Pro 面向复杂编程、Agent 和专业任务,MiMo-V2.6-Flash 更强调性能、效率与成本之间的平衡。 小米还同步推出 MiMo-V2.6-Pro-UltraSpeed,官方称其在保持模型质量的前提下,输出速度最高可达到 Pro 版本的 20 倍。 而除了版本更新,APPSO

09/22
华尔街日报

独家 | 新谷歌AI模型据称缩小编程能力差距

谷歌正在准备一款具有更强编程技能的新AI模型,以寻求缩小与OpenAI和Anthropic的差距。 Gemini 3.8 Flash的内部测试显示,在该公司落后于Anthropic和OpenAI的领域取得了进展。预计本周发布。

09/02
凤凰网科技

阿里发布Qwen3.8-Omni-Flash:音视频API降价超90%

凤凰网科技讯 9月18日,阿里千问正式上线新一代原生全模态模型Qwen3.8-Omni-Flash。该模型支持文本、图像、音频和视频输入,具备1M长上下文,核心目标是推动全模态模型从“理解内容”走向“规划任务、调用工具并完成创作”。 在累计30项评测中,该模型相比上一代Qwen3.5-Omni-Plus平均得分提升超26%。其中,音视频Agent、Coding及长程任务在WildClawBench

09/18
LoopDNS 资讯播报

↩️ 9月21日,原高瓴创投合伙人严文韬正式入职DeepSeek,至此该公司成立三年来CFO长期空缺的局面宣告结束,这也是这家AI公司迄今为止最重要的一次非技术高管引...

LoopDNS资讯播报: 路透:据两位知情人士透露,中国人工智能初创公司深度求索(DeepSeek)已选定中信证券为其在上海科创板进行首次公开募股(IPO)做准备。 9月21日,原高瓴创投合伙人严文韬正式入职DeepSeek,至此该公司成立三年来CFO长期空缺的局面宣告结束,这也是这家AI公司迄今为止最重要的一次非技术高管引进。严文韬将带领DeepSeek冲刺首次公开募股,此前该公司已选定中信证券

09/22 全文见 凤凰网科技
财新

Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化

【财新网】在各自的旗舰模型基础上,各大模型厂发布更新版模型。北京时间9月2日和3日,Anthropic、Meta、谷歌和阿里等公司发布了基于旗舰模型的更新版本,在编程、网络安全和办公等领域的能力提升。 目前从第三方AI模型榜单看,最新发布的模型当中,Claude Fable 5.1在智能水平上排名最靠前,Meta新发布的Muse Spark 1.3排名第三,谷歌的新模型Gemini 3.8 Fla

09/03
cnbeta

DeepSeek招150人,全部押注工程岗

DeepSeek的人才扩张还在继续,但枪口已经调转方向。9月8日,DeepSeek启动新一轮招聘,计划招募约150名工程师,岗位全部集中于服务端开发工程师与Agent弹性计算研发工程师两个方向,重点面向2至10年经验的资深后端工程师,未设AI研究类岗位。 这是DeepSeek在两个多月内的第二次大规模招贤。6月25日,DeepSeek曾在官方公众号宣布“随着技术演进,正努力将所有部门的规模扩大至少

09/08
cnbeta

阿里巴巴发布Qwen3.8-Omni-Flash 多项表现逼近Gemini 3.8 Flash

阿里巴巴旗下Qwen团队近日发布新一代原生全模态模型Qwen3.8-Omni-Flash,进一步将音频、视频理解与AI智能体能力结合起来。该模型支持文本、图像、音频和视频四种输入形式,并提供100万Token上下文窗口。与上一代Qwen3.5-Omni-Plus相比,Qwen官方称其在29项基准测试中的平均成绩提升超过25%,同时大幅降低了音频和音视频处理成本。 Qwen3.8-Omni-Flas

09/18
cnbeta

微软发布MAI-Image-2.6 Flash 主打更快、更便宜的AI图像生成

微软正在进一步扩大自研人工智能模型的布局。当地时间9月4日,据Neowin报道,微软推出了MAI-Image-2.6 Flash,这是一款面向高频图像生成任务优化的新模型,重点提升生成速度和成本效率。微软方面表示,新模型能够在保持较高图像质量的同时,以更低的成本处理大量生成请求。 MAI-Image-2.6 Flash属于微软MAI系列图像模型,主要面向需要快速生成图片的用户和开发者。与更注重最高

09/05
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…