1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8」共 31 条 · 第 1 页
cnbeta

DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8

在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn

09/01
cnbeta

DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持

9月8日,DeepSeek今日在官方交流群内发布通知,DeepSeek V4.1 Flash的中间版本内测。据介绍,模型采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。模型的base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费与deepseek-v4-flash相同,每账号限流20并发。 据了解,DeepS

09/08
cnbeta

DeepSeek 开口说话了:灰度测试上线,支持四种音色

同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De

09/12
风向旗参考快讯

DeepSeek V4.1 Flash预计9月10日前后发布

DeepSeek开放平台发布通知,计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。 据官方介绍,经内部及外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。 昨日,DeepSeek已在官方交流群内开启V4.1 Flash中间版本内测。据参与内测的用户反馈,新模型采用了全新模型结构,原生支持多模态,能力更强、速度更快、成本更低。凤凰

09/09
路透社

中国DeepSeek发布V4.1-Flash模型

据一份声明,中国人工智能初创公司DeepSeek周四推出了DeepSeek-V4.1-Flash,该公司称这是其新架构系列中规模最小的模型。

09/10
theregister

DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板

中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe

09/11
日经

DeepSeek涨价不足1月又宣布最高降价6成

| 围绕AI模型使用费,价格竞争越来越激烈 |中国AI初创企业DeepSeek于9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费,最高降幅达60%。该公司在8月中旬才刚刚上调过价格。此次降价意在通过价格战对抗竞争对手。 V4系列包含主打响应速度的“V4-Flash”以及擅长更复杂任务处理的“V4-Pro”等版本。本次的降价对象为V4-Flash。输入、输出每100万token的单价下调

09/10
南华早报

深度求索称新款 Flash 人工智能模型在网络安全和编程基准测试中击败 Kimi K3

深度求索(DeepSeek)发布了 V4.1 Flash 模型,宣称其性能超越了上一代旗舰产品,同时降低了推理成本并提升了运行速度——这是中国激烈的价格与性能大战中的又一最新举措。 这家中国人工智能开发商周四表示,V4.1 Flash 采用了全新的“因果-编码器-解码器”(Causal-Encoder-Decoder)架构。尽管它构建于 5520 亿参数的大规模框架之上,但采用了混合专家(MoE)

09/10
南华早报

腾讯Hy4模型在生态驱动训练后于开源AI排名中上升

腾讯控股利用其庞大产品生态系统训练新Hy4预览模型的策略,使其在开发AI智能体方面占据优势,并使其旗舰模型系列重回开源产品第一梯队,分析师表示。 这家中国科技巨头的“差异化产品加模型策略”——即预览模型首先部署在腾讯全系产品中——使其能够收集用户数据,再将信息反馈到后续训练轮次中,高盛分析师在周一的研究报告中表示。 “我们认为这种闭环方法对生产力和编码工作负载尤其重要,在智能体AI时代,真实世界的

09/02
罗塞塔简报

谷歌 DeepMind 的 Gemini 4 模型即将发布

Google DeepMind 高级副总裁 Koray Kavukcuoglu 于 2026 年 9 月 23 日星期三在 The Information 的 AI Agenda Live Summit 上宣布,公司的下一代旗舰人工智能模型 Gemini 4 目前处于后训练的早期阶段。 Kavukcuoglu 表示,他希望该模型能在年底之前「提前很多」发布,以重新夺回与竞争对手 Anthropic

09/24
LoopDNS 资讯播报

谷歌宣布正加速推进旗舰级 Gemini 4 AI 模型研发

谷歌科技巨头即将推出其最新旗舰人工智能模型 Gemini 4,以在与 Anthropic 和 OpenAI 的竞争中重新赢得优势。谷歌 DeepMind 新任最高领导人 Kavukcuoglu 在 AI Agenda Live 峰会上表示,Gemini 4 目前正处于后训练阶段的早期,团队正在对其进行精调与安全性测试,目标是“远早于”今年年底发布。 该模型是自去年 Gemini 3 系列发布以来的

09/24 全文见 罗塞塔简报
凤凰网科技

Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑

快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS

09/24
凤凰网科技

阶跃发布旗舰模型Step 5 Preview:跻身全球权威榜单开源前三

凤凰网科技讯 9月20日,阶跃StepFun正式发布新一代旗舰基座模型Step 5 Preview,面向真实世界Agentic任务设计。该模型采用稀疏MoE架构,总参数量600B、激活参数仅27B,支持100万Token上下文窗口,原生支持文本与视觉输入。即日起全量开放I,模型权重将于10月15日开源释放。 在全球权威的Artificial Analysis Intelligence Index中

09/20
𝕏 @fxtrader

DeepSeek下调flash系列模型定价,降幅11%-60%

DeepSeek开放平台今日公告,00起,空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。 00(其余为空闲时段)。据悉,缓存命中、缓存未命中及输出价格最高降幅分别为60%、33.33%和11.11%。

09/09
日经

中国AI使用比例过半

在可灵活选用不同人工智能(AI)模型的服务中,中国AI的使用比例已超过一半。在提升性能的同时,中国AI采取了便于外部开发者以低成本使用的“开源”策略,扩大了市场份额。未来,高端AI领域的价格竞争将更加激烈。 能够区分使用不同AI模型的美国OpenRouter截至9月7日的每周数据显示,使用最广泛的AI模型是中国腾讯控股推出的新型AI“Hy4 preview”。 Hy4 preview的智能体具有优

09/16
凤凰网科技

8万亿,梁文锋也开始卷“超大”

DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。

09/22
cnbeta

下一代旗舰模型Gemini 4发布时间或“远早于”今年底

Google DeepMind部门负责人Koray Kavukcuoglu周三表示,Google接近发布其最新旗舰模型 Gemini 4,这是这家科技巨头在人工智能模型竞赛中落后于竞争对手 Anthropic 和 OpenAI 后期待已久的进展。 Kavukcuoglu 在一次活动上表示,Gemini 4 正处于被称为“后训练”的开发阶段的初期,在此阶段,基础 AI 模型将得到完善,以使其表现可靠

09/24
cnbeta

智谱宣布GLM-5.3模型开源 支持免费部署和商用 但大型企业必须先提交审查

智谱日前宣布 GLM-5.3 模型正式开源,该模型已经在 8 月中旬上线 I 服务供开发者们使用,但由于模型网络安全能力增长超出预期,所以模型权重开放被推迟以进行额外的审查,现在完成审查后智谱开始提供模型权重。 总参数规模为GLM-5.3 模型沿用 GLM-5.2 的基础模型,所有能力提升均来自后训练阶段。模型采用 MoE 混合专家架构,总参数规模为 743B,每次推理时激活的参数为 39B,支持

08/29
cnbeta

深度求索推迟DS V4 Pro下线时间 但也只延迟到9月14日

昨天深度求索已经预告将在今天上线 DS V4.1 Flash 模型,深度求索经过内部和外部评测后认为 DS V4.1 Flash 能力和响应速度都远超 DS V4 Pro,所以深度求索计划在 DS V4.1 Flash 上线后,直接将现有的 DS V4 Pro 请求全部自动路由到 DS V4.1 Flash。 按照深度求索所说,新模型性能好、能力高、价格也更便宜,所以直接路由应该是好事情才对。然而

09/10
cnbeta

DeepSeek的烦恼:任务越来越多,人不够用了

以“小团队、高人才密度”著称的DeepSeek,开始大规模补充工程人员。9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。他称,这是“前所未有的150个HC的招聘需求”,公司目前有“很多新方向、新系统、新需求需要搞”。 崔添翼贴文截图两天后,DeepSeek又宣布下调Flash系列I价格,缓存命中输入价格最高下降60%。相比价格变化,此次招聘

09/09
日经

中国AI加码价格竞争

中国的人工智能(AI)新兴企业正推出低价格的AI模型。低于美国AI产品,甚至低于中国知名AI企业DeepSeek(深度求索),希望抓住DeepSeek8月中旬大幅提价的机会扩大份额。 中国AI新兴企业北京智谱华章科技(智谱)9月26日透露,Ox-Alpha的真实身份是该公司的“GLM-5.3-Flash”。每token的价格比提价后的DeepSeek便宜20%~70%。 性能也表现出色。专注于AI

09/08
财新

【周刊提前读】AI竞争白热化、模型超速迭代 “Kimi时刻”已来

从2月到8月底,中国AI(人工智能)大模型公司月之暗面(Kimi)在私募市场的投前估值从100亿美元涨了4倍至500亿美元;而其7月末开始的350亿美元估值的上轮融资刚刚交割,募资额35亿美元——这意味着,仅仅一个月,月之暗面的估值又涨了150亿美元。 另一家中国大模型公司DeepSeek(深度求索)更是抢手,其在7、8月间启动的第二轮融资谈判,放出的投前估值接近5000亿元人民币。“一级市场能投

09/05
财新

T早报|DeepSeek扩招150人;Meta发布个人AI智能体Muse;华为“韬定律”芯片麒麟9050 Pro首现身

DeepSeek扩招150人 为史上单次最大规模招聘9月8日,DeepSeek发布招聘信息,招聘人数达到150人。招聘包含两大方向,一类是服务端开发工程师,覆盖大模型研究平台、Agent框架组件、研发效率基建、DeepSeek I、线上服务、数据工程六大方向;另一类则是Agent弹性计算研发工程师,涉及平台开发和底层系统。DeepSeek Harness团队负责人崔添翼在社交平台称,这个计算机领域

09/09
𝕏 @fxtrader

The Information:DeepSeek完成75亿美元融资,估值达到750亿美元。

09/24 全文见 thenextweb
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…