搜索结果
DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8
在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn
DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持
9月8日,DeepSeek今日在官方交流群内发布通知,DeepSeek V4.1 Flash的中间版本内测。据介绍,模型采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。模型的base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费与deepseek-v4-flash相同,每账号限流20并发。 据了解,DeepS
DeepSeek 开口说话了:灰度测试上线,支持四种音色
同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De
DeepSeek V4.1 Flash预计9月10日前后发布
DeepSeek开放平台发布通知,计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。 据官方介绍,经内部及外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。 昨日,DeepSeek已在官方交流群内开启V4.1 Flash中间版本内测。据参与内测的用户反馈,新模型采用了全新模型结构,原生支持多模态,能力更强、速度更快、成本更低。凤凰
中国DeepSeek发布V4.1-Flash模型
据一份声明,中国人工智能初创公司DeepSeek周四推出了DeepSeek-V4.1-Flash,该公司称这是其新架构系列中规模最小的模型。
DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板
中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe
DeepSeek涨价不足1月又宣布最高降价6成
| 围绕AI模型使用费,价格竞争越来越激烈 |中国AI初创企业DeepSeek于9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费,最高降幅达60%。该公司在8月中旬才刚刚上调过价格。此次降价意在通过价格战对抗竞争对手。 V4系列包含主打响应速度的“V4-Flash”以及擅长更复杂任务处理的“V4-Pro”等版本。本次的降价对象为V4-Flash。输入、输出每100万token的单价下调
深度求索称新款 Flash 人工智能模型在网络安全和编程基准测试中击败 Kimi K3
深度求索(DeepSeek)发布了 V4.1 Flash 模型,宣称其性能超越了上一代旗舰产品,同时降低了推理成本并提升了运行速度——这是中国激烈的价格与性能大战中的又一最新举措。 这家中国人工智能开发商周四表示,V4.1 Flash 采用了全新的“因果-编码器-解码器”(Causal-Encoder-Decoder)架构。尽管它构建于 5520 亿参数的大规模框架之上,但采用了混合专家(MoE)
腾讯Hy4模型在生态驱动训练后于开源AI排名中上升
腾讯控股利用其庞大产品生态系统训练新Hy4预览模型的策略,使其在开发AI智能体方面占据优势,并使其旗舰模型系列重回开源产品第一梯队,分析师表示。 这家中国科技巨头的“差异化产品加模型策略”——即预览模型首先部署在腾讯全系产品中——使其能够收集用户数据,再将信息反馈到后续训练轮次中,高盛分析师在周一的研究报告中表示。 “我们认为这种闭环方法对生产力和编码工作负载尤其重要,在智能体AI时代,真实世界的
谷歌 DeepMind 的 Gemini 4 模型即将发布
Google DeepMind 高级副总裁 Koray Kavukcuoglu 于 2026 年 9 月 23 日星期三在 The Information 的 AI Agenda Live Summit 上宣布,公司的下一代旗舰人工智能模型 Gemini 4 目前处于后训练的早期阶段。 Kavukcuoglu 表示,他希望该模型能在年底之前「提前很多」发布,以重新夺回与竞争对手 Anthropic
腾讯宣传新AI模型,声称超越Z.AI和月之暗面
腾讯控股有限公司发布了一款基础模型,称其在内部测试中优于竞争对手Z.AI公司和月之暗面,声称在中国顶级人工智能玩家中占有一席之地。 该公司在一份声明中表示,Hy4 Preview模型运行在7700亿参数上,并具有100万token的上下文窗口,这标志着其前身在规模和数据规模上的巨大进步。上下文窗口越大,AI模型能记住的就越多,也就能更好地回应用户的查询和指令。 在腾讯自己的专家进行的盲测工程测试中
谷歌宣布正加速推进旗舰级 Gemini 4 AI 模型研发
谷歌科技巨头即将推出其最新旗舰人工智能模型 Gemini 4,以在与 Anthropic 和 OpenAI 的竞争中重新赢得优势。谷歌 DeepMind 新任最高领导人 Kavukcuoglu 在 AI Agenda Live 峰会上表示,Gemini 4 目前正处于后训练阶段的早期,团队正在对其进行精调与安全性测试,目标是“远早于”今年年底发布。 该模型是自去年 Gemini 3 系列发布以来的
Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑
快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS
阶跃发布旗舰模型Step 5 Preview:跻身全球权威榜单开源前三
凤凰网科技讯 9月20日,阶跃StepFun正式发布新一代旗舰基座模型Step 5 Preview,面向真实世界Agentic任务设计。该模型采用稀疏MoE架构,总参数量600B、激活参数仅27B,支持100万Token上下文窗口,原生支持文本与视觉输入。即日起全量开放I,模型权重将于10月15日开源释放。 在全球权威的Artificial Analysis Intelligence Index中
DeepSeek下调flash系列模型定价,降幅11%-60%
DeepSeek开放平台今日公告,00起,空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。 00(其余为空闲时段)。据悉,缓存命中、缓存未命中及输出价格最高降幅分别为60%、33.33%和11.11%。
中国AI使用比例过半
在可灵活选用不同人工智能(AI)模型的服务中,中国AI的使用比例已超过一半。在提升性能的同时,中国AI采取了便于外部开发者以低成本使用的“开源”策略,扩大了市场份额。未来,高端AI领域的价格竞争将更加激烈。 能够区分使用不同AI模型的美国OpenRouter截至9月7日的每周数据显示,使用最广泛的AI模型是中国腾讯控股推出的新型AI“Hy4 preview”。 Hy4 preview的智能体具有优
8万亿,梁文锋也开始卷“超大”
DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。
下一代旗舰模型Gemini 4发布时间或“远早于”今年底
Google DeepMind部门负责人Koray Kavukcuoglu周三表示,Google接近发布其最新旗舰模型 Gemini 4,这是这家科技巨头在人工智能模型竞赛中落后于竞争对手 Anthropic 和 OpenAI 后期待已久的进展。 Kavukcuoglu 在一次活动上表示,Gemini 4 正处于被称为“后训练”的开发阶段的初期,在此阶段,基础 AI 模型将得到完善,以使其表现可靠
智谱宣布GLM-5.3模型开源 支持免费部署和商用 但大型企业必须先提交审查
智谱日前宣布 GLM-5.3 模型正式开源,该模型已经在 8 月中旬上线 I 服务供开发者们使用,但由于模型网络安全能力增长超出预期,所以模型权重开放被推迟以进行额外的审查,现在完成审查后智谱开始提供模型权重。 总参数规模为GLM-5.3 模型沿用 GLM-5.2 的基础模型,所有能力提升均来自后训练阶段。模型采用 MoE 混合专家架构,总参数规模为 743B,每次推理时激活的参数为 39B,支持
深度求索推迟DS V4 Pro下线时间 但也只延迟到9月14日
昨天深度求索已经预告将在今天上线 DS V4.1 Flash 模型,深度求索经过内部和外部评测后认为 DS V4.1 Flash 能力和响应速度都远超 DS V4 Pro,所以深度求索计划在 DS V4.1 Flash 上线后,直接将现有的 DS V4 Pro 请求全部自动路由到 DS V4.1 Flash。 按照深度求索所说,新模型性能好、能力高、价格也更便宜,所以直接路由应该是好事情才对。然而
DeepSeek的烦恼:任务越来越多,人不够用了
以“小团队、高人才密度”著称的DeepSeek,开始大规模补充工程人员。9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。他称,这是“前所未有的150个HC的招聘需求”,公司目前有“很多新方向、新系统、新需求需要搞”。 崔添翼贴文截图两天后,DeepSeek又宣布下调Flash系列I价格,缓存命中输入价格最高下降60%。相比价格变化,此次招聘
中国AI加码价格竞争
中国的人工智能(AI)新兴企业正推出低价格的AI模型。低于美国AI产品,甚至低于中国知名AI企业DeepSeek(深度求索),希望抓住DeepSeek8月中旬大幅提价的机会扩大份额。 中国AI新兴企业北京智谱华章科技(智谱)9月26日透露,Ox-Alpha的真实身份是该公司的“GLM-5.3-Flash”。每token的价格比提价后的DeepSeek便宜20%~70%。 性能也表现出色。专注于AI
【周刊提前读】AI竞争白热化、模型超速迭代 “Kimi时刻”已来
从2月到8月底,中国AI(人工智能)大模型公司月之暗面(Kimi)在私募市场的投前估值从100亿美元涨了4倍至500亿美元;而其7月末开始的350亿美元估值的上轮融资刚刚交割,募资额35亿美元——这意味着,仅仅一个月,月之暗面的估值又涨了150亿美元。 另一家中国大模型公司DeepSeek(深度求索)更是抢手,其在7、8月间启动的第二轮融资谈判,放出的投前估值接近5000亿元人民币。“一级市场能投
T早报|DeepSeek扩招150人;Meta发布个人AI智能体Muse;华为“韬定律”芯片麒麟9050 Pro首现身
DeepSeek扩招150人 为史上单次最大规模招聘9月8日,DeepSeek发布招聘信息,招聘人数达到150人。招聘包含两大方向,一类是服务端开发工程师,覆盖大模型研究平台、Agent框架组件、研发效率基建、DeepSeek I、线上服务、数据工程六大方向;另一类则是Agent弹性计算研发工程师,涉及平台开发和底层系统。DeepSeek Harness团队负责人崔添翼在社交平台称,这个计算机领域