搜索结果
Cloudflare 发布基于 Qwen3.8-27B 和 Qwen3.5-9B 的开源多模态决策模型 Clef 和 Clef-flash
Cloudflare近日推出Clef系列决策模型,包含Clef与Clef-flash两个版本。 该模型基于Qwen3.8-27B及Qwen3.5-9B开发,旨在处理是非题、多项选择及排序等任务。 相比TypeSafe的Jev,Clef不仅支持文本处理,还具备图像与视频处理能力,且支持64k上下文窗口。 Clef可通过Cloudflare Workers AI调用,或以Apache-2.0协议从Hu
Cloudflare试图用开放权重的Clef模型击败Jev
在Jev模型轰动人工智能界两周后,Cloudflare发布了自己的两款“Clef”决策模型,称其不仅比Jev更聪明、更快,还采用开放权重,可在本地运行。Cloudflare于周四宣布了Clef决策模型系列,该系列包括两个模型:Clef和体积略小、速度更快的Clef-flash。就实际用途而言,它们的运作方式与TypeSafe的Jev基本相同,能够回答三类有边界且结构化的问题:是/否问题、多项选择题
DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持
9月8日,DeepSeek今日在官方交流群内发布通知,DeepSeek V4.1 Flash的中间版本内测。据介绍,模型采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。模型的base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费与deepseek-v4-flash相同,每账号限流20并发。 据了解,DeepS
阿里巴巴发布Qwen3.8-Omni-Flash 多项表现逼近Gemini 3.8 Flash
阿里巴巴旗下Qwen团队近日发布新一代原生全模态模型Qwen3.8-Omni-Flash,进一步将音频、视频理解与AI智能体能力结合起来。该模型支持文本、图像、音频和视频四种输入形式,并提供100万Token上下文窗口。与上一代Qwen3.5-Omni-Plus相比,Qwen官方称其在29项基准测试中的平均成绩提升超过25%,同时大幅降低了音频和音视频处理成本。 Qwen3.8-Omni-Flas
阿里发布Qwen3.8-Omni-Flash:音视频API降价超90%
凤凰网科技讯 9月18日,阿里千问正式上线新一代原生全模态模型Qwen3.8-Omni-Flash。该模型支持文本、图像、音频和视频输入,具备1M长上下文,核心目标是推动全模态模型从“理解内容”走向“规划任务、调用工具并完成创作”。 在累计30项评测中,该模型相比上一代Qwen3.5-Omni-Plus平均得分提升超26%。其中,音视频Agent、Coding及长程任务在WildClawBench
阿里Qwen4和下代视频模型训练中,Qwen4.5后模型将扩展至5-10T参数
IT之家 9 月 22 日消息,IT之家今日从 2026 年云栖大会现场获悉,阿里巴巴公布了大模型一系列进展,大模型递归自我改进已初步进入模型训练、推理及芯模协同等环节中,基于新一代架构的 Qwen4 已在训练中,未来 Qwen4.5、Qwen5 等版本将扩展至 5-10T 参数。 同时,阿里的视频生成模型、语音模型、图像模型、世界模型、音乐模型以及全模态模型等均在当天或近期推出新版本。 阿里全新
🖼 美国《联邦公报》网站接入 Qwen3,0.6B 开源模型进入政府法规搜索系统。
美国《联邦公报》网站接入 Qwen3,0.6B 开源模型进入政府法规搜索系统。来源:新浪财经 / Federal Register
千问同声传译大模型Qwen3.8-LiveTranslate正式发布
凤凰网科技讯 9月19日,千问正式发布同声传译大模型Qwen3.8-LiveTranslate,模型以Interleave架构重构实时同传,准确度、流畅度、简洁度全面提升,字均延迟从2.8秒降至2.3秒。 据介绍,在支持60种语言的基础上,Qwen3.8-LiveTrans实时说话人分离,每句话归属清晰,音色复刻更稳定;
DeepSeek 开口说话了:灰度测试上线,支持四种音色
同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De
DeepSeek V4.1 Flash预计9月10日前后发布
DeepSeek开放平台发布通知,计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。 据官方介绍,经内部及外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。 昨日,DeepSeek已在官方交流群内开启V4.1 Flash中间版本内测。据参与内测的用户反馈,新模型采用了全新模型结构,原生支持多模态,能力更强、速度更快、成本更低。凤凰
阶跃发布旗舰模型Step 5 Preview:跻身全球权威榜单开源前三
凤凰网科技讯 9月20日,阶跃StepFun正式发布新一代旗舰基座模型Step 5 Preview,面向真实世界Agentic任务设计。该模型采用稀疏MoE架构,总参数量600B、激活参数仅27B,支持100万Token上下文窗口,原生支持文本与视觉输入。即日起全量开放I,模型权重将于10月15日开源释放。 在全球权威的Artificial Analysis Intelligence Index中
Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化
【财新网】在各自的旗舰模型基础上,各大模型厂发布更新版模型。北京时间9月2日和3日,Anthropic、Meta、谷歌和阿里等公司发布了基于旗舰模型的更新版本,在编程、网络安全和办公等领域的能力提升。 目前从第三方AI模型榜单看,最新发布的模型当中,Claude Fable 5.1在智能水平上排名最靠前,Meta新发布的Muse Spark 1.3排名第三,谷歌的新模型Gemini 3.8 Fla
中国电信发布基于华为升腾NPU训练的Xing4.0-29B-A4B MoE模型
中国电信发布了Xing4.0-29B-A4B MoE模型,该模型采用华为Ascend NPUs进行训练。 这款开放权重混合专家语言模型专为工具调用、编码和多步骤规划等任务设计,拥有290亿个总参数,每个令牌有40亿个活跃参数,并支持256K的上下文窗口。 值得注意的是,这是首个完全在华为Ascend 910C NPUs上使用MindSpore/MindFormers框架训练的此类规模模型,通过定制
中国DeepSeek发布V4.1-Flash模型
据一份声明,中国人工智能初创公司DeepSeek周四推出了DeepSeek-V4.1-Flash,该公司称这是其新架构系列中规模最小的模型。
DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板
中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe
DeepSeek下调flash系列模型定价,降幅11%-60%
DeepSeek开放平台今日公告,00起,空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。 00(其余为空闲时段)。据悉,缓存命中、缓存未命中及输出价格最高降幅分别为60%、33.33%和11.11%。
阿里千问发布Qwen-Audio-3.1系列语音大模型,全线降价最高达95%
千问今日正式发布Qwen-Audio-3.1系列语音大模型,对语音识别、语音合成和实时语音交互三大核心模型进行全面升级同时推出全新的音频创作模型Qwen-Audio-3.1-TTS-Next和音频理解模型Qwen-Audio-3.1-ASR-Next。官方称,五款新模型形成覆盖“理解-生成-交互-创作”的完整音频能力栈。为进一步降低使用成本,Qwen-Audio全线语音模型价格均下调,其中TTS降
T早报|腾讯WorkBuddy布局生态;阿里更新Qwen 3.8-Max;Anthropic发布Fable 5.1和Mythos 5.1
腾讯WorkBuddy布局生态 为软硬件开放智能体底座能力9月2日,腾讯WorkBuddy宣布开放平台正式上线,首批引入硬软件百余家厂商合作,面向智能硬件、行业应用与开发者等开放底层智能体能力。腾讯在WorkBuddy生态发布会上展出9款联名智能硬件,具体合作方包括Plaud、乐奇Rokid、影石、科大讯飞、安克、猛玛、京东京造等品牌;同时,通达信、广发证券、北大法宝、微盟、北森、云账房和帆软等3
DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8
在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn
PrismML发布可在手机运行的27B模型
AI实验室PrismML正在把推理模型做得小到能装到个人电脑和智能手机上。当地时间周四,PrismML发布了Bonsai 2 27B,这是其模型系列中的最新款,将来自阿里巴巴的开源模型Qwen3.8 27B压缩到5.9GB。 这足够小,能装到一台个人电脑上,甚至可能装到一部高端智能手机上。与原版模型相比,内存占用减少了9到10倍。PrismML由一群加州理工学院研究人员创立,并由加州理工学院教授兼
OpenAI推出新生图模型ChatGPT Images 2.
ChatGPT Images 2.5——更快、更清晰、更智能,并配备更好的工具,让你能创造出你所梦想的一切。
亚马逊发布自家Jev克隆版,决策模型席卷网络
亚马逊网络服务(AWS)发布了一款受 TypeSafe 的 Jev 启发的开源决策模型,随着 AI 开发者越来越寻求比前沿大语言模型(LLM)更适合计算机自动化的智能。 亚马逊的 Strands Decider 2B 在 OpenAI 宣布类似产品的同一周发布,它是一种高速、低成本的方法,用于在预先决定的选项中进行挑选,并提供其对选择的确信程度。该模型完全开源,现已推出,且体积小到足以在本地运行。
智谱GLM-5.3-FlashX模型上线:进一步形成智能、价格、速度的全面竞争力
凤凰网科技讯 9月18日,智谱宣布推出GLM-5.3-FlashX(最高200tokens/s),为企业与开发者带来更快、更流畅的模型体验。 智谱官方表示,GLM-5.3-Flash此前以“Ox Alpha”之名与全球开发者见面,调用量持续攀升。面对快速增长的需求,智谱在10万张国产芯片提供的推理算力基础上,进一步加大对Infra侧的投入与推理优化。GLM-5.3-Flash 长期保持同尺寸最强智
Cognition推出SWE-2编程模型,旨在提升智能体性能
2026年9月10日,Cognition推出了其迄今为止最先进的编程模型SWE-2,旨在优化成本与性能的帕累托前沿(Pareto frontier)。 SWE-2基于拥有2.8万亿参数的Kimi K3模型进行后训练,采用了一种全新的强化学习(RL)算法,通过线性成本惩罚同时训练多个推理力度级别。 基准测试数据显示,SWE-2在FrontierCode 1.1 Main上的得分为50.0%,在性能上