搜索结果
生图AI模型FLUX 3 Image发布:支持4K生成
IT之家 10 月 2 日消息,德国 AI 公司 Black Forest Labs 今天(10 月 2 日)发布公告,宣布推出图像生成 AI 模型 FLUX 3 Image,支持生成最高 4K 分辨率图片,输出画面在放大后仍保持丰富细节。 该模型基于 FLUX 3 基座开发,以高可控性与精细编辑能力为核心卖点。用户可在归一化的 0–1000 坐标网格上,为每个元素指定 ID、描述文本及精确边界框
腾讯混元发布Hy Image3.5 preview:支持文生图和图生图,多轮对话创作
凤凰网科技讯 9月22日,腾讯混元正式发布图像生成模型Hy Image3.5 preview,支持文生图、图生图及多轮对话创作。据官方介绍,该模型经腾讯内部数百名专业设计师GSB盲测,效果较Hy Image3.0提升30%,与Seedream 5.0 pro持平,略优于Nano-Banana Pro和Qwen-Image-3.0 Pro。 定价方面,腾讯云I 2K图像定价为0.15元/张(国际版0
微软发布MAI-Image-2.6 Flash 主打更快、更便宜的AI图像生成
微软正在进一步扩大自研人工智能模型的布局。当地时间9月4日,据Neowin报道,微软推出了MAI-Image-2.6 Flash,这是一款面向高频图像生成任务优化的新模型,重点提升生成速度和成本效率。微软方面表示,新模型能够在保持较高图像质量的同时,以更低的成本处理大量生成请求。 MAI-Image-2.6 Flash属于微软MAI系列图像模型,主要面向需要快速生成图片的用户和开发者。与更注重最高
OpenAI推出新生图模型ChatGPT Images 2.
ChatGPT Images 2.5——更快、更清晰、更智能,并配备更好的工具,让你能创造出你所梦想的一切。
DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持
9月8日,DeepSeek今日在官方交流群内发布通知,DeepSeek V4.1 Flash的中间版本内测。据介绍,模型采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。模型的base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费与deepseek-v4-flash相同,每账号限流20并发。 据了解,DeepS
DeepSeek 开口说话了:灰度测试上线,支持四种音色
同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De
快手旗下可灵发布新一代视频生成模型
中国快手科技拟分拆上市的AI部门发布最新视频生成模型可灵4.0,以加快缩小与行业领先者字节跳动的差距。 可灵4.0把单次可生成视频片段的最长时长翻倍至30秒,并可接受十多种参考输入,包括文字、图片和现有视频。 新模型在复杂度上进一步提升,用户最多还可添加10个所谓「关键帧」,即用于确定视频特定片段预期画面效果的图像,从而更精细地控制生成结果。 目前新模型仍在向部分用户测试,简化版已面向年度订阅用户
MiniMax新模型上线:能够完成Bug修复、完整功能开发等任务
DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8
在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn
OpenAI 现在为 Adobe 的创意工作室提供图像模型,并将其转化为可分享的提示词。
OpenAI 发布了 ChatGPT Images 2.5,包含两个新的图像模型,Adobe 已经将其中一个应用到了 Firefly 中。 该公司表示,ChatGPT 及其图像模型每周生成的图像超过 30 亿张。 值得注意的是,此次新增的主要是界面功能而非模型研究,其中包括能够将提示词与图像一起分享等 […]
智谱GLM-5.3-FlashX模型上线:进一步形成智能、价格、速度的全面竞争力
凤凰网科技讯 9月18日,智谱宣布推出GLM-5.3-FlashX(最高200tokens/s),为企业与开发者带来更快、更流畅的模型体验。 智谱官方表示,GLM-5.3-Flash此前以“Ox Alpha”之名与全球开发者见面,调用量持续攀升。面对快速增长的需求,智谱在10万张国产芯片提供的推理算力基础上,进一步加大对Infra侧的投入与推理优化。GLM-5.3-Flash 长期保持同尺寸最强智
谷歌最前沿AI模型:Gemini 4 Argon登场,长周期代码工程测试超Opus 5.5
谷歌推出面向企业的Gemini 3.8 Live,配备实时虚拟形象
谷歌推出面向企业的 Gemini 3.8 Live,配备实时虚拟形象。 2026 年 9 月 24 日,谷歌推出 Gemini 3.8 Live 的实时虚拟形象功能。 这是 Gemini Enterprise 的一项功能,将近实时视频生成与语音相结合,提供动态的视觉形象。 该工具支持 97 种语言的精准唇形同步和自然表情,让企业智能体能够改善客户服务和交互式操作演示。 它支持异步工具执行,使 AI
DeepSeek V4.1 Flash预计9月10日前后发布
DeepSeek开放平台发布通知,计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。 据官方介绍,经内部及外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。 昨日,DeepSeek已在官方交流群内开启V4.1 Flash中间版本内测。据参与内测的用户反馈,新模型采用了全新模型结构,原生支持多模态,能力更强、速度更快、成本更低。凤凰
SpaceXAI发布Grok 4.7 AI模型,提升编码与知识处理能力
2026年9月21日,SpaceXAI发布了Grok 4.7这款专为编码和专业知识工作优化的人工智能模型。 该模型采用了更大的基础模型和扩展的强化学习技术,提高了自我验证能力和处理复杂上下文的能力。 其定价与Grok 4.6保持一致,每百万输入令牌2美元,每百万输出令牌6美元。 Grok 4.7可通过Cursor、Grok Build、Grok I以及多种云平台使用。 该公司表示,该模型在Curs
Google推出AI图像创作工具Pics 基于Nano Banana模型打造
Google于9月1日正式推出Google Pics,这是一款集成在Google Workspace中的生成式人工智能图像创作与编辑工具,旨在与Canva、Adobe Express以及微软Designer等产品展开竞争。Google AI Pro和Ultra订阅用户,以及大多数Google Workspace企业客户,都可以免费使用该工具。 Google Pics由Gemini的“Nano Ba
Google发布Gemini 3.8 Live Live Avatar数字人交互功能 赋予AI实时视频面孔
Google公司宣布,正式在Gemini Enterprise企业级平台中全面上线“Live Avatar”(实时数字人)功能。该技术深度集成了Google最新的Gemini 3.8 Live大模型架构,在原有近乎零延迟的高流畅语音对谈基础上,首次引入了近乎实时的生成式视频生成能力,使对话式人工智能拥有了能够“边听、边看、边说”的动态视觉形象。 根据官方介绍,Gemini 3.8 Live Liv
阿里发布Qwen3.8-Omni-Flash:音视频API降价超90%
凤凰网科技讯 9月18日,阿里千问正式上线新一代原生全模态模型Qwen3.8-Omni-Flash。该模型支持文本、图像、音频和视频输入,具备1M长上下文,核心目标是推动全模态模型从“理解内容”走向“规划任务、调用工具并完成创作”。 在累计30项评测中,该模型相比上一代Qwen3.5-Omni-Plus平均得分提升超26%。其中,音视频Agent、Coding及长程任务在WildClawBench
千问同声传译大模型Qwen3.8-LiveTranslate正式发布
凤凰网科技讯 9月19日,千问正式发布同声传译大模型Qwen3.8-LiveTranslate,模型以Interleave架构重构实时同传,准确度、流畅度、简洁度全面提升,字均延迟从2.8秒降至2.3秒。 据介绍,在支持60种语言的基础上,Qwen3.8-LiveTrans实时说话人分离,每句话归属清晰,音色复刻更稳定;
突发:谷歌推出其全新前沿AI模型Gemini
谷歌发布Gemini 3.8 Flash,六周内第三个Flash模型
自2026年初以来,谷歌尚未发布前沿级别的Gemini Pro AI模型,但它确实热衷于推出新的Gemini Flash变体。今天,谷歌宣布在短短六周内发布第三个Flash模型,这使得我们更有可能永远看不到承诺的Gemini 3.5 Pro。但谷歌表示没关系,因为Gemini 3.8 Flash是其迄今为止最好的推理和编码模型。 Gemini 3.8 Flash有两个版本。有标准Flash,谷歌将
中国大模型首次进入OpenAI企业付费结算体系,Kimi K3接入Codex企业通道
IT之家 9 月 30 日消息,美国 AI 基础设施公司 Baseten 今天宣布与 OpenAI 达成合作,成为 OpenAI B2B 市场首批开源模型推理服务提供商之一。企业用户可通过 Codex 使用 Kimi K3 和 GLM 5.3 等开源模型,意味着中国开源模型首次进入 OpenAI 企业采购体系。 IT之家了解到,Kimi K3 是月之暗面开发的大模型。官方宣称其是首个参数规模达 2
月之暗面最强AI:消息称Kimi K3.1下月登场
IT之家 9 月 24 日消息,科技媒体 Wccftech 昨日(9 月 23 日)发布博文,报道称月之暗面(Moonshot)正酝酿推出 Kimi K3.1 模型,并将提供 Low、High、Max 共 3 档推理强度,预估会在下月(2026 年 10 月)登场。消息源 @MaxForAI 昨日在 X 平台发布推文,发现月之暗面内部 JSON / API 响应中,出现 Kimi K3.1 相关标
[GIF] Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列
Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列 谷歌最新大模型Gemini 4 Pro在权威平台Arena及多项基准测试中展现出卓越性能。 在 Three.js 3D渲染与代码生成测试中,该模型响应速度与生成质量均显著超越同类竞品;在智能体编码、知识工作及终端操作等测评中亦斩获多项最佳成绩。 该模型在保持旗舰级性能的同时具备极高性价比,预示着谷歌在前沿AI领域的研发节奏正