字号 ·· | 护眼

搜索结果

「生图AI模型FLUX 3 Image发布:支持4K生成」共 86 条 · 第 1 页
凤凰网科技

生图AI模型FLUX 3 Image发布:支持4K生成

IT之家 10 月 2 日消息,德国 AI 公司 Black Forest Labs 今天(10 月 2 日)发布公告,宣布推出图像生成 AI 模型 FLUX 3 Image,支持生成最高 4K 分辨率图片,输出画面在放大后仍保持丰富细节。 该模型基于 FLUX 3 基座开发,以高可控性与精细编辑能力为核心卖点。用户可在归一化的 0–1000 坐标网格上,为每个元素指定 ID、描述文本及精确边界框

3小时前
凤凰网科技

腾讯混元发布Hy Image3.5 preview:支持文生图和图生图,多轮对话创作

凤凰网科技讯 9月22日,腾讯混元正式发布图像生成模型Hy Image3.5 preview,支持文生图、图生图及多轮对话创作。据官方介绍,该模型经腾讯内部数百名专业设计师GSB盲测,效果较Hy Image3.0提升30%,与Seedream 5.0 pro持平,略优于Nano-Banana Pro和Qwen-Image-3.0 Pro。 定价方面,腾讯云I 2K图像定价为0.15元/张(国际版0

09/22
cnbeta

微软发布MAI-Image-2.6 Flash 主打更快、更便宜的AI图像生成

微软正在进一步扩大自研人工智能模型的布局。当地时间9月4日,据Neowin报道,微软推出了MAI-Image-2.6 Flash,这是一款面向高频图像生成任务优化的新模型,重点提升生成速度和成本效率。微软方面表示,新模型能够在保持较高图像质量的同时,以更低的成本处理大量生成请求。 MAI-Image-2.6 Flash属于微软MAI系列图像模型,主要面向需要快速生成图片的用户和开发者。与更注重最高

09/05
𝕏 @fxtrader

OpenAI推出新生图模型ChatGPT Images 2.

ChatGPT Images 2.5——更快、更清晰、更智能,并配备更好的工具,让你能创造出你所梦想的一切。

09/09
cnbeta

DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持

9月8日,DeepSeek今日在官方交流群内发布通知,DeepSeek V4.1 Flash的中间版本内测。据介绍,模型采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。模型的base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费与deepseek-v4-flash相同,每账号限流20并发。 据了解,DeepS

09/08
cnbeta

DeepSeek 开口说话了:灰度测试上线,支持四种音色

同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De

09/12
风向旗参考快讯

快手旗下可灵发布新一代视频生成模型

中国快手科技拟分拆上市的AI部门发布最新视频生成模型可灵4.0,以加快缩小与行业领先者字节跳动的差距。 可灵4.0把单次可生成视频片段的最长时长翻倍至30秒,并可接受十多种参考输入,包括文字、图片和现有视频。 新模型在复杂度上进一步提升,用户最多还可添加10个所谓「关键帧」,即用于确定视频特定片段预期画面效果的图像,从而更精细地控制生成结果。 目前新模型仍在向部分用户测试,简化版已面向年度订阅用户

09/29
凤凰网科技

MiniMax新模型上线:能够完成Bug修复、完整功能开发等任务

09/28
cnbeta

DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8

在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn

09/01
thenextweb

OpenAI 现在为 Adobe 的创意工作室提供图像模型,并将其转化为可分享的提示词。

OpenAI 发布了 ChatGPT Images 2.5,包含两个新的图像模型,Adobe 已经将其中一个应用到了 Firefly 中。 该公司表示,ChatGPT 及其图像模型每周生成的图像超过 30 亿张。 值得注意的是,此次新增的主要是界面功能而非模型研究,其中包括能够将提示词与图像一起分享等 […]

09/09
凤凰网科技

智谱GLM-5.3-FlashX模型上线:进一步形成智能、价格、速度的全面竞争力

凤凰网科技讯 9月18日,智谱宣布推出GLM-5.3-FlashX(最高200tokens/s),为企业与开发者带来更快、更流畅的模型体验。 智谱官方表示,GLM-5.3-Flash此前以“Ox Alpha”之名与全球开发者见面,调用量持续攀升。面对快速增长的需求,智谱在10万张国产芯片提供的推理算力基础上,进一步加大对Infra侧的投入与推理优化。GLM-5.3-Flash 长期保持同尺寸最强智

09/18
凤凰网科技

谷歌最前沿AI模型:Gemini 4 Argon登场,长周期代码工程测试超Opus 5.5

10/01 全文见 美国消费者新闻与商业频道
罗塞塔简报

谷歌推出面向企业的Gemini 3.8 Live,配备实时虚拟形象

谷歌推出面向企业的 Gemini 3.8 Live,配备实时虚拟形象。 2026 年 9 月 24 日,谷歌推出 Gemini 3.8 Live 的实时虚拟形象功能。 这是 Gemini Enterprise 的一项功能,将近实时视频生成与语音相结合,提供动态的视觉形象。 该工具支持 97 种语言的精准唇形同步和自然表情,让企业智能体能够改善客户服务和交互式操作演示。 它支持异步工具执行,使 AI

09/25
风向旗参考快讯

DeepSeek V4.1 Flash预计9月10日前后发布

DeepSeek开放平台发布通知,计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。 据官方介绍,经内部及外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。 昨日,DeepSeek已在官方交流群内开启V4.1 Flash中间版本内测。据参与内测的用户反馈,新模型采用了全新模型结构,原生支持多模态,能力更强、速度更快、成本更低。凤凰

09/09
罗塞塔简报

SpaceXAI发布Grok 4.7 AI模型,提升编码与知识处理能力

2026年9月21日,SpaceXAI发布了Grok 4.7这款专为编码和专业知识工作优化的人工智能模型。 该模型采用了更大的基础模型和扩展的强化学习技术,提高了自我验证能力和处理复杂上下文的能力。 其定价与Grok 4.6保持一致,每百万输入令牌2美元,每百万输出令牌6美元。 Grok 4.7可通过Cursor、Grok Build、Grok I以及多种云平台使用。 该公司表示,该模型在Curs

09/22
cnbeta

Google推出AI图像创作工具Pics 基于Nano Banana模型打造

Google于9月1日正式推出Google Pics,这是一款集成在Google Workspace中的生成式人工智能图像创作与编辑工具,旨在与Canva、Adobe Express以及微软Designer等产品展开竞争。Google AI Pro和Ultra订阅用户,以及大多数Google Workspace企业客户,都可以免费使用该工具。 Google Pics由Gemini的“Nano Ba

09/02
cnbeta

Google发布Gemini 3.8 Live Live Avatar数字人交互功能 赋予AI实时视频面孔

Google公司宣布,正式在Gemini Enterprise企业级平台中全面上线“Live Avatar”(实时数字人)功能。该技术深度集成了Google最新的Gemini 3.8 Live大模型架构,在原有近乎零延迟的高流畅语音对谈基础上,首次引入了近乎实时的生成式视频生成能力,使对话式人工智能拥有了能够“边听、边看、边说”的动态视觉形象。 根据官方介绍,Gemini 3.8 Live Liv

09/25
凤凰网科技

阿里发布Qwen3.8-Omni-Flash:音视频API降价超90%

凤凰网科技讯 9月18日,阿里千问正式上线新一代原生全模态模型Qwen3.8-Omni-Flash。该模型支持文本、图像、音频和视频输入,具备1M长上下文,核心目标是推动全模态模型从“理解内容”走向“规划任务、调用工具并完成创作”。 在累计30项评测中,该模型相比上一代Qwen3.5-Omni-Plus平均得分提升超26%。其中,音视频Agent、Coding及长程任务在WildClawBench

09/18
凤凰网科技

千问同声传译大模型Qwen3.8-LiveTranslate正式发布

凤凰网科技讯 9月19日,千问正式发布同声传译大模型Qwen3.8-LiveTranslate,模型以Interleave架构重构实时同传,准确度、流畅度、简洁度全面提升,字均延迟从2.8秒降至2.3秒。 据介绍,在支持60种语言的基础上,Qwen3.8-LiveTrans实时说话人分离,每句话归属清晰,音色复刻更稳定;

09/19
𝕏 @spectatorindex

突发:谷歌推出其全新前沿AI模型Gemini

10/01 全文见 彭博社
arstechnica

谷歌发布Gemini 3.8 Flash,六周内第三个Flash模型

自2026年初以来,谷歌尚未发布前沿级别的Gemini Pro AI模型,但它确实热衷于推出新的Gemini Flash变体。今天,谷歌宣布在短短六周内发布第三个Flash模型,这使得我们更有可能永远看不到承诺的Gemini 3.5 Pro。但谷歌表示没关系,因为Gemini 3.8 Flash是其迄今为止最好的推理和编码模型。 Gemini 3.8 Flash有两个版本。有标准Flash,谷歌将

09/03
凤凰网科技

中国大模型首次进入OpenAI企业付费结算体系,Kimi K3接入Codex企业通道

IT之家 9 月 30 日消息,美国 AI 基础设施公司 Baseten 今天宣布与 OpenAI 达成合作,成为 OpenAI B2B 市场首批开源模型推理服务提供商之一。企业用户可通过 Codex 使用 Kimi K3 和 GLM 5.3 等开源模型,意味着中国开源模型首次进入 OpenAI 企业采购体系。 IT之家了解到,Kimi K3 是月之暗面开发的大模型。官方宣称其是首个参数规模达 2

09/30
凤凰网科技

月之暗面最强AI:消息称Kimi K3.1下月登场

IT之家 9 月 24 日消息,科技媒体 Wccftech 昨日(9 月 23 日)发布博文,报道称月之暗面(Moonshot)正酝酿推出 Kimi K3.1 模型,并将提供 Low、High、Max 共 3 档推理强度,预估会在下月(2026 年 10 月)登场。消息源 @MaxForAI 昨日在 X 平台发布推文,发现月之暗面内部 JSON / API 响应中,出现 Kimi K3.1 相关标

09/24
LoopDNS 资讯播报

[GIF] Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列

Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列 谷歌最新大模型Gemini 4 Pro在权威平台Arena及多项基准测试中展现出卓越性能。 在 Three.js 3D渲染与代码生成测试中,该模型响应速度与生成质量均显著超越同类竞品;在智能体编码、知识工作及终端操作等测评中亦斩获多项最佳成绩。 该模型在保持旗舰级性能的同时具备极高性价比,预示着谷歌在前沿AI领域的研发节奏正

09/20 全文见 cnbeta
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…