搜索结果
快手旗下可灵发布新一代视频生成模型
中国快手科技拟分拆上市的AI部门发布最新视频生成模型可灵4.0,以加快缩小与行业领先者字节跳动的差距。 可灵4.0把单次可生成视频片段的最长时长翻倍至30秒,并可接受十多种参考输入,包括文字、图片和现有视频。 新模型在复杂度上进一步提升,用户最多还可添加10个所谓「关键帧」,即用于确定视频特定片段预期画面效果的图像,从而更精细地控制生成结果。 目前新模型仍在向部分用户测试,简化版已面向年度订阅用户
可灵4.0首发实测,国产AI视频再次掀桌?
MiniMax新模型上线:能够完成Bug修复、完整功能开发等任务
字节跳动新AI模型曝光:可实时生成空间视频 张一鸣亲自负责
据彭博社报道,字节跳动正准备推出一款面向实时空间视频生成的AI模型,在机器人和自主系统应用领域与Meta、Google母公司Alphabet展开竞争。据知情人士透露,字节跳动创始人张一鸣正在亲自监督这款新模型的开发工作,该模型最快将于下个月发布。知情人士称,张一鸣一直在协调公司旗下各业务部门的相关工作,并为这一项目调配AI资源和算力。该模型的发布时间尚不确定,计划可能会有所变动。 字节跳动知情人士
实测智象视频模型:嘻哈说唱、NBA绝杀,视频生成开始理解真实世界
先理解,后生成,更懂物理规律的视频模型。近几月,AI视频生成赛道持续升温。7月31日,Seedance 2.5与MiniMax H3同日发布;8月,阿里发布Wan3.0;进入9月,智象HiDream-O1-Video-1.0(下文简称HiDream V1)发布并冲上权威榜单全球前四。 短短两个月,多家厂商接连推出新一代视频生成模型,行业竞争进一步加速。以字节Seedance、MiniMax H3、
腾讯混元发布Hy Image3.5 preview:支持文生图和图生图,多轮对话创作
凤凰网科技讯 9月22日,腾讯混元正式发布图像生成模型Hy Image3.5 preview,支持文生图、图生图及多轮对话创作。据官方介绍,该模型经腾讯内部数百名专业设计师GSB盲测,效果较Hy Image3.0提升30%,与Seedream 5.0 pro持平,略优于Nano-Banana Pro和Qwen-Image-3.0 Pro。 定价方面,腾讯云I 2K图像定价为0.15元/张(国际版0
阿里Qwen4和下代视频模型训练中,Qwen4.5后模型将扩展至5-10T参数
IT之家 9 月 22 日消息,IT之家今日从 2026 年云栖大会现场获悉,阿里巴巴公布了大模型一系列进展,大模型递归自我改进已初步进入模型训练、推理及芯模协同等环节中,基于新一代架构的 Qwen4 已在训练中,未来 Qwen4.5、Qwen5 等版本将扩展至 5-10T 参数。 同时,阿里的视频生成模型、语音模型、图像模型、世界模型、音乐模型以及全模态模型等均在当天或近期推出新版本。 阿里全新
微软发布MAI-Image-2.6 Flash 主打更快、更便宜的AI图像生成
微软正在进一步扩大自研人工智能模型的布局。当地时间9月4日,据Neowin报道,微软推出了MAI-Image-2.6 Flash,这是一款面向高频图像生成任务优化的新模型,重点提升生成速度和成本效率。微软方面表示,新模型能够在保持较高图像质量的同时,以更低的成本处理大量生成请求。 MAI-Image-2.6 Flash属于微软MAI系列图像模型,主要面向需要快速生成图片的用户和开发者。与更注重最高
美团上线LongCat-2.5-Preview模型:1.6T参数,原生100万Token上下文
IT之家 9 月 26 日消息,美团旗下 LongCat API 开放平台于 9 月 25 日上线新一代大模型 LongCat-2.5-Preview,主打“长程任务”与多模态能力,并同步开放 API 与网页端体验入口。IT之家附上官方更新日志内容如下:LongCat-2.5-Preview 的核心特性如下:多模态理解:新增图片理解能力,可解析图像内容,支持跨模态问答、内容摘要与复杂视觉推理。 卓
MiniMax最新文本模型M3.1-Flash-Preview上线MiniMax Code平台
IT之家 9 月 27 日消息,MiniMax 今天宣布其最新文本模型 M3.1-Flash-Preview 现已上线 MiniMax Code 平台。官方还同步发出额度重置卡,为所有用户的 Token Plan 额度进行重置,并发出签到双倍积分、免费领 Token 等福利。 IT之家了解到,M3.1-Flash-Preview 模型可为日常开发工作提供稳定生产力,从 Bug 修复到完整功能开发,
Meta推出Horizon Create游戏创作套件 引入生成式AI工具降低开发门槛
科技巨头Meta在其Meta Connect开发者大会上,正式发布了面向Horizon平台的全新游戏与互动体验创作工具套件“Horizon Create”。该套件将生成式人工智能技术深度融入虚拟现实(VR)与混合现实(MR)内容的开发流程中,旨在大幅降低普通用户与独立开发者在元宇宙生态中创建三维游戏与虚拟空间的门槛。 根据官方介绍,Horizon Create整合了一系列基于大语言模型与三维生成模
Google发布原生语音大模型Gemini 3.8 Live 首创“边说边想”扩展推理模式
Google今日正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型Gemini 3.8 Live以及针对高难度任务定制的Gemini 3.8 Live Extended Thinking。 这两款模型代表了Google原生音频对音频(Audio-to-Audio)技术体系的重大跨越,不仅将实时对话延迟与自然度推向新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变
Meta推出带有增强AI功能的订阅服务
阿里发布Qwen3.8-Omni-Flash:音视频API降价超90%
凤凰网科技讯 9月18日,阿里千问正式上线新一代原生全模态模型Qwen3.8-Omni-Flash。该模型支持文本、图像、音频和视频输入,具备1M长上下文,核心目标是推动全模态模型从“理解内容”走向“规划任务、调用工具并完成创作”。 在累计30项评测中,该模型相比上一代Qwen3.5-Omni-Plus平均得分提升超26%。其中,音视频Agent、Coding及长程任务在WildClawBench
YouTube 新推出的“短片系列”功能将剧集观看体验带入 Shorts
随着微剧类应用程序的日益流行,YouTube显然认为这种以短片段形式呈现的故事叙述方式将会持续存在,并且这种形式非常适合在 YouTube 的 “Shorts” 功能中使用。 在周三举办的 “Made On YouTube” 活动上,YouTube 宣布推出了 “Shorts Series” 这一新工具,该工具允许创作者将他们的短视频按照电视剧的格式组织成“季”和“集”。这一功能为 YouTube
OpenAI推出新生图模型ChatGPT Images 2.
ChatGPT Images 2.5——更快、更清晰、更智能,并配备更好的工具,让你能创造出你所梦想的一切。
亮源新创发布全身智能基础模型Light-O1:让机器人从人类视频中学会全身动作
凤凰网科技讯 9月21日,亮源新创今日发布全身智能基础模型Light-O1。该模型通过学习互联网视频中的人类动作,并结合语言和视觉信息,将人类动作知识迁移到机器人,以提升机器人全身协调与任务执行能力。官方称,该模用于预训练的人类动作数据越多,模型在适配不同机器人本体和视角后,动作预测越准确。 当前,机器人动作模型主要依赖遥操作、UMI等方式专门采集数据,成本高、周期长,覆盖不同任务还需定制采集流程
AI将改变所有交互方式,这一次轮到了3D
硅星人下载客户端 独家抢先看2026年09月22日 15:10:18 来自北京 作者|周一笑微信|smiletalker过去一年,Agent(能自己拆解任务、调用软件的 AI 系统)开始越来越频繁地进入专业软件。写代码只是最早的一站,Blender、CAD、游戏引擎也逐渐变成大模型可以直接操作的工具。GPT-6 Astra 最近展示的 3D 能力,又把这种变化推到了台前。对 3D 生成大模型公司来
Meta发布AI游戏生成工具:一句话打造可玩的2D与3D游戏 直接接入Facebook和Instagram
Meta正式公布两款全新的生成式人工智能游戏开发工具“Horizon Create”和“Horizon Studio”,希望通过自然语言生成技术彻底降低游戏开发门槛,让普通用户无需编程经验也能够创建并发布可实际运行的游戏作品。 根据Meta介绍,这两款工具都基于Meta Horizon Engine平台构建,能够根据用户输入的文字描述自动生成完整的2D或3D游戏。与传统游戏开发流程相比,用户无需学
YouTube新增创作者工具,包括视频A/B测试、动态缩略图和实时配音
为了帮助创作者触达更多人,YouTube周三推出一系列新工具,其中许多工具利用人工智能尝试不同的视频策略,以找出最能提升视频表现的方法。 新的Ask Studio功能允许创作者将草稿视频分享给AI,以便根据他们之前的内容和用户评论获得个性化反馈。该功能将提出替代标题和缩略图选项,分析创作者的频道数据以解释其视频的表现,并提供改进指标的建议。Ask Studio也将扩展到YouTube的移动应用中。
Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化
【财新网】在各自的旗舰模型基础上,各大模型厂发布更新版模型。北京时间9月2日和3日,Anthropic、Meta、谷歌和阿里等公司发布了基于旗舰模型的更新版本,在编程、网络安全和办公等领域的能力提升。 目前从第三方AI模型榜单看,最新发布的模型当中,Claude Fable 5.1在智能水平上排名最靠前,Meta新发布的Muse Spark 1.3排名第三,谷歌的新模型Gemini 3.8 Fla
OpenAI 现在为 Adobe 的创意工作室提供图像模型,并将其转化为可分享的提示词。
OpenAI 发布了 ChatGPT Images 2.5,包含两个新的图像模型,Adobe 已经将其中一个应用到了 Firefly 中。 该公司表示,ChatGPT 及其图像模型每周生成的图像超过 30 亿张。 值得注意的是,此次新增的主要是界面功能而非模型研究,其中包括能够将提示词与图像一起分享等 […]
独家 | 新谷歌AI模型据称缩小编程能力差距
谷歌正在准备一款具有更强编程技能的新AI模型,以寻求缩小与OpenAI和Anthropic的差距。 Gemini 3.8 Flash的内部测试显示,在该公司落后于Anthropic和OpenAI的领域取得了进展。预计本周发布。
视频AI公司Pika推出新工具以加速AI视频创作
该产品可自动选择用于创建视频中特定元素的AI模型,并加快提示词生成过程。 用户无需从零开始撰写段落描述,只需输入视频外观的基本细节,即可生成可编辑的逐镜头列表。 该公司还发布了一套应用程序,包括用于重新打光以及更换角色或服装的工具。 Pika估值4.7亿美元,背后有Spark Capital、Lightspeed Venture Partners以及演员杰瑞德·莱托和AI研究员安德烈·卡帕西等投资