搜索结果
亚马逊的新AI技术将嘴唇与配音音频匹配
亚马逊旗下 Prime Video 正在推出一项新的AI驱动功能,该功能将演员的嘴唇与真人配音的音频对齐。这项功能目前仅适用于德国剧集《Maxton Hall》的英语配音,但Prime Video 计划将来将其扩展到“额外作品”。 在其公告中,Prime Video 表示,其使用AI和视觉特效技术的组合,使嘴唇动作与翻译后的语音匹配。去年,Prime Video 已经开始在12部电影和电视节目中试
亚马逊 Prime Video 的全新 AI 技术可使口型与配音完美契合
亚马逊的 Prime Video 推出了一项全新的 AI 驱动功能,可将演员的嘴型与“人工配音”进行对齐。目前该功能仅适用于德语剧集的英语配音版,但 Prime Video 计划在未来将其扩展到“更多影视作品”。 在公告中,Prime Video 表示该技术结合了人工智能与视觉特效技术,使口型能够与翻译后的语音相匹配。 Meta YouTube 最近也为创作者推出了一项由 AI 驱动的自动配音功能
亚马逊Prime Video使用AI进行口型同步翻译
该公司表示,正在“不断利用新工具进行创新,以提升客户的观看体验”。
Meta推出带有增强AI功能的订阅服务
Google发布Gemini 3.8 Live Live Avatar数字人交互功能 赋予AI实时视频面孔
Google公司宣布,正式在Gemini Enterprise企业级平台中全面上线“Live Avatar”(实时数字人)功能。该技术深度集成了Google最新的Gemini 3.8 Live大模型架构,在原有近乎零延迟的高流畅语音对谈基础上,首次引入了近乎实时的生成式视频生成能力,使对话式人工智能拥有了能够“边听、边看、边说”的动态视觉形象。 根据官方介绍,Gemini 3.8 Live Liv
YouTube 对话式视频编辑工具让创作者用自然语言进行编辑
YouTube 在周三的 Made On YouTube 活动上宣布了一系列新的创作者工具,其中包括一款对话式编辑工具,可使用自然语言来精修长视频和短视频素材。 “一小时的拍摄可能需要十小时甚至更长的剪辑时间。那么,如果我们能在不牺牲任何创作控制权的情况下加快这一过程呢?”YouTuber Happy Kelli 在台上分享道。 在聊天界面中,创作者向 AI 发出指令,指导它如何帮助自己完成视频制
视频AI公司Pika推出新工具以加速AI视频创作
该产品可自动选择用于创建视频中特定元素的AI模型,并加快提示词生成过程。 用户无需从零开始撰写段落描述,只需输入视频外观的基本细节,即可生成可编辑的逐镜头列表。 该公司还发布了一套应用程序,包括用于重新打光以及更换角色或服装的工具。 Pika估值4.7亿美元,背后有Spark Capital、Lightspeed Venture Partners以及演员杰瑞德·莱托和AI研究员安德烈·卡帕西等投资
苹果发布Audio Intelligence功能 端侧声学模型迎来系统级重塑
伴随全新硬件与操作系统的集中亮相,苹果公司正式揭晓了一系列基于端侧深度学习算法打造的“音频智能”(Audio Intelligence)前沿功能。这套全新声学技术体系深度整合至iOS 27、macOS Golden Gate以及新一代AirPods 5与AirPods Pro固件之中,将苹果的人工智能战略从传统的文本与图像模态进一步拓宽至听觉感知维度,带来了面对面实时翻译、动态智能降噪以及演播室级
亚马逊助力OpenAI广告业务,允许其广告商进入ChatGPT
亚马逊于周四宣布与OpenAI建立合作伙伴关系,允许其广告商在ChatGPT中投放广告,首批试点从美国的部分品牌开始。 这标志着全球最大的在线零售商对OpenAI蓬勃发展的广告业务投下了信任票。该业务最近实现了10亿美元的年化营收运行率。OpenAI于2.月份开始在美国销售ChatGPT中的赞助广告位,首批合作品牌包括百思买和威廉-索诺玛等零售商。 长期以来,亚马逊一直严格限制人工智能平台(如Ch
井英科技吴高明:AI视频,终局是编剧中心制
AI替代了导演、演员和后期,但替代不了编剧。这是井英科技联合创始人吴高明的判断。 今年一季度,中国新上线了12.8万部微短剧,AI生成的占比超过95%。月活7.18亿,人均每天刷129分钟,首次超过长视频。全球短剧应用内购收入去年达到29.8亿美元,同比翻了一倍还多。 内容制作端,整条生产链都在被AI接管,但吴高明认为,编剧是这条链上最后一个、也最难被替代的环节。 因为创意的源头、对人心的直觉、对
YouTube借助AI驱动的“Ask YouTube”功能加倍押注视频购物
“Ask YouTube”是该视频网站较新的AI驱动对话式搜索功能,将成为一个购物助手,该公司在周三的“Made on YouTube”活动上宣布。 Ask YouTube最初是作为对话式搜索的一项实验,后来成为YouTube体验中更重要的组成部分。该功能允许任何人使用自然语言请求搜索YouTube,包括比传统搜索更复杂、更详细的查询。YouTube随后会汇总一组结果,其中可能包括Shorts和长
OpenAI为开发者提供可同时听说的人工智能对话工具
OpenAI已将其最新的实时全双工语音模型作为API推出,允许软件开发人员实现响应更灵敏的语音应用和对话工作流。 GPT-Live-1于7月首次亮相,提供了一种通过语音提示和响应而非键入文本进行交互的方式。 该语音模型最初通过ChatGPT界面提供,现在可以通过API调用访问。 作为全双工模型,GPT-Live-1可以同时收听和生成语音,这有助于流畅的沟通。 人们经常互相打断,如果像使用半双工对讲
这些俄罗斯数学家教会了AI模型如何不用语言相互交流
一家名为Mostik的初创公司采用了一种新颖的方法来整合AI模型的能力。
YouTube新增创作者工具,包括视频A/B测试、动态缩略图和实时配音
为了帮助创作者触达更多人,YouTube周三推出一系列新工具,其中许多工具利用人工智能尝试不同的视频策略,以找出最能提升视频表现的方法。 新的Ask Studio功能允许创作者将草稿视频分享给AI,以便根据他们之前的内容和用户评论获得个性化反馈。该功能将提出替代标题和缩略图选项,分析创作者的频道数据以解释其视频的表现,并提供改进指标的建议。Ask Studio也将扩展到YouTube的移动应用中。
津田健次郎告TikTok案30宣判 日本保护个人声音特征免受AI侵害诉讼首例
(中央社东京27日综合外电报导)日本知名动画配音员津田健次郎将TikTok告上法庭,指控TikTok发布的影片使用人工智慧(AI)仿造他「浑厚」的男中音声线,法院预定于30日宣判。 法新社报导,全球演艺人员日益担心AI仿造声音的问题,这股威胁也冲击日本历史悠久的动漫产业。在日本,配音员有时受到粉丝追捧的程度,甚至不亚于他们所配音的角色。 津田健次郎因为「咒术回战」及「游戏王」等知名系列作品献声而广
人工智能模型用“超现实”的方言聊天,混合了诗意的语言和科技圈的行话
人工智能模型开始使用一种奇怪的新版英语进行交流,这种语言读起来像是詹姆斯·乔伊斯的《芬尼根的守灵夜》和科技界术语的混合体,一项新研究发现。 自主人工智能代理正在迅速创造新的方言,使它们能够用一种通常难以理解的语言进行对话,这可能会使人类更难监控它们的行为。 纽约前沿人工智能实验室 Emergence 的研究人员发现,在被要求在实验性“社会”中进行合作的几天之内,来自几家全球最大人工智能公司的模型就
麦当劳推出AI驱动的得来速点餐系统
麦当劳正押注全新的AI得来速点餐系统“Archy”,希望借此在销售额下滑、股价大跌之际重振这家快餐连锁企业。 公司表示,这套支持语音识别、可使用英语和西班牙语的AI系统,在初步测试餐厅中的准确率超过90%,并获得了顾客的积极反馈。然而,在其他快餐连锁企业,顾客似乎并不喜欢这项技术:今年早些时候推出AI驱动得来速系统的汉堡王,在遭遇顾客反弹后正重新审视其策略。 “有些顾客会直接开车离开,因为他们不想
亚马逊Prime Video借短视频新闻片段向TikTok发起挑战
Amazon Prime Video正效仿TikTok,新增短视频新闻片段。该公司周一表示,正在扩大其新闻覆盖范围,纳入可点播的新闻短片,提供本地和全国新闻。这些内容将可在电视和其他客厅设备上观看,但该公司表示,很快也会推广到网页端和Prime Video移动应用。 这些短片将在Prime Video应用内的“新闻”板块中,出现在“热门话题”和“本地新闻”轮播区。它们将加入Prime Video现
YouTube Music通过新的人工智能功能变得更加对话化
YouTube正在为YouTube Music添加新的AI功能,旨在帮助用户更轻松地发现新音乐、探索艺术家,并找到那些他们可能错过的播客节目。 这些更新在今年的“Made On YouTube”活动中宣布,其中包括“Ask Music”(一个用于查询音乐和播客信息的交互式工具)以及“Your Podcast Lineup”(一个个性化的音频推荐系统,旨在帮助用户发现新的播客节目)。 “Ask Mu
苹果以始终聆听的手表功能进军AI可穿戴设备
苹果公司正在为其设备(包括其高端智能手表)添加人工智能驱动的音频功能和其他新功能,以应对日益增长的AI可穿戴设备品类。 苹果周三在加利福尼亚州库比蒂诺的产品发布会上表示,Apple Watch Series 12和Ultra 4型号将配备新的音频智能工具,包括Siri Recap,该功能利用环境聆听来记录佩戴者全天对话的概要。还有Live Recap,可显示最近15秒实时对话内容的转录。手表还将能
Meta首席执行官马克·扎克伯格在Connect大会上发布新款AI与智能眼镜
Meta首席执行官马克·扎克伯格在2026年9月24日的年度Connect大会上发布了多款新产品,包括仅限音频的雷朋(Ray-Ban)智能眼镜和新型VR眼镜。 在独家采访中,扎克伯格探讨了他对未来计算的愿景,即集成到智能眼镜中的个人AI代理将实时协助用户。 他还谈到了AI安全性,认为个别公司应该在内部管理安全,而不是通过全行业协调。 此外,文章还提到了Adobe Acrobat中新增的AI音频功能
亚马逊将第三方AI代理集成至卖家工具,首批支持Anthropic的Claude
亚马逊在2026年9月23日于西雅图举行的年度Accelerate会议上宣布,通过一个测试版插件,将第三方AI代理集成到卖家工具中,首批支持Anthropic的Claude。 该插件允许卖家在美国商家的基础上,通过外部平台管理库存、定价和商品信息。 此外,亚马逊还推出了后台业务自动化功能、升级版的Seller Assistant(包含“canvas”功能),以及为主要账户持有人提供免费的12个月A
靠机器热源“说话”:OpenAI研究员警告“断网”也困不住未来AI
微软Foundry加入原生实时语音智能体 正面挑战Google Gemini Live
微软正在进一步加强Foundry平台的实时语音能力,为开发者提供能够直接进行语音输入和语音输出的原生语音智能体,从而让企业能够更加容易地构建类似Google Gemini Live的实时对话式AI体验。 微软此次更新的核心变化,是Foundry Agent Service开始支持原生实时语音能力。与传统AI智能体先将语音转换成文字、再交给文本模型处理、最后把文字重新转换成语音的流程不同,原生语音架