搜索结果
Google翻译迎来重磅更新:Android端支持后台实时同传 iOS端上线贴耳“听力模式”
Google近日宣布对其旗下翻译应用“Google翻译”(Google Translate)进行重要功能升级,分别针对 Android 与 iOS 平台推出了更贴合用户实际使用场景的实时翻译改进。本次更新旨在降低跨语言沟通的操作门槛,让用户在跨国出行、涉外交流或日常多任务处理时获得更加自然顺畅的沟通体验。 目前,Google翻译的实时同传模式已支持超过70种语言的近实时语音转换。Google官方数
Google发布原生语音大模型Gemini 3.8 Live 首创“边说边想”扩展推理模式
Google今日正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型Gemini 3.8 Live以及针对高难度任务定制的Gemini 3.8 Live Extended Thinking。 这两款模型代表了Google原生音频对音频(Audio-to-Audio)技术体系的重大跨越,不仅将实时对话延迟与自然度推向新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变
Google深度整合Gemini语音交互功能 全面登陆Gmail、Docs与Keep
Google宣布为其Workspace办公生态推出一系列基于Gemini的人工智能语音新功能,正式将对话式语音交互深度整合进Gmail、Google Docs和Google Keep三大核心产品。用户未来无需繁琐地手动打字输入,直接通过语音对话即可完成邮件检索、文档起草以及结构化笔记整理等多项复杂任务。 在Google Docs中,用户现在能够通过语音指令直接创建和编辑文档草稿。该功能特别针对处理
Google公布9月Android更新:Gemini、消息应用和无障碍功能迎来多项改进
Google于9月2日宣布推出2026年9月Android更新,为Android手机带来五项新功能,涵盖Gemini深度整合、晕车缓解、无障碍体验以及Google Messages功能升级等方面。 其中一项实用改进是,用户可以让Gemini记住个人物品的放置位置。例如,用户可以告诉Gemini“我把车钥匙放在客厅的抽屉里”,还可以附加一张参考照片。相关信息随后会保存到“查找中心”(Find Hub
谷歌新的Gemini TTS模型可以从30秒的音频中克隆声音
“今天,我们为Gemini系列引入两款全新的文本转语音模型,将语音生成从静态预设转变为动态创意工作室。”谷歌在公告中写道。 谷歌于周三发布了Gemini 3.8 Flash TTS和Gemini 3.8 Flash-Lite TTS。两款模型从今天起在Gemini API和Google AI Studio中逐步上线。它们加入了谷歌本月早些时候推出的Gemini 3.8系列。 据谷歌介绍,Flash
Google发布Gemini 3.8 Live Live Avatar数字人交互功能 赋予AI实时视频面孔
Google公司宣布,正式在Gemini Enterprise企业级平台中全面上线“Live Avatar”(实时数字人)功能。该技术深度集成了Google最新的Gemini 3.8 Live大模型架构,在原有近乎零延迟的高流畅语音对谈基础上,首次引入了近乎实时的生成式视频生成能力,使对话式人工智能拥有了能够“边听、边看、边说”的动态视觉形象。 根据官方介绍,Gemini 3.8 Live Liv
Google正式推出面向Windows平台的Gemini原生桌面应用程序
Google公司正式宣布向全球Windows操作系统用户推出Gemini人工智能助手的原生桌面客户端应用程序。这一长期受PC用户期待的举措,标志着Google不再将Gemini的桌面访问体验局限于网页浏览器标签页之内,而是选择直接切入全球最大的桌面计算操作系统底层生态,正面迎战已深度植入Windows平台的微软Copilot以及OpenAI早前上线的ChatGPT桌面客户端。 长期以来,Windo
苹果发布AirPods 5耳机 搭载实时翻译与更强续航
在备受瞩目的秋季新品发布会上,苹果公司正式推出了全新一代主力无线耳机AirPods 5。本次新品延续了双版本并行的产品策略,同步推出标准版与搭载主动降噪功能的高配版两款机型,不仅在声学硬件与工业设计上进行了细致打磨,更将单次充电续航提升至5小时,并依托Apple Intelligence深度集成了备受期待的实时翻译核心功能。 作为本次AirPods 5最引人注目的软硬件协同亮点,实时翻译功能的全面
苹果发布Audio Intelligence功能 端侧声学模型迎来系统级重塑
伴随全新硬件与操作系统的集中亮相,苹果公司正式揭晓了一系列基于端侧深度学习算法打造的“音频智能”(Audio Intelligence)前沿功能。这套全新声学技术体系深度整合至iOS 27、macOS Golden Gate以及新一代AirPods 5与AirPods Pro固件之中,将苹果的人工智能战略从传统的文本与图像模态进一步拓宽至听觉感知维度,带来了面对面实时翻译、动态智能降噪以及演播室级
千问同声传译大模型Qwen3.8-LiveTranslate正式发布
凤凰网科技讯 9月19日,千问正式发布同声传译大模型Qwen3.8-LiveTranslate,模型以Interleave架构重构实时同传,准确度、流畅度、简洁度全面提升,字均延迟从2.8秒降至2.3秒。 据介绍,在支持60种语言的基础上,Qwen3.8-LiveTrans实时说话人分离,每句话归属清晰,音色复刻更稳定;
亚马逊的新AI技术将嘴唇与配音音频匹配
亚马逊旗下 Prime Video 正在推出一项新的AI驱动功能,该功能将演员的嘴唇与真人配音的音频对齐。这项功能目前仅适用于德国剧集《Maxton Hall》的英语配音,但Prime Video 计划将来将其扩展到“额外作品”。 在其公告中,Prime Video 表示,其使用AI和视觉特效技术的组合,使嘴唇动作与翻译后的语音匹配。去年,Prime Video 已经开始在12部电影和电视节目中试
微软Foundry加入原生实时语音智能体 正面挑战Google Gemini Live
微软正在进一步加强Foundry平台的实时语音能力,为开发者提供能够直接进行语音输入和语音输出的原生语音智能体,从而让企业能够更加容易地构建类似Google Gemini Live的实时对话式AI体验。 微软此次更新的核心变化,是Foundry Agent Service开始支持原生实时语音能力。与传统AI智能体先将语音转换成文字、再交给文本模型处理、最后把文字重新转换成语音的流程不同,原生语音架
谷歌在其AI计划中新增三项功能,第四项仅限美国用户
谷歌秋季AI订阅汇总主打Gemini Spark通过Chrome处理网页任务,面向美国用户,同时还有语音工具、图像编辑器和电子表格应用构建器,这些功能确实覆盖欧洲。 但Spark本身在欧洲经济区、瑞士和英国不可用,谷歌未给出原因。谷歌已
谷歌在Gmail、Docs和Keep中推出AI语音功能
用户可以使用新的对话式功能搜索电子邮件或起草文档
谷歌推出面向企业的Gemini 3.8 Live,配备实时虚拟形象
谷歌推出面向企业的 Gemini 3.8 Live,配备实时虚拟形象。 2026 年 9 月 24 日,谷歌推出 Gemini 3.8 Live 的实时虚拟形象功能。 这是 Gemini Enterprise 的一项功能,将近实时视频生成与语音相结合,提供动态的视觉形象。 该工具支持 97 种语言的精准唇形同步和自然表情,让企业智能体能够改善客户服务和交互式操作演示。 它支持异步工具执行,使 AI
苹果在这次发布会上还发布了新一代的Apple AI,计划支持英语、简体中文、繁体中文等16 种语言,但右下角小字显示首发不支持在中国大陆使用。
Google Gemini开始替你打电话:AI可代表用户联系商家、预约服务并全程处理通话
Google正在测试一项名为“Call for Me”的新功能,让Gemini能够代表用户直接拨打商家的电话,并独立完成整个通话过程。与过去只能帮助用户拨号或者在电话菜单中提供辅助不同,这一次Gemini真正承担了“替用户打电话”的工作,可以询问商品库存、了解价格、预约服务、修改预约时间,甚至在电话另一端长时间等待人工接听。 目前这项功能仍处于实验阶段,首批仅面向美国地区的Pixel 11系列手机
iOS 27 于 9 月 14 日发布,搭载 Siri AI
Apple 将于 9 月 14 日星期一发布其下一个 iOS 27 更新。 头条功能是 Siri AI,这是对 Siri 助手进行 AI 驱动的全面改造,此前有所延迟。 Siri AI 将作为测试版随 iOS 27 推出,最初仅适用于英语设备。 Apple 表示,法语、日语、韩语、葡萄牙语和西班牙语的支持将于 10 月推出。 不过,Siri AI 并不是 iOS 27 中唯一的重要功能。 Appl
ChatGPT移动端加入语音智能代理功能
OpenAI宣布ChatGPT移动应用开始加入基于语音的智能代理功能,用户今后不只是能够通过语音与ChatGPT聊天,还可以直接用语音指挥它执行更加复杂的实际工作。例如,用户可以要求ChatGPT创建一份文档、起草电子邮件、总结Slack消息,甚至开展一系列需要多个步骤才能完成的任务。 此次更新的核心是将ChatGPT此前已经逐步加入桌面端的Agentic Work能力带到手机上。对于Plus和P
苹果iOS 27更新 升级照片AI修图、Siri AI对话
(中央社记者吴家豪台北15日电)苹果公司(Apple)今天释出iOS 27作业系统更新,升级跨App的个人智慧系统Apple Intelligence功能,最大亮点之一是「照片」App提升人工智慧(AI)修图体验,新增拍照后可虚拟改变取景角度的「空间重构」功能,并加入果粉期待已久的闹钟与计时器独立音量设定。 另一项升级重点是全新Siri AI亮相,不仅具备更深入的回答与自然流畅的连续对话能力,还能
独家 | 新谷歌AI模型据称缩小编程能力差距
谷歌正在准备一款具有更强编程技能的新AI模型,以寻求缩小与OpenAI和Anthropic的差距。 Gemini 3.8 Flash的内部测试显示,在该公司落后于Anthropic和OpenAI的领域取得了进展。预计本周发布。
Google推出ADB Wi-Fi 2.0:无线调试速度提升66% 连接稳定性大幅改善
Google近日正式推出ADB Wi-Fi 2.0,对Android系统的无线调试功能进行了全面重构。新版本随Android 17推出,重点解决此前无线ADB容易断开、重新配对麻烦以及Android Studio中设备发现困难等问题。Google表示,经过升级后,ADB Wi-Fi的自动连接成功率提高了32%,在90%的连接情况下,连接速度提升幅度达到66%。 Android Debug Brid
谷歌员工已在测试下一代Gemini Flash AI模型
虽然谷歌的下一代前沿模型仍在推迟,但它正以快速的速度推出更快、更便宜的模型。
ChatGPT 移动应用新增语音智能体功能
OpenAI 于周三宣布,其移动应用将引入基于语音的智能体功能,允许用户通过语音触发诸如起草文档或总结电子邮件等工作流。随着越来越多的用户开始使用语音向 AI 助手下达复杂任务指令,这一功能应运而生。 今年七月,OpenAI 推出了其新的对话模型 GPT-Live,随后该公司将其与桌面应用集成,使用户能够利用语音在“工作”标签页中完成任务或在“Codex”标签页中构建应用。此次新功能的推出将类似的