搜索结果
谷歌在Gmail、Docs和Keep中推出AI语音功能
用户可以使用新的对话式功能搜索电子邮件或起草文档
Google深度整合Gemini语音交互功能 全面登陆Gmail、Docs与Keep
Google宣布为其Workspace办公生态推出一系列基于Gemini的人工智能语音新功能,正式将对话式语音交互深度整合进Gmail、Google Docs和Google Keep三大核心产品。用户未来无需繁琐地手动打字输入,直接通过语音对话即可完成邮件检索、文档起草以及结构化笔记整理等多项复杂任务。 在Google Docs中,用户现在能够通过语音指令直接创建和编辑文档草稿。该功能特别针对处理
Google发布原生语音大模型Gemini 3.8 Live 首创“边说边想”扩展推理模式
Google今日正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型Gemini 3.8 Live以及针对高难度任务定制的Gemini 3.8 Live Extended Thinking。 这两款模型代表了Google原生音频对音频(Audio-to-Audio)技术体系的重大跨越,不仅将实时对话延迟与自然度推向新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变
Google公布9月Android更新:Gemini、消息应用和无障碍功能迎来多项改进
Google于9月2日宣布推出2026年9月Android更新,为Android手机带来五项新功能,涵盖Gemini深度整合、晕车缓解、无障碍体验以及Google Messages功能升级等方面。 其中一项实用改进是,用户可以让Gemini记住个人物品的放置位置。例如,用户可以告诉Gemini“我把车钥匙放在客厅的抽屉里”,还可以附加一张参考照片。相关信息随后会保存到“查找中心”(Find Hub
谷歌在其AI计划中新增三项功能,第四项仅限美国用户
谷歌秋季AI订阅汇总主打Gemini Spark通过Chrome处理网页任务,面向美国用户,同时还有语音工具、图像编辑器和电子表格应用构建器,这些功能确实覆盖欧洲。 但Spark本身在欧洲经济区、瑞士和英国不可用,谷歌未给出原因。谷歌已
Google Gemini开始替你打电话:AI可代表用户联系商家、预约服务并全程处理通话
Google正在测试一项名为“Call for Me”的新功能,让Gemini能够代表用户直接拨打商家的电话,并独立完成整个通话过程。与过去只能帮助用户拨号或者在电话菜单中提供辅助不同,这一次Gemini真正承担了“替用户打电话”的工作,可以询问商品库存、了解价格、预约服务、修改预约时间,甚至在电话另一端长时间等待人工接听。 目前这项功能仍处于实验阶段,首批仅面向美国地区的Pixel 11系列手机
谷歌Gemini可以呈现卡通或逼真的虚拟形象,为生成式对话进行唇形同步
谷歌为其实时对话模型 Gemini 3.8 Live 增加了一项名为“Live Avatar”的功能,该功能能够生成动画角色和逼真的数字人,为 Gemini 机器生成的语音进行对口型配音。谷歌 DeepMind 研究科学家张硕茵(Shuo-yiin Chang)和 Gemini 软件工程师郑承杰(CJ Zheng)在一篇博文中解释道:“对话本质上是多模态的:我们通过倾听、注视、说话以及使用面部表情
Google发布Gemini 3.8 Live Live Avatar数字人交互功能 赋予AI实时视频面孔
Google公司宣布,正式在Gemini Enterprise企业级平台中全面上线“Live Avatar”(实时数字人)功能。该技术深度集成了Google最新的Gemini 3.8 Live大模型架构,在原有近乎零延迟的高流畅语音对谈基础上,首次引入了近乎实时的生成式视频生成能力,使对话式人工智能拥有了能够“边听、边看、边说”的动态视觉形象。 根据官方介绍,Gemini 3.8 Live Liv
ChatGPT 移动应用新增语音智能体功能
OpenAI 于周三宣布,其移动应用将引入基于语音的智能体功能,允许用户通过语音触发诸如起草文档或总结电子邮件等工作流。随着越来越多的用户开始使用语音向 AI 助手下达复杂任务指令,这一功能应运而生。 今年七月,OpenAI 推出了其新的对话模型 GPT-Live,随后该公司将其与桌面应用集成,使用户能够利用语音在“工作”标签页中完成任务或在“Codex”标签页中构建应用。此次新功能的推出将类似的
谷歌推出面向企业的Gemini 3.8 Live,配备实时虚拟形象
谷歌推出面向企业的 Gemini 3.8 Live,配备实时虚拟形象。 2026 年 9 月 24 日,谷歌推出 Gemini 3.8 Live 的实时虚拟形象功能。 这是 Gemini Enterprise 的一项功能,将近实时视频生成与语音相结合,提供动态的视觉形象。 该工具支持 97 种语言的精准唇形同步和自然表情,让企业智能体能够改善客户服务和交互式操作演示。 它支持异步工具执行,使 AI
Google翻译迎来重磅更新:Android端支持后台实时同传 iOS端上线贴耳“听力模式”
Google近日宣布对其旗下翻译应用“Google翻译”(Google Translate)进行重要功能升级,分别针对 Android 与 iOS 平台推出了更贴合用户实际使用场景的实时翻译改进。本次更新旨在降低跨语言沟通的操作门槛,让用户在跨国出行、涉外交流或日常多任务处理时获得更加自然顺畅的沟通体验。 目前,Google翻译的实时同传模式已支持超过70种语言的近实时语音转换。Google官方数
Google宣布新的实验性“CC”AI代理面向家庭
Google的AI模型目前在大多数指标上可能并非领先,但公司拥有一项关键数据。 若你深度使用Google生态系统,Gemini模型已拥有大量关于你的上下文。 Google最新的Google Labs实验,称为CC,旨在将这种定制化扩展到整个家庭。CC是2025年Google宣布的某项技术的演进。 最初的CC最终演变为Gemini的每日简报,利用你Google账户中的数据提供每日行动项和建议。 新的
OpenAI想让你对着手机“脱口而出你的想法”
OpenAI正在进一步进军竞争激烈的个人智能体市场——这一次是语音领域。该公司于周三将其最先进的语音系统接入ChatGPT的网页端和移动应用。OpenAI此次发布的功能允许用户通过语音来委派需要多个步骤、浏览器以及不同应用协同完成的单次和重复性任务。该公司一直在为下周举行的OpenAI DevDay大型活动预热,接连发布新产品。OpenAI负责ChatGPT语音功能的产品主管阿蒂·埃莱蒂向Busi
谷歌的AI笔记应用现在允许你与书籍互动
谷歌的AI笔记应用Gemini Notebook现在可以从你购买的书籍中提取信息。 新的“专家智能”功能允许你将Google Play Books中的书籍直接导入Gemini Notebook,这意味着你可以就材料内容提问,并根据其内容生成计划、信息图表、AI播客等。 在与媒体的简报会上,谷歌实验室编辑总监史蒂文·约翰逊展示了如何使用该工具,利用迈克尔·波伦的书籍信息生成一本食谱。 在另一个例子中
谷歌AI概览功能引发用户评价两极分化
用户对谷歌整合的AI概览功能评价不一。谷歌在搜索结果顶部添加了AI概览,这些概览提供了聊天机器人的总结回答。 虽然一些用户认为这些AI功能使搜索更快、信息更丰富,但另一些人则认为该工具掩盖了信息来源,提供了不准确的信息,并将流量从内容创作者那里分流走了。 这一变化导致一些用户转向了DuckDuckGo和Ecosia等替代搜索引擎。 此外,美国大型媒体公司正在起诉谷歌,称AI概览减少了网站的流量和收
谷歌面临英国要求在Android和Chrome选择屏幕上展示AI助手的推动
9月23日:英国竞争监管机构提出建议,旨在为Android和Chrome用户提供更多选择和控制权,包括ChatGPT和Perplexity等AI助手的使用。 新规定要求谷歌在用户首次设置Android手机或打开Chrome时展示搜索服务提供商的选择,每年提醒用户选择默认搜索服务,并允许符合技术和安全标准的AI助手出现在这些屏幕上。 同时,搜索服务提供商需公正标注内容来源,以便用户了解信息来源。 C
ChatGPT移动端加入语音智能代理功能
OpenAI宣布ChatGPT移动应用开始加入基于语音的智能代理功能,用户今后不只是能够通过语音与ChatGPT聊天,还可以直接用语音指挥它执行更加复杂的实际工作。例如,用户可以要求ChatGPT创建一份文档、起草电子邮件、总结Slack消息,甚至开展一系列需要多个步骤才能完成的任务。 此次更新的核心是将ChatGPT此前已经逐步加入桌面端的Agentic Work能力带到手机上。对于Plus和P
您的人工智能代理现在可以控制您的Google Home设备
智能家居用户很快就能通过人工智能代理控制连接到 Google Home 的设备。周二,谷歌为其 Google Home 生态系统推出了模型上下文协议(MCP)服务器的抢先体验版。这将允许任何支持 MCP 的人工智能代理(如 Claude、Hermes、OpenClaw、ChatGPT 和 Google Antigravity)安全地与智能家居设备交互并访问其事件历史记录。 此次更新将允许用户使用自
Googlebook正式开启预订 Chromebook进入历史新阶段
Google打造的新一代笔记本平台Googlebook正式迈入市场化阶段。随着9月21日预订通道开启,这个自今年5月首次亮相的全新产品类别,正被视为Google对人工智能时代个人电脑的一次重大重构尝试。 根据Google此前发出的通知,美国地区用户将从9月21日上午9点开始预订首批Googlebook设备。首发阵容包括宏碁、华硕、戴尔、惠普和联想等合作伙伴推出的产品,首批机型预计将在今年秋季陆续发
独家 | 新谷歌AI模型据称缩小编程能力差距
谷歌正在准备一款具有更强编程技能的新AI模型,以寻求缩小与OpenAI和Anthropic的差距。 Gemini 3.8 Flash的内部测试显示,在该公司落后于Anthropic和OpenAI的领域取得了进展。预计本周发布。
微软Foundry加入原生实时语音智能体 正面挑战Google Gemini Live
微软正在进一步加强Foundry平台的实时语音能力,为开发者提供能够直接进行语音输入和语音输出的原生语音智能体,从而让企业能够更加容易地构建类似Google Gemini Live的实时对话式AI体验。 微软此次更新的核心变化,是Foundry Agent Service开始支持原生实时语音能力。与传统AI智能体先将语音转换成文字、再交给文本模型处理、最后把文字重新转换成语音的流程不同,原生语音架
谷歌的新产品“CC”是一款人工智能助手,可以帮助家庭管理家务事务。
颠覆OpenAI、Anthropic、Replit等,覆盖6大产业阶段。门票现享75折 关闭 图片 谷歌 # 谷歌新推出的“CC”是一款帮助家庭打理家务的AI智能体 太平洋时间上午3:33 · 2026年9月18日 谷歌正在测试一款新产品,旨在借助AI智能体的支持帮助家庭协调事务。本周,这家搜索巨头推出了新版本的CC,这是一款可在电子邮件、日历、聊天和任务之间协同工作的AI智能体。通过此次更新,C
Meta推出带有增强AI功能的订阅服务
如何在保护隐私的情况下使用人工智能
OpenAI的ChatGPT、Anthropic的Claude、Google的Gemini以及无数较小的竞争对手,已成为全球数百万人的治疗师、倾诉对象和虚拟忏悔室。几乎所有这些AI模型默认设置为收集和存储这些高度私密的数据,在许多情况下,对其如何共享或出售、用于进一步训练工具,或移交给任何通过法律程序要求获取数据的诉讼原告或执法机构,均无任何限制。 “你面对着这个智能体,基本上是在一步步地、通过一