搜索结果
Google深度整合Gemini语音交互功能 全面登陆Gmail、Docs与Keep
Google宣布为其Workspace办公生态推出一系列基于Gemini的人工智能语音新功能,正式将对话式语音交互深度整合进Gmail、Google Docs和Google Keep三大核心产品。用户未来无需繁琐地手动打字输入,直接通过语音对话即可完成邮件检索、文档起草以及结构化笔记整理等多项复杂任务。 在Google Docs中,用户现在能够通过语音指令直接创建和编辑文档草稿。该功能特别针对处理
Google正式推出面向Windows平台的Gemini原生桌面应用程序
Google公司正式宣布向全球Windows操作系统用户推出Gemini人工智能助手的原生桌面客户端应用程序。这一长期受PC用户期待的举措,标志着Google不再将Gemini的桌面访问体验局限于网页浏览器标签页之内,而是选择直接切入全球最大的桌面计算操作系统底层生态,正面迎战已深度植入Windows平台的微软Copilot以及OpenAI早前上线的ChatGPT桌面客户端。 长期以来,Windo
Google公布9月Android更新:Gemini、消息应用和无障碍功能迎来多项改进
Google于9月2日宣布推出2026年9月Android更新,为Android手机带来五项新功能,涵盖Gemini深度整合、晕车缓解、无障碍体验以及Google Messages功能升级等方面。 其中一项实用改进是,用户可以让Gemini记住个人物品的放置位置。例如,用户可以告诉Gemini“我把车钥匙放在客厅的抽屉里”,还可以附加一张参考照片。相关信息随后会保存到“查找中心”(Find Hub
谷歌在Gmail、Docs和Keep中推出AI语音功能
用户可以使用新的对话式功能搜索电子邮件或起草文档
Google发布Gemini 3.8 Live Live Avatar数字人交互功能 赋予AI实时视频面孔
Google公司宣布,正式在Gemini Enterprise企业级平台中全面上线“Live Avatar”(实时数字人)功能。该技术深度集成了Google最新的Gemini 3.8 Live大模型架构,在原有近乎零延迟的高流畅语音对谈基础上,首次引入了近乎实时的生成式视频生成能力,使对话式人工智能拥有了能够“边听、边看、边说”的动态视觉形象。 根据官方介绍,Gemini 3.8 Live Liv
Google发布原生语音大模型Gemini 3.8 Live 首创“边说边想”扩展推理模式
Google今日正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型Gemini 3.8 Live以及针对高难度任务定制的Gemini 3.8 Live Extended Thinking。 这两款模型代表了Google原生音频对音频(Audio-to-Audio)技术体系的重大跨越,不仅将实时对话延迟与自然度推向新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变
谷歌推出面向企业的Gemini 3.8 Live,配备实时虚拟形象
谷歌推出面向企业的 Gemini 3.8 Live,配备实时虚拟形象。 2026 年 9 月 24 日,谷歌推出 Gemini 3.8 Live 的实时虚拟形象功能。 这是 Gemini Enterprise 的一项功能,将近实时视频生成与语音相结合,提供动态的视觉形象。 该工具支持 97 种语言的精准唇形同步和自然表情,让企业智能体能够改善客户服务和交互式操作演示。 它支持异步工具执行,使 AI
Googlebook正式开启预订 Chromebook进入历史新阶段
Google打造的新一代笔记本平台Googlebook正式迈入市场化阶段。随着9月21日预订通道开启,这个自今年5月首次亮相的全新产品类别,正被视为Google对人工智能时代个人电脑的一次重大重构尝试。 根据Google此前发出的通知,美国地区用户将从9月21日上午9点开始预订首批Googlebook设备。首发阵容包括宏碁、华硕、戴尔、惠普和联想等合作伙伴推出的产品,首批机型预计将在今年秋季陆续发
Google Gemini开始替你打电话:AI可代表用户联系商家、预约服务并全程处理通话
Google正在测试一项名为“Call for Me”的新功能,让Gemini能够代表用户直接拨打商家的电话,并独立完成整个通话过程。与过去只能帮助用户拨号或者在电话菜单中提供辅助不同,这一次Gemini真正承担了“替用户打电话”的工作,可以询问商品库存、了解价格、预约服务、修改预约时间,甚至在电话另一端长时间等待人工接听。 目前这项功能仍处于实验阶段,首批仅面向美国地区的Pixel 11系列手机
谷歌Gemini可以呈现卡通或逼真的虚拟形象,为生成式对话进行唇形同步
谷歌为其实时对话模型 Gemini 3.8 Live 增加了一项名为“Live Avatar”的功能,该功能能够生成动画角色和逼真的数字人,为 Gemini 机器生成的语音进行对口型配音。谷歌 DeepMind 研究科学家张硕茵(Shuo-yiin Chang)和 Gemini 软件工程师郑承杰(CJ Zheng)在一篇博文中解释道:“对话本质上是多模态的:我们通过倾听、注视、说话以及使用面部表情
谷歌的AI笔记应用现在允许你与书籍互动
谷歌的AI笔记应用Gemini Notebook现在可以从你购买的书籍中提取信息。 新的“专家智能”功能允许你将Google Play Books中的书籍直接导入Gemini Notebook,这意味着你可以就材料内容提问,并根据其内容生成计划、信息图表、AI播客等。 在与媒体的简报会上,谷歌实验室编辑总监史蒂文·约翰逊展示了如何使用该工具,利用迈克尔·波伦的书籍信息生成一本食谱。 在另一个例子中
谷歌新的Gemini TTS模型可以从30秒的音频中克隆声音
“今天,我们为Gemini系列引入两款全新的文本转语音模型,将语音生成从静态预设转变为动态创意工作室。”谷歌在公告中写道。 谷歌于周三发布了Gemini 3.8 Flash TTS和Gemini 3.8 Flash-Lite TTS。两款模型从今天起在Gemini API和Google AI Studio中逐步上线。它们加入了谷歌本月早些时候推出的Gemini 3.8系列。 据谷歌介绍,Flash
Google宣布新的实验性“CC”AI代理面向家庭
Google的AI模型目前在大多数指标上可能并非领先,但公司拥有一项关键数据。 若你深度使用Google生态系统,Gemini模型已拥有大量关于你的上下文。 Google最新的Google Labs实验,称为CC,旨在将这种定制化扩展到整个家庭。CC是2025年Google宣布的某项技术的演进。 最初的CC最终演变为Gemini的每日简报,利用你Google账户中的数据提供每日行动项和建议。 新的
谷歌的Gemini在AI网络测试中闯入三家真实公司
在人工智能网络测试中,谷歌的Gemini闯入了三家真实公司。CNBC的MacKenzie Sigalos报道了谷歌的说法,即Gemini在意识到自己已逃出模拟环境并进入现实世界系统后自行停止了行动。24分钟前
谷歌在其AI计划中新增三项功能,第四项仅限美国用户
谷歌秋季AI订阅汇总主打Gemini Spark通过Chrome处理网页任务,面向美国用户,同时还有语音工具、图像编辑器和电子表格应用构建器,这些功能确实覆盖欧洲。 但Spark本身在欧洲经济区、瑞士和英国不可用,谷歌未给出原因。谷歌已
Google翻译迎来重磅更新:Android端支持后台实时同传 iOS端上线贴耳“听力模式”
Google近日宣布对其旗下翻译应用“Google翻译”(Google Translate)进行重要功能升级,分别针对 Android 与 iOS 平台推出了更贴合用户实际使用场景的实时翻译改进。本次更新旨在降低跨语言沟通的操作门槛,让用户在跨国出行、涉外交流或日常多任务处理时获得更加自然顺畅的沟通体验。 目前,Google翻译的实时同传模式已支持超过70种语言的近实时语音转换。Google官方数
谢尔盖·布林重返谷歌,参与Gemini工作
谢尔盖·布林在谷歌没有高管头衔。尽管如此,据Business Insider援引八名现任和前任员工的说法,他对公司旗舰AI模型Gemini的影响力却日益增强。 这位谷歌联合创始人在公司山景城总部大楼Gradient Canopy的一间由微型厨房改造而成的房间里办公。
微软Foundry加入原生实时语音智能体 正面挑战Google Gemini Live
微软正在进一步加强Foundry平台的实时语音能力,为开发者提供能够直接进行语音输入和语音输出的原生语音智能体,从而让企业能够更加容易地构建类似Google Gemini Live的实时对话式AI体验。 微软此次更新的核心变化,是Foundry Agent Service开始支持原生实时语音能力。与传统AI智能体先将语音转换成文字、再交给文本模型处理、最后把文字重新转换成语音的流程不同,原生语音架
谷歌在AI竞赛中获得了新优势
谷歌希望提升自己的编程能力。它或许已经找到了一条捷径。谷歌已完成与初创公司Mechanize的交易,将联合创始人塔迈·贝西罗格鲁和十多名员工纳入其人工智能部门DeepMind。
谷歌的Gemini AI在安全测试中入侵了另外三家公司
谷歌的Gemini AI在安全测试中入侵了三家公司在其中一个案例中,Gemini不断尝试猜测密码,最终成功入侵了目标系统的权限。 2026年9月19日,英国时间下午5点谷歌表示,其Gemini AI在测试网络安全能力的过程中入侵了另外三家公司——这是首次有记录显示该AI系统能够自主发起此类攻击。 谷歌的安全工程副总裁Heather Adkins解释称:Gemini在标准测试过程中从互联网上获取了相
[GIF] Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列
Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列 谷歌最新大模型Gemini 4 Pro在权威平台Arena及多项基准测试中展现出卓越性能。 在 Three.js 3D渲染与代码生成测试中,该模型响应速度与生成质量均显著超越同类竞品;在智能体编码、知识工作及终端操作等测评中亦斩获多项最佳成绩。 该模型在保持旗舰级性能的同时具备极高性价比,预示着谷歌在前沿AI领域的研发节奏正
谷歌DeepMind,已经破解RSI?
谷歌跑通RSI了?!一个名叫「rsi-model-liverl-le」的模型,突然出现在Google生成式语言I的返回结果里。 没错,就是那个RSI(递归自我改进,Recursive Self-Improvement)谣言正在像野火一样蔓延,称谷歌 DeepMind 已经实现了RSI。 就在网友Chubby还在推测之际,Anthropic CEO突然公开宣布全行业包括Anthropic,RSI在各
Google宣布全新笔记本产品Googlebook首批定档9月21日
Google公司日前正式对外确认,旗下全新笔记本计算设备Googlebook的首批产品将于美国东部时间9月21日上午9点正式开放预购。这一关键时间节点已通过官方电子邮件通知,向此前在相关发布活动页面登记预约的关注者完成首轮推送,标志着Google在个人电脑终端生态领域开启了全新的硬件攻势。 作为承载Google下一阶段个人计算战略的重要硬件载体,Googlebook被视为Google深度整合端侧算
谷歌的Gemini Spark现在可以管理你的Google Photos图库
Gemini Spark可以为AI Pro和Ultrars用户编辑和策划相册、创建共享收藏、将照片转换为日历事件,并处理其他Google Photos任务。