搜索结果
Google推出AI图像创作工具Pics 基于Nano Banana模型打造
Google于9月1日正式推出Google Pics,这是一款集成在Google Workspace中的生成式人工智能图像创作与编辑工具,旨在与Canva、Adobe Express以及微软Designer等产品展开竞争。Google AI Pro和Ultra订阅用户,以及大多数Google Workspace企业客户,都可以免费使用该工具。 Google Pics由Gemini的“Nano Ba
谷歌对Canva的回应是一款AI工具,你只需提示而非设计
借助Google Pics,谷歌正深入由Canva和Adobe主导的创意软件市场,但采用了明显的AI优先方法。
独家 | 新谷歌AI模型据称缩小编程能力差距
谷歌正在准备一款具有更强编程技能的新AI模型,以寻求缩小与OpenAI和Anthropic的差距。 Gemini 3.8 Flash的内部测试显示,在该公司落后于Anthropic和OpenAI的领域取得了进展。预计本周发布。
OpenAI买下iPhone人像模式幕后功臣,要给AI装上一双新眼睛
过去一周之内,连着两台新手机产品刷屏,一台是 Apple 新出的 iPhone 18,一台则是豆包手机助手消费者版发布——首款搭载机型努比亚 NaviX Ultra 在今日开售,AI 将进入手机系统,我们也做过详细测评。 AI 开始看见屏幕,也开始伸手触碰屏幕。与此同时,《华尔街日报》透露,OpenAI 已经以超过 3 亿美元收购相机技术公司 Glass Imaging。 交易尚未得到 OpenA
谷歌在其AI计划中新增三项功能,第四项仅限美国用户
谷歌秋季AI订阅汇总主打Gemini Spark通过Chrome处理网页任务,面向美国用户,同时还有语音工具、图像编辑器和电子表格应用构建器,这些功能确实覆盖欧洲。 但Spark本身在欧洲经济区、瑞士和英国不可用,谷歌未给出原因。谷歌已
Google宣布新的实验性“CC”AI代理面向家庭
Google的AI模型目前在大多数指标上可能并非领先,但公司拥有一项关键数据。 若你深度使用Google生态系统,Gemini模型已拥有大量关于你的上下文。 Google最新的Google Labs实验,称为CC,旨在将这种定制化扩展到整个家庭。CC是2025年Google宣布的某项技术的演进。 最初的CC最终演变为Gemini的每日简报,利用你Google账户中的数据提供每日行动项和建议。 新的
谷歌的Gemini Spark现在可以管理你的Google Photos图库
Gemini Spark可以为AI Pro和Ultrars用户编辑和策划相册、创建共享收藏、将照片转换为日历事件,并处理其他Google Photos任务。
谷歌最强数学推理AI模型曝光:100万词元上下文,专攻数学难题
IT之家 9 月 18 日消息,消息源 @lyraxana 于 9 月 16 日在 X 平台发布推文,爆料称谷歌正基于 DeepThink V3 模型,构建内部代号为 Mathematica 的实验 AI 模型,主要针对繁重计算、复杂的符号问题求解特别优化,预估将成为谷歌最强数学推理 AI 模型。 I 数据显示,该模型内部标识符为“models / deepthink-mathematica-tf
谷歌称其AI天气模型正在变得更好
谷歌正在推出一款更新的AI天气模型,该模型预计将更加准确,尤其是在预测降雨和降雪方面。 在今天的公告中,该公司表示,借助其新的WeatherNext 3 AI模型,现在能够以“前所未有的分辨率”进行预报。据该公司称,该模型通过从实时天气观测中学习,能够生成比谷歌之前的模型清晰五倍的全球图像。 谷歌研究院的研究工程师Samier Merchant表示:“WeatherNext 3的主要进展之一是超越
OpenAI 现在为 Adobe 的创意工作室提供图像模型,并将其转化为可分享的提示词。
OpenAI 发布了 ChatGPT Images 2.5,包含两个新的图像模型,Adobe 已经将其中一个应用到了 Firefly 中。 该公司表示,ChatGPT 及其图像模型每周生成的图像超过 30 亿张。 值得注意的是,此次新增的主要是界面功能而非模型研究,其中包括能够将提示词与图像一起分享等 […]
IBM和NASA推出AI模型帮助绘制月球上的冰和陨石坑
视频AI公司Pika推出新工具以加速AI视频创作
该产品可自动选择用于创建视频中特定元素的AI模型,并加快提示词生成过程。 用户无需从零开始撰写段落描述,只需输入视频外观的基本细节,即可生成可编辑的逐镜头列表。 该公司还发布了一套应用程序,包括用于重新打光以及更换角色或服装的工具。 Pika估值4.7亿美元,背后有Spark Capital、Lightspeed Venture Partners以及演员杰瑞德·莱托和AI研究员安德烈·卡帕西等投资
联合国借助谷歌的技术,将其全球数据整理为适合人工智能系统使用的数据格式。
联合国周四宣布,正与谷歌合作,使其庞大的全球统计数据更易于人工智能系统访问和使用。 这一新系统名为“联合国系统数据公共库”,基于谷歌的开源数据公共库平台构建,允许用户通过自然语言查询搜索联合国各机构的统计数据。它取代了现有的UNData门户网站,在该门户中,用户主要通过更传统的数据库界面浏览和搜索统计数据。新平台还支持模型上下文协议(MCP),这是一种允许人工智能系统直接连接外部数据源的标准。 用
谷歌人工智能天气模型的更新提高了预报准确性
谷歌是人工智能(即机器学习)天气预报模型领域的主要参与者之一。它和其他机构生成的模型各有优缺点,但最大的优势在于它们能够实现与传统模型相似的预报性能,同时运行所需的计算能力却要少得多。这意味着它们的运行频率可以更高。 谷歌最近发布了 WeatherNext 模型的第三版,其最大的变化是现在能够摄取部分卫星天气数据,从而缩短了当前天气状况与生成新预报之间的滞后时间。该更新在一份白皮书中进行了详细说明
Google发布原生语音大模型Gemini 3.8 Live 首创“边说边想”扩展推理模式
Google今日正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型Gemini 3.8 Live以及针对高难度任务定制的Gemini 3.8 Live Extended Thinking。 这两款模型代表了Google原生音频对音频(Audio-to-Audio)技术体系的重大跨越,不仅将实时对话延迟与自然度推向新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变
[GIF] Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列
Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列 谷歌最新大模型Gemini 4 Pro在权威平台Arena及多项基准测试中展现出卓越性能。 在 Three.js 3D渲染与代码生成测试中,该模型响应速度与生成质量均显著超越同类竞品;在智能体编码、知识工作及终端操作等测评中亦斩获多项最佳成绩。 该模型在保持旗舰级性能的同时具备极高性价比,预示着谷歌在前沿AI领域的研发节奏正
英伟达推出免费工具,将闲置电脑连接成个人AI数据中心
英伟达正在发布其新的个人AI路由器(PAIR),这是一款免费工具,可将你的家用电脑同步起来,用于处理本地AI推理任务,支持Ollama和LM Studio等工具。 先把显而易见的事情说清楚:尽管名字可能让人误解,但PAIR并不是硬件路由器。它是英伟达开发的开源软件,能够发现网络上的兼容PC,将它们连接起来,并为处理智能体工作流中的计算任务做好准备。虽然兼容设备大多是英伟达GeForce GPU(P
OpenAI推出新生图模型ChatGPT Images 2.
ChatGPT Images 2.5——更快、更清晰、更智能,并配备更好的工具,让你能创造出你所梦想的一切。
Google正式推出面向Windows平台的Gemini原生桌面应用程序
Google公司正式宣布向全球Windows操作系统用户推出Gemini人工智能助手的原生桌面客户端应用程序。这一长期受PC用户期待的举措,标志着Google不再将Gemini的桌面访问体验局限于网页浏览器标签页之内,而是选择直接切入全球最大的桌面计算操作系统底层生态,正面迎战已深度植入Windows平台的微软Copilot以及OpenAI早前上线的ChatGPT桌面客户端。 长期以来,Windo
微软发布MAI-Image-2.6 Flash 主打更快、更便宜的AI图像生成
微软正在进一步扩大自研人工智能模型的布局。当地时间9月4日,据Neowin报道,微软推出了MAI-Image-2.6 Flash,这是一款面向高频图像生成任务优化的新模型,重点提升生成速度和成本效率。微软方面表示,新模型能够在保持较高图像质量的同时,以更低的成本处理大量生成请求。 MAI-Image-2.6 Flash属于微软MAI系列图像模型,主要面向需要快速生成图片的用户和开发者。与更注重最高
YouTube在年度活动中发布AI创作者工具和购物功能
谷歌Gemini可以呈现卡通或逼真的虚拟形象,为生成式对话进行唇形同步
谷歌为其实时对话模型 Gemini 3.8 Live 增加了一项名为“Live Avatar”的功能,该功能能够生成动画角色和逼真的数字人,为 Gemini 机器生成的语音进行对口型配音。谷歌 DeepMind 研究科学家张硕茵(Shuo-yiin Chang)和 Gemini 软件工程师郑承杰(CJ Zheng)在一篇博文中解释道:“对话本质上是多模态的:我们通过倾听、注视、说话以及使用面部表情
谷歌推出面向企业的Gemini 3.8 Live,配备实时虚拟形象
谷歌推出面向企业的 Gemini 3.8 Live,配备实时虚拟形象。 2026 年 9 月 24 日,谷歌推出 Gemini 3.8 Live 的实时虚拟形象功能。 这是 Gemini Enterprise 的一项功能,将近实时视频生成与语音相结合,提供动态的视觉形象。 该工具支持 97 种语言的精准唇形同步和自然表情,让企业智能体能够改善客户服务和交互式操作演示。 它支持异步工具执行,使 AI
Snap 推出全新 Specs AI 工具,即将登陆 iOS 和 Mac
Snap 正在推出“Specs Intelligence”,这是一款新的 AI 助手,能够连接其他数字账户,帮助用户处理工作任务和追踪旅行信息等事务。它似乎与 Meta 的 Muse 和 Gemini 的 Spark 等 AI 助手类似,不过 Snap 将 Specs Intelligence 定位为一种“预判式 AI 服务”,旨在“帮助你管理今天需要关注的事项,从而让你朝着长期目标迈进”。与其他