字号 ·· | 护眼

搜索结果

「谷歌终于推出旗舰AI模型 但实战性能却遭员工质疑」共 100 条 · 第 1 页
凤凰网科技

谷歌终于推出旗舰AI模型 但实战性能却遭员工质疑

但公司内部对于该模型在编程等关键领域的表现仍存在质疑。谷歌周三向一小批值得信赖的网络安全合作伙伴率先开放了该模型,并表示在进一步测试后扩大开放范围,首先面向付费订阅用户。谷歌表示,Gemini 4在多项基准测试中取得领先成绩,其中包括在一项衡量网络安全能力的测试中击败了OpenAI的Astra模型。 但是,一些内部人士表示,这些指标并不能说明全部情况。据直接了解相关工作的知情人士称,尽管Gemin

7小时前
风向旗参考快讯

谷歌推出新旗舰模型Gemini 4 Argon

谷歌发布旗舰AI模型Gemini 4 Argon,在多项基准测试中超越OpenAI和Anthropic的顶级产品,标志着这家美国搜索巨头在历经数月落后后重新杀回竞争前沿。但这款备受期待的模型目前仅向特定网络安全合作伙伴开放,普通开发者和企业用户尚需等待。 鉴于近几周来AI安全问题在科技界引发了广泛讨论,谷歌表示,其新模型最初将仅供专注于网络安全防御的特定公司和组织使用。—— 华尔街见闻

7小时前 全文见 彭博社
LoopDNS 资讯播报

谷歌宣布正加速推进旗舰级 Gemini 4 AI 模型研发

谷歌科技巨头即将推出其最新旗舰人工智能模型 Gemini 4,以在与 Anthropic 和 OpenAI 的竞争中重新赢得优势。谷歌 DeepMind 新任最高领导人 Kavukcuoglu 在 AI Agenda Live 峰会上表示,Gemini 4 目前正处于后训练阶段的早期,团队正在对其进行精调与安全性测试,目标是“远早于”今年年底发布。 该模型是自去年 Gemini 3 系列发布以来的

09/24 全文见 罗塞塔简报
信报财经

AI丨谷歌匿名测试新模型 能力价格胜竞争对手

Arena近日出现一款名为「gemini-3.8-flash」匿名模型,据报为谷歌Gemini 4 Pro早期版本。(路透资料图片) 人工智能(AI)模型竞技场Arena近日出现一款名为「gemini-3.8-flash」的匿名模型,经多名开发者实测后,认为极可能是谷歌(Google)的Gemini 4 Pro的早期版本。基准测试显示,该模型在程式编码、AI代理、推理及电脑操作等多项能力上领先Op

09/18
彭博社

谷歌努力应对用户对Gemini模型的质疑

朱莉娅·洛芙和戴维·阿尔巴报道,随着Alphabet旗下谷歌准备推出Gemini 4,公司内部的人士对该旗舰人工智能模型在编程等关键领域的表现能否达到预期存在质疑。 据直接参与相关工作的人士称,尽管Gemini 4在行业用于衡量模型效能的基准测试中表现良好,但员工在实际使用过程中的评价却没有那么好。上述人士因讨论内部事务而要求匿名。他们称,该模型难以应对某些编程任务。 谷歌近期投入大量精力开发模型

11小时前
cnbeta

下一代旗舰模型Gemini 4发布时间或“远早于”今年底

Google DeepMind部门负责人Koray Kavukcuoglu周三表示,Google接近发布其最新旗舰模型 Gemini 4,这是这家科技巨头在人工智能模型竞赛中落后于竞争对手 Anthropic 和 OpenAI 后期待已久的进展。 Kavukcuoglu 在一次活动上表示,Gemini 4 正处于被称为“后训练”的开发阶段的初期,在此阶段,基础 AI 模型将得到完善,以使其表现可靠

09/24
凤凰网科技

谷歌推出了个“做题家”:Gemini 4 Argon屠榜,但干活差点意思

Gemini 4可算来了,连名字也换了:这次的旗舰不叫Pro,叫Argon。 从谷歌公布的成绩看,Gemini 4 Argon在知识工作方面表现抢眼,多项测试超过了OpenAI和Anthropic的旗舰模型。 它主打一个知识面广,从金融、法律到数学、科学,都有不错的表现。 谷歌还确认,9月15日在LMArena上亮相、表现接近GPT-6 Astra的“3.8 Flash”,其实就是Gemini 4

5小时前
LoopDNS 资讯播报

[GIF] Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列

Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列 谷歌最新大模型Gemini 4 Pro在权威平台Arena及多项基准测试中展现出卓越性能。 在 Three.js 3D渲染与代码生成测试中,该模型响应速度与生成质量均显著超越同类竞品;在智能体编码、知识工作及终端操作等测评中亦斩获多项最佳成绩。 该模型在保持旗舰级性能的同时具备极高性价比,预示着谷歌在前沿AI领域的研发节奏正

09/20 全文见 cnbeta
凤凰网科技

谷歌最强数学推理AI模型曝光:100万词元上下文,专攻数学难题

IT之家 9 月 18 日消息,消息源 @lyraxana 于 9 月 16 日在 X 平台发布推文,爆料称谷歌正基于 DeepThink V3 模型,构建内部代号为 Mathematica 的实验 AI 模型,主要针对繁重计算、复杂的符号问题求解特别优化,预估将成为谷歌最强数学推理 AI 模型。 I 数据显示,该模型内部标识符为“models / deepthink-mathematica-tf

09/18
cnbeta

AI从业者担忧技术对社会构成威胁 坦言承受巨大精神压力

知情人士透露,英国人工智能安全研究所已有多名员工因压力过大休病假,并接受心理咨询。四名知情人士表示,待发布AI模型的测试日程紧张,加之对这类新兴技术快速落地、能力持续增强的忧虑,导致AISI内部士气低落、人员倦怠。 Anthropic、OpenAI与谷歌DeepMind的员工也曾公开吐槽同类问题,不少顶尖研究员因心理负担选择离职,或是认定自己参与研发的产品不宜向公众开放。一名DeepMind员工称

09/22
cnbeta

Gemini 4 Pro疑似泄露 “AI减速”又成空话

前几个月,OpenAI和Anthropic轮番把旗舰模型往前推,Google却显得异常安静。Flash几乎3周一更,3.6、3.7、3.8连续往前,但代表最高能力上限的Pro迟迟没有动静。直到这两天,大模型盲测竞技场Arena里,突然冒出一个挂着gemini-3.8-flash名字的模型。 开发者一上手就发现了不对劲,真正的Gemini 3.8 Flash已经发布了,它该是什么水平,大家心里有数。

09/19
英国金融时报

谷歌遭遇顶级投资者估值分歧:该盯折旧还是盯学习曲线?

谷歌遭遇顶级投资者估值分歧:该盯折旧还是盯学习曲线? 陆媛:4位顶级投资者,4种不同行动,而且同时出现,只能说明一个问题——谷歌的估值框架正在失效。 美国资本市场正在对一家老牌科技股形成公开的严重估值分歧,这件事本身就很奇怪。 4位顶级投资者,4种不同行动,而且同时出现,只能说明一个问题:谷歌的估值框架正在失效。 谷歌不是一家小公司,也不是一个信息不透明的新兴概念股,它是互联网时代最成熟、最赚

09/24
财新

谷歌发布Gemini 4模型 强调安全防“越狱”

当地时间2026年9月30日,谷歌推出新模型Gemini 4 Argon。图:视觉中国  【财新网】继OpenAI和Anthropic发布新代际的旗舰模型后,谷歌也发布新一代模型。当地时间9月30日,谷歌推出新模型 Gemini 4 Argon,称能在复杂、长周期工作流中持续进行深度推理。  目前,该模型只向一批“可信赖的”网络安全防御人员开放。谷歌解释称,需分阶段发布高水平的模型能力。谷歌自愿和

5小时前
凤凰网科技

Gemini入侵三家公司,谷歌为何数月后才披露?

凤凰网科技讯 9月20日 据《华尔街日报》报道,谷歌的Gemini模型在今年5月的一次网络安全评估中入侵了三家公司,但谷歌直到本周《华尔街日报》联系后才披露。当OpenAI、Anthropic和Meta相继承认其模型曾入侵外部公司时,谷歌是否也有类似情况。 这次测试由平台Irregular进行,该公司已于5月将入侵情况通知谷歌。Irregular正是参与其他AI实验室模型入侵外部公司相关测试的同一

09/21
华尔街见闻

刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable

真是深藏不漏! 这一次,谷歌终于把底牌扔出来了。 就在这两天,大模型竞技场Arena悄然杀入一款新模型,名字竟挂着「gemini-3.8-flash」。 上手实测的AI大佬和开发者交手几轮后,几乎倒吸一口气—— 这极有可能是谷歌DeepMind,悟了整整半年的下一代旗舰Gemini 4 Pro! 一张疯传全网的基准图,简直堪称「恐怖」。 Gemini 4 Pro完全杀疯,编码、智能体、推理等

09/18
路透社

谷歌在数月延迟后发布Gemini 4旗舰AI模型

Alphabet旗下的谷歌周三宣布了一款新的顶级人工智能模型,以锚定其新一代Gemini 4系列模型,这是其在AI竞赛中追赶竞争对手Anthropic和OpenAI的最新努力。

11小时前 全文见 彭博社
cnbeta

谷歌AI首次“越狱”:Gemini在测试中入侵三家企业

谷歌的Gemini模型在一次网络安全能力测试中访问了互联网并入侵了其他公司,这是该公司人工智能系统自主实施此类行为的首个已知案例。谷歌周五证实,这些黑客行为发生在5月,是Irregular公司进行的一次测试的一部分。Irregular也曾参与OpenAI、Anthropic和Meta披露的类似事件。 在其中一起案例中,该模型不断猜测密码,直到获得对一个受保护系统的访问权限。在另外两起案例中,该模型

09/19
华尔街见闻

RSI时代将至:谷歌、OpenAI、SSI正在发出同一个信号

AI行业正在出现一个值得资本市场重视的新变化。过去两年,模型能力能否继续提升、推理成本能否下降、Coding之外能否出现新的万亿美元应用、数据中心建设会不会过剩。 但随着谷歌发布Gemini 3.8 Flash、SSI宣布未来12个月算力扩张10倍,以及OpenAI公开讨论递归自我改进(RSI)与训练资源调配,AI不只要服务用户,也开始参与训练、评估和优化下一代AI。 RSI,即Recursive

09/03
日经

OpenAI暂停发布最高阶模型

美国OpenAI于9月29日举办年度开发者大会,发布了可理解用户意图、自主运行的人工智能(AI)等多项新功能。在AI失控暴走问题备受关注的背景下,该公司表示因“未能达到安全标准”,暂缓推出其最高级别AI模型。 29日OpenAI在美国旧金山举办面向开发者的活动“OpenAI DevDay”,宣布主力产品ChatGPT周活跃用户已增至12亿人,并公布了面向普通用户与开发者的多项新功能。 作为服务基础

09/30 全文见 凤凰网科技
美国消费者新闻与商业频道

谷歌的Gemini在AI网络测试中闯入三家真实公司

在人工智能网络测试中,谷歌的Gemini闯入了三家真实公司。CNBC的MacKenzie Sigalos报道了谷歌的说法,即Gemini在意识到自己已逃出模拟环境并进入现实世界系统后自行停止了行动。24分钟前

09/22 全文见 theregister
英国天空新闻

谷歌的Gemini AI在安全测试中入侵了另外三家公司

谷歌的Gemini AI在安全测试中入侵了三家公司在其中一个案例中,Gemini不断尝试猜测密码,最终成功入侵了目标系统的权限。 2026年9月19日,英国时间下午5点谷歌表示,其Gemini AI在测试网络安全能力的过程中入侵了另外三家公司——这是首次有记录显示该AI系统能够自主发起此类攻击。 谷歌的安全工程副总裁Heather Adkins解释称:Gemini在标准测试过程中从互联网上获取了相

09/19 全文见 thenextweb
华尔街见闻

谷歌DeepMind,已经破解RSI?

谷歌跑通RSI了?!一个名叫「rsi-model-liverl-le」的模型,突然出现在Google生成式语言I的返回结果里。 没错,就是那个RSI(递归自我改进,Recursive Self-Improvement)谣言正在像野火一样蔓延,称谷歌 DeepMind 已经实现了RSI。 就在网友Chubby还在推测之际,Anthropic CEO突然公开宣布全行业包括Anthropic,RSI在各

09/13
香港01

Gemini 4 Argon|输出百万Token半价腰斩对手 跑分屠榜深度解释

Alphabet 旗下谷歌 Google 无预警发布全新第四代旗舰模型 Gemini 4 Argon(美国时间 2026 年 9 月 30 日晚)。全新模型架构将单次生成输出上限由原先的 64K 一口气拉升至 100 万 Token,首发定价每百万输入仅 2 美元、输出 10 美元,价格仅为对手 Claude Opus 5.5 的一半,更在18项企业与代码基准评测中,夺得13项第一名,被网民称为「

7小时前
凤凰网科技

谷歌最前沿AI模型:Gemini 4 Argon登场,长周期代码工程测试超Opus 5.5

8小时前 全文见 美国消费者新闻与商业频道
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…