字号 ·· | 护眼

搜索结果

「人工分析基准测试发布:谷歌Gemini 4 Argon与OpenAI GPT-6 Astra的对比」共 100 条 · 第 2 页
凤凰网科技

Gemini 4 Pro全新曝光,实测碾压Opus 5.5

Gemini 4 Pro,又曝出新的检查点了!最近,两个全新检查点(内部代号「barium-b」或 Checkpoint 2)被开发者们发现了,实测后发现,Gemini 4 Pro强得可怕! 有开发者直呼:「在爆肝 400 小时使用 Opus 5.5 和 GPT-6 之后,Gemini 4 Pro 依然让我头皮发麻!」谷歌的新一代大杀器,展现出超强的3D 物理模拟能力、代码生成能力和长文本推理能力

09/27
凤凰网科技

GPT-6新模型掀桌 “白菜价”杀进DeepSeek腹地

DeepSeek 快醒醒,ChatGPT 要打到家门口了。就在刚刚,OpenAI 正式发布 GPT-6 Sol 和 GPT-6 Luna,API 价格降至上一代的一半左右。其中,Luna 每百万 Token 输入 0.1 美元、输出 0.5 美元,约合人民币 0.7 元和 3.5 元。 作为对照,DeepSeek V4.1 Flash 闲时的缓存未命中输入价为每百万 Token 1 元,输出价为

09/23
印度斯坦时报

OpenAI推迟GPT-6.1 Astra发布,因研究人员标记安全风险:版本“未达标”

| 世界新闻 编辑个人资料 关注 退出 获取应用

09/29 全文见 theregister
风向旗参考快讯

OpenAI发布GPT-6.1 Sol 成本仅Astra 20%

OpenAI 推出新模型 GPT-6.1 Sol,声称在代理编码、电脑操作及办公室工作等任务上表现接近计划中的旗舰模型 Astra,成本只需约五分之一;原定推出的旗舰 GPT-6.1 Astra 则因安全考虑暂缓发布。 Sol 现已向付费客户开放,API 定价与 Anthropic 公司的 Claude Sonnet 5.5 相若。 Sol 的 API 定价为每百万输入 Token 2 美元、输出

09/30 全文见 凤凰网科技
华尔街见闻

GPT-6,“强拆”App的墙

过去三天,全球三家头部模型公司接连更新了自己的前沿模型。重点依然是更强的Coding、更复杂的推理、更长时间的Agent任务,但是背后还有一个更值得关注的趋势,Computer Use、Browser和Tool Use,越来越成为一套统一的环境交互能力。 以前,AI如果想调用一个软件,软件提供I,模型调用工具;软件运行在网页里,AI操作浏览器;第三种,像人一样看屏幕、点鼠标、敲键盘。 但是在过去很

09/04
cnbeta

GPT-6 Astra还没正式开放 大家怎么把庆功宴都办完了

GPT-6 还没正式开放,怎么全网已经替它把庆功宴都办完了?这场面虽然有点夸张,但这香槟可能还真开对了。4 号凌晨,在经历了服务器爆炸,熬夜等待三小时之后,OpenAI GPT-6 Astra。 副总裁 Greg 更是直接大胆放话,宣称欢迎进入 AGI 时代。 但大伙们敢提前开香槟,押的其实不是模型的跑分,大家押的是一个已经被市场验证过的方向 :Work。 过去一年,Coding Agent 已经

09/05
LoopDNS 资讯播报

谷歌宣布正加速推进旗舰级 Gemini 4 AI 模型研发

谷歌科技巨头即将推出其最新旗舰人工智能模型 Gemini 4,以在与 Anthropic 和 OpenAI 的竞争中重新赢得优势。谷歌 DeepMind 新任最高领导人 Kavukcuoglu 在 AI Agenda Live 峰会上表示,Gemini 4 目前正处于后训练阶段的早期,团队正在对其进行精调与安全性测试,目标是“远早于”今年年底发布。 该模型是自去年 Gemini 3 系列发布以来的

09/24 全文见 罗塞塔简报
semafor

OpenAI开始分阶段推出GPT-6 Astra模型

周四开始分阶段发布其最新模型,该公司称该模型超越了Anthropic最先进的模型,并切实接近“通用人工智能”。 OpenAI表示,GPT-6 Astra是其首个跨越“关键”网络安全能力门槛的模型,初期将仅限于企业使用,以便它们解决漏洞。 此举与Anthropic限制发布Mythos的做法如出一辙,Mythos的能力促使监管机构介入。五角大楼周四确认了对Mythos的禁令。 在专家、科技领袖和公众对

09/04
彭博社

谷歌努力应对用户对Gemini模型的质疑

朱莉娅·洛芙和戴维·阿尔巴报道,随着Alphabet旗下谷歌准备推出Gemini 4,公司内部的人士对该旗舰人工智能模型在编程等关键领域的表现能否达到预期存在质疑。 据直接参与相关工作的人士称,尽管Gemini 4在行业用于衡量模型效能的基准测试中表现良好,但员工在实际使用过程中的评价却没有那么好。上述人士因讨论内部事务而要求匿名。他们称,该模型难以应对某些编程任务。 谷歌近期投入大量精力开发模型

12小时前
路透社

谷歌在数月延迟后发布Gemini 4旗舰AI模型

Alphabet旗下的谷歌周三宣布了一款新的顶级人工智能模型,以锚定其新一代Gemini 4系列模型,这是其在AI竞赛中追赶竞争对手Anthropic和OpenAI的最新努力。

11小时前 全文见 彭博社
罗塞塔简报

OpenAI推出基于GPT-6的专用法律AI Astra for Law

2026年9月17日,OpenAI推出了专为律师事务所和法律科技公司设计的AI工具Astra for Law。 该工具基于GPT-6模型构建,拥有覆盖超过2.3亿个URL的法律搜索索引,其中通过Free Law Project收录了99.9%的美国判例法。 与标准GPT-6相比,Astra在Vals AI Legal Research Bench测试中的正确率提高了40%。 OpenAI正与Lat

09/18
cnbeta

OpenAI强力新模型 GPT-6一天攻破5道至今未解数学难题

OpenAI正式推出品牌史上能力最强大模型GPT-6 Astra,官方将这款模型定义为全球智能水平最高、对齐效果最优的生成式AI模型。其训练工作在美国德州Stargate超算基地完成,动用超过10万张GPU完成预训练,也是OpenAI首次大规模使用前代模型参与监督训练的旗舰产品。 那么它的能力有多强?Epoch AI联合曼彻斯特大学发布 FrontierMath Erdős(FME)基准测试论文,

09/05
亚洲新闻台

OpenAI暂缓发布新AI模型,因内部安全测试问题

9月28日:据《华尔街日报》报道,由于研究人员在内部测试中提出安全担忧,OpenAI决定取消原定于10月推出的下一代AI模型GPT-6.1 Astra的发布。 该模型原本计划应用于ChatGPT和Codex等产品中,旨在实现无需人工协助即可处理更复杂任务的功能。 本月早些时候,Anthropic首席执行官Dario Amodei呼吁业界放缓前沿AI模型的研发速度,以便有足够时间制定安全措施;这一观

09/29
华尔街见闻

OpenAI高管:Astra需求太猛,新的Pro订阅或被迫暂停

GPT-6 Astra的发布正在引发一场算力与容量危机。Astra的用户需求已超出历史经验,公司可能不得不暂停新的Pro订阅。 Tibo在X平台发文称,“Astra的需求真的是前所未有。我们已经在拉动所有能拉的杠杆来维持服务,但直到现在,我从未见过任何类似的情况——而我们此前已经经历过非常陡峭的增长。”他表示,首要原则是确保现有用户的服务质量,但如果需求持续,“我们可能不得不暂时暂停新的Pro订阅

09/09
财新

T早报|OpenAI推出GPT-6 Astra;长江存储科创板IPO审核状态变更为“已问询”;英伟达129亿美元收购Hugging Face

OpenAI推出GPT-6 Astra 称是全球智能水平最高模型当地时间9月3日,OpenAI推出GPT‑6 Astra,称是全球智能水平最高、对齐效果最优的模型,在计算机操作、网页浏览、软件工程、网络安全、科学研究以及专业办公领域均达到业界顶尖水平。根据OpenAI,GPT-6 Astra在FrontierMath四级测试集、ARC‑AGI‑3和ExploitBench测试集在内的多个测试集中取

09/04
TheVerge

OpenAI的下一个大型AI模型已“进入AGI时代”

OpenAI的下一个大型模型是GPT-6 Astra。该公司称其在网络安全、专业工作、软件工程、科学和计算机使用等领域实现了“代际能力飞跃”。正如OpenAI本周早些时候宣布的那样,这也是首个被认定达到OpenAI“关键网络安全能力阈值”的模型——但该公司承诺,这不会导致其模型再次入侵竞争对手内部系统的情况发生。 “如果我们快进几年,回头看看说,‘AGI到底是什么时候真正创造出来的?’我认为大约就

09/04
cnbeta

下一代旗舰模型Gemini 4发布时间或“远早于”今年底

Google DeepMind部门负责人Koray Kavukcuoglu周三表示,Google接近发布其最新旗舰模型 Gemini 4,这是这家科技巨头在人工智能模型竞赛中落后于竞争对手 Anthropic 和 OpenAI 后期待已久的进展。 Kavukcuoglu 在一次活动上表示,Gemini 4 正处于被称为“后训练”的开发阶段的初期,在此阶段,基础 AI 模型将得到完善,以使其表现可靠

09/24
thenextweb

OpenAI的AGI数字来自测试工具,而非模型本身

OpenAI凭借99.9%的得分宣布了AGI时代。但通过基准测试自身的软件运行同一模型,其得分仅为62.7%。 这一差距并非四舍五入的误差,也不是竞争对手的抱怨,而是来自构建该测试的组织。 ARC Prize在GPT-6 Astra发布当天公布了这两个数字。

09/06
theregister

OpenAI将Astra推入顶级模型竞争行列

在短暂暂停训练以反思其AI安全措施不足之后,OpenAI发布了GPT-6 Astra,最初面向其可信访问计划的成员。 假设一切顺利,且不再发生类似Hugging Face遭黑客攻击的事件,这家AI公司将在几天后允许Plus、Pro、Business和Enterprise用户试用其所称的“我们迄今为止最智能的模型,在计算机使用、浏览、软件工程、科学和专业工作方面具有最先进的性能”。 GPT-6 As

09/04
𝕏 @spectatorindex

突发:谷歌推出其全新前沿AI模型Gemini

11小时前 全文见 彭博社
techcrunch

OpenAI 发布 GPT-6.1 Sol,称其性能接近 GPT-6 Astra 且成本更低

在周二的 OpenAI DevDay 活动上,该公司展示了 GPT-6.1 Sol,此时距离其发布 GPT-6 Sol 仅过去了一周。OpenAI 表示,这款新模型在智能体编码、电脑操作和专业工作方面,能够提供与 GPT-6 Astra 几乎相同的智能水平,而输入和输出 Token 的标准价格仅为后者的五分之一。 值得注意的是,该公司并未像最初预期那样发布 GPT-6.1 Astra。《华尔街日报

09/29
thenextweb

OpenAI推出面向法律领域的Astra,并发布自有法律研究索引

“随着人工智能变得更加开放和可互操作,价值并不只在于连接性本身,”汤森路透首席技术官乔尔·赫伦表示。“法律专业人士需要的不仅仅是获取信息。”他是在支持OpenAI的一份声明中这样说的,而就在同一天,OpenAI开始构建自己的法律研究索引。 OpenAI于9月17日推出了Astra for Law。它是GPT-6 Astra,该公司最强大的模型,配置了法律搜索、法律分析与写作指令,以及面向律师事务所

09/18
凤凰网科技

Luna发布,API价格砍半,性能全面超越前代

GPT-6 Sol斩杀5.6全系!Astra的1/5价格,Luna比梁文谷还便宜,周二Codex重置梦晨 发自 凹非寺量子位 | 公众号 QbitAI GPT-6 Sol、Luna深夜上线,API价格直接砍半! Astra改进的训练方法这两款也都用上了,所以也继承了Astra在计算机使用等方面的提升。那还有啥好说的,等于5.6系列直接被斩杀了呗。 现在系列里Astra负责当以前的Sol,Sol负责

09/23
techcrunch

OpenAI推出GPT-6 Sol与Luna,宣称成本更低、错误更少

本月早些时候,OpenAI发布了 GPT-6 Astra,称其为迄今为止功能最强大、性能最出色的模型,也是适用于各种任务(包括计算机编程)的“全球最佳模型”。如今,OpenAI正在通过更新 Sol 和 Luna 模型的版本来进一步扩展 GPT-6 系列。 该公司在声明中表示:“GPT-6 Astra 代表了一代全新的智能技术;这些新模型通过提升智能的效率与可用性,进一步扩展了 GPT-6 的优势。

09/23
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…