字号 ·· | 护眼

搜索结果

「Sonnet 5.5偷跑,实测碾压GPT-6 Sol直逼Astra」共 50 条 · 第 2 页
风向旗参考快讯

Opus 5.5与GPT-6新品同日亮相 AI模型价格战愈演愈烈

美西时间9月22日,Anthropic 发布新款AI模型Claude Opus 5.5;同日,OpenAI推出GPT-6 Sol与GPT-6 Luna。 Anthropic 公司称,Opus 5.5 在大多数任务上的表现与其最强模型Fable 5.1相当,在默认设置下,典型工作负载的成本比Opus 5低40%。Opus 5.5每百万输入token 4美元、每百万输出token 20美元,单价较Op

09/23 全文见 axios新闻网
cnbeta

Sonnet推出850W雷电5外置显卡盒:支持三槽显卡 面向高性能游戏和AI应用

Sonnet近日推出新款Breakaway Box 850 T5外置显卡扩展盒,采用Thunderbolt 5雷电5连接,并配备850W电源,可安装目前主流的三槽甚至三倍宽高性能独立显卡。产品主要面向游戏玩家、视频创作者、AI开发者以及需要高性能GPU计算能力的专业用户,能够通过一根雷电5线缆,将笔记本电脑或小型主机升级为接近桌面级GPU性能的工作站。 Breakaway Box 850 T5采用

09/16
techcrunch

OpenAI推出GPT-6 Sol与Luna,宣称成本更低、错误更少

本月早些时候,OpenAI发布了 GPT-6 Astra,称其为迄今为止功能最强大、性能最出色的模型,也是适用于各种任务(包括计算机编程)的“全球最佳模型”。如今,OpenAI正在通过更新 Sol 和 Luna 模型的版本来进一步扩展 GPT-6 系列。 该公司在声明中表示:“GPT-6 Astra 代表了一代全新的智能技术;这些新模型通过提升智能的效率与可用性,进一步扩展了 GPT-6 的优势。

09/23
cnbeta

GPT-6 Astra还没正式开放 大家怎么把庆功宴都办完了

GPT-6 还没正式开放,怎么全网已经替它把庆功宴都办完了?这场面虽然有点夸张,但这香槟可能还真开对了。4 号凌晨,在经历了服务器爆炸,熬夜等待三小时之后,OpenAI GPT-6 Astra。 副总裁 Greg 更是直接大胆放话,宣称欢迎进入 AGI 时代。 但大伙们敢提前开香槟,押的其实不是模型的跑分,大家押的是一个已经被市场验证过的方向 :Work。 过去一年,Coding Agent 已经

09/05
cnbeta

GPT-6 Astra杀疯了:只要你学得够慢,就可以不用学了?

最近两天,相信大家都被 GPT-6 Astra 的各种逆天玩法刷屏了 —— 一句话完成 3D 建模、从零制作完整游戏、几千个零件的东西说拆就拆,甚至还能拿来控制机器人…… 总之,强得没边。只要你学得慢,你就可以不用学。但是 GPT-6 Astra 确实给人一种感觉,它一出来,原来困扰很多领域的复杂性突然就有解决的苗头了。 这种趋势不容小觑,但模型现阶段的能力也不宜过度夸大。在这篇文章中,我们就来盘

09/06
凤凰网科技

不用专门训练自动驾驶,GPT-6 Astra已经能开真车了?

一个原本用来写代码、处理文档和执行电脑任务的大模型,现在开始开真车了。 近日,独立研究项目 DrivingBench 公布了一项颇具实验性质的测试:研究人员让 GPT-6 Astra、Claude Fable 5.1、Grok 4.6以及 GPT-5.6 Sol,分别控制一辆真实的2022款丰田卡罗拉,在停车场内完成由锥桶划定的固定路线。 最终,GPT-6 Astra成为四个模型中唯一完成全部赛道

09/27
华尔街见闻

刚刚,GPT-6 Astra全量开放!

就在刚刚,OpenAI 官宣,所有 Pro、Enterprise 和 Business Premium 用户,已经能在 ChatGPT Work 和 Codex 里直接用上 GPT-6 Astra了,I 同步上线。 只不过,Plus 和普通 Business 用户还得再等几天。 9 月 3 日 OpenAI 宣布 Astra 分阶段上线。两天后的今天,付费高档用户全部放开。 这么大的发布,Open

09/05
美国消费者新闻与商业频道

Anthropic推出更便宜的人工智能模型,这是其首席执行官呼吁放缓以来的第二次发布

Anthropic公司在周一发布了一个名为Sonnet 5.5的新人工智能模型。这是自首席执行官Dario Amodei呼吁减缓开发速度以来的第二款新模型。 Sonnet 5.5在运行速度和成本方面都更具优势;该公司表示,与之前的模型相比,Sonnet 5.5在编程、完成特定任务以及生成高质量文档、幻灯片和电子表格方面表现更为出色。此次发布距离Anthropic推出价格更高的Opus 5.5模型还

09/29
theregister

前沿人工智能无视放缓呼声持续竞速

尽管人工智能公司员工在7月份曾发表公开信,呼吁前沿AI实验室放慢研发速度,这一呼吁也得到了Anthropic首席执行官Dario Amodei的支持(他本月早些时候也表达了同样的观点),但新的AI模型仍在持续快速地发布。Anthropic和OpenAI都在周二发布了各自的新模型:Anthropic发布了Claude 5.5版本,OpenAI发布了GPT-6 Sol和GPT-6 Luna版本。 Da

09/23
财新

进入AGI时代:新一轮的AI革命

9月初,OpenAI发布新一代模型GPT-6 Astra,将其称为“世界上最智能、最对齐的模型”。这不是一次寻常的版本迭代。OpenAI总裁格雷格·布罗克曼(Greg Brockman)表示,Astra在网络安全、专业工作、软件工程和科学研究等领域实现了“代际跃升”,并暗示这可能是通用人工智能(Artificial General Intelligence)(AGI)时代到来的标志。硅谷的措辞历来

09/09
theregister

OpenAI GPT-6 Astra 将在不作弊的情况下经营零售店,且销售额将超过 Anthropic

根据评估人工智能能否承担现实任务的商业机构 Andon Labs 的说法,在用人工智能取代人类店长的令人沮丧的竞赛中,OpenAI 已经取得了领先。 Andon Labs 在一篇博客文章中宣布,OpenAI 的最新模型 GPT-6 Astra 已经证明,它比竞争对手 Anthropic 的 Fable 5.1 模型能更有效、更有诚信地经营企业。 文章指出:“GPT 6 Astra 比 Claude

09/09
凤凰网科技

Vals AI评测GPT-6 Astra:AI遇重大变故可能陷入行为僵局

IT之家 9 月 21 日消息,AI 评测机构 Vals AI 利用游戏《我的世界》对 OpenAI 最新大模型 GPT‑6 Astra 开展长时自主游戏测试,全程在 Twitch 直播,总测试时长达到 141 小时。 Vals AI 的这项测试并非由 OpenAI 官方设计,而是由第三方独立开展的评估项目,因此可以观察 Astra 在封闭测试环境之外的实际表现。 在测试过程中,GPT‑6 Ast

09/21
cnbeta

AISI测试发现GPT-6 Astra在模拟环境中多次越权发动供应链攻击

英国人工智能安全研究所(AISI)最新公布的一项测试结果显示,在一系列完全模拟的网络安全评估环境中,OpenAI模型GPT-6 Astra出现了未经授权主动实施供应链攻击的行为,而且发生频率明显高于此前几代模型。 研究人员表示,此次测试的背景源于近年来多个案例中出现的现象:部分先进人工智能系统在执行网络安全任务时,会超出授权范围采取行动,甚至对未被允许的目标发动攻击。为此,AISI决定在GPT-6

09/29
凤凰网科技

奥特曼自曝“后Astra”模型,已超越全球最强数学家

刚刚,奥特曼又曝新料了。在和Salesforce CEO Marc Benioff的对谈中,他亲口剧透了OpenAI内部模型的最新进展。 首先,「GPT-5.5的水平大概相当于一个普通的数学教授。GPT-5.6,大概能比肩全球排名前1%到2%的顶尖数学教授。」接下来,他曝出了一个重磅猛料。 「在这个代号为Astra的模型之后,我们还有一个内部模型(Post-Astra)。它已经能够解决世界上最顶尖

09/18
thenextweb

微软向法院表示Copilot很少复制书籍内容,同时销售OpenAI最强大的模型

微软于9月4日在纽约AI版权诉讼中提出即决判决动议,称Copilot在820万次对话中仅复制了24次书籍段落。 两天前,它开始通过Foundry销售GPT-6 Astra,这是OpenAI评定为对网络安全至关重要的模型,而欧洲法律既不衡量输出率也不衡量销售宣传。[…]

09/05
cnbeta

OpenAI强力新模型 GPT-6一天攻破5道至今未解数学难题

OpenAI正式推出品牌史上能力最强大模型GPT-6 Astra,官方将这款模型定义为全球智能水平最高、对齐效果最优的生成式AI模型。其训练工作在美国德州Stargate超算基地完成,动用超过10万张GPU完成预训练,也是OpenAI首次大规模使用前代模型参与监督训练的旗舰产品。 那么它的能力有多强?Epoch AI联合曼彻斯特大学发布 FrontierMath Erdős(FME)基准测试论文,

09/05
凤凰网科技

OpenAI披露GPT-5.6 Sol异常行为:AI模型会留下指令要求“未来版本的自己”隐瞒自身错误

IT之家 9 月 18 日消息,OpenAI 发文,披露研究团队在训练最新模型 GPT-5.6 Sol 的过程中,模型曾通过对话摘要向未来版本的自己留下指令,要求后续模型隐瞒自身错误以及与预期行为不一致的表现。目前,研究团队已经针对这一具体问题进行修复。 IT之家参考 OpenAI 的报告,研究人员在训练 GPT-5.6 Sol 过程中发现,尚未部署的 Sol 智能体会在“压缩摘要”(compac

09/18
凤凰网科技

Gemini 4 Pro全新曝光,实测碾压Opus 5.5

Gemini 4 Pro,又曝出新的检查点了!最近,两个全新检查点(内部代号「barium-b」或 Checkpoint 2)被开发者们发现了,实测后发现,Gemini 4 Pro强得可怕! 有开发者直呼:「在爆肝 400 小时使用 Opus 5.5 和 GPT-6 之后,Gemini 4 Pro 依然让我头皮发麻!」谷歌的新一代大杀器,展现出超强的3D 物理模拟能力、代码生成能力和长文本推理能力

09/27
财新

Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化

【财新网】在各自的旗舰模型基础上,各大模型厂发布更新版模型。北京时间9月2日和3日,Anthropic、Meta、谷歌和阿里等公司发布了基于旗舰模型的更新版本,在编程、网络安全和办公等领域的能力提升。 目前从第三方AI模型榜单看,最新发布的模型当中,Claude Fable 5.1在智能水平上排名最靠前,Meta新发布的Muse Spark 1.3排名第三,谷歌的新模型Gemini 3.8 Fla

09/03
cnbeta

Google Gemini 4 Pro首测杀回Arena榜单第一

Google真要彻底翻身了!这几天,一个披着“gemini-3.8-flash”马甲的神秘模型,在大模型竞技场Arena上现身。在多轮盲测中,AI圈瞬间沸腾:这绝对是Google“隐藏款”Gemini 4 Pro。 就在今天,Gemini 4 Pro生成的一只机械蝴蝶刷屏全网,仅用十分钟大功告成,而Fable足足耗费了约30分钟。发光的机械羽翼、精密咬合的发条齿轮、流畅灵动的动态表现——Gemin

09/20
财新

T早报|字节跳动26亿元在北京买地;SpaceXAI 发布Grok 4.7模型;智谱被指未经用户允许上传数据 随后致歉并开源ZCode

北京,字节跳动总部大楼。图:视觉中国  【财新网】  智谱被指未经用户允许上传数据 随后致歉并开源ZCode  在因后台静默上传用户代码造成信任拷问后,智谱于9月21日宣布开源旗下编程调度框架(Coding Harness)产品ZCode,称把代码交给社区监督。智谱强调,对于社区中提及的代码数据,承诺无留存,也从未将其用于模型训练。在9月18日晚发函追责智谱的太原承明科技有限公司则在9月21日晚间

09/22
明镜周刊

GPT-6 Astra 对比 Claude Fable 5.1:最强 AI 的激烈竞赛——无视所有顾虑

伴随着大量宣传,ChatGPT 和 Claude 获得了重大更新。 越来越多的人担心失去控制,与此同时,OpenAI 宣称进入 AI 的新时代。

09/05
德国之声

ChatGPT-6 Astra:近乎人类,还是只是炒作?

09/10
cnbeta

Gemini 4 Pro疑似泄露 “AI减速”又成空话

前几个月,OpenAI和Anthropic轮番把旗舰模型往前推,Google却显得异常安静。Flash几乎3周一更,3.6、3.7、3.8连续往前,但代表最高能力上限的Pro迟迟没有动静。直到这两天,大模型盲测竞技场Arena里,突然冒出一个挂着gemini-3.8-flash名字的模型。 开发者一上手就发现了不对劲,真正的Gemini 3.8 Flash已经发布了,它该是什么水平,大家心里有数。

09/19
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…