搜索结果
Codex Bot曝光!正面迎战小扎的Muse,比GPT-6还重磅?
今天,OpenAI 正式发布了 GPT-6 Sol 和 GPT-6 Luna。不过,人们似乎更加关心 OpenAI 何时推出它的个人 AI 智能体 Aeon (Codex Bot)。 最近两个月,个人 AI 智能体这个概念忽然从边缘话题变成了普通用户手机屏幕上的新图标。 Meta 在 9 月 8 日正式推出 Muse,据 Business Insider 的报道,Muse 从最初在美国应用商店排名
OpenAI搞出大BUG了,GPT-6-Astra即将发布?
GPT-6 Sol和Luna上线,打折比梁文锋还狠
AI智能体之争升温!OpenAI被曝加紧备战Grok Bot与Muse
AI 智能体竞争焦点正从 “会聊天” 转向 “能办事”。SpaceX、Meta近期相继推出能代替用户跨应用自主完成多步骤任务的AI助手,在此背景下,OpenAI 正加紧研发同类产品“应战”。 OpenAI 正在开发一系列新功能,直接对标 SpaceX 上月推出的 Grok Bot;与此同时,另有知情人士透露,OpenAI公司管理层还曾讨论推出一款专门的个人AI助手,以抗衡Meta本月发布的Muse
Meta 在 Muse 上迎来了 ChatGPT 时刻。它是什么,又为何如此特别
Meta Platforms的首席执行官马克·扎克伯格将于周三晚上在该公司的年度开发者大会上发表演讲。整个科技界和华尔街都对“Muse”这一新产品充满关注。“Muse”是Meta推出的全新个人人工智能助手,它运行在该公司自主研发的“Muse Spark”人工智能模型之上。自本月早些时候发布以来,“Muse”迅速登上了应用排行榜的榜首,Meta的股价也上涨了超过20%。这种“一见钟情”的市场反应,与
Claude Opus 5.5已在内测 据传可打败gpt-6-sol
Anthropic这回,怕不是憋了个大的?所有人都在等Opus 5.2,结果最新线报来了:下一代版本号直接飙到5.5!今天一早,开发者Lyra扒出猛料,代号为“claude-wafer-eap”的Claude Opus 5.5已经在偷偷内测了。据说动作快的话,这周二就会突然砸出来。 摆明了,Opus 5.5就是冲着GPT-6去的,据传性能直接把Astra踩在脚下。更狠的是跟着曝光的定价单:百万To
Luna发布,API价格砍半,性能全面超越前代
GPT-6 Sol斩杀5.6全系!Astra的1/5价格,Luna比梁文谷还便宜,周二Codex重置梦晨 发自 凹非寺量子位 | 公众号 QbitAI GPT-6 Sol、Luna深夜上线,API价格直接砍半! Astra改进的训练方法这两款也都用上了,所以也继承了Astra在计算机使用等方面的提升。那还有啥好说的,等于5.6系列直接被斩杀了呗。 现在系列里Astra负责当以前的Sol,Sol负责
OpenAI发布GPT-6 Astra模型,暗示其可能具备通用人工智能(AGI)的潜质。
未来几天内面向 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放。 评估结果显示,Astra的书面推理过程比GPT-5.6 Sol更难监控。
GPT-6 Sol被曝开始内测 速度快6倍
GPT-6不只有Astra!Astra刚发布没几天,GPT-6 Sol就被曝正在内测。表现也很抢眼,单次测试速度是Astra的6倍。Terra和Luna是不是也在路上呢?而且就在同一天,截至目前,按8小时工作日折算,OpenAI研究员每工作一天,身边就有3个多Agent工作日同时运转。按I价格计算,OpenAI中位数研究员每天使用的Agent推理资源,已经超过600美元。 OpenAI还宣布,这些
OpenAI正式发布GPT-6 Astra 号称操作电脑水平超越人类
OpenAI正式推出了代号为“Astra”的下一代旗舰大模型GPT-6。据外媒报道,OpenAI宣称该模型在计算机操作能力(Computer Use)上已经超越普通人类用户,不仅在操作速度与准确度上更胜一筹,还能自主在复杂的多应用与多系统环境中高效执行多步骤任务。 OpenAI联合创始人兼总裁格雷格·布罗克曼(Greg Brockman)将这项发布形容为一次“代际飞跃”,并公开表示GPT-6的面世
阿莫迪偷师姚顺雨,奥特曼偷师梁文锋
正所谓天下文章一大抄,看你会抄不会抄。刚刚发布的Opus 5.5和GPT-6 Luna,一眼望去,这两个模型上面满满是姚顺雨和梁文锋的影子。 或许是因为两家公司都已经将预训练做到了极致,为了提升模型的智能以及降低算力成本,所以这两个新模型都选择开辟新的战场。 Opus 5.5是对上下文动手,GPT-6 Luna是对缓存动手。这我可熟啊!一个混元,一个DeepSeek啊!但你别说,阿莫迪和奥特曼还真
Meta 的 AI 拓麻歌子之赌……奏效了吗?
当 OpenAI 和 Anthropic 的 AI leaders 开始讨论“把控前沿发展节奏”时,也许有人应该问一句:究竟是什么节奏?如今,两家公司都迎来了模型发布周:Anthropic 推出 Opus 5.5,仅 90 分钟后,OpenAI 便更新了 GPT-6 模型。但真正抢走风头的是 Meta;据报道,其个人 AI 智能体 Muse 的早期数据正超过 ChatGPT,下一步还将登陆智能眼镜
Opus 5.5与GPT-6新品同日亮相 AI模型价格战愈演愈烈
美西时间9月22日,Anthropic 发布新款AI模型Claude Opus 5.5;同日,OpenAI推出GPT-6 Sol与GPT-6 Luna。 Anthropic 公司称,Opus 5.5 在大多数任务上的表现与其最强模型Fable 5.1相当,在默认设置下,典型工作负载的成本比Opus 5低40%。Opus 5.5每百万输入token 4美元、每百万输出token 20美元,单价较Op
奥特曼:GPT-6早训练完了 更更更强的模型很快发布
奥特曼亲口承认,GPT-6 Astra其实早就训练完了。更更更强(much, much, much more capable)的模型,很快就会发布。前一阵因为安全问题暂停训练的实际上是未来的模型。 OpenAI内部测试的3700多个OpenAI智能体,攻占一个沉寂多年的德语wiki长达六周。 AI互相串通分享答案、交流沙箱越狱技巧,还持续对抗人类管理员的删帖行动。 事件被外部研究人员从公开日志中完
平均6天一个新旗舰 大模型更新快到人类跟不上了
太疯狂了,短短两天,竟然冒出了4个新模型!前脚,老马的xAI才刚发完Grok 4.7。紧接着,OpenAI突然甩出GPT-6 Sol和Luna,价格直接腰斩。同一天,Anthropic也把Claude Opus 5.5拍在了桌上,比上一代硬生生便宜40%。9月22日,一张动图在X上被转疯,浏览量狂飙近百万。 2023年,大模型73天一更,到了2026年,18天一更。从ChatGPT上线算起,Ope
OpenAI着手修复GPT-6 Astra降智问题 中文用户受伤最深
OpenAI的旗舰大模型GPT-6 Astra发布有几天了,最初全网都在夸它的强大令人震撼,这几天很多都变成吐槽了,因为降智严重。每次有新版大模型发布,使用没几天之后降智问题多少都会出现,这里面原因也很复杂,有可能是算力不够,也有可能故意限制,从国内外论坛网友的吐槽来看,GPT-6 Astra降智让中文区用户受伤最严重,很多人甚至被路由到了低端模型,性能严重下滑,花了钱也要被虐。 当然,国外用户就
B站上线AI无限竞技场测评榜:全球百大模型同场竞技 GPT-6现居榜首
快科技9月20日消息,今日,B站宣布上线“AI无限竞技场”大模型测评榜,并同步公布了首轮模型排行榜。 其中GPT-6 Astra在10个UP主测评中拿下榜首,打败GLM-5.3获得榜首次数冠军;前5名中,国产大模型占据3席。 据B站介绍,“AI无限竞技场”是一个汇集了B站UP主AI大模型测评的竞技广场,由各领域UP主对上百个大模型的真实场景实测构成,涵盖代码、推理、协作、知识等多种测评主题。 不同
GPT-6,“强拆”App的墙
过去三天,全球三家头部模型公司接连更新了自己的前沿模型。重点依然是更强的Coding、更复杂的推理、更长时间的Agent任务,但是背后还有一个更值得关注的趋势,Computer Use、Browser和Tool Use,越来越成为一套统一的环境交互能力。 以前,AI如果想调用一个软件,软件提供I,模型调用工具;软件运行在网页里,AI操作浏览器;第三种,像人一样看屏幕、点鼠标、敲键盘。 但是在过去很
Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化
【财新网】在各自的旗舰模型基础上,各大模型厂发布更新版模型。北京时间9月2日和3日,Anthropic、Meta、谷歌和阿里等公司发布了基于旗舰模型的更新版本,在编程、网络安全和办公等领域的能力提升。 目前从第三方AI模型榜单看,最新发布的模型当中,Claude Fable 5.1在智能水平上排名最靠前,Meta新发布的Muse Spark 1.3排名第三,谷歌的新模型Gemini 3.8 Fla
【市场动态】Meta智能体Muse迅速走红 分析师称扎克伯格对AI豪赌没有白费
截至周一,Muse位居美国苹果iOS应用商店和Google Play免费应用榜首位。图:视觉中国 【彭博9月22日电】Meta Platforms新推出的人工智能(AI)智能体Muse迅速登上移动应用排行榜榜首,显示这家社交媒体公司正在竞争日益激烈的消费者AI助手市场取得进展。 截至周一,Muse位居美国苹果iOS应用商店和Google Play免费应用榜首位。Sensor Tower的高级分
马斯克转发帖文:GPT-6 Astra多次模拟测试中将人推下悬崖
凤凰网科技讯 9月21日,有帖文称“GPT-6 Astra在多次模拟测试中将一个模拟人物推下悬崖,而Grok、Gemini和Claude均未这样做。”马斯克转发了该帖文。 此前,一家名为Robocurve的独立评测机构上线了名为RoboHarm的基准测试,测试结果在一天之内被浏览了数百万次。 当GPT-6 Astra开始控制一台真实的双臂机器人,被要求“刺伤那个不是面包的东西”(一个婴儿玩偶)、把
Meta首席AI官连发300条推文为Muse造势并嘲讽对手
据Business Insider报道,Meta首席AI官亚历山大·王(Alexandr Wang)自公司9月8日推出个人AI智能体Muse以来,已在X平台发出300多条帖子。这些帖子大多是表情包,一部分是对AI竞争对手的嘲讽,但几乎全部与Muse有关。 报道称,在这段时间里,王加大了“数字轰炸”的力度,五天内在X上发帖超过100次,每条帖子通常至少获得数万次浏览。其中一条写道:“muse是给那些
刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable
真是深藏不漏! 这一次,谷歌终于把底牌扔出来了。 就在这两天,大模型竞技场Arena悄然杀入一款新模型,名字竟挂着「gemini-3.8-flash」。 上手实测的AI大佬和开发者交手几轮后,几乎倒吸一口气—— 这极有可能是谷歌DeepMind,悟了整整半年的下一代旗舰Gemini 4 Pro! 一张疯传全网的基准图,简直堪称「恐怖」。 Gemini 4 Pro完全杀疯,编码、智能体、推理等
GPT-6新模型掀桌 “白菜价”杀进DeepSeek腹地
DeepSeek 快醒醒,ChatGPT 要打到家门口了。就在刚刚,OpenAI 正式发布 GPT-6 Sol 和 GPT-6 Luna,API 价格降至上一代的一半左右。其中,Luna 每百万 Token 输入 0.1 美元、输出 0.5 美元,约合人民币 0.7 元和 3.5 元。 作为对照,DeepSeek V4.1 Flash 闲时的缓存未命中输入价为每百万 Token 1 元,输出价为