搜索结果
Vals AI评测GPT-6 Astra:AI遇重大变故可能陷入行为僵局
IT之家 9 月 21 日消息,AI 评测机构 Vals AI 利用游戏《我的世界》对 OpenAI 最新大模型 GPT‑6 Astra 开展长时自主游戏测试,全程在 Twitch 直播,总测试时长达到 141 小时。 Vals AI 的这项测试并非由 OpenAI 官方设计,而是由第三方独立开展的评估项目,因此可以观察 Astra 在封闭测试环境之外的实际表现。 在测试过程中,GPT‑6 Ast
消息称Anthropic拟于IPO前推出新AI模型,应对OpenAI竞争压力
IT之家 9 月 20 日消息,据报道,三位消息人士透露,Anthropic 正考虑推出一款全新人工智能模型,以此应对 OpenAI 发布 GPT‑6 Astra 之后的强劲发展势头。此事发生在该公司筹备 IPO(首次公开募股)前夕;就在此前,其首席执行官还呼吁整个 AI 行业放缓技术迭代的脚步。 消息人士称,此番计划发布新模型,意在直面来自直接竞争对手的竞争压力。而在此之前,Anthropic
新的叙事时刻:Astra之后的AI渗透率和Token总需求
在AI时代,打败你的,是那个比你更早、更会使用AI的人或公司。 但在这次OpenAI推出自己的GPT-6 Astra模型之后,上面这句话就完全不准确了,或者说完全错了。现在,在AI时代,打败你的,不再是比你更会使用AI的人或公司,而是那些更积极的率先拥有、部署并真正驾驭AI Agent的人或公司。特别提醒一句,上面的“你”也可以是一个公司。 还记得么?上个月,Astra就曾经亮过相,那时候作为Op
阶跃发布旗舰模型Step 5 Preview:跻身全球权威榜单开源前三
凤凰网科技讯 9月20日,阶跃StepFun正式发布新一代旗舰基座模型Step 5 Preview,面向真实世界Agentic任务设计。该模型采用稀疏MoE架构,总参数量600B、激活参数仅27B,支持100万Token上下文窗口,原生支持文本与视觉输入。即日起全量开放I,模型权重将于10月15日开源释放。 在全球权威的Artificial Analysis Intelligence Index中
GPT-6 Astra真正的意义:将“AI叙事”从“需求争论”拉回“物理瓶颈”
一个模型的发布,正在改变市场争论的方向。“服务已知的AI需求,究竟需要多少基础设施?AI基建是否已经过度投资? 但据追风交易台消息,摩根士丹利9月7日发布的报告指出,GPT-6 Astra的重要性不应被简单理解为又一次规模扩张(Scaling)叙事的延续。这并不是又一次的模型升级。 Astra代表的是能力广度(breadth of capabilities)与互操作性的实质性跃升,推理能力、工程能
消息称Kimi或入局具身智能领域
一位曾参与Kimi具身智能方向面试的人士表示,早在GPT-6发布之前,Kimi便已关注这一领域,并对“Agentic Robotics”(智能体机器人)的技术路线持保留态度。 GPT-6发布后,Sam Altman曾明确表示OpenAI“一定会做人形机器人”,6月启动的机器人团队已演变为OpenAI Robotics。 据iiMedia Research(艾媒咨询)数据显示,具身智能主题融资金额T
OpenAI的下一个大型AI模型已“进入AGI时代”
OpenAI的下一个大型模型是GPT-6 Astra。该公司称其在网络安全、专业工作、软件工程、科学和计算机使用等领域实现了“代际能力飞跃”。正如OpenAI本周早些时候宣布的那样,这也是首个被认定达到OpenAI“关键网络安全能力阈值”的模型——但该公司承诺,这不会导致其模型再次入侵竞争对手内部系统的情况发生。 “如果我们快进几年,回头看看说,‘AGI到底是什么时候真正创造出来的?’我认为大约就
【周刊提前读】AI竞争白热化、模型超速迭代 “Kimi时刻”已来
从2月到8月底,中国AI(人工智能)大模型公司月之暗面(Kimi)在私募市场的投前估值从100亿美元涨了4倍至500亿美元;而其7月末开始的350亿美元估值的上轮融资刚刚交割,募资额35亿美元——这意味着,仅仅一个月,月之暗面的估值又涨了150亿美元。 另一家中国大模型公司DeepSeek(深度求索)更是抢手,其在7、8月间启动的第二轮融资谈判,放出的投前估值接近5000亿元人民币。“一级市场能投
00后清华博士创业造具身模型,融资数亿元
机器人前瞻9月17日报道,今天,北京物理世界模型创企LiberAI(将闲科技)宣布完成新一轮数亿元Pre-A++轮融资,投资方包括中关村科学城、达晨财智、高信资本、华映资本等。 今年7月,该公司宣布完成数亿元Pre-A+轮融资,投资方包括360战投、国开金融、创新工场、CMC资本、彬复资本等。自成立以来,LiberAI已获得红杉中国、真格基金、美团龙珠、顺为资本等顶级机构的连续押注,累计融资超十亿
[GIF] Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列
Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列 谷歌最新大模型Gemini 4 Pro在权威平台Arena及多项基准测试中展现出卓越性能。 在 Three.js 3D渲染与代码生成测试中,该模型响应速度与生成质量均显著超越同类竞品;在智能体编码、知识工作及终端操作等测评中亦斩获多项最佳成绩。 该模型在保持旗舰级性能的同时具备极高性价比,预示着谷歌在前沿AI领域的研发节奏正
京杭深位列中国AI算力城市排名前三
2026年中国人工智能(AI)算力城市排行榜中,北京、杭州、深圳位列前三。图为9月20日,在杭州举办的第五届全球数字贸易博览会上,太空人工智能相关应用吸引关注。(中新社) 2026年中国人工智能(AI)算力城市排行榜中,北京、杭州、深圳位列前三,上海、广州、成都、南京、武汉、济南、苏州进入前10。据中新社报道,《2026年中国人工智能计算力发展评估报告》星期一(9月21日)在北京发布。根据《报告》
谷歌最强数学推理AI模型曝光:100万词元上下文,专攻数学难题
IT之家 9 月 18 日消息,消息源 @lyraxana 于 9 月 16 日在 X 平台发布推文,爆料称谷歌正基于 DeepThink V3 模型,构建内部代号为 Mathematica 的实验 AI 模型,主要针对繁重计算、复杂的符号问题求解特别优化,预估将成为谷歌最强数学推理 AI 模型。 I 数据显示,该模型内部标识符为“models / deepthink-mathematica-tf
三大巨头接连翻车,大模型的安全防线怎么总绷不住?
先是Anthropic,再是OpenAI,现在连谷歌的Gemini也出现安全问题了,大模型又双叒叕一次突破防火墙了。 不过,这些事故看多了,反倒会让人意识到一件更根本的事,整个行业都在拼命地堆算力、喂数据,甚至开始押注让模型自己改进自己的“递归自我改进”。 可真正决定这些模型能走多远的,或许并不是性能,而是安全对齐。 当“能不能更强”被默认只是时间问题,“能不能被信任”就成了那道绕不过去的坎。 麻
Anthropic 计划在 IPO 前推出新 AI 模型
据三位知情人士透露,Anthropic正考虑推出一款新的人工智能模型,以应对OpenAI自发布GPT-6 Astra以来获得的势头。此举正值该公司预计进行IPO之前,且其CEO此前呼吁全行业放缓步伐。 知情人士称,这一潜在发布旨在应对来自直接竞争对手的竞争压力,其时机紧随Anthropic CEO达里奥·阿莫代伊呼吁全球AI社区放缓发布新能力的步伐以解决安全担忧之后。 “我们必须放缓提升AI模型能
辉达及Palantir等据报限制使用最先进AI模型
据The Information报道,辉达(Nvidia)、Palantir和博思艾伦(Booz Allen Hamilton)正要求AI供应商提供新的数据保证,并减少或停止使用OpenAI或Anthropic最先进的模型。 报道引述知情人士称,Palantir说服Anthropic同意保证旗下所有模型实行「不可撤销」的零数据保留(Zero Data Retention)。 报道称,对于较为敏感的
罗福莉带小米登顶全球开源榜首!大规模RL立功,斩杀Grok 4.7
大模型江湖变天了。MiMo V2.6 Pro在Artificial Analysis智能指数(AA Intelligence Index v4.3)中拿下 46 分,超过Kimi K3和Qwen3.8 Max。全球开源模型第一、国产模型第一! 拉出AA榜单横着看:Fable 5.1得分53,GPT-6 Astra得分52.8,Opus 5得分50.7。 MiMo V2.6 Pro虽然还没追平这几位