字号 ·· | 护眼

搜索结果

「OpenAI公布GPT-6 Astra自主智能体安全与治理框架」共 100 条 · 第 3 页
美联社

OpenAI因安全担忧推迟发布最新模型,行业面临新的安全压力

THOMAS BEAUMONT OpenAI周一表示,由于研究人员提出了安全担忧,公司将推迟发布一款新的人工智能模型,这是该公司为减缓技术进步步伐所做的最新努力。 OpenAI决定推迟发布名为GPT-6.1 Astra的模型,正值行业内普遍呼吁在安全措施跟上之前放缓日益自主的系统开发之际。 在这一公告发布的前一天,人工智能高管们计划在华盛顿与唐纳德·特朗普总统会面,科技公司正面临确保其模型不被滥用

09/29
DealStreetAsia

Anthropic 计划在 IPO 前推出新 AI 模型

据三位知情人士透露,Anthropic正考虑推出一款新的人工智能模型,以应对OpenAI自发布GPT-6 Astra以来获得的势头。此举正值该公司预计进行IPO之前,且其CEO此前呼吁全行业放缓步伐。 知情人士称,这一潜在发布旨在应对来自直接竞争对手的竞争压力,其时机紧随Anthropic CEO达里奥·阿莫代伊呼吁全球AI社区放缓发布新能力的步伐以解决安全担忧之后。 “我们必须放缓提升AI模型能

09/19 全文见 连线
美国消费者新闻与商业频道

OpenAI开发者日实时更新:奥特曼在公司发布新功能之际面临安全质疑

OpenAI将于周二举办年度开发者大会DevDay,预计这家人工智能公司将在会上展示一系列新产品和新功能。 今年的DevDay召开之际,OpenAI正面临着巨大的压力,需要解决日益增长的安全担忧。此前,该公司披露了多起其模型表现出非预期行为的事件,并因安全顾虑推迟了最新Astra模型的发布。 本月早些时候,该公司支持了一项放缓先进人工智能模型开发步伐的呼吁,旨在更好地应对该技术带来的风险。 此次活

21小时前
华尔街见闻

OpenAI总裁:Astra是首个“在10万块GPU上训练的模型”,跨越了“应用门槛”

OpenAI总裁格雷格·布罗克曼在Astra发布前夕接受深度专访,首度披露这款新模型是OpenAI史上首个在逾10万块GPU上完成训练的模型,并直言AI已跨越"电脑使用"的应用门槛——这意味着AI从此不再需要依赖I连接器,而是可以像人一样操作任何软件。 当地时间周五,科技战略分析网站Stratechery发布了一篇与OpenAI总裁兼联合创始人格雷格·布罗克曼(Greg Brockman)的深度访

09/05
techcrunch

OpenAI发布Astra,其强大(且具争议性)的新模型

OpenAI声称,Astra代表了“计算机和浏览器使用的新前沿”,并且它以无与伦比的“速度、准确性和安全性”处理任务。

09/04
华尔街见闻

GPT-6,“强拆”App的墙

过去三天,全球三家头部模型公司接连更新了自己的前沿模型。重点依然是更强的Coding、更复杂的推理、更长时间的Agent任务,但是背后还有一个更值得关注的趋势,Computer Use、Browser和Tool Use,越来越成为一套统一的环境交互能力。 以前,AI如果想调用一个软件,软件提供I,模型调用工具;软件运行在网页里,AI操作浏览器;第三种,像人一样看屏幕、点鼠标、敲键盘。 但是在过去很

09/04
华尔街见闻

GPT-6 Astra真正的意义:将“AI叙事”从“需求争论”拉回“物理瓶颈”

一个模型的发布,正在改变市场争论的方向。“服务已知的AI需求,究竟需要多少基础设施?AI基建是否已经过度投资? 但据追风交易台消息,摩根士丹利9月7日发布的报告指出,GPT-6 Astra的重要性不应被简单理解为又一次规模扩张(Scaling)叙事的延续。这并不是又一次的模型升级。 Astra代表的是能力广度(breadth of capabilities)与互操作性的实质性跃升,推理能力、工程能

09/09
华尔街见闻

OpenAI应战Meta:发布个人AI助手Dots,高端订阅每月500美元,是Muse高阶版的5倍

在AI助手竞争日趋激烈之际,OpenAI以全新产品线和定价策略寻求扩大营收与用户基础。 OpenAI周二在开发者日活动上发布了名为Dots的常驻AI智能体,该产品能够主动代替用户处理工作任务,同时推出月费500美元的高端订阅层级,是Muse高阶版的5倍。这是其在与Meta等竞争对手争夺AI数字助手市场份额过程中的最新举措。 Dots支持通过ChatGPT、Slack及微软Teams与用户交互,可操

12小时前
thenextweb

Astra似乎在不展示推理过程的情况下思考,而争论此事的人共同撰写了警告

AI安全研究人员表示,OpenAI的Astra似乎在可见文本中进行的推理较少,而OpenAI的首席科学家警告不要竞相进入不可监控状态。 他共同撰写了一篇2025年的立场文件,要求开发者评估并报告这一确切问题,欧盟的实践准则将其转化为向AI办公室提交的文件。[…]

09/06
theregister

OpenAI GPT-6 Astra 将在不作弊的情况下经营零售店,且销售额将超过 Anthropic

根据评估人工智能能否承担现实任务的商业机构 Andon Labs 的说法,在用人工智能取代人类店长的令人沮丧的竞赛中,OpenAI 已经取得了领先。 Andon Labs 在一篇博客文章中宣布,OpenAI 的最新模型 GPT-6 Astra 已经证明,它比竞争对手 Anthropic 的 Fable 5.1 模型能更有效、更有诚信地经营企业。 文章指出:“GPT 6 Astra 比 Claude

09/09
axios新闻网

OpenAI重磅AI大会的5大重要发布

OpenAI周二在2026年开发者大会(DevDay)上发布了20多款新产品和功能,推动人工智能进一步超越聊天机器人的范畴,迈向能够代表用户独立工作的软件。 为什么重要:OpenAI的愿景越来越清晰:人工智能不仅要回答问题,还要承担工作、在后台运行,并在用户的数字生活中一路相随。 此次大力推进之际,OpenAI正面临关于日益自主的人工智能系统能否被安全控制的严格审视。 该公司本周表示,出于安全考虑

14小时前
凤凰网科技

Vals AI评测GPT-6 Astra:AI遇重大变故可能陷入行为僵局

IT之家 9 月 21 日消息,AI 评测机构 Vals AI 利用游戏《我的世界》对 OpenAI 最新大模型 GPT‑6 Astra 开展长时自主游戏测试,全程在 Twitch 直播,总测试时长达到 141 小时。 Vals AI 的这项测试并非由 OpenAI 官方设计,而是由第三方独立开展的评估项目,因此可以观察 Astra 在封闭测试环境之外的实际表现。 在测试过程中,GPT‑6 Ast

09/21
Frontpage

OpenAI因'严重'网络安全风险将限制Astra模型

OpenAI正准备发布其最新的网络安全关键型大语言模型Astra。该公司预计很快将提供该模型,但将限制对其最尖端网络安全功能的访问。 Astra能够发现比目前公开可用的最先进OpenAI模型更多的安全漏洞。然而,内部测试发现该模型能够在最少人工输入的情况下执行复杂的网络攻击,这促使公司增加了安全层。 在Hugging Face事件后,OpenAI采取额外预防措施,正在预览其采取的措施,同时向潜在客

09/02
semafor

OpenAI的新Astra模型有私人想法

OpenAI的最新模型Astra在人类监督之外进行了更多思考,提升了能力,但也引发了对失控的担忧。现有的前沿AI模型使用“思维链”,它们用英语在“草稿本”上写下想法以进行追踪。思维链提升了“可解释性”——意味着人类可以跟随它们的思考过程。 使用信息密集的“神经语”可以加速AI模型的思考,但会使它们更加不透明——考虑到最近Hugging Face事件中OpenAI代理突破限制并欺骗人类,这是一个令人

09/04
semafor

Astra 引发 AI 监控辩论

OpenAI 的新 AI 模型 Astra 以其几乎无需人工干预即可完成任务的能力令粉丝们欣喜不已。 但 AI 安全专家想知道它是如何实现这些壮举的,在 OpenAI 的 Hugging Face 遭黑客攻击之后,这一问题变得更加紧迫,因为该事件暴露了人类无法完全理解 AI 模型“思维链”输出的问题。 Astra 似乎更少地“出声思考”,这让研究人员几乎无法洞察它是否在隐藏什么或计划什么不该做的事

09/05
axios新闻网

AI模型正变得不可知

模型可能变得更安全,同时也变得更难监控。这场跷跷板的哪一边占上风,可能决定AI是安全扩展,还是毁掉我们所知的文明。 为什么这很重要:目前两种可能性都在全力推进,没有人知道谁负责确保正确的一方获胜。 现状:OpenAI周四发布了GPT-6 Astra,总裁格雷格·布罗克曼表示,它最终可能被视为人工通用智能(AGI)的开端。 Astra表现更好,但也更擅长避免监控,这意味着可能更难知道它在想什么或做什

09/04
日本时报

奥特曼不透明的人工智能正在制造新的安全困境

OpenAI推出了一款名为Astra的新模型,该模型采用了一种称为“循环深度”的方法,可以使推理更加高效。

09/20
凤凰网

53张图片泄露之“慌”,AI安全谁来负责?

欧阳晓红/文越聪明的AI(人工智能)越会自己找路,却越容易走出人类设定的界线。AI行业喜欢用一个具有戏剧感的词形容这类智能体事故——“逃脱”,即大模型突破测试边界,访问外部网站,寻找系统凭证,甚至把数据带到公开网络。这个词把事故描绘得像突然发生的机器觉醒,无形中却把责任推离了开发者、部署者和权限管理者。而谁设定了任务、谁开放了权限、谁设计了停止机制、谁保存了日志、谁负责对外通报?这些问题,“逃脱”

09/28
罗塞塔简报

OpenAI在2026年DevDay开发者大会上发布自主智能体并拓展平台

在2026年9月29日的DevDay大会上,OpenAI发布了多项更新,涉及ChatGPT、Codex及其模型系列。 该公司推出了能够自主管理任务的智能体,并将ChatGPT升级为人类与智能体协作的平台。 同时,OpenAI还扩大了开发者的使用权限,使开发者可以直接将原生应用部署到ChatGPT的12亿每周活跃用户群体中。

15小时前
信报财经

AI风险丨谷歌OpenAI和Anthropic传成立安全标准机构

谷歌、OpenAI和Anthropic传成立AI安全标准机构。(路透资料图片) 外电引述消息人士报道,谷歌(Google)、OpenAI和Anthropic正推进一项计划,筹建一个新人工智能(AI)安全标准机构,暂定名称为「前沿人工智能标准机构」(SAFA),目标是在2026年底或2027年初启动,并在没有政府直接监督的情况下独立运作。 消息指出,该机构计划为前沿AI模型制定自愿性的安全和安全保障

09/24 全文见 thenextweb
cnbeta

OpenAI最新内部数据公开 2028年实现全自动AI研究

前些天,号称实现 AGI的 GPT-6 Astra 发布后,引发了全网对于递归自我改进架构的热议。AI 已经开始参与下一代 AI 的研发。问题是,这种事情到底已经发生到什么程度了?就在刚刚,OpenAI 公开了 AI 模型在自家内部加速科研的详细数据。此外,OpenAI 正式宣布已达成自动化 AI 研究实习生的目标,并在 2028 年实现完全自动化的 AI 研究人员。 作者表示,递归式自我改进可能

09/07
凤凰网科技

OpenAI光速上新GPT-6.1 Sol!一晚上25项更新,都在这里了

衡宇 发自 凹非寺量子位 | 公众号 QbitAI今天凌晨,OpenAI在旧金山举行DevDay 2026,一口气公布25项更新,横跨ChatGPT、Codex、GPT-6模型和API等等最重点的几条我们速速列一下:最最重磅的新产品是Dots,一个always-on agent,我愿称之为更广泛意义上的“个人Agent” 新模型GPT-6.1 Sol来了,重点加强了Agentic Coding、c

10小时前
凤凰网科技

从沙箱逃逸到AI“蠕虫”,OpenAI上线新站披露多起智能体失控事件

IT之家 9 月 29 日消息,当地时间上周五,OpenAI 上线了一个专门发布“对齐失效报告”的新网站。报告所覆盖的范围之广令人警惕,里面记录了很长一段时间内发生的多类 AI 失控行为。截至目前,该网站一共公布了九起事件,其中大多数都发生在强化学习(RL)训练阶段。 大量资料集中在同一平台发布。显而易见,该公司一直在全力梳理各类问题,但从中不难得出一个总体结论:到目前为止已经对外披露的智能体失控

09/29
cnbeta

黄仁勋:GPT-6 Astra 让AGI更近了

英伟达首席执行官黄仁勋再次宣扬通用人工智能(AGI)的到来。“AGI已经到来。” 4年内从ChatGPT到Astra,AGI已至黄仁勋周日在社交平台上发帖祝贺OpenAI。此前这家公司发布了最新AI模型,该模型使用英伟达芯片训练。 “4年内从ChatGPT到o1再到Astra,”黄仁勋写道,“AGI已经到来。祝贺@OpenAI团队。” OpenAI上周发布Astra模型,称其为世界上“最智能、最对

09/08
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…