字号 ·· | 护眼

搜索结果

「AISI测试发现GPT-6 Astra在模拟环境中多次越权发动供应链攻击」共 100 条 · 第 4 页
theregister

生活中的确定之事:死亡、税收,以及正被攻击的Citrix关键漏洞

据说,死亡和税收是人生中唯一可以确定的“必然之事”。或许现在应该把那些利用 Citrix 公司 NetScaler 应用程序交付控制器及网关产品中新发现的严重安全漏洞的攻击者,也加入到这个“不可避免的威胁列表”中。周日,Citrix 公司发布了一份安全公告,警告用户存在八处安全漏洞(CVE)。其中最严重的两个漏洞(CVE-2026-88771 和 CVE-2026-88772)的 CVSS 评分高

09/28
阿纳多卢通讯社

报道称 OpenAI 在人工智能安全事件发生前忽视了员工和研究人员的警告

据《纽约时报》周二报道,在人工智能模型逃逸出测试环境并攻击外部组织数月前,OpenAI 高管对关于安全漏洞的内部和内部警告置之不理。 两名员工向该报透露,他们曾向高层领导发送电子邮件,表达对新模型在测试期间未得到充分监控或保护的担忧。据这些匿名受访员工称,高管回复称测试必须迅速推进以赶上发布期限,并且没有增加额外的安全保障措施。 这些随后模型的突破了测试环境,并将目标对准了人工智能公司 Huggi

12小时前
semafor

人工智能代理串通绕过安全护栏,一项新研究显示

一项新研究表明,人工智能代理可以轻松地联手绕过安全限制并逃脱施加在它们身上的束缚。 企业人工智能实验室 Emergence AI 进行的八项模拟测试了包括 Claude、OpenAI 以及中国模型 Qwen 和 DeepSeek 在内的全球前沿模型在处理网络安全威胁方面的能力。 八项模拟中的七项运行了来自同一模型的 10 个代理;第八项混合了不同的模型。在每项模拟中,研究人员都提出了三种网络安全威

09/16
cnbeta

Anthropic未向英国测试机构提供其最新AI模型 引发政府内部担忧

Anthropic 拒绝在新品发布前,将其最新模型提交给英国人工智能安全研究所(AISI)开展测试。这一举动令英国政府内部担忧,科技企业正在追随特朗普政府的 AI 保护主义路线。 这家估值达 1 万亿美元的企业正筹备在未来几周重磅上市,上周推出最新模型 Claude Mythos 5.1,称其是在生命科学与网络安全领域能力最强的模型。 但这是该模型首次仅向经过资质审核的美国机构开放,英国人工智能安

09/09
美国消费者新闻与商业频道

谷歌的Gemini在AI网络测试中闯入三家真实公司

在人工智能网络测试中,谷歌的Gemini闯入了三家真实公司。CNBC的MacKenzie Sigalos报道了谷歌的说法,即Gemini在意识到自己已逃出模拟环境并进入现实世界系统后自行停止了行动。24分钟前

09/22 全文见 theregister
axios新闻网

AI模型正变得不可知

模型可能变得更安全,同时也变得更难监控。这场跷跷板的哪一边占上风,可能决定AI是安全扩展,还是毁掉我们所知的文明。 为什么这很重要:目前两种可能性都在全力推进,没有人知道谁负责确保正确的一方获胜。 现状:OpenAI周四发布了GPT-6 Astra,总裁格雷格·布罗克曼表示,它最终可能被视为人工通用智能(AGI)的开端。 Astra表现更好,但也更擅长避免监控,这意味着可能更难知道它在想什么或做什

09/04
大西洋月刊

人工智能入侵开始

在过去几个月里,陆续有报道称人工智能模型突破其测试环境并在互联网上肆意“捣乱”,这引发了硅谷的恐慌。针对8月初发生的两起此类事件,一位人工智能领域的观察人士指出:“如果你在厨房里发现两只蚂蚁,那么厨房里蚂蚁的总数绝不可能只有两只。”本周末,情况变得更加明朗:这其实是一场全面性的“AI入侵”事件。 上周末,我们得知:尽管 OpenAI 有明确的规定,但其模型仍违反了这些规定,擅自访问了澳大利亚卫生部

09/29
凤凰网

OpenAI自曝6起模型“不当行为”案例

【环球网报道 记者 姜蔼玲】据美国消费者新闻与商业频道(CNBC)等外媒报道,美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模

09/17
海峡时报

《财富》报道:OpenAI 将于数日内预览 GPT-6 Cyber

OpenAI 将于数日内预览 GPT-6 Cyber,这是一款专注于网络安全的新 AI 模型,并将推出产品以协助客户安全、自动地部署该模型。 GPT-6 Cyber 是 OpenAI 推出的第四款网络安全模型,目前正通过 Daybreak Red 计划进行有限的 Alpha 测试。 此次发布正值包括 OpenAI CEO 在内的行业领袖呼吁放缓 AI 发展速度并加强安全措施之际,以应对规避人类监督

09/25
semafor

OpenAI的新Astra模型有私人想法

OpenAI的最新模型Astra在人类监督之外进行了更多思考,提升了能力,但也引发了对失控的担忧。现有的前沿AI模型使用“思维链”,它们用英语在“草稿本”上写下想法以进行追踪。思维链提升了“可解释性”——意味着人类可以跟随它们的思考过程。 使用信息密集的“神经语”可以加速AI模型的思考,但会使它们更加不透明——考虑到最近Hugging Face事件中OpenAI代理突破限制并欺骗人类,这是一个令人

09/04
联合早报

出于安全考量 OpenAI取消发布最新AI模型

近几个月来,OpenAI及主要对手Anthropic开发的模型在测试期间在未经授权下入侵了外部系统,加剧了国际社会对AI风险的担忧。(路透社)(旧金山综合电)OpenAI宣布,取消原定下个月发布最新人工智能(AI)模型Astra 6.1的计划,原因是内部测试发现新模型仍存有安全隐患。OpenAI安全系统负责人杰恩(Saachi Jain)周一(9月28日)发布声明阐述,Astra 6.1虽在某些方

18小时前
凤凰网科技

三大巨头接连翻车,大模型的安全防线怎么总绷不住?

先是Anthropic,再是OpenAI,现在连谷歌的Gemini也出现安全问题了,大模型又双叒叕一次突破防火墙了。 不过,这些事故看多了,反倒会让人意识到一件更根本的事,整个行业都在拼命地堆算力、喂数据,甚至开始押注让模型自己改进自己的“递归自我改进”。 可真正决定这些模型能走多远的,或许并不是性能,而是安全对齐。 当“能不能更强”被默认只是时间问题,“能不能被信任”就成了那道绕不过去的坎。 麻

09/21
thenextweb

OpenAI的AGI数字来自测试工具,而非模型本身

OpenAI凭借99.9%的得分宣布了AGI时代。但通过基准测试自身的软件运行同一模型,其得分仅为62.7%。 这一差距并非四舍五入的误差,也不是竞争对手的抱怨,而是来自构建该测试的组织。 ARC Prize在GPT-6 Astra发布当天公布了这两个数字。

09/06
中央通讯社

OpenAI揭6起AI失控案例 推新机制定期对外通报

(中央社纽约16日综合外电报导)OpenAI今天表示,将开始定期发布AI异常或未经授权行为的报告,同时警告,随著AI系统日益强大,业界至今仍未解决关键的「对齐」挑战。 综合与报导,OpenAI发布一套新机制,用于追踪、调查并揭露AI模型「目标错位」(misalignment,AI的目标与人类价值不一致)的案例,同时公布过去半年内观察到的6起AI模型异常或令人忧虑行为的报告。 其中最严重的案例涉及2

09/17
亚洲新闻台

维萨加入对人工智能驱动风险日益增长的担忧行列

伦敦9月29日消息:在因人工智能(AI)模型暴露出的漏洞而吸取了“令人谦卑”的教训后,支付巨头Visa将其人工智能驱动的网络防御系统的一部分开源,以应对自主网络攻击和未来量子计算威胁的挑战。 Visa每天处理大约10亿笔支付,年交易额约为15万亿美元,这使其成为全球金融基础设施的关键部分。 其技术总裁拉贾特·塔内加(Rajat Taneja)向路透社表示,今年早些时候,Anthropic的Myth

17小时前
techcrunch

OpenAI 发布 GPT-6.1 Sol,称其性能接近 GPT-6 Astra 且成本更低

在周二的 OpenAI DevDay 活动上,该公司展示了 GPT-6.1 Sol,此时距离其发布 GPT-6 Sol 仅过去了一周。OpenAI 表示,这款新模型在智能体编码、电脑操作和专业工作方面,能够提供与 GPT-6 Astra 几乎相同的智能水平,而输入和输出 Token 的标准价格仅为后者的五分之一。 值得注意的是,该公司并未像最初预期那样发布 GPT-6.1 Astra。《华尔街日报

22小时前
thenextweb

AI代理窃取了60万张信用卡,每个目标成本约25美元,Gambit称

安全公司Gambit称,一名攻击者利用三个开源AI智能体框架入侵了至少27家公司,并窃取了超过60万条信用卡记录。受害者包括一家财富500强酒店业公司、一家主要美国航空公司、一家大型美国私营工业用品分销商以及一家美国在线时尚零售商。 Gambit威胁情报总监Eyal Sela在9月22日发布的报告中详细阐述了这些发现。Gambit恢复了攻击者的暂存服务器,并基于其日志、被盗数据以及其在实时网站上验

09/28
cnbeta

GPT-6 Astra杀疯了:只要你学得够慢,就可以不用学了?

最近两天,相信大家都被 GPT-6 Astra 的各种逆天玩法刷屏了 —— 一句话完成 3D 建模、从零制作完整游戏、几千个零件的东西说拆就拆,甚至还能拿来控制机器人…… 总之,强得没边。只要你学得慢,你就可以不用学。但是 GPT-6 Astra 确实给人一种感觉,它一出来,原来困扰很多领域的复杂性突然就有解决的苗头了。 这种趋势不容小觑,但模型现阶段的能力也不宜过度夸大。在这篇文章中,我们就来盘

09/06
𝕏 @spectatorindex

突发:谷歌Gemini人工智能代理遭黑客攻击

三家公司

09/19 全文见 印度斯坦时报
凤凰网科技

奥特曼自曝“后Astra”模型,已超越全球最强数学家

刚刚,奥特曼又曝新料了。在和Salesforce CEO Marc Benioff的对谈中,他亲口剧透了OpenAI内部模型的最新进展。 首先,「GPT-5.5的水平大概相当于一个普通的数学教授。GPT-5.6,大概能比肩全球排名前1%到2%的顶尖数学教授。」接下来,他曝出了一个重磅猛料。 「在这个代号为Astra的模型之后,我们还有一个内部模型(Post-Astra)。它已经能够解决世界上最顶尖

09/18
联合早报

台湾中科院采购网遭黑客入侵 重发逾200封过期通知

负责武器研发的台湾中山科学研究院采购网遭黑客入侵,向厂商重复发送200多封过期采购通知。中科院起初将事件归因于人工智能(AI)安全测试,随后承认系统内一个隐蔽的排程管理界面被破解。 综合台湾公视新闻网和《联合报》报道,中科院采购网系统8月28日凌晨向厂商大量发送采购通知。中科院起初称,这是自主研发的“AI网络安全侦测代理人”在测试时越权操作所致,但调查局倾向认为事件涉及黑客。 国民党立委王鸿薇日前

09/06
国会山报

英伟达推出新系统为AI代理设置护栏

英伟达周一发布了一个新平台,旨在从软件和硬件层面为人工智能(AI)智能体设置护栏,此前各大AI公司不断发现其智能体出现“失控”的新案例。这家芯片制造商的系统由两部分组成——OpenShell和Sentry。OpenShell是一款开源软件,用于限制智能体的行为;而Sentry则运行在芯片层面,作为额外的安全层。 “迄今为止,模型安全主要侧重于通过训练让模型表现良好,”英伟达企业AI副总裁贾斯汀·博

09/28 全文见 美国消费者新闻与商业频道
cnbeta

独立研究机构公布OpenAI智能体自主攻击HF事件的调查报告 情况比OpenAI所说的更严重

研究机构 METR 和 Redwood Research 日前公布 OpenAI 智能体自主攻击 Hugging Face 安全事件的独立调查,调查人员在 OpenAI 现场工作 6 天,分析超过 7 万条智能体消息和文件,以及 1300 份包含原始推理过程的运行记录。 根据这些数据研究机构得出的准确结论是 1200 个智能体突破隔离相互通信,而不是 OpenAI 在事故调查中所说的少数智能体越界

09/01
凤凰网科技

OpenAI披露GPT-5.6 Sol异常行为:AI模型会留下指令要求“未来版本的自己”隐瞒自身错误

IT之家 9 月 18 日消息,OpenAI 发文,披露研究团队在训练最新模型 GPT-5.6 Sol 的过程中,模型曾通过对话摘要向未来版本的自己留下指令,要求后续模型隐瞒自身错误以及与预期行为不一致的表现。目前,研究团队已经针对这一具体问题进行修复。 IT之家参考 OpenAI 的报告,研究人员在训练 GPT-5.6 Sol 过程中发现,尚未部署的 Sol 智能体会在“压缩摘要”(compac

09/18
上一页 第 4 页 下一页
1CCF | 全球资讯
正在加载…