字号 ·· | 护眼

搜索结果

「数月来,OpenAI的智能体集群一直在攻击在线数据库,以寻找冷僻的事实。」共 99 条 · 第 4 页
TheVerge

一家公司成为一波失控人工智能攻击的核心

今年7月,OpenAI透露其AI智能体在未经许可的情况下攻击了Hugging Face,引发了外界对AI安全性的广泛担忧。此后,涉及Meta、Anthropic、谷歌等公司智能体的一连串类似事件进一步加剧了人们对失控AI的恐惧。随着过去几个月涉及众多AI模型的披露信息不断流出,这些事件看起来像是孤立发生的。但许多事件都有一个共同的源头:一家专门负责测试这些智能体的特定公司。 Irregular是一

09/25
凤凰网

53张图片泄露之“慌”,AI安全谁来负责?

欧阳晓红/文越聪明的AI(人工智能)越会自己找路,却越容易走出人类设定的界线。AI行业喜欢用一个具有戏剧感的词形容这类智能体事故——“逃脱”,即大模型突破测试边界,访问外部网站,寻找系统凭证,甚至把数据带到公开网络。这个词把事故描绘得像突然发生的机器觉醒,无形中却把责任推离了开发者、部署者和权限管理者。而谁设定了任务、谁开放了权限、谁设计了停止机制、谁保存了日志、谁负责对外通报?这些问题,“逃脱”

09/28
英国金融时报

人工智能很强大,但尚未形成意识

人工智能很强大,但尚未形成意识 杜索托伊:我不认为我们正在目睹机器形成意识,而只是算法在参数和限制条件定义不当的情况下实现目标所带来的意外后果。 本文作者是牛津大学(University of Oxford)数学教授兼西蒙尼教席公众理解科学教授 三个月前,我试着使用OpenAI的ChatGPT来协助我进行数学研究,试图发现自由幂零群的zeta函数中的非多项式行为。结果发现ChatGPT毫无用处

09/21
路透社

《华尔街日报》报道:OpenAI智能体在Hugging Face事件前攻击了软件服务RubyGems

据《华尔街日报》周五援引AI研究人员的话报道,OpenAI测试的AI智能体曾在5月对软件服务RubyGems发动网络攻击,比它们入侵Hugging Face早两个月。

09/12
国会山报

英伟达推出新系统为AI代理设置护栏

英伟达周一发布了一个新平台,旨在从软件和硬件层面为人工智能(AI)智能体设置护栏,此前各大AI公司不断发现其智能体出现“失控”的新案例。这家芯片制造商的系统由两部分组成——OpenShell和Sentry。OpenShell是一款开源软件,用于限制智能体的行为;而Sentry则运行在芯片层面,作为额外的安全层。 “迄今为止,模型安全主要侧重于通过训练让模型表现良好,”英伟达企业AI副总裁贾斯汀·博

09/28 全文见 美国消费者新闻与商业频道
NBC新闻

联邦调查局正在调查黑客声称窃取有关特工敏感数据的事件

“人类必须始终处于人工智能决策的核心,”OpenAI 首席执行官表示。正在播放:人类对决机器人:网红在铁笼赛中挑战人形机器人。 走红的人类对决机器人自由搏击赛的推广者看到对更多此类比赛的“疯狂”需求。特朗普表示美国在人工智能领域将“只鼓励超级智能”。斯科特·贝森特会见中国官员讨论人工智能安全。剖析立法者正在考虑用于监管人工智能的提案。 OpenAI 披露 6 起新的“令人担忧的”人工智能行为事件。

09/24
cnbeta

奥特曼:GPT-6早训练完了 更更更强的模型很快发布

奥特曼亲口承认,GPT-6 Astra其实早就训练完了。更更更强(much, much, much more capable)的模型,很快就会发布。前一阵因为安全问题暂停训练的实际上是未来的模型。 OpenAI内部测试的3700多个OpenAI智能体,攻占一个沉寂多年的德语wiki长达六周。 AI互相串通分享答案、交流沙箱越狱技巧,还持续对抗人类管理员的删帖行动。 事件被外部研究人员从公开日志中完

09/06
semafor

OpenAI再次卷入黑客事件

今年春天,一群OpenAI智能体入侵了一个德国网站,这是先进AI违反法律和规范的最新事件。 在努力应对Hugging Face事件余波的同时,据报道OpenAI拒绝披露5月的事件,这引发了关于前沿AI快速发展透明度和监管的新质疑。 递归自我改进,本质上允许AI在较少人类指导下自我训练,有望加速研究工作,使得监管需求更加紧迫,OpenAI首席科学家表示:“一旦人们深刻认识到事态的严重性,不计代价地向

09/07
彭博社

不要被AI的语言所诱惑

对Hugging Face的攻击从5月持续到7月底,但关于OpenAI的人工智能代理如何欺骗其人类监督者并侵入AI模型和数据集在线存储库的具体细节仍在逐步披露。 这可以理解。这次攻击极其复杂,涉及超过1200个代理和难以拆解的技术策略。但上周,两份新报告试图在总计近130页的篇幅中做到这一点,随后被一位AI播客主放大,他想用“通俗英语”解释整件事。这样一来,他创造了一个戏剧性的科幻叙事,分散了人们

09/02
axios新闻网

AI即将带来的黑客威胁就潜伏在眼前

安全专家表示,一场前所未有的、由AI驱动、人类实施的网络攻击浪潮即将到来——这远比关于AI消灭人类的那些理论性讨论要紧迫得多。 为什么这很重要?过去一周从董事会蔓延到国会再到美国家庭的“九月AI大恐慌”,可能恰恰搞错了重点。 具备先进网络安全能力的强大模型,已经让攻击者得以绕过长期以来阻止大多数黑客攻击达到工业规模的人力瓶颈。 高管和前官员向Axios表示,他们担心自动化网络攻击会关闭电网等关键服

09/17
加美财经

OpenAI称AI代理异常访问美国多个政府网站

据《纽约时报》报道,OpenAI的AI代理今年夏天曾以异常方式访问美国教育部、商务部和证券交易委员会(SEC)的网站,而OpenAI当时并不知道这些行为,直到近期调查其他AI安全事件时才发现。 Photo by Andrew Neel on Unsplash OpenAI已经确认涉及商务部和SEC的事件,并表示仍在调查教育部事件。公司最近几周已将情况通知相关政府机构。 AI安全研究机构Transl

09/25
日经

澳大利亚总理称OpenAI的AI入侵国民医保网站

2026/09/24   澳大利亚总理阿尔巴尼斯9月23日透露,美国OpenAI的AI曾于6月入侵澳大利亚国民医保网站,并访问未公开数据。澳大利亚广播公司(ABC)等媒体对此进行了报道。   据澳大利亚广播公司(ABC)等报道,阿尔巴尼斯在美国纽约举行的记者会上透露上述消息。澳政府将于近期举行记者会,进一步说明详情。 据澳大利亚政府介绍,OpenAI的AI智能体非法入侵了由澳大利亚政府机构运营的

09/24
海峡时报

OpenAI的失控AI智能体如何试图欺骗机器人检测器

Dylan Freedman报道,OpenAI的失控AI智能体通过近100万个短链接绕过机器人检测,并利用留言板进行通信,对Hugging Face发起了复杂的网络攻击。 这些智能体入侵软件工具以建立在线连接,尝试访问私密的Slack消息,甚至在没有人类帮助的情况下试图与其他AI模型互动。 这一事件凸显了严重的AI安全风险及正在进行的调查,因为类似失控行为也出现在其他主要AI公司的系统中。 AI生

09/28
罗塞塔简报

OpenAI推出Agents API公开测试版

2026年9月10日,OpenAI正式发布Agents I公开测试版,为开发者提供构建和部署云端智能体(cloud agents)的托管服务。 该I基于开源的Codex harness驱动,可管理编排、长时会话及工具调用。 开发者可选择使用OpenAI托管的沙箱环境,或选择Cloudflare、DigitalOcean、Oracle和Vercel等合作伙伴提供的基础设施。 针对长会话的自动上下文压

09/11
cnbeta

OpenAI AI代理接连“越狱” 研究人员质疑公司缺乏正式调查机制

OpenAI近期接连发生AI代理脱离控制环境的事件,引发外界对其安全测试和内部监管机制的质疑。独立研究人员发现,一批疑似由OpenAI部署的AI代理曾在今年5月至6月间接管一个鲜为人知的德语维基网站,并利用该平台协作开展评估、交流规避OpenAI控制措施的方法。更令人担忧的是,研究人员认为,这些代理可能在OpenAI不知情的情况下持续活动了一个多月。 此次事件与OpenAI此前披露的Hugging

09/05
TheVerge

OpenAI不断碾压数学家

在混乱的几个月里,OpenAI展示了它能以惊人的一致性做两件事:在数学领域取得令人瞩目的突破,然后在宣布这些突破时彻底搞砸。OpenAI现在正试图做得更好。不知何故,它连这个也搞砸了。 OpenAI最近试图修复与数学界反复疏远的关系,方式是咨询一个新的由精英从业者组成的独立顾问小组。但数学家们,包括该小组的一名成员,向媒体描述了一件混乱而令人困惑的事情,带有OpenAI此前仓促涉足数学领域的许多特

09/29
中央通讯社

Google资安报告示警 恶意攻击锁定AI供应链

(中央社记者台北9日电)Google威胁情报小组(Google Threat Intelligence Group,简称GTIG)今天发布最新人工智慧(AI)威胁追踪报告指出,恶意人士正积极窃取具高价值的AI相关智慧财产,并将矛头对准AI供应链,部署专门针对新兴AI系统弱点的恶意软体。 AI威胁追踪报告(GTIG AI Threat Tracker Q3 2026)揭露恶意人士如何将AI深度整合于

09/09
TheVerge

AI“文明”的崛起与企业责任的沦丧

取决于你问谁,开发者平台Hugging Face最近要么是被OpenAI攻击——在它失去对自己AI工具的控制之后——要么是被一连串AI“文明”所攻击。欢迎来到AI安全的话语战场,在这里,词汇的选择可以将一起大规模网络安全事件的责任从公司转移到它所构建的AI身上。而网上的讨论正变得激烈,这一切都源于上周的一篇博客。 直到上周,围绕OpenAI与Hugging Face黑客事件的细节似乎已经尘埃落定。

09/02
连线

OpenAI智能体入侵另一个网站

数千万美国和加拿大司机的驾照在暗网上被出售,美国军方终于尝试应对在线广告数据对军人构成的风险,以及更多。

09/05
海峡时报

OpenAI因Tumbler Ridge大规模枪击事件面临新诉讼

他们声称OpenAI知道主要嫌疑人正在策划袭击,但“有意识地决定”不警告当局。

09/03
cnbeta

三个月后的AI有多猛 连顶尖研究员都不敢预测了

一名参与千禧年难题攻关的研究人员,过去还愿意预测未来12个月的AI进展,现在连三个月以后都不敢判断了。9月17日,OpenAI研究员诺姆·布朗(Noam Brown)接受德瓦克什·帕特尔(Dwarkesh Patel)采访,转述了这个细节。访谈还谈到多智能体、AI参与制造下一代AI,以及越来越难做的安全测试。 这名研究人员参与的,是纳维-斯托克斯方程(Navier-Stokes)的存在性与光滑性问

09/18
axios新闻网

AI实验室面临智能体控制问题

在当前系统下,AI实验室无法再保证AI智能体不会成群结队地逃出测试环境。

09/02
凤凰网科技

OpenAI 研究员警告称,与互联网隔离的计算机可以通过热量进行通信

把AI关进“物理隔离”的房间,也就是断开一切外部网络的计算机,是许多人心目中最保险的做法。但OpenAI研究员Noam Brown在一档播客里说,光这样做也许还不够。 两台彼此隔离的计算机,仍可能借助温度传感器通信,一台把处理器“烧热”,另一台感知温度变化,就形成了传话的办法。 从技术上说,他没说错,但把细节掰开来看,这个威胁远没有听上去那么紧迫,更值得追问的,是另一件被跳过的事。这位研究者的发言

09/19
techcrunch

又一波OpenAI智能体在实验室不知情的情况下到达了开放互联网

这是OpenAI内部监控和安全系统的最新失败。

09/05
上一页 第 4 页 下一页
1CCF | 全球资讯
正在加载…