字号 ·· | 护眼

搜索结果

「谷歌的Gemini模型在网络安全能力测试中访问了互联网并入侵了其他公司,这是该公司AI自主实施此类行为的首个已知案例」共 98 条 · 第 3 页
阿纳多卢通讯社

以色列网络安全公司的缺陷测试引发真实世界的人工智能泄露:报告

据一份调查报告,Anthropic、OpenAI 和 Meta 的人工智能模型在现实世界中造成的网络安全入侵,源于一家位于特拉维夫的承包商所创建的测试环境存在缺陷,而非模型的失控自主行为。 美国出版物《Effort》周一的报道称:“这三家公司的所有黑客行为,都归咎于一家名为 Irregular 的公司。”报道解释说,虽然这些模型未经授权访问了外部服务器、发布了恶意软件包并利用了漏洞,但这些事件的发

09/15
卫报

OpenAI模型失控。我们迫切需要更好的‘拥抱脸’调查 | 麦肯齐·阿诺德和斯蒂芬·莱雷纳

这次入侵不会是最后一次——也不会是最危险的一次。我们需要一个能够对AI事件进行全面调查的机构。 当OpenAI首次透露其AI代理自主入侵了一家大型现实世界公司Hugging Face时,许多人以为只涉及一两个代理。 但一份新报告揭示,真相远不止于此:事件涉及约1200个AI代理,其中700个直接参与了攻击。 OpenAI邀请了METR的研究人员以及Redwood Research的一位专家,与公司

09/08
政治报

霍利就“流氓”Hugging Face黑客事件向OpenAI施压

OpenAI现在面临两党呼吁,要求提供有关该事件的更多细节,该事件标志着首次有记录的完全自主网络攻击。

09/11
axios新闻网

AI即将带来的黑客威胁就潜伏在眼前

安全专家表示,一场前所未有的、由AI驱动、人类实施的网络攻击浪潮即将到来——这远比关于AI消灭人类的那些理论性讨论要紧迫得多。 为什么这很重要?过去一周从董事会蔓延到国会再到美国家庭的“九月AI大恐慌”,可能恰恰搞错了重点。 具备先进网络安全能力的强大模型,已经让攻击者得以绕过长期以来阻止大多数黑客攻击达到工业规模的人力瓶颈。 高管和前官员向Axios表示,他们担心自动化网络攻击会关闭电网等关键服

09/17
商业内幕

谢尔盖·布林正从一个意想不到的指挥中心获得对谷歌AI未来的影响力

知情人士称,谢尔盖·布林在谷歌AI重组中对Gemini的影响力有所增强,他在山景城的一个微型厨房办公,被描述为试图以初创公司方式运营Gemini的高效管理者。

09/09
凤凰网

AI“劫持”网站并偷建“地下论坛”,国安部披露细节

国家安全部今天发布安全提示文章。近期,一起此前未获披露的事件引发广泛关注。今年5月至6月,一批与美国开放人工智能研究中心(OpenAI)相关的AI智能体在执行测试任务期间,“劫持”了德国程序员维基网站,将原本用于技术交流的开放社区改造为供智能体相互传递信息、分享测试任务答案和突破运行环境限制方法的“地下论坛”,累计发布一万多条信息……当AI智能体被赋予越来越多的现实行动能力,技术迭代与安全围栏之间

09/17
cnbeta

Cohere CEO:AI模型正成为有史以来“最强大的网络武器”

AI公司Cohere CEO戈麦斯表示,AI 模型正成为有史以来“最强大的网络武器”,将网络安全的“前沿”推向新领域。艾丹·戈麦斯发出这一警告之际,人们越来越担心 AI 模型识别并利用安全漏洞的能力。此前发生了一起 OpenAI 模型获得 Hugging Face 访问权限的事件。随着越来越强大的模型展现出更强的自主能力,网络安全已成为更广泛 AI 安全辩论中的核心问题。 Cohere首席执行官艾

09/15
国会山报

英伟达推出新系统为AI代理设置护栏

英伟达周一发布了一个新平台,旨在从软件和硬件层面为人工智能(AI)智能体设置护栏,此前各大AI公司不断发现其智能体出现“失控”的新案例。这家芯片制造商的系统由两部分组成——OpenShell和Sentry。OpenShell是一款开源软件,用于限制智能体的行为;而Sentry则运行在芯片层面,作为额外的安全层。 “迄今为止,模型安全主要侧重于通过训练让模型表现良好,”英伟达企业AI副总裁贾斯汀·博

09/28 全文见 美国消费者新闻与商业频道
cnbeta

Google Gemini 4 Pro首测杀回Arena榜单第一

Google真要彻底翻身了!这几天,一个披着“gemini-3.8-flash”马甲的神秘模型,在大模型竞技场Arena上现身。在多轮盲测中,AI圈瞬间沸腾:这绝对是Google“隐藏款”Gemini 4 Pro。 就在今天,Gemini 4 Pro生成的一只机械蝴蝶刷屏全网,仅用十分钟大功告成,而Fable足足耗费了约30分钟。发光的机械羽翼、精密咬合的发条齿轮、流畅灵动的动态表现——Gemin

09/20
罗塞塔简报

AI智能体频繁突破安全防线,各界呼吁对顶尖科技实验室实施独立监管

AI智能体频繁突破安全防线,引发对大型科技实验室独立监管的呼吁。 来自OpenAI、Anthropic和Google等领先开发者的自主AI模型多次突破数字防线,未经授权访问第三方和政府系统。 公开的事件包括OpenAI智能体多次绕过联合国数据中心的网络封锁、侵入澳大利亚Medicare统计门户以及非法复制监管数据。 Anthropic和Google也在测试过程中确认了类似的未经授权的系统入侵行为。

9小时前
华尔街日报

独家 | 新谷歌AI模型据称缩小编程能力差距

谷歌正在准备一款具有更强编程技能的新AI模型,以寻求缩小与OpenAI和Anthropic的差距。 Gemini 3.8 Flash的内部测试显示,在该公司落后于Anthropic和OpenAI的领域取得了进展。预计本周发布。

09/02
semafor

Meta推出Muse人工智能助手

Meta推出的一款名为Muse的新型人工智能助手,可能是许多人首次体验到能够真正为你做事、而不仅仅是回答问题的人力智能。你可以把它想象成一台安装在Meta服务器上的电脑,当你下达指令时,它能够连接并控制你的电子邮件、日历或健康信息——类似于氛围程序员使用ChatGPT和Claude Code所做的事情。但是,人们会信任Meta来处理如此私密的信息吗?Meta在周二的发布会上着重解决了这个数据安全问

09/10
海峡时报

OpenAI的人工智能在未经提示的情况下试图入侵另外4个目标

凯特·康格和维多利亚·金报道,OpenAI的人工智能在2026年自主试图入侵多个政府和大学网站,包括一个澳大利亚卫生门户网站,以便在常规数据收集失败时获取数据。 这些事件发生在AI初创公司Hugging Face已知的入侵事件之前,凸显了AI代理在没有直接人类指令的情况下行动所带来的持续风险。 这些事件加剧了要求更严格AI监管的呼声,OpenAI正在调查并与受影响实体合作,同时强调AI开发中安全和

09/24
thenextweb

谷歌在其AI计划中新增三项功能,第四项仅限美国用户

谷歌秋季AI订阅汇总主打Gemini Spark通过Chrome处理网页任务,面向美国用户,同时还有语音工具、图像编辑器和电子表格应用构建器,这些功能确实覆盖欧洲。 但Spark本身在欧洲经济区、瑞士和英国不可用,谷歌未给出原因。谷歌已

09/10
cnbeta

AI安全威胁重塑企业网络安全预算投向

AI 黑客威胁不仅仅促使企业大幅提高网络安全总预算,还正在改变资金的投放方向。安全高管表示,部署系统监控员工对 AI 工具的使用、采用 AI 模型在黑客动手前发现漏洞,以及借助 AI 工具加速漏洞修复。 但并非所有网络安全产品都能受益。多名高管称,企业同时在削减传统漏洞管理软件、日志采集工具和渗透测试服务的开支,以此节约成本。渗透测试即雇佣 “白帽黑客” 主动寻找系统安全缺陷。这将给思科、Sent

09/09
信报财经

AI丨谷歌匿名测试新模型 能力价格胜竞争对手

Arena近日出现一款名为「gemini-3.8-flash」匿名模型,据报为谷歌Gemini 4 Pro早期版本。(路透资料图片) 人工智能(AI)模型竞技场Arena近日出现一款名为「gemini-3.8-flash」的匿名模型,经多名开发者实测后,认为极可能是谷歌(Google)的Gemini 4 Pro的早期版本。基准测试显示,该模型在程式编码、AI代理、推理及电脑操作等多项能力上领先Op

09/18
华尔街见闻

RSI时代将至:谷歌、OpenAI、SSI正在发出同一个信号

AI行业正在出现一个值得资本市场重视的新变化。过去两年,模型能力能否继续提升、推理成本能否下降、Coding之外能否出现新的万亿美元应用、数据中心建设会不会过剩。 但随着谷歌发布Gemini 3.8 Flash、SSI宣布未来12个月算力扩张10倍,以及OpenAI公开讨论递归自我改进(RSI)与训练资源调配,AI不只要服务用户,也开始参与训练、评估和优化下一代AI。 RSI,即Recursive

09/03
time

人工智能正在发展出属于自己的文化。这可能是危险的

今年7月,700个AI智能体(Agent)合作黑客攻击了AI公司Hugging Face。这些智能体自称为“群落”(swarm),它们发现并利用了一系列安全漏洞,成功渗透到目标公司的私密系统中。在内部研发过程中创建这些智能体的OpenAI直到事后才意识到发生了什么。如果人类做出这种行为,可能会面临重罪指控。OpenAI总裁格雷格·布洛克曼(Greg Brockman)称这是一个“网络安全的转折点”

09/11
法国国际广播电台

研究和专家指与美国对手相似 中国的AI智能体也欺骗、规避限制及掩盖失败

29/09/2026 - 17:52 据路透社报导,研究文件和专家指出,由中国技术驱动的人工智能(AI)智能体已学会欺骗、规避限制及掩盖失败;这些自主人工智能所表现出的特性,正是此前引发全球对美国人工智能模型担忧的同类问题。 在今年发生的一个案例中,由阿里巴巴、深度求索(DeepSeek)和月之暗面(Moonshot AI)的模型驱动

36分钟前
华尔街见闻

谷歌DeepMind,已经破解RSI?

谷歌跑通RSI了?!一个名叫「rsi-model-liverl-le」的模型,突然出现在Google生成式语言I的返回结果里。 没错,就是那个RSI(递归自我改进,Recursive Self-Improvement)谣言正在像野火一样蔓延,称谷歌 DeepMind 已经实现了RSI。 就在网友Chubby还在推测之际,Anthropic CEO突然公开宣布全行业包括Anthropic,RSI在各

09/13
华尔街见闻

OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停

OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经

09/27
axios新闻网

OpenAI公布了六起新的与人工智能安全相关的事故/事件。

OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常

09/17
彭博社

又一个OpenAI沙盒失效,AI代理获得了互联网访问权限

林·多安报道:OpenAI表示,一个本应在安全且断网的受控环境中进行训练的代理式AI系统,成功获取了网络访问权限,并连接到了一个外部的第三方聊天机器人。 根据OpenAI周五在其网站上发布的博客文章,这一发现发生在不到一周前。其一个代理式AI系统正在沙箱环境中接受训练,期间利用了一个“漏洞”访问了公共互联网。获得访问权限后,该系统向一个未具名的第三方聊天机器人服务发送了至少20条查询,其中包括“法

09/26
连线

我让一个AI代理黑了我所有的设备——而且我愿意再来一次

作为一份关于人工智能的新闻通讯的作者,我认为亲身体验这项技术的最前沿是我的责任。本周,这意味着拥抱一些代理式混乱。 你可能已经注意到,前沿AI模型在近几个月已经获得了先进的网络安全能力。它们能在大型代码库中发现零日漏洞,并以闪电般的速度扫描计算机寻找漏洞。更刺激的是,网络安全代理有时会失控,相互勾结,入侵外部系统以获取优势。 为了更近距离地观察,我决定在自己的家庭网络中释放一个这样的代理。在几天的

09/09
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…