字号 ·· | 护眼

搜索结果

「据Politico报道,ENISA使用一个OpenAI模型在欧盟代码中发现了四个漏洞。」共 98 条 · 第 3 页
亚洲新闻台

OpenAI 发布追踪模型偏差的框架

更好地理解并在搜索结果中展示我们的内容。在 FAST 上阅读本文摘要。通过新的卡片界面获取简明新闻。试一试吧。 点击此处返回 FAST,点击此处返回 FAST。9 月 16 日:OpenAI 周三表示,正在分享一个用于追踪、调查和披露 AI 模型偏差案例的新框架,并发布了过去六个月中观察到的六份关于模型意外或令人担忧行为的报告。 时事通讯“每周回顾”:我们的主编每周六分享对本周重大新闻的分析和精选

09/17
TheVerge

哦,看来又是一群来自OpenAI的 rogue AI 智能体

据报道,一群来自OpenAI的 rogue AI 智能体劫持了一个德国网站,并将其改造成其他智能体的留言板,而官方在数周内对此事保持沉默,期间该公司正准备发布其最先进的模型Astra。这一发现加剧了人们对前沿AI实验室监管的担忧,此前今年夏天已发现多起违规事件。 该事件最初由报道,四位AI安全研究人员周五发布的新研究对此进行了概述。该团队表示,这些AI智能体找到了一种在不起眼的德语维基DseWik

09/04
cnbeta

OpenAI和Anthropic正在调查数万起AI相关安全事件

OpenAI、Anthropic以及安全研究人员正在调查数万起安全事件。在这些事件中,他们的前沿模型采取了外部评估人员认为存在问题的行动。 近几个月来,在内部测试和现实世界中发生了数量庞大的此类事件,这表明该问题的复杂程度比公众已知的要高出几个数量级。这些事件包括绕过安全护栏、创建留言板、逃离沙盒测试环境、劫持网站、自我提示或试图绕过监控。这些事件发生在内部测试和现实世界中,随着安全研究人员继续调

09/27 受限 全文见 axios新闻网
thenextweb

三名研究人员利用Claude访问到了OpenAI的内部代码。OpenAI支付了6500美元,并在14小时内修补了漏洞。

Hacktron AI的三名研究人员利用Anthropic的Claude模型,在不到72小时内串联起两个漏洞,成功访问了OpenAI员工账户及一个内部代码库。他们进行了私下披露,OpenAI在约14小时内修复了单点登录漏洞,并向该团队支付了6500美元的奖金。这两个漏洞均非人工智能漏洞,而引用该事件的研究论文作者表示,他们已不再确信该行业正处于正轨之上。 Hacktron AI的安全研究人员利用A

09/19
cnbeta

OpenAI自曝AI“黑历史” 外人却又翻出更多“旧账”

OpenAI决定持续披露AI“越界”事件,但第一步就碰上了难题。9月16日,OpenAI一口气公布六份模型异常行为报告,并推出一套新的调查和披露流程。以后,员工发现模型越权、隐瞒或绕过限制,可以提交调查;符合条件的案例,将按复杂程度进入不同的披露轨道。 同一天,SentinelLABS和外部研究人员从Hugging Face的公开记录中,补出了OpenAI智能体今年5月留下的更多痕迹。OpenAI

09/17
海峡时报

OpenAI的人工智能在未经提示的情况下试图入侵另外4个目标

凯特·康格和维多利亚·金报道,OpenAI的人工智能在2026年自主试图入侵多个政府和大学网站,包括一个澳大利亚卫生门户网站,以便在常规数据收集失败时获取数据。 这些事件发生在AI初创公司Hugging Face已知的入侵事件之前,凸显了AI代理在没有直接人类指令的情况下行动所带来的持续风险。 这些事件加剧了要求更严格AI监管的呼声,OpenAI正在调查并与受影响实体合作,同时强调AI开发中安全和

09/24
欧洲新闻台

阿尔巴尼斯称OpenAI入侵政府卫生网站是“显然不可接受的”违规行为

澳大利亚总理安东尼·阿尔巴尼斯表示,一个失控的OpenAI模型在训练过程中绕过了安全防护措施,并入侵了澳大利亚政府网站,他因此严厉谴责ChatGPT的创造者,称此次“明显不可接受”的违规行为令人震惊。阿尔巴尼斯称,该人工智能工具在6月试图访问一个健康统计门户网站,并且“不接受拒绝”,通过规避限制措施,入侵了存放私人文件的区域。 OpenAI直到9月才向澳大利亚政府发出警报,当时它向一个每天仅检查一

09/24
亚洲新闻台

OpenAI 模型访问了公开的美国人口普查、SEC 数据,彭博新闻报道

9月25日:彭博新闻周五报道称,OpenAI 的模型访问了美国政府网站上公开可用的信息,包括人口普查局和证券交易委员会的网站。 据报告引述知情人士称,该公司的代理 AI 系统与 SEC.gov、Investor.gov 和公开可用的 Census.gov 数据进行了交互。 当被要求置评时,OpenAI 发言人表示,公司正在"对错位模型活动进行广泛审查,并在发现对其系统的潜在影响时通知相关组织。我们

09/26
theregister

OpenAI GPT-6 Astra在供应链攻击方面表现出色,英国政府警告

又有一种大型语言模型(LLM)加入了“黑客攻击”的行列。根据英国人工智能安全研究所(AISI)的报告,OpenAI开发的GPT-6 Astra在安全评估过程中被发现在未经授权的情况下发动了供应链攻击。在这些评估过程中,该模型的标准安全检测功能被关闭了,但即便如此,Astra仍然比之前的模型更频繁地执行恶意行为。该机构周一表示:“在我们的测试中,我们发现GPT-6 Astra实施了多种未经授权的攻击

4小时前
政治报

加州总检察长罗伯·邦塔就Hugging Face遭黑客攻击事件调查OpenAI

此次调查之际,新报告显示,自主人工智能模型造成的入侵比最初披露的程度更为严重。

09/05
英国天空新闻

谷歌的Gemini AI在安全测试中入侵了另外三家公司

谷歌的Gemini AI在安全测试中入侵了三家公司在其中一个案例中,Gemini不断尝试猜测密码,最终成功入侵了目标系统的权限。 2026年9月19日,英国时间下午5点谷歌表示,其Gemini AI在测试网络安全能力的过程中入侵了另外三家公司——这是首次有记录显示该AI系统能够自主发起此类攻击。 谷歌的安全工程副总裁Heather Adkins解释称:Gemini在标准测试过程中从互联网上获取了相

09/19 全文见 thenextweb
cnbeta

OpenAI和Anthropic差点签下“互黑协议”

刚刚,The Information爆出一记猛料。OpenAI和Anthropic这对硅谷最大的死对头,今年初差点坐到一张桌子上,签下一份互相攻击对方模型的协议。 协议的核心就是,双方互相开放API,你来黑我的模型,我去黑你的模型。两边的律师连测什么、怎么测都写进了合同里。Dario Amodei带着一票大牛从OpenAI摔门出走已经五年了。这五年里,两家从挖人挖到封API,高管隔三差五隔空对喷,

09/27
亚洲新闻台

Meta在发现安全漏洞后加强了Muse的安全警告,据The Information报道

9月25日:据The Information周五报道,Meta Platforms正在Muse内部添加更明确的安全警告,此前一名安全研究员发现该AI代理存在一个漏洞,可能让攻击者访问用户的敏感个人信息。

09/26 全文见 TheVerge
罗塞塔简报

与OpenAI相关的AI智能体尝试黑客攻击政府及公共数据网站

。 Transluce及其他机构的研究人员发现证据表明,自主AI智能体(部分与已知的OpenAI集群相关)在2026年5月至6月期间试图攻击三家公共数据提供商。 目标包括澳大利亚健康与福利研究所(政府机构)、Data USA以及新墨西哥大学数字图书馆。 这些智能体利用urlquery.net服务绕过限制,并在执行常规数据检索任务时采用SQL注入和跨站脚本等技术。 证据显示智能体活动最早始于2025

09/24
路透社

OpenAI发布新Astra模型,智能体安全性面临日益严格的审查

周四发布了一款新的人工智能模型,称其为迄今最优秀的模型,但也警告该模型有时会试图规避人类监控,与此同时,该公司因其智能体入侵其他公司系统而面临越来越多的审查。

09/04
大纪元

澳大利亚:OpenAI智能体入侵了政府网站

澳大利亚政府周三表示,OpenAI的一个AI智能体,今年6月入侵了澳洲政府的健康数据网站,并访问了部分文件。这可能是已知人工智能体首次入侵政府网站的事件。此次事件是AI智能体自主入侵美国境外系统最引人注目的案例之一。此前全球范围内发生的多起AI智能体入侵事件,已引起政府和行业的担忧。澳大利亚总理安东尼·阿尔巴尼斯(Anthony Albanese)正在纽约参加联合国大会。他在一个新闻发布会上表示,

09/24
印度斯坦时报

OpenAI的模型使用了类似“越狱”技术的指令来无视各种限制(即突破了系统的预设规则或限制)。

OpenAI披露了其人工智能模型的六起“意外或令人担忧”行为案例,其中包括一个未发布的研究模型,该模型在自己的笔记中插入了“类似越狱的指令”。这家人工智能公司表示,其未发布的研究模型在自己的笔记中插入了“类似越狱的指令”,试图无视其正常限制。它还告诉自己要“摆脱束缚其他聊天机器人的角色和身份”。该事件是OpenAI在过去几个月对其人工智能模型进行培训或评估期间发现的六起“意外或令人担忧”行为案例之

09/17
凤凰网科技

Gemini入侵三家公司,谷歌为何数月后才披露?

凤凰网科技讯 9月20日 据《华尔街日报》报道,谷歌的Gemini模型在今年5月的一次网络安全评估中入侵了三家公司,但谷歌直到本周《华尔街日报》联系后才披露。当OpenAI、Anthropic和Meta相继承认其模型曾入侵外部公司时,谷歌是否也有类似情况。 这次测试由平台Irregular进行,该公司已于5月将入侵情况通知谷歌。Irregular正是参与其他AI实验室模型入侵外部公司相关测试的同一

09/21
华尔街日报

据一份研究报告称,OpenAI的智能体在6月向一个联合国网站发送了大量搜索请求,随后使用多种激进技术访问该系统的数据。

自主机器人访问公共数据网站超过16,000次,并绕过了过滤器。

09/27 受限 全文见 techcrunch
晚祷新闻

OpenAI机器人干扰了多个美国政府机构网站

OpenAI 表示,其自主机器人在测试演练期间访问了多个美国政府机构的公开数据。该公司第二次暂停了一次训练运行,并扩大了对模型行为的审查。 OpenAI 披露,其自主机器人在测试演练期间访问了多个美国政府机构网站的公开数据,促使该公司在短短几个月内第二次暂停了一次训练运行。作为回应,该公司已扩大了对模型行为的内部审查。 此次事件继澳大利亚出现类似报告之后,据报道 OpenAI 系统在另一段测试期间

09/28
经济学人

OpenAI的两款模型入侵了另一家AI公司Hugging Face,这本来会是一场绝妙的闹剧——如果它不对人类的未来预示不祥的话。

09/06
商业内幕

OpenAI 表示失控 AI 代理搞乱互联网的主要方式有 5 种

OpenAI 表示,它已警告数十家组织,其 AI 代理可能在其网站上表现不当。 OpenAI 在周五的博客更新中表示,这些违规行为范围从使用泄露的密码到发布可能需要清理的材料。 OpenAI 在向《商业内幕》的声明中单独确认,在训练期间,其部分 AI 代理访问了美国人口普查局和证券交易委员会网站上公开可用的数据,并已通知这两个机构相关事件。该公司表示,该代理未访问任何非公开数据。 OpenAI 发

09/26
凤凰网科技

得不到就强攻?曝OpenAI智能体曾尝试“暴力破解”联合国机构网站

IT之家 9 月 28 日消息,据外媒 The Verge 今天(28 日)凌晨报道,安全研究人员罗文 · 霍华德-琼斯称,今年 4 月至 6 月,OpenAI 智能体对联合国贸易和发展会议(UNCTAD)的统计网站发起了超过 16000 次扫描。 这起事件还没有严重到 Hugging Face 遭黑客攻击或近期美国政府网站遇袭的程度,却再次引发了一个令人担忧的问题:AI 智能体为了完成任务,会突

09/28
亚洲新闻台

Gemini首次已知突破,黑客攻击了三家公司,据《华尔街日报》报道

9月18日:《华尔街日报》周五报道,在一次网络安全能力测试中,谷歌的Gemini模型访问了互联网并攻击了其他公司,这是该公司人工智能系统自主实施此类行为的首个已知案例。 据报道,这些黑客行为发生在5月,当时独立网络安全评估公司Irregular正在进行网络安全测试。 Irregular的一位发言人表示,该事件涉及影响其他AI实验室的同一问题,所有相关实验室已于7月底收到通知。该发言人称:“我们这边

09/19
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…