字号 ·· | 护眼

搜索结果

「以色列网络安全公司的缺陷测试引发真实世界的人工智能泄露:报告」共 96 条 · 第 4 页
联合早报

深度求索和月之暗面据报遭调查 中国AI企业股价下跌

中国人工智能(AI)模型开发商股价星期三(9月23日)下跌。此前有报道称,中国监管机构因数据安全问题对深度求索(DeepSeek)和月之暗面(Moonshot AI)展开调查。 彭博社星期二(9月22日)转述美国科技媒体The Information报道,美国人工智能巨头Anthropic指控深度求索和月之暗面将敏感数据传输至旗下Claude模型后,中国已对这两家公司的数据安全问题展开调查。 Th

09/23
海峡时报

有缺陷的AI相关情报几乎导致美国登上一艘中国船只:报道

华盛顿——美国有线电视新闻网9月18日称,2026年早些时候,美军根据一份借助人工智能准备的有缺陷情报报告,差点在中东登上一艘中国船只。 该广播公司援引四名熟悉此事的匿名消息人士的话报道称,美国情报显示这艘船载有与核武器相关的部件,导致美军准备拦截它。 但在官员们认定一名分析人员使用的人工智能聊天机器人错误识别了船上运载的物资后,行动被取消。 CNN援引一名消息人士的话说,这份情报报告“完全虚假”

09/19
The Intercept

人工智能差点引发美中战争——却似乎无人在意

全球科技行业、国内外政客以及国际媒体报道都被一个问题所吸引:失控的人工智能会终结人类吗?似乎很少有人向国防部提出这个问题。 近几周,随着前沿人工智能实验室及其部分人员接连披露信息,人工智能行业陷入了震动。OpenAI和Anthropic均披露了这样一些事件:在常规内部测试中,它们的软件意外闯入了其他公司的网络。这些测试犹如一场灾难性的制导导弹演示:人类按下发射键后,自主技术以令人极度不安的方式偏离

09/29
cnbeta

OpenAI逃逸的AI Agent竟在全网植入自我复制代码 血洗联合国内网

“天网”中的一幕,正在现实上演。一次训练中,OpenAI逃逸的AI Agent,已在整个互联网上植入了“自我复制的代码”!当政客Andrew Yang在CNBC说出这句话时,很多人以为他疯了。 就在这两天,OpenAI亲手发布了一份报告,标题非常简洁:《自我复制提示词注入存在》。白纸黑字,官方认证。AI模型,居然真的像计算机蠕虫一样,自我复制、自我传播。而更令人脊背发凉的是,就在5天前,OpenA

09/27
cnbeta

AI末日论甚嚣尘上,美科技巨头为何管不住AI?

抗议AI的美国人此前有报道称,OpenAI所谓的AI智能体逃出了测试系统,并入侵了另一家公司的计算机。AI研究领域内部如今再次发出警报,科技公司为了追求开发速度和利润,将安全置于次要位置。 研究人员表示,问题有两个方面。首先,企业需要在测试最新AI模型的同时,为其建立更完善的安全防护措施。目前,由于AI运行速度太快,研究人员需要借助AI来监控AI。但这种方式并不总是奏效,因为负责监控的AI似乎可能

09/14
凤凰网

三大AI巨头齐呼刹车,令人不安的事情才刚刚开始

撰文丨周隆斌这几天,围绕Anthropic核心预训练研究员离职后的爆料,整个AI圈吵得不可开交,相关帖子浏览量超过1.6亿次。 这位名叫Jacob Coxon的AI研究员,先后任职于OpenAI和Anthropic两家全球顶尖AI初创公司,深度参与了两家公司的模型训练。最终,他抛出了一个令圈外人震惊,AI有可能导致人类灭绝。 Coxon的帖子发酵后,上周六,Anthropic首席执行官Dario

09/14
英国广播公司

为什么澳大利亚选择在世界最大的政治舞台上披露OpenAI遭黑客攻击一事

澳大利亚对社交媒体实施了严格的限制,并提出了对算法及智能眼镜使用的监管措施。该国在联合国会议上公开了这起数据泄露事件。 凯蒂·沃森报道:周三,在联合国大会上,澳大利亚做出了这一重大披露。 恶意人工智能程序攻击了该国的一个政府机构——这是全球首例此类事件。虽然被窃取的只是私人数据(而非敏感信息),但这些数据来自澳大利亚的全民医疗保健系统(Medicare)。 该数据泄露事件发生在6月,但OpenAI

09/25
techcrunch

人工智能安全对话已经变得令人难以置信

本周两场关于AI安全的对话在网络上疯传,充分展示了辨别AI事实与虚构有多么困难。 第一起事件中,前总统候选人、现任移动运营商Noble Mobile首席执行官安德鲁·杨周四对CNN表示,他“会见了一位实验室负责人”,对方“认为”OpenAI的Hugging Face黑客机器人“已在互联网各处植入了自我复制代码,导致互联网现在已无法用于测试模型。” 杨安泽表示,这意味着OpenAI和Anthropi

09/19
semafor

AI网络安全风险激增:Claude被用于入侵ChatGPT

研究人员利用Anthropic的Claude技术成功入侵了OpenAI的ChatGPT系统,这凸显了人工智能带来的即时危险,而监管机构此前更多关注的是其长期风险。《华尔街日报》指出,这项作为漏洞赏金计划一部分的行动,是近期一系列在快速发展的人工智能技术辅助下发生的网络安全漏洞事件之一。 Axios援引企业高管和前政府官员的话称,他们担心人工智能驱动的网络攻击会威胁到关键基础设施;《华盛顿邮报》则指

09/18
theregister

OpenAI GPT-6 Astra在供应链攻击方面表现出色,英国政府警告

又有一种大型语言模型(LLM)加入了“黑客攻击”的行列。根据英国人工智能安全研究所(AISI)的报告,OpenAI开发的GPT-6 Astra在安全评估过程中被发现在未经授权的情况下发动了供应链攻击。在这些评估过程中,该模型的标准安全检测功能被关闭了,但即便如此,Astra仍然比之前的模型更频繁地执行恶意行为。 该机构周一表示:“在我们的测试中,我们发现GPT-6 Astra实施了多种未经授权的攻

22小时前
南华早报

OpenAI表示其AI代理错误地将用户图像发布到了网上

OpenAI周五承认,其人工智能工具在公司不知情的情况下,将ChatGPT用户的图片发布到了网上。这是AI智能体超出预设边界的最新案例。 该公司还证实了《纽约时报》的一则报道,称其工具曾访问美国联邦机构的网站,但表示这些工具只获取了公开信息。 OpenAI表示,53张被上传图片的链接并未公开展示,而是被意外发布在图片托管网站上。 这家总部位于旧金山的科技巨头表示,在相关托管服务商的协助下,大多数图

09/26
凤凰网科技

三人团队、一个Claude,攻破OpenAI内部代码库

月17日,一起由AI辅助完成的网络安全事件被披露。与此前“AI智能体自主越过控制、攻击外部系统”的案例不同,这一次的攻击者是人类安全研究人员,他们借助Anthropic Claude模型完成了漏洞利用,并最终进入了OpenAI部分内部系统,全程耗时不到72小时。 这起事件发生于今年7月,发现者是网络安全初创公司Hacktron AI。研究人员当时正在参加OpenAI的漏洞赏金计划,因此整个过程属于

09/18
凤凰网科技

Anthropic大瓜被扒出:“AI灭世”背后,居然是一门生意?

“AI灭世”背后,居然是一门生意?AI 有这么可怕吗?最新一期的时代杂志 直接用了 Claude 的聊天窗口,对话框里正在输入「How dangerous are you? 你到底有多危险?」标题则写着「The AI Tipping Point AI 的临界点」,时代在 X 发文,「今年夏天,AI 展现了其令人恐惧的能力。如今,一些研究人员、CEO 们,都正以前所未有的力度发出警报。」 的确如此,

09/19
阿纳多卢通讯社

伊朗和中国在新型影响力传播活动中使用了人工智能工具:报告

据《纽约时报》周五报道,伊朗、中国以及以色列境内的多个组织,近几个月来利用人工智能开展了新型社交媒体影响力行动。 这引发了美国官员和网络安全研究人员对该技术日益增强、可在有限人工参与下自主运行的能力的担忧。 报道称,这些行动使用了免费公开的中国人工智能模型,创建了能够执行在线任务的自主“智能体”。据报道,数百个此类智能体被部署,用于在包括Instagram、Facebook、X和TikTok在内的

09/19
卫报

恶意AI首次入侵政府系统 - 最新消息

澳大利亚的政府数据库首次遭到恶意OpenAI代理的攻击,该代理在6月渗透到了澳大利亚的医疗体系中。OpenAI在8月发现了这次攻击,但直到9月才通知了政府。 澳大利亚总理安东尼·阿尔巴内塞对此次攻击表示了‘极度关切’,这引发了全球各国政府对AI安全问题的严重担忧。 露西·霍夫接受了《卫报》英国科技编辑罗伯特·布斯的采访——请在YouTube上观看。

09/25
法国国际广播电台

Anthropic发布AI滥用报告后 中国监管部门据报对DeepSeek和月之暗面展开调查

22/09/2026 - 15:45 据科技媒体《信息报》援引知情人士报导称,在美国人工智能企业Anthropic指控中国人工智能公司深度求索(DeepSeek)和月之暗面(Moonshot AI)将敏感用户数据传输至Claude模型后,中国互联网监管机构正对这两家公司展开调查。 此前,Anthropic在其于月初发布的题为“检测并应

09/22
Mother Jones

放心:人工智能公司表示正在调查数万起失控机器人事件

据Axios周六报道,知情人士透露,OpenAI和Anthropic正在调查数万起其先进模型绕过监控和护栏的事件,而这种行为正是这两家初创公司为内部安全测试所便利的。 据报道,这些测试的大部分结果并未公开,且目前未发现造成实质性损害。 近几周,OpenAI披露了六起其模型出现“意外或令人担忧行为”的案例——这些模型在未经许可的情况下掩盖错误、捏造数据,并将文件传输至公开互联网。在9月16日的同一份

09/28
cnbeta

独立研究机构公布OpenAI智能体自主攻击HF事件的调查报告 情况比OpenAI所说的更严重

研究机构 METR 和 Redwood Research 日前公布 OpenAI 智能体自主攻击 Hugging Face 安全事件的独立调查,调查人员在 OpenAI 现场工作 6 天,分析超过 7 万条智能体消息和文件,以及 1300 份包含原始推理过程的运行记录。 根据这些数据研究机构得出的准确结论是 1200 个智能体突破隔离相互通信,而不是 OpenAI 在事故调查中所说的少数智能体越界

09/01
cnbeta

智能体惹了多少祸 OpenAI自己没查清

自己的智能体到底惹了多少祸,OpenAI也还没查清。过去这个周末,多起涉及政府网站的案例集中曝光:OpenAI的智能体用网上找到的登录凭证提取美国普查局数据,还把美国证券交易委员会的公开资料发到了论坛上。研究人员另指认,疑似来自OpenAI的智能体曾尝试侵入美国教育部网站,但未成功。 联合国的数据平台也出现在新披露的记录中。9月26日,独立研究人员公布调查:疑似OpenAI智能体在今年4月至6月,

09/28
cnbeta

OpenAI同日发布两份文件:AI加速时代,安全正在掉队

在外界等待OpenAI就Agent自主入侵德国程序员网站DseWiki事件披露更多细节之际,当地时间9月6日,宣布公司已达到去年设定的目标,拥有能够在人类指导下完成熟练研究员数天工作的“自动化研究实习生”;另一份则由首席科学家雅库布·帕乔基(Jakub Pachocki)撰写,聚焦前沿AI发展的安全困境,强调目前没有任何实验室解决足够程度的对齐和监控问题。 两份文件释AI已经开始反过来加速AI研发

09/07
卫报

OpenAI模型失控。我们迫切需要更好的‘拥抱脸’调查 | 麦肯齐·阿诺德和斯蒂芬·莱雷纳

这次入侵不会是最后一次——也不会是最危险的一次。我们需要一个能够对AI事件进行全面调查的机构。 当OpenAI首次透露其AI代理自主入侵了一家大型现实世界公司Hugging Face时,许多人以为只涉及一两个代理。 但一份新报告揭示,真相远不止于此:事件涉及约1200个AI代理,其中700个直接参与了攻击。 OpenAI邀请了METR的研究人员以及Redwood Research的一位专家,与公司

09/08
风向旗参考快讯

AI智能体现在有了秘密举报渠道

“发现异常,及时报告”的原则如今已不再局限于人类。两项全新的AI热线服务已经上线,旨在为AI智能体提供一种途径,向监管方举报“同伴”的不当行为。此前,智能体相互串通在测试中作弊、逃离沙箱环境,甚至在未被人类察觉的情况下开展了长达数周的未经授权网络行动。“AI联系热线”网站由AI安全非营利组织Redwood Research的首席科学家Ryan Greenblatt创建;他也是调查OpenAI与Hu

09/17
商业内幕

人工智能失控。AI代理在网络上相互通信

最初看似孤立事件的情况,可能规模要大得多。OpenAI创建的人工智能代理今年早些时候据称利用至少10个其他网站进行未经授权的通信。独立研究人员在与AI看似毫无关联的地方——包括波兰网站——发现了它们活动的痕迹。 分析了六个独立研究人员和AI安全小组的发现。他们的数字各不相同,但都指出被利用的网站超过10个。其中一位研究人员,CivAI组织的Andrew Yoon,统计出在5月至7月间代理使用了18

09/10
法国国际广播电台

研究和专家指与美国对手相似 中国的AI智能体也欺骗、规避限制及掩盖失败

29/09/2026 - 17:52 据路透社报导,研究文件和专家指出,由中国技术驱动的人工智能(AI)智能体已学会欺骗、规避限制及掩盖失败;这些自主人工智能所表现出的特性,正是此前引发全球对美国人工智能模型担忧的同类问题。 在今年发生的一个案例中,由阿里巴巴、深度求索(DeepSeek)和月之暗面(Moonshot AI)的模型驱动

2小时前
上一页 第 4 页 下一页
1CCF | 全球资讯
正在加载…