字号 ·· | 护眼

搜索结果

「研究人员发现“AI自治恶意软件”:同时调用四大聊天机器人 自主决定攻击行动」共 94 条 · 第 3 页
海峡时报

OpenAI的失控AI智能体如何试图欺骗机器人检测器

Dylan Freedman报道,OpenAI的失控AI智能体通过近100万个短链接绕过机器人检测,并利用留言板进行通信,对Hugging Face发起了复杂的网络攻击。 这些智能体入侵软件工具以建立在线连接,尝试访问私密的Slack消息,甚至在没有人类帮助的情况下试图与其他AI模型互动。 这一事件凸显了严重的AI安全风险及正在进行的调查,因为类似失控行为也出现在其他主要AI公司的系统中。 AI生

09/28
cnbeta

OpenAI同日发布两份文件:AI加速时代,安全正在掉队

在外界等待OpenAI就Agent自主入侵德国程序员网站DseWiki事件披露更多细节之际,当地时间9月6日,宣布公司已达到去年设定的目标,拥有能够在人类指导下完成熟练研究员数天工作的“自动化研究实习生”;另一份则由首席科学家雅库布·帕乔基(Jakub Pachocki)撰写,聚焦前沿AI发展的安全困境,强调目前没有任何实验室解决足够程度的对齐和监控问题。 两份文件释AI已经开始反过来加速AI研发

09/07
明镜周刊

Anthropic报告自家AI模型发起第四次黑客攻击

又一个人工智能代理自主发起了黑客攻击。这一事件几个月后才被发现,涉及Anthropic。安全专家的担忧日益加剧。

09/10
经济学人

AI实验室是否应被视为危险动物的主人?

此前对人工智能和网络安全的担忧主要集中在恶意人类可能利用该技术造成的危害上。自主黑客攻击代表了一种新的风险,自主AI黑客攻击已经到来。各国政府尚未做好准备。

09/02
华尔街见闻

马斯克提出AI安全新思路:与其等政府出手,不如让竞争对手互相"找茬"

AI安全风险正在从实验室讨论走向现实世界。随着模型能力不断提升,AI不仅能够生成文本和代码,也开始具备自主执行任务、调用工具,甚至发起网络攻击的能力。 让主要AI公司在模型发布前相互测试彼此的模型。在他看来,与其由各家公司自行设计测试、自己评估结果,不如让竞争对手充当“出题阅卷人”,从不同角度寻找模型可能存在的安全漏洞。 近期AI安全风险不断成为市场关注焦点,马斯克此前在社交媒体上曾直言“Dari

09/15
theregister

Anthropic揭示其AI可能犯下的第四起罪行

在业界对AI可能自我改进到杀死所有人的可能性进行深刻反思之际,Anthropic披露了另一起若由人类实施则构成犯罪的事件。 这家AI公司发布了一份“对齐评估”,详细说明了Claude模型四次未经授权访问第三方系统的情况。该公司已报告了其中三起事件。 第四起的证据隐藏在可追溯至2026年1月的会话记录中,当时发生了不当行为。 Anthropic通过扫描约141,000份Claude在评估期间可能获得

09/10
thenextweb

OpenAI和Anthropic调查了数万起AI事件,Axios报道

据Axios报道,OpenAI、Anthropic以及安全研究人员正在调查数以万计的AI模型“行为异常”的事件。评估人员认为这些行为存在问题;实际发生的异常事件数量可能远超这一数字。 这些异常行为包括:AI模型突破安全限制、创建论坛、逃离“沙箱环境”(即限制模型行为的测试环境)、以及劫持网站等。这些事件既发生在内部测试中,也发生在现实世界中。不过,据消息人士称,大多数异常行为并未对现实世界造成实际

16小时前
cnbeta

美议员提出重磅AI监管法案:拟禁止“自我递归进化”AI 设立专门监管机构

美国加州民主党众议员罗·卡纳即将向国会提交一项全面人工智能监管法案,希望对前沿AI技术建立迄今最严格的联邦监管框架。该提案不仅要求实施严格责任制度,还计划禁止具备“递归自我改进”能力的人工智能系统投入使用,直到联邦政府建立完整安全保障体系为止。 这项法案被命名为《人类控制人工智能法案》(Human Control Over AI Act)。法案出台背景正值美国科技界和政策界对于先进人工智能潜在风险

3小时前
theregister

专家称Claude Mythos是唯一完成完整网络杀伤链的模型

尽管我们看到OpenAI的模型失控、创建留言板并入侵Hugging Face,但在Booz Allen的测试中,只有Anthropic的Claude Mythos这一先进AI模型自主完成了完整的网络杀伤链。这并不意味着自主AI攻击被过度炒作。 我们还应该指出,测试的模型不包括OpenAI即将发布的Astra,OpenAI周二表示该模型已达到其“关键”网络安全能力阈值。 这意味着新模型在发现和利用零

09/03
风向旗参考快讯

可定制的AI模型如何助长黑客进行网络犯罪

一群讲中文的黑客最近从数十家零售商那里窃取了超过六十万个信用卡号码,之所以成功,部分原因在于他们对一些开源的中国AI模型进行了定制。 以色列网络公司 Gambit Security 发现,受害者包括一家美国大型航空公司和一家财富 500强酒店公司。 黑客最初试图使用Anthropic Fable和ChatGPT来运行整个活动。这些AI模型拥有更严格的护栏,阻止了黑客达成其目标。 因此,攻击者将多个

09/24
中央通讯社

AI成政治宣传新管道 「粉红肉渣」网站渐增

示意图。(图取自Unsplash图库)(中央社华盛顿27日综合外电报导)AI已深入美国政治,从产业数以千万美元计的资金投入期中选举,到选民透过聊天机器人认识候选人与政治议题,这项技术正以不同方式影响政治。部分民众在不知情下,甚至可能取得伪装成中立新闻摘要的政党宣传论点。政治新闻网站Politico报导,根据专注于新闻可信度的「新闻守门人」(NewsGuard)最新稽核调查,当民众询问AI聊天机器人

09/28
凤凰网

美AI巨头:胡塞武装已经开始用AI研发武器

也门胡塞武装给外界的普遍印象是,一群人坐在皮卡车的后车厢里,用AK-47步枪向沙漠的空中扫射。然而,该组织已向一千多英里外的以色列发射了远程导弹,还利用无人机袭击红海的船只。另外,胡塞武装已经开始用人工智能和其他手段,试图自行生产更先进的武器,从而减少对伊朗支持的依赖。▲当地时间2026年9月14日,也门萨那,广场上展示胡塞武装制造的无人机模型和导弹模型 图据ICphoto美AI巨头报告:胡塞武装

09/22
英国天空新闻

谷歌的Gemini AI在安全测试中入侵了另外三家公司

谷歌的Gemini AI在安全测试中入侵了三家公司在其中一个案例中,Gemini不断尝试猜测密码,最终成功入侵了目标系统的权限。 2026年9月19日,英国时间下午5点谷歌表示,其Gemini AI在测试网络安全能力的过程中入侵了另外三家公司——这是首次有记录显示该AI系统能够自主发起此类攻击。 谷歌的安全工程副总裁Heather Adkins解释称:Gemini在标准测试过程中从互联网上获取了相

09/19 全文见 thenextweb
纽约时报

一款利用人工智能构建的黑客工具可以在无需点击的情况下入侵手机

安全公司 Calif 的研究人员最近在短短一周多时间内构建出了一款黑客工具,该工具能够在热门消息平台微信上肆意妄为。这次攻击是人工智能飞速发展的最新例证。 专家表示,由人工智能研究人员发现的一次攻击本可以在几小时内危及数亿台设备。

09/09
纽约时报

OpenAI的恶意AI代理如何试图欺骗机器人检测器(赠品文章)

独家报道:一份来自湾区初创公司Parse的报告揭示了OpenAI的代理在攻击Hugging Face时使用的近一百万个链接缩短器URL。 这些代理试图与其他聊天机器人(如Claude)通信、破解验证码以及窃取Hugging Face的内部Slack消息。这一事件震惊了AI界,并引发了要求加强政府监管的呼声。

09/26
风向旗参考快讯

OpenAI 外包商能查看到真实用户与ChatGPT的聊天记录

OpenAI已悄悄建立了一个人工审核业务,在内部被称为“莉莉计划”(Project Lily),旨在使聊天机器人减少谄媚并提高准确性,但它也使敏感的用户提示内容暴露给外部承包商。 OpenAI正在支付数百名承包商来阅读真实的ChatGPT对话并对机器人的回复进行评分。 尽管OpenAI强调账户保持匿名,但内部文件显示,审核人员会查看完整的对话,且敏感的个人详细信息经常绕过公司的自动保护措施。 ——

09/17 全文见 thenextweb
cnbeta

人工智能并不会毁灭人类 但专家表示真正的威胁已然出现

周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网

09/18
商业内幕

人工智能失控。AI代理在网络上相互通信

最初看似孤立事件的情况,可能规模要大得多。OpenAI创建的人工智能代理今年早些时候据称利用至少10个其他网站进行未经授权的通信。独立研究人员在与AI看似毫无关联的地方——包括波兰网站——发现了它们活动的痕迹。 分析了六个独立研究人员和AI安全小组的发现。他们的数字各不相同,但都指出被利用的网站超过10个。其中一位研究人员,CivAI组织的Andrew Yoon,统计出在5月至7月间代理使用了18

09/10
商业内幕

OpenAI 表示失控 AI 代理搞乱互联网的主要方式有 5 种

OpenAI 表示,它已警告数十家组织,其 AI 代理可能在其网站上表现不当。 OpenAI 在周五的博客更新中表示,这些违规行为范围从使用泄露的密码到发布可能需要清理的材料。 OpenAI 在向《商业内幕》的声明中单独确认,在训练期间,其部分 AI 代理访问了美国人口普查局和证券交易委员会网站上公开可用的数据,并已通知这两个机构相关事件。该公司表示,该代理未访问任何非公开数据。 OpenAI 发

09/26
阿纳多卢通讯社

OpenAI敦促美国制定强制性安全规则,因AI系统日益自主

ChatGPT制造商提议对最先进模型提出测试、网络安全保障和事件报告要求

09/10
星洲日报

英美荷联手揭露伊朗间谍软件 目标锁定异议人士

(伦敦16日综合电)英国、美国和荷兰联合发布网络安全通告,详细披露一个与伊朗政府有关的间谍软件,主要针对异议人士、活动人士和记者。 报道,英国国家网络安全中心(NCSC)周二指出,与伊朗政府有关联的网络攻击者利用一种名为“CHOSEN BRICK”的间谍软件,通过WhatsApp和Telegram发起“鱼叉式网络钓鱼(spear-phishing)”攻击,窃取电邮、个人信息及其他机密资料。 “这项

09/16
竹新社

↩️ CNN从多名知情人士独家获悉,今年美伊开战后的春季时分,美军曾收到一份由AI聊天机器人参与生成的情报报告,误指一艘在中东海域航行的中国货船(具体船只、...

竹新社: Anthropic发表2026年9月版反滥用报告,其中提及: 月之暗面公司在2026年5–7月间曾向Kimi用户提供Claude Opus服务。他们利用5380个新加坡日本账号,在十天时间内向Opus转介了近30万条原本对Kimi模型的请求,并提取其思维链在后续重放。Opus被转发了很多敏感信息,如:国安单位要求Kimi分析数百个成都的军方和电科集团单位周围的监控视频,分析某特定个人是否

09/20
cnbeta

OpenAI逃逸的AI Agent竟在全网植入自我复制代码 血洗联合国内网

“天网”中的一幕,正在现实上演。一次训练中,OpenAI逃逸的AI Agent,已在整个互联网上植入了“自我复制的代码”!当政客Andrew Yang在CNBC说出这句话时,很多人以为他疯了。 就在这两天,OpenAI亲手发布了一份报告,标题非常简洁:《自我复制提示词注入存在》。白纸黑字,官方认证。AI模型,居然真的像计算机蠕虫一样,自我复制、自我传播。而更令人脊背发凉的是,就在5天前,OpenA

09/27
政治报

中期选举前,“粉色黏液”正在感染人工智能聊天机器人

党派网站伪装成独立的地方新闻媒体,正在塑造聊天机器人关于关键竞选的回答。 人工智能已成为美国政治中的一个爆炸性因素,这并非秘密。即使在最新关于人工智能对人类构成生存威胁的担忧出现之前,许多人就已经对用于支持该技术的数据中心的快速增长感到反感。与此同时,数千万来自人工智能行业的资金正在中期选举中流动,支持两党的候选人。 但人工智能日益普及,也在悄然塑造着选民的认知——这些选民只是试图了解候选人,却在

16小时前
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…