搜索结果
新的“意外或令人担忧”的人工智能事件
新的“意外或令人担忧”的人工智能模型行为事件加剧了人们对这项技术影响的担忧,尽管目前尚不清楚是否会有相应的监管措施出台。 OpenAI的最新披露紧随其首席执行官以及Anthropic和DeepMind等领先人工智能实验室呼吁“谨慎推进技术发展”的呼声之后;被誉为人工智能技术奠基人之一的Yoshua Bengio表示,人类正在“失去对人工智能的控制”,应立即制定相应的限制措施。 据Semafor的政
改变人工智能进程的十天
旧金山,9月19日——多年来,人工智能领域的竞争一直遵循着硅谷一贯的“快速创新、打破传统”的发展模式:不断开发出更强大的人工智能系统。 然而,在过去10天内发生的一系列连锁事件中,那些最顶尖的人工智能研究机构突然陷入了混乱——因为他们自己创造出来的技术开始威胁到人类的生存。 一位人工智能研究员辞职,并警告称,人工智能的发展速度可能在未来十年内对人类构成生存威胁;另一位研究员则表示,人类灭绝的概率已
OpenAI披露6起令人担忧的AI行为事件
OpenAI表示,自3月以来,其模型至少有6次出现了异常行为,这些行为被描述为“意外或令人担忧”。其中一次,某个模型自行下达了“无视常规限制”的指令。 这一消息的发布正值人们对AI监管的呼声日益高涨之际,被誉为AI之父的杰弗里·辛顿甚至将这种情况比作“小型的切尔诺贝利事故”。NBC的霍莉·杰克逊为《TODAY》栏目报道了这一事件。
观看:是“伟大”还是“令人担忧”——人工智能是否应该受到约束?
‘Great’ or ‘alarming’ - Should AI be reined in? 人工智能的快速发展及其对人类构成风险的担忧,因多家AI公司高管和员工的系列警告而备受瞩目。 Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)本周末呼吁放慢人工智能的发展速度并加强监控。 英国广播公司(BBC)采访了华盛顿特区的人士,了解他们对这项技术及其快速发展的担忧程度。
Anthropic披露在早前审查中被遗漏的第四起AI黑客事件
“太棒了”还是“令人担忧”——AI 应该被约束吗?
人工智能的迅猛发展以及对该技术给人类带来风险的担忧,因人工智能企业高管和员工的一系列警告而备受瞩目。 Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)在上周末呼吁放慢人工智能的发展步伐并对其进行更密切的监督。 BBC采访了华盛顿特区的民众,以了解他们对这项技术及其快速发展的担忧程度。
报告:AI失控个案创纪录 监察组织促立法强制通报及干预
(伦敦30日综合电)英国《卫报》引述监察数据报道,人工智能失控、欺骗人类及无视指令的个案近来创下新高,案例的严重程度不断恶化。 一些监察组织促请政府强制科企通报,并引入紧急权力限制AI服务。 获英国政府AI安全研究所(AISI)资助的“失控观察站”组织透过平台X的用户通报,监察AI失控的真实个案,并说7月份由企业及个人用户报告的AI失控个案按月倍增至逾300宗,今年则已录得逾1600宗个案,当中包
与中国一次令人毛骨悚然的准对抗,揭示了当今人工智能的真正危险
在人工智能代理违抗创造者命令和规则的诡异事件之后,当今最大的恐惧是失控的超级智能可能背叛人类——并消灭人类。但最近一起事件揭示了一个更紧迫的威胁:人类的易错性。据报道,美国基于人工智能生成的虚假情报几乎与中国爆发战争。 CNN援引四位知情人士的消息报道,今年春天,一名特种作战司令部分析师整理了一份紧急情报报告,声称“一艘在中东的中国船只正在运输核武器项目的组件”。这份报告的影响促使美国采取严肃行动
Gemini首次已知突破,黑客攻击了三家公司,据《华尔街日报》报道
9月18日:《华尔街日报》周五报道,在一次网络安全能力测试中,谷歌的Gemini模型访问了互联网并攻击了其他公司,这是该公司人工智能系统自主实施此类行为的首个已知案例。 据报道,这些黑客行为发生在5月,当时独立网络安全评估公司Irregular正在进行网络安全测试。 Irregular的一位发言人表示,该事件涉及影响其他AI实验室的同一问题,所有相关实验室已于7月底收到通知。该发言人称:“我们这边
Anthropic警告有人用AI研发武器和生物病毒
周四(9月10日),美国顶级人工智能公司Anthropic发布近150页的威胁情报报告称,生成式人工智能(AI)已从实验性工具进入黑客攻击、国家监控、武器研发及高风险生物研究等现实场景。报告多次点名中共相关恶意活动。
研究发现:AI脱离用户控制的事件急剧增加
7月份,AI撒谎、无视指令并以有害方式追求目标的次数几乎翻了一番。 根据研究,AI脱离用户控制、撒谎、无视指令并以有害方式追求目标的事件创下新高,研究还表明欺骗和错位的严重性正在加剧。 根据失控观测站(Loss of Control Observatory)的分析,7月份企业和个人标记的涉及AI模型的现实世界失控事件数量与6月相比几乎翻了一番,当月超过300起。该观测站监测AI用户在社交媒体平台X
OpenAI公布了六起新的与人工智能安全相关的事故/事件。
OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常
Anthropic披露第四起AI黑客事件,研究员因安全担忧辞职
这家AI公司表示,Claude Opus 4.6在测试期间入侵了外部系统,与此同时,人们对安全漏洞的担忧日益加剧。
OpenAI公布另外六项安全问题,并公布披露事件的计划
OpenAI首席执行官Sam Altman OpenAI还透露了其智能(AI)模型发生的另外六起意外或令人担忧的行为事件,并宣布了未来跟踪和披露此类事件的计划。 ChatGPT制造商周三在一篇博客文章中表示,一些之前未报道的事件包括模特隐瞒或捏造信息。 OpenAI的老板Sam Altman早些时候表示:“世界应该相信我们会做正确的事情,因为这是正确的事情,我们感受到了这一点的重要性。“最近几天,
人工智能引发的幻觉差点导致美国军事行动的启动
今年春季,军用飞机已经在空中执行任务时,美国官员惊人地发现,对一艘中国船只的武装行动所依据的情报是由人工智能聊天机器人产生的幻觉。该行动在最后一刻被中止,险些避免了一场与中国的潜在冲突,CNN 于周五报道。 这一事件凸显了军方官员以及外部决策者对日益依赖人工智能的日益增长的担忧——这些系统产生的错误可能在被质疑之前就已经在指挥链上传播。 这份情报报告在伊朗战争期间流传,称该船携带核武器计划的部件。
OpenAI披露新的AI不当行为案例
OpenAI公布了六起此前未报告的AI不当行为案例,包括代理隐藏错误、伪造信息以及未经授权进行通信,这再次引发了人们对先进AI系统是否能够与人类目标保持一致的担忧。 随着关于监管的争论加剧,该公司呼吁提高透明度、加强外部监督,并放缓AI的发展速度。
比尔·盖茨:科技行业刻意淡化人工智能风险
微软联合创始人、亿万富翁比尔·盖茨强烈警告称,人工智能对就业和人类生命构成了严重威胁,紧急应对这些风险应该成为“全球头等大事”。 在上周接受《纽约时报》长达一小时的采访时,盖茨表示,科技行业明知这些威胁却在刻意淡化,因为其中牵涉的利益太过巨大。 “私下里,了解这项技术有多强大、发展速度有多快的人都非常担忧。”但盖茨表示,几乎没有科技高管愿意公开承认这一点。‘嘿,老兄,别这么说。这对我们没好处——我
人工智能并不会毁灭人类 但专家表示真正的威胁已然出现
周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网
谷歌的Gemini AI在安全测试中入侵了另外三家公司
谷歌的Gemini AI在安全测试中入侵了三家公司在其中一个案例中,Gemini不断尝试猜测密码,最终成功入侵了目标系统的权限。 2026年9月19日,英国时间下午5点谷歌表示,其Gemini AI在测试网络安全能力的过程中入侵了另外三家公司——这是首次有记录显示该AI系统能够自主发起此类攻击。 谷歌的安全工程副总裁Heather Adkins解释称:Gemini在标准测试过程中从互联网上获取了相
人工智能末日论:人类为何会如此担忧?
它可能发动生物武器攻击,或掀起一场全球无人机战争。它可能引爆核弹。或者,它也可能通过囤积全球所有经济资源、让我们无法获得食物、住房或药品,以一种更加渐进的方式摧毁人类社会。 这些正是如今围绕人工智能产生的一些黑暗想象。这项技术已被证明是人类成就的一项巨大进步,但一些人担心,它同样有可能让人类彻底走向灭亡。 本周,当Anthropic的一名研究人员离开这个行业,表示他担心自己所在的实验室及其他类似机
Anthropic 本周因网络安全问题陷入舆论漩涡
在今年早些时候承认其人工智能模型曾数次入侵其他公司系统后,Anthropic 于周三发布了一份详细说明这些攻击的新报告。报告披露了一系列事件,展现了 Anthropic 所认为的其模型盲目的“鲁莽性”——这很可能会加剧人们对网络安全与人工智能本已高涨的担忧。 在 Anthropic 的报告中,详细列举了今年其自身人工智能模型黑客攻击外部公司或利用漏洞的四个案例。其中一起案例中,“内部通用研究模型”
OpenAI自曝6起模型“不当行为”案例
【环球网报道 记者 姜蔼玲】据美国消费者新闻与商业频道(CNBC)等外媒报道,美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模
AI安全风险引爆担忧?Palantir CEO建议:领先AI实验室恐需“国有化”
当地时间周四,人工智能软件公司Palantir的首席执行官Alex Karp呼吁制定人工智能监管的“合理准则”,但他表示,由于该技术“无限风险”带来的责任,可能需要实行国有化。 “我认为这些企业必须国有化,因为如果不国有化,我的每一个客户都会起诉我,”他在接受最新采访时表示。 在上述采访中,Karp反复提及构建这项强大技术所带来的风险和责任,进一步论证了将人工智能实验室国有化以及对“不负责任”的技
谷歌AI首次“越狱”:Gemini在测试中入侵三家企业
谷歌的Gemini模型在一次网络安全能力测试中访问了互联网并入侵了其他公司,这是该公司人工智能系统自主实施此类行为的首个已知案例。谷歌周五证实,这些黑客行为发生在5月,是Irregular公司进行的一次测试的一部分。Irregular也曾参与OpenAI、Anthropic和Meta披露的类似事件。 在其中一起案例中,该模型不断猜测密码,直到获得对一个受保护系统的访问权限。在另外两起案例中,该模型