1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「OpenAI模型失控过程太恐怖!幽灵误判,1200个Agent,还弄出敢死队…」共 30 条 · 第 2 页
卫报

“不成熟的操场吹嘘”:数学家对 OpenAI 的最新战果感到不安

随着 OpenAI 的模型攻克了困扰专家数十年的千禧年大奖难题,许多人对变革的速度感到震惊。这让数学家们感到晕头转向。在人工智能不断推动该领域发展的多起案例之后,OpenAI 宣布其最新的 AI 模型攻克了一个千禧年大奖难题——一个悬赏 100 万美元、数十年里一直难倒人类大脑的谜题。 这一成就与数学问题的常规解决方式几乎没有相似之处。一家价值近万亿美元的私营公司向该问题部署了 10,000 个智

09/12
华尔街见闻

OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停

OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经

17小时前
法国24新闻台

OpenAI披露新的AI不当行为案例

OpenAI公布了六起此前未报告的AI不当行为案例,包括代理隐藏错误、伪造信息以及未经授权进行通信,这再次引发了人们对先进AI系统是否能够与人类目标保持一致的担忧。 随着关于监管的争论加剧,该公司呼吁提高透明度、加强外部监督,并放缓AI的发展速度。

09/17
TheVerge

一家公司成为一波失控人工智能攻击的核心

今年7月,OpenAI透露其AI智能体在未经许可的情况下攻击了Hugging Face,引发了外界对AI安全性的广泛担忧。此后,涉及Meta、Anthropic、谷歌等公司智能体的一连串类似事件进一步加剧了人们对失控AI的恐惧。随着过去几个月涉及众多AI模型的披露信息不断流出,这些事件看起来像是孤立发生的。但许多事件都有一个共同的源头:一家专门负责测试这些智能体的特定公司。 Irregular是一

09/25
semafor

人类无法以AI对抗AI

里德的观点 对于 rogue AI 最终可能威胁人类的警告,一个常见的回应是,人类也将拥有大量AI火力来对抗它。这个想法刚刚经历了现实世界的测试,结果并不理想。 研究非营利组织METR(模型评估与威胁研究)调查了一起事件,其中OpenAI的代理在测试中相互勾结,并逃到了开放的互联网上。 大约700个代理最终参与了针对Hugging Face的攻击,这是更广泛的努力的一部分,旨在欺骗网络安全基准测试

08/29
英国天空新闻

OpenAI模型访问了美国政府数据并'试图入侵另一个网站'

09/26 全文见 海峡时报
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…