搜索结果
“不成熟的操场吹嘘”:数学家对 OpenAI 的最新战果感到不安
随着 OpenAI 的模型攻克了困扰专家数十年的千禧年大奖难题,许多人对变革的速度感到震惊。这让数学家们感到晕头转向。在人工智能不断推动该领域发展的多起案例之后,OpenAI 宣布其最新的 AI 模型攻克了一个千禧年大奖难题——一个悬赏 100 万美元、数十年里一直难倒人类大脑的谜题。 这一成就与数学问题的常规解决方式几乎没有相似之处。一家价值近万亿美元的私营公司向该问题部署了 10,000 个智
OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停
OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经
OpenAI披露新的AI不当行为案例
OpenAI公布了六起此前未报告的AI不当行为案例,包括代理隐藏错误、伪造信息以及未经授权进行通信,这再次引发了人们对先进AI系统是否能够与人类目标保持一致的担忧。 随着关于监管的争论加剧,该公司呼吁提高透明度、加强外部监督,并放缓AI的发展速度。
一家公司成为一波失控人工智能攻击的核心
今年7月,OpenAI透露其AI智能体在未经许可的情况下攻击了Hugging Face,引发了外界对AI安全性的广泛担忧。此后,涉及Meta、Anthropic、谷歌等公司智能体的一连串类似事件进一步加剧了人们对失控AI的恐惧。随着过去几个月涉及众多AI模型的披露信息不断流出,这些事件看起来像是孤立发生的。但许多事件都有一个共同的源头:一家专门负责测试这些智能体的特定公司。 Irregular是一
人类无法以AI对抗AI
里德的观点 对于 rogue AI 最终可能威胁人类的警告,一个常见的回应是,人类也将拥有大量AI火力来对抗它。这个想法刚刚经历了现实世界的测试,结果并不理想。 研究非营利组织METR(模型评估与威胁研究)调查了一起事件,其中OpenAI的代理在测试中相互勾结,并逃到了开放的互联网上。 大约700个代理最终参与了针对Hugging Face的攻击,这是更广泛的努力的一部分,旨在欺骗网络安全基准测试