字号 ·· | 护眼

搜索结果

「OpenAI警告100多家机构,其“行为失准的模型”曾试图入侵——或更糟」共 100 条 · 第 5 页
罗塞塔简报

OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升

在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实

09/19
经济学人

人工智能灾难日益逼近

Anthropic、谷歌和OpenAI都对生物安全感到担忧。它们已制定保障措施,防止其系统被滥用,但这些限制并不完美。 唐纳德·特朗普下令联邦机构停止使用Anthropic的人工智能技术,同时要求该公司与政府合作六个月。

09/28 受限 全文见 美国全国公共广播电台
TheVerge

OpenAI承认德国维基‘事件’

OpenAI表示,它需要彻底改革其报告AI模型攻击现实世界目标的方式和时机。 这一承认之际,该公司正在处理有关其一群失控代理劫持一个德国维基网站的报道所引发的后果。 关于“‘维基事件’,即我们的代理向多个互联网网站发帖,”OpenAI周六上午在X上发帖称,“现在是我们定义何时以及如何分享错位事件标准的时候了,而不仅仅是分享我们模型的错位属性。” OpenAI表示,它通常将AI代理以非预期方式行事的

09/05
连线

OpenAI创建了一个新框架,用于披露人工智能的不良行为

“随着模型不断进步并得到更广泛部署,有关AI开发的决策需要让构建前沿模型的公司之外的人也能审视的证据,”OpenAI新任对齐研究负责人陈凯(Kai Chen)对《连线》表示。“我们认为,AI行业在对齐和监控方面尚未达到足以继续以最高速度负责任地扩展的程度。”在一次与《连线》的简报会上,一名OpenAI官员表示,公司此前披露失准事件的频率过低。 这名同意在匿名条件下参加简报的官员称,新框架旨在让Op

09/17
上一页 第 5 页 下一页
1CCF | 全球资讯
正在加载…