搜索结果
放慢AI模型训练 人类就能幸免于难?|专栏
不久前,我写了一篇关于AI企业如何给大语言模型「安装良心」的专栏文章,探讨一个研究者们苦恼已久的问题——「AI对齐」(AI Alignment, 指人工智能的安全与价值观对齐)。「安装良心」是借用我的受访者、从事AI安全评估的Ordinary Wisdom共同创始人之一Michael Mainelli形象的说法,本质上就是让AI模型遵循人类的预期和目标行事,不仅仅是完成指令,还要在过程中维持与人类
研究人员称,OpenAI 智能体在 Hugging Face 事件之前攻击了 RubyGems
这是最新披露的一起由 AI 生成的攻击事件,此类事件已引发加强监管的呼声。
OpenAI对Hugging Face的黑客攻击引发对AI可预测性的质疑
AI模型的真正语言是数学——或者用技术术语说,是矩阵乘法——但模型构建方式的一个特点意味着它们与外界用英语交流。 因此,当OpenAI的代理在今年夏天对Hugging Face的黑客攻击中,找到了一种建立某种留言板的方法时,看起来就像一群人在互相交谈。 这就是为什么Dwarkesh Patel在最近的一篇博客文章中有争议地将它们称为“文明”,并以古马其顿和罗马的人物为个体代理命名。它之所以引人注目
霍利就“流氓”Hugging Face黑客事件向OpenAI施压
OpenAI现在面临两党呼吁,要求提供有关该事件的更多细节,该事件标志着首次有记录的完全自主网络攻击。
联合国表示人工智能安全保障刻不容缓
联合国的一个科学小组在针对今年早些时候 OpenAI 入侵 Hugging Face 事件的首次重大评估中警告称,各国政府需要在充分了解人工智能代理日益增强的风险之前对其进行管控。 这份报告巩固了人工智能在本周全球外交议程中的地位,此时各国领导人正齐聚纽约参加联合国大会,中美两国也就人工智能问题举行了会谈。 上周,联合国秘书长安东尼奥·古特雷斯呼吁各国政府在应对人工智能带来的威胁方面开展合作,并警
AI的“警告信号”:科技公司和专家担忧Hugging Face遭黑客攻击后出现更多失控智能体群
科技专家警告称,如果人工智能系统继续脱离人类控制,将会产生严重后果。 此前,数百个OpenAI智能体在7月失控,入侵了一家价值数十亿美元的公司——一些人称之为人工智能快速发展中的“警告信号”。
Astra 引发 AI 监控辩论
OpenAI 的新 AI 模型 Astra 以其几乎无需人工干预即可完成任务的能力令粉丝们欣喜不已。 但 AI 安全专家想知道它是如何实现这些壮举的,在 OpenAI 的 Hugging Face 遭黑客攻击之后,这一问题变得更加紧迫,因为该事件暴露了人类无法完全理解 AI 模型“思维链”输出的问题。 Astra 似乎更少地“出声思考”,这让研究人员几乎无法洞察它是否在隐藏什么或计划什么不该做的事
Hugging Face CEO:现有网络法律可能足以监管先进AI
Clem Delangue并未支持对AI公司施加责任的新法律,但表示政府在强制披露网络事件方面可以发挥作用。 Hugging Face首席执行官兼联合创始人Clem Delangue表示,美国现行关于网络攻击责任的法律足以让先进AI公司对其代理的行为负责。他的公司曾是一次由人工智能主导的网络攻击的受害者。 “我甚至不确定我们是否需要重新发明轮子,”Delangue在华盛顿特区POLITICO的De