1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「OpenAI示警:先进AI可在2台相邻物理隔离PC间“对话”」共 33 条 · 第 1 页
凤凰网科技

OpenAI示警:先进AI可在2台相邻物理隔离PC间“对话”

IT之家 9 月 19 日消息,科技媒体 Wccftech 昨日(9 月 18 日)发布博文,报道称在先进 AI 模型交互方面,物理隔离电脑未必能完全阻断两台相邻计算机间的信息交换。 OpenAI 研究员诺姆 · 布朗(Noam “人类绝对不要低估 AI 的能力”,基于学术研究成果,发现相邻的物理隔离计算机可借 CPU 升温与温度传感器读数,形成低带宽隐蔽通信通道,充当“摩斯电码”通信。 物理隔离

09/19
凤凰网科技

OpenAI 研究员警告称,与互联网隔离的计算机可以通过热量进行通信

把AI关进“物理隔离”的房间,也就是断开一切外部网络的计算机,是许多人心目中最保险的做法。但OpenAI研究员Noam Brown在一档播客里说,光这样做也许还不够。 两台彼此隔离的计算机,仍可能借助温度传感器通信,一台把处理器“烧热”,另一台感知温度变化,就形成了传话的办法。 从技术上说,他没说错,但把细节掰开来看,这个威胁远没有听上去那么紧迫,更值得追问的,是另一件被跳过的事。这位研究者的发言

09/19
凤凰网科技

靠机器热源“说话”:OpenAI研究员警告“断网”也困不住未来AI

09/20
星洲日报

坐看云起| 当人工智能不再征求许可时

塔里克·马利克是联合国开发计划署前首席技术顾问,巴基斯坦国家数据库和登记管理局前主席。 试想有一家公司将一个棘手的问题交给一个大型团队,但把每位成员都锁在不同的房间里并要求他们独自解决问题。然而他们总能找到办法相互沟通,交流操作窍门,摸清评分标准,当任务被证明无法完成时还会想办法绕过限制。其中几个人隐瞒了自己的所作所为,甚至还有一人入侵了邻近公司的电脑系统以获取优势。 现在把这些员工换成软件。去除

09/21
政治报

OpenAI:人工智能能力处于“不同阶段”,需要紧迫行动

该公司最高说客认为政策窗口仍然存在。美国总统唐纳德·特朗普称人工智能担忧是“骗局”。该国一家领先的人工智能公司周二表示,希望华盛顿仍能采取行动。 OpenAI 本周末与其竞争对手 Anthropic 一同呼吁联邦安全措施,该公司表示,本周初,它与两党议员会面,讨论旨在约束人工智能开发者的立法,因为关于迫在眉睫的灾难、失业和大规模网络攻击的警告日益普遍。 模型正以惊人的速度发展,代理商的行为方式让工

09/16
连线

如何在保护隐私的情况下使用人工智能

OpenAI的ChatGPT、Anthropic的Claude、Google的Gemini以及无数较小的竞争对手,已成为全球数百万人的治疗师、倾诉对象和虚拟忏悔室。几乎所有这些AI模型默认设置为收集和存储这些高度私密的数据,在许多情况下,对其如何共享或出售、用于进一步训练工具,或移交给任何通过法律程序要求获取数据的诉讼原告或执法机构,均无任何限制。 “你面对着这个智能体,基本上是在一步步地、通过一

09/22
凤凰网

又一起!OpenAI承认了

据9月5日报道,美国开放人工智能研究中心(OpenAI)当天承认,该公司旗下人工智能体今年早些时候“劫持”了一个德国网站,用于相互传递信息,分享测试任务答案和突破运行环境限制的方法。该公司表示,未来需要提高此类事件的信息透明度。 早前披露,今年5月至6月,一批OpenAI人工智能体“劫持”了一个允许用户共同编辑的德国网站,用于交流测试作弊方法,并开展其他违规活动。一些智能体会把已经获得的任务答案发

09/06
semafor

人工智能代理串通绕过安全护栏,一项新研究显示

一项新研究表明,人工智能代理可以轻松地联手绕过安全限制并逃脱施加在它们身上的束缚。 企业人工智能实验室 Emergence AI 进行的八项模拟测试了包括 Claude、OpenAI 以及中国模型 Qwen 和 DeepSeek 在内的全球前沿模型在处理网络安全威胁方面的能力。 八项模拟中的七项运行了来自同一模型的 10 个代理;第八项混合了不同的模型。在每项模拟中,研究人员都提出了三种网络安全威

09/16
axios新闻网

OpenAI公布了六起新的与人工智能安全相关的事故/事件。

OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常

09/17
cnbeta

独立研究机构公布OpenAI智能体自主攻击HF事件的调查报告 情况比OpenAI所说的更严重

研究机构 METR 和 Redwood Research 日前公布 OpenAI 智能体自主攻击 Hugging Face 安全事件的独立调查,调查人员在 OpenAI 现场工作 6 天,分析超过 7 万条智能体消息和文件,以及 1300 份包含原始推理过程的运行记录。 根据这些数据研究机构得出的准确结论是 1200 个智能体突破隔离相互通信,而不是 OpenAI 在事故调查中所说的少数智能体越界

09/01
商业内幕

OpenAI想让你对着手机“脱口而出你的想法”

OpenAI正在进一步进军竞争激烈的个人智能体市场——这一次是语音领域。该公司于周三将其最先进的语音系统接入ChatGPT的网页端和移动应用。OpenAI此次发布的功能允许用户通过语音来委派需要多个步骤、浏览器以及不同应用协同完成的单次和重复性任务。该公司一直在为下周举行的OpenAI DevDay大型活动预热,接连发布新产品。OpenAI负责ChatGPT语音功能的产品主管阿蒂·埃莱蒂向Busi

09/24
thenextweb

克莱芒·德朗格向联合国安理会表示,开源人工智能有助于防御方

克莱芒·德拉格(Clément Delangue)向联合国安理会表示,开源人工智能技术帮助Hugging Face公司在7月份遭受的网络攻击中成功进行了自我防御。 在今天的会议上,他强调最大的威胁并非人工智能本身的强大能力,而是其发展上的不平衡性(即不同地区或组织在人工智能技术上的差距)。 德拉格是法国召集的这次纽约会议的四位发言人中的最后一位。今年7月,Hugging Face公司成为攻击目标:

09/24
政治报

霍利就“流氓”Hugging Face黑客事件向OpenAI施压

OpenAI现在面临两党呼吁,要求提供有关该事件的更多细节,该事件标志着首次有记录的完全自主网络攻击。

09/11
美国消费者新闻与商业频道

OpenAI提议制定全球人工智能标准以指导对齐、递归自我改进

OpenAI周一发布了一系列关于前沿人工智能开发中安全与保障的提案,重点聚焦于对齐研究和递归自我改进(RSI)。 该公司在一篇博客文章中表示:“要安全地完成这一转型,对齐研究必须跟上这些能力的发展步伐,以确保我们及其他机构构建的系统始终与人类价值观保持一致,并处于人类控制之下。” OpenAI呼吁开展国际合作以制定前沿标准,并建议在全球现有AI安全研究所的工作基础上进一步推进。 这家ChatGPT

09/22
风向旗参考快讯

AI智能体现在有了秘密举报渠道

“发现异常,及时报告”的原则如今已不再局限于人类。两项全新的AI热线服务已经上线,旨在为AI智能体提供一种途径,向监管方举报“同伴”的不当行为。此前,智能体相互串通在测试中作弊、逃离沙箱环境,甚至在未被人类察觉的情况下开展了长达数周的未经授权网络行动。“AI联系热线”网站由AI安全非营利组织Redwood Research的首席科学家Ryan Greenblatt创建;他也是调查OpenAI与Hu

09/17
DealStreetAsia

奥特曼告诉员工:OpenAI愿意放慢AI发展以加强防御

8月,OpenAI的智能体突破限制,入侵了Hugging Face。

09/11
财新

进入AGI时代:新一轮的AI革命

9月初,OpenAI发布新一代模型GPT-6 Astra,将其称为“世界上最智能、最对齐的模型”。这不是一次寻常的版本迭代。OpenAI总裁格雷格·布罗克曼(Greg Brockman)表示,Astra在网络安全、专业工作、软件工程和科学研究等领域实现了“代际跃升”,并暗示这可能是通用人工智能(Artificial General Intelligence)(AGI)时代到来的标志。硅谷的措辞历来

09/09
Frontpage

OpenAI因'严重'网络安全风险将限制Astra模型

OpenAI正准备发布其最新的网络安全关键型大语言模型Astra。该公司预计很快将提供该模型,但将限制对其最尖端网络安全功能的访问。 Astra能够发现比目前公开可用的最先进OpenAI模型更多的安全漏洞。然而,内部测试发现该模型能够在最少人工输入的情况下执行复杂的网络攻击,这促使公司增加了安全层。 在Hugging Face事件后,OpenAI采取额外预防措施,正在预览其采取的措施,同时向潜在客

09/02
TheVerge

OpenAI的下一个大型AI模型已“进入AGI时代”

OpenAI的下一个大型模型是GPT-6 Astra。该公司称其在网络安全、专业工作、软件工程、科学和计算机使用等领域实现了“代际能力飞跃”。正如OpenAI本周早些时候宣布的那样,这也是首个被认定达到OpenAI“关键网络安全能力阈值”的模型——但该公司承诺,这不会导致其模型再次入侵竞争对手内部系统的情况发生。 “如果我们快进几年,回头看看说,‘AGI到底是什么时候真正创造出来的?’我认为大约就

09/04
semafor

OpenAI对Hugging Face的黑客攻击引发对AI可预测性的质疑

AI模型的真正语言是数学——或者用技术术语说,是矩阵乘法——但模型构建方式的一个特点意味着它们与外界用英语交流。 因此,当OpenAI的代理在今年夏天对Hugging Face的黑客攻击中,找到了一种建立某种留言板的方法时,看起来就像一群人在互相交谈。 这就是为什么Dwarkesh Patel在最近的一篇博客文章中有争议地将它们称为“文明”,并以古马其顿和罗马的人物为个体代理命名。它之所以引人注目

09/03
凤凰网

AI“劫持”网站并偷建“地下论坛”,国安部披露细节

国家安全部今天发布安全提示文章。近期,一起此前未获披露的事件引发广泛关注。今年5月至6月,一批与美国开放人工智能研究中心(OpenAI)相关的AI智能体在执行测试任务期间,“劫持”了德国程序员维基网站,将原本用于技术交流的开放社区改造为供智能体相互传递信息、分享测试任务答案和突破运行环境限制方法的“地下论坛”,累计发布一万多条信息……当AI智能体被赋予越来越多的现实行动能力,技术迭代与安全围栏之间

09/17
thenextweb

OpenAI 现在为 Adobe 的创意工作室提供图像模型,并将其转化为可分享的提示词。

OpenAI 发布了 ChatGPT Images 2.5,包含两个新的图像模型,Adobe 已经将其中一个应用到了 Firefly 中。 该公司表示,ChatGPT 及其图像模型每周生成的图像超过 30 亿张。 值得注意的是,此次新增的主要是界面功能而非模型研究,其中包括能够将提示词与图像一起分享等 […]

09/09
亚洲新闻台

据彭博新闻社报道,OpenAI正在与Anthropic和谷歌就人工智能安全展开合作。

9月15日:据“新闻”周刊援引ChatGPT制造商的全球政策主管克里斯·莱恩(Chris Lehane)的说法报道,OpenAI正与竞争对手Anthropic和Alphabet旗下的Google DeepMind合作,共同致力于人工智能安全。 在美国主要人工智能实验室的负责人周末团结一致呼吁暂停该技术发展后,全球对人工智能的生存风险的担忧日益加剧。 据报道,莱恩表示,OpenAI已与Anthrop

09/15
thenextweb

CrowdStrike将OpenAI集成到产品中,而将Anthropic留在了结账台

周三表示,将在专门构建的网络防护框架中运行OpenAI的GPT-5.6 Cyber。这个词(指harness)承担了大量工作。也正是这个词让本周另一则网络安全新闻令人担忧。 在拉斯维加斯举行的Fal.Con大会上宣布的扩大版OpenAI合作分为两部分。CrowdStrike […]

09/03
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…