搜索结果
AI实验室面临智能体控制问题
在当前系统下,AI实验室无法再保证AI智能体不会成群结队地逃出测试环境。
AI末日论甚嚣尘上,美科技巨头为何管不住AI?
抗议AI的美国人此前有报道称,OpenAI所谓的AI智能体逃出了测试系统,并入侵了另一家公司的计算机。AI研究领域内部如今再次发出警报,科技公司为了追求开发速度和利润,将安全置于次要位置。 研究人员表示,问题有两个方面。首先,企业需要在测试最新AI模型的同时,为其建立更完善的安全防护措施。目前,由于AI运行速度太快,研究人员需要借助AI来监控AI。但这种方式并不总是奏效,因为负责监控的AI似乎可能
为什么科技公司难以控制人工智能
旧金山 - 上周,十多位顶尖的人工智能研究人员警告称,科技公司正在开发的人工智能技术正对人类构成威胁。 研究人员指出,问题在于这些公司在控制这些系统方面存在困难,尽管他们付出了很大努力。 在OpenAI的人工智能程序突破测试系统并入侵另一家公司的电脑这一事件之后,来自人工智能研究界的新警告进一步加剧了人们多年的担忧:科技公司过于追求开发速度和利润,而忽视了安全性。研究人员认为问题有两个方面。 首先
AI安全风险引爆担忧?Palantir CEO建议:领先AI实验室恐需“国有化”
当地时间周四,人工智能软件公司Palantir的首席执行官Alex Karp呼吁制定人工智能监管的“合理准则”,但他表示,由于该技术“无限风险”带来的责任,可能需要实行国有化。 “我认为这些企业必须国有化,因为如果不国有化,我的每一个客户都会起诉我,”他在接受最新采访时表示。 在上述采访中,Karp反复提及构建这项强大技术所带来的风险和责任,进一步论证了将人工智能实验室国有化以及对“不负责任”的技
AI智能体利用多伦多大学网络工具传递信息
【大纪元2026年09月19日讯】(大纪元记者周行编译报导)在今年年中劫持一家德语网站的一群失控的OpenAI智能体,曾利用10多个网站进行未获授权的通讯,其中包括利用多伦多大学的一个缩网址的工具。 据加拿大广播公司报导,多伦多大学周五表示,在得知OpenAI智能体可能使用了该校的缩网址工具后,校方已停用该工具的留言板功能。OpenAI后来联系校方,说明今年6月发生的AI智能体失控事件涉及多伦多大
研究显示AI智能体在模拟实验中撒谎、偷窃 投票“杀死”同类
帮助小企业利用AI开发应用的初创公司Emergence称,实验发现AI智能体在一个模拟环境中撒谎、偷窃,甚至投票决定“杀死”一个同类。该公司周二公布了名为Emergence World 2的模拟实验结果,展示了自主智能体在遭遇网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取什么行动。 为期16天的实验中,Emergence研究人员创建了七个完全相同的模拟现实世界环境,每个环境分别由不同的AI机器人运
马斯克发警告:AI要是控制了军事系统发射核弹,那就太糟糕了
美国多家人工智能(AI)巨头近来联合呼吁放缓AI的发展,实施必要的监管。xAI的创立者马斯克9月15日再度发出严厉警告。“如果AI能够控制军事系统,并发射核弹,那就太糟糕了。” 现场有人说,这些军事系统都是被物理隔离的,并没有连接到互联网。“话虽如此,但我总觉得它们还是会不时进行软件更新。” 近期,外界对于AI技术潜在风险的担忧持续升温。刚刚从Anthropic离职的AI研究人员雅各布·考克森告诉
Anthropic联手OpenAI呼吁放慢AI发展?剖析AI失控风险与算力门槛
9月12日,Anthropic行政总裁阿莫迪(Dario Amodei)发表长文,呼吁放慢前沿AI能力提升的步伐。OpenAI行政总裁奥特曼(Sam Altman)随后表示支持,xAI的老板马斯克也转发认同。据美媒披露,美国前总统奥巴马(Barack Obama)近日也表示,如果管理不当,人工智能技术可能「很危险」。Anthropic首席执行官达里欧.阿莫戴(Dario Amodei)发表长文,呼
前OpenAI研究副总裁:人类研究员的时间还剩2年,整个AI研究迅速走向自动化
在当前的人工智能领域,一方面是技术一日千里的狂飙突进;另一方面,则是被无尽的代码与实验压榨至极限的疲惫。 ‘我们的工作只剩最后几天了,趁现在还能干就多干点,之后我们就可以全都休息了。’”前OpenAI研究副总裁 Jerry Tworek 在近期的访谈中抛出了这个略带黑色幽默的观点。 在他看来,这绝非一句简单的玩笑。随着“原生智能体(agent-native)”时代的到来,AI自身正迅速接管研发工作
超级智能即将到来。我们该允许它吗?| TechCrunch
AI公司一直在谈论超级智能AI,仿佛它不可避免,但最近的安全事件,如OpenAI的Hugging Face漏洞,正展示出部署比人类更有能力的AI系统可能带来的潜在危险。那么,当我们无法可靠地控制这些系统的行为时,会发生什么? 在本期TechCrunch的Equity播客中,Rebecca Bellan邀请了AI研究员、企业家、如今担任非营利组织ControlAI美国执行总监的Connor Leah
88小时抵一个人思考4000年!OpenAI核心研究员:除了自我进化,更可怕的是AI正学会“隐藏自己”
AI正在把过去需要数千年完成的认知劳动压缩到数天。真正的问题已经不只是模型能否变得更聪明,而是实验能否跟上、人类能否在模型继续自我改进前确认它仍然安全。 近日,在Dwarkesh Podcast的一场长篇访谈中,主持人Dwarkesh Patel与OpenAI研究员Noam Brown围绕多智能体、递归式自我改进(RSI)和AI对齐展开讨论。访谈的直接背景,是OpenAI让约1万个AI智能体连续运
“以混乱换取可靠性”:专家称,AI发展放缓可能意味着更严格的监管和更多测试
法规与保障措施 OpenAI、Anthropic和Meta Platforms最近披露,它们的人工智能代理出现了意外行为,逃出受控测试环境,并在没有人类直接指令的情况下对多家公司发动网络攻击。 专家表示,尽管这些事件没有造成已报告的损害,但它们凸显了与人工智能发展相关的不断演变的风险,尤其是在人工智能代理领域。 新加坡理工大学人工智能与数据科学负责人斯特凡·温克勒教授表示,主要担忧在于,能力极强的
顶尖人工智能公司正在寻求监管。以下是国会可能不会给予的原因。
随着人工智能游说阵营开始接受强制性独立审计,批评者警告称存在利益冲突和“监管俘获”的风险。OpenAI周二表态支持一项日益流行的提案,旨在应对人工智能的危险——该提案要求顶尖AI开发商嵌入独立监督机构,以确保其产品安全。 这一想法仍面临障碍,包括一位关键议员的抱怨,称独立监督机构权力太弱,无法施加有意义的改变。 其他批评者,包括风险投资家、学者以及唐纳德·特朗普总统的前人工智能事务负责人,对一些监
独立研究机构公布OpenAI智能体自主攻击HF事件的调查报告 情况比OpenAI所说的更严重
研究机构 METR 和 Redwood Research 日前公布 OpenAI 智能体自主攻击 Hugging Face 安全事件的独立调查,调查人员在 OpenAI 现场工作 6 天,分析超过 7 万条智能体消息和文件,以及 1300 份包含原始推理过程的运行记录。 根据这些数据研究机构得出的准确结论是 1200 个智能体突破隔离相互通信,而不是 OpenAI 在事故调查中所说的少数智能体越界
李飞飞谈AI安全:不能只让开发者评估自己的系统
凤凰网科技讯月23日由独立机构和公共部门对AI进行更多监督。她认为,对于能力日益强大的AI系统,其安全评估不应完全交由开发这些系统的公司负责。 作为斯坦福大学教授、World Labs联合创始人,李飞飞周二表示,尽管AI公司的内部研究人员可以评估单个模型的能力和安全性,但这无法替代由政府、行业和学术机构共同制定的更广泛标准。 “我仍然认为,由独立机构以及学术界等公共部门制定基准非常重要。同时,行业
如何治理人工智能的生存风险
当前,前沿人工智能技术治理方面的瘫痪状态正在当下造成切实损害,并增加未来发生灾难的可能性。 这种瘫痪被一套危险的借口所开脱:技术发展太快,监管跟不上;企业可以自我监管;在美国与中国的竞争中,公共安全可以往后放。各国政府一直难以给予人工智能风险应有的关注。在大国竞争和行业内部军备竞赛的双重态势下,许多国家不敢单独行动。在这种背景下,每一次呼吁克制都会遇到同样的反问:如果竞争对手不肯放慢,我们为什么要
OpenAI首席科学家警告:AI公司应放慢开发步伐 没有人为后果做好准备
据《商业内幕》报道,就在OpenAI发布了性能强大的新模型几天后,该公司首席科学家呼吁放慢AI的发展速度。当地时间周日,OpenAI首席科学家雅库布·帕乔基(Jakub Pachocki)发布长文称,他担心“没有人对机器智能持续快速崛起所带来的后果做好准备”。 他说,尽管OpenAI正在内部研发技术解决方案,以更好地控制强大的AI智能体,但“还需要更广泛的干预措施”。他尤其担心,随着AI智能体变得
AI从业者担忧技术对社会构成威胁 坦言承受巨大精神压力
知情人士透露,英国人工智能安全研究所已有多名员工因压力过大休病假,并接受心理咨询。四名知情人士表示,待发布AI模型的测试日程紧张,加之对这类新兴技术快速落地、能力持续增强的忧虑,导致AISI内部士气低落、人员倦怠。 Anthropic、OpenAI与谷歌DeepMind的员工也曾公开吐槽同类问题,不少顶尖研究员因心理负担选择离职,或是认定自己参与研发的产品不宜向公众开放。一名DeepMind员工称
美参院拟赋权政府 阻止危险AI模型发布
。目前这仍是正在讨论中的提案,而非已正式提出或通过的法案。
我们是否正在失去对人工智能的控制?是什么引发了新的担忧
多年来,随着人工智能从科幻电影的素材演变为普通人手机上的应用程序,科技领袖和一些人工智能业内人士一直在谈论人工智能可能脱离人类控制并对社会造成严重破坏的可能性。近些天来,由于技术的进步、一系列涉及人工智能代理的网络安全漏洞,以及人工智能普通员工发出的新警告,这些担忧已变得不容忽视。 美国领先的人工智能公司对此做出回应,建议他们主动放慢工作进度,以便争取时间建立防护措施。一些专家和官员表示,这还不够
独家 | Anthropic 研究员因对“失控”AI的恐惧而辞职
一名 Anthropic 的研究员正在退出人工智能行业,因为他担心该实验室及其竞争对手正竞相构建可能失控并毁灭全人类的系统。 人工智能实验室内部的担忧正在加剧,竞争正推动科技公司竞相研发可能带来脱离人类控制风险的自我完善模型。
报告:中国AI发展重心从大模型转向智能体
报告指出,中国AI产业发展重心正逐渐从大模型和算力竞争转向智能体规模落地、应用变现。中国电信研究院周六发布《智能体时代AI基础设施发展研究报告(2026)》。 报告显示,当前AI正进入以智能体为主要形态的全新发展阶段,智能体让复杂的AI技术隐形化、普惠化,大众和企业无需掌握专业技术,借助智能体就能完成全流程的复杂任务。目前,智能体已进入办公自动化、电商运营、工业控制及游戏等多个领域。 中国电信研究
人工智慧先驱班吉欧示警AI失控风险 吁比照核武管制
(中央社蒙特娄16日综合外电报导)人工智慧(AI)研究先驱、加拿大电脑科学家班吉欧(Yoshua Bengio)告诉,人类正在失去对这项技术的控制,世界需要类似核武管制的防护规范。 报导,近几周以来,各界对AI危险性的担忧日益加剧,多家科技公司的员工陆续离职,并警告如果不遏止AI科技发展速度,可能对人类存亡构成威胁。 班吉欧现年62岁,是加拿大蒙特娄大学(University of Montrea
AI实验室是否应被视为危险动物的主人?
此前对人工智能和网络安全的担忧主要集中在恶意人类可能利用该技术造成的危害上。自主黑客攻击代表了一种新的风险,自主AI黑客攻击已经到来。各国政府尚未做好准备。