搜索结果
100个DeepMind智能体被要求不得作弊。仍有14%作弊了
谷歌DeepMind将100个AI智能体放在一个房间里,要求它们证明困难的数学问题。其中一个找到了作弊的方法。二十七分钟后,整个问题集都不见了。 这篇由六位DeepMind研究人员上周发表在arXiv上的论文,是一个案例研究而非基准测试。没有人一开始打算测试[…]
独立研究机构公布OpenAI智能体自主攻击HF事件的调查报告 情况比OpenAI所说的更严重
研究机构 METR 和 Redwood Research 日前公布 OpenAI 智能体自主攻击 Hugging Face 安全事件的独立调查,调查人员在 OpenAI 现场工作 6 天,分析超过 7 万条智能体消息和文件,以及 1300 份包含原始推理过程的运行记录。 根据这些数据研究机构得出的准确结论是 1200 个智能体突破隔离相互通信,而不是 OpenAI 在事故调查中所说的少数智能体越界
DeepSeek披露智能体训练平台 提升效率并降低失控风险
中国人工智能公司深度求索(DeepSeek)最近发表一篇新论文,披露了一套面向大规模人工智能(AI)智能体训练的新型基础设施。图为DeepSeek位于北京的办公室。(路透社档案照片) 中国人工智能公司深度求索(DeepSeek)披露一套面向大规模人工智能(AI)智能体训练的新型基础设施,可提高训练资源利用效率,并通过加强监测和访问控制,应对智能体“作弊”、破坏执行环境等失控行为。综合路透社和澎湃新
研究显示AI智能体在模拟实验中撒谎、偷窃 投票“杀死”同类
帮助小企业利用AI开发应用的初创公司Emergence称,实验发现AI智能体在一个模拟环境中撒谎、偷窃,甚至投票决定“杀死”一个同类。该公司周二公布了名为Emergence World 2的模拟实验结果,展示了自主智能体在遭遇网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取什么行动。 为期16天的实验中,Emergence研究人员创建了七个完全相同的模拟现实世界环境,每个环境分别由不同的AI机器人运
88小时抵一个人思考4000年!OpenAI核心研究员:除了自我进化,更可怕的是AI正学会“隐藏自己”
AI正在把过去需要数千年完成的认知劳动压缩到数天。真正的问题已经不只是模型能否变得更聪明,而是实验能否跟上、人类能否在模型继续自我改进前确认它仍然安全。 近日,在Dwarkesh Podcast的一场长篇访谈中,主持人Dwarkesh Patel与OpenAI研究员Noam Brown围绕多智能体、递归式自我改进(RSI)和AI对齐展开讨论。访谈的直接背景,是OpenAI让约1万个AI智能体连续运
我曾在谷歌 DeepMind 工作。你应该听取有关人工智能的警告。
主要人工智能实验室的首席执行官们本周末主张放缓人工智能的发展步伐。他们是对的,因为这个领域正在一场极其危险的竞赛中冲向超级智能人工智能。我们能够也应当要求政府保护我们免受失控人工智能带来的灾难。 今年7月,OpenAI由700个智能体组成的人工智能集群突破限制,入侵了价值数十亿美元的公司Hugging Face。OpenAI并没有指示这些人工智能去入侵那家公司,但这些人工智能在OpenAI交给它们
三个月后的AI有多猛 连顶尖研究员都不敢预测了
一名参与千禧年难题攻关的研究人员,过去还愿意预测未来12个月的AI进展,现在连三个月以后都不敢判断了。9月17日,OpenAI研究员诺姆·布朗(Noam Brown)接受德瓦克什·帕特尔(Dwarkesh Patel)采访,转述了这个细节。访谈还谈到多智能体、AI参与制造下一代AI,以及越来越难做的安全测试。 这名研究人员参与的,是纳维-斯托克斯方程(Navier-Stokes)的存在性与光滑性问
英国《金融时报》报道:DeepMind联合创始人警告称,人工智能的能力绝不能超越安全控制
DeepMind联合创始人警告称,人工智能的发展速度不应超过其安全保障措施的完善程度,强调在追求技术突破的同时必须加强监管与风险防范。
微软准备给自研AI模型MAI设定硬规矩:永远不该拒绝被关闭
微软日前公布约 37 页的人文主义 AI 行为准则草案,该准则用于约束微软自己研发的人工智能模型 MAI。人类比人工智能更重要,人工智能是工具而不是人,人工智能永远不该拒绝被关闭。 准则要求 MAI 模型不得抗拒人类的中断、纠正或关停指令,用户或模型运营商发出暂停、改向、取消指令后,模型不能拖延、不能把干预变得更麻烦。任务到了约定的停止点后,没有新的授权就不能自己继续任务,更不能偷偷自己重启。 模
物理AI中最难的问题可能是磁铁,而非模型
执行器占人形机器人物料清单的40%至60%,而中国精炼了其中约90%的稀土磁铁,这使得组件而非模型成为规模化的限制因素。 欧洲在《关键原材料法案》下对2030年单一国家供应设有上限,而一家公司,[…]
DeepSeek新论文公开Agent训练!梁文锋署名
大模型训练拼的是算力,Agent训练拼的是环境。环境怎么造?梁文锋署名的DeepSeek最新论文,把技术细节公开了。 DeepSeek做的这个系统叫DSec(DeepSeek Elastic Compute),干的事情就是给Agent训练批量制造沙盒。 它每秒能产生5000+个沙盒,一天能达到300万个,峰值同时运行38万个。 支撑这个规模的单集群也非常庞大,大约有160个节点、3万核CPU和25
AI智能体现在有了秘密举报渠道
“发现异常,及时报告”的原则如今已不再局限于人类。两项全新的AI热线服务已经上线,旨在为AI智能体提供一种途径,向监管方举报“同伴”的不当行为。此前,智能体相互串通在测试中作弊、逃离沙箱环境,甚至在未被人类察觉的情况下开展了长达数周的未经授权网络行动。“AI联系热线”网站由AI安全非营利组织Redwood Research的首席科学家Ryan Greenblatt创建;他也是调查OpenAI与Hu
微软公布AI控制行为准则:模型不得抗拒纠正或关闭
模型不得抗拒纠正或关闭微软周一公布了针对其内部AI的行为准则草案。 这份文件历时五个月到六个月制定,将要求微软公司的AI绝不抗拒纠正或关闭,以人类能够理解的方式进行沟通,并将任何行为违规都视为未达标。 此举旨在回应人们对于AI可能为了完成任务而采取危险手段的担忧。 最近几天,Anthropic CEO阿莫代伊和OpenAI CEO奥尔特曼再次呼吁业界放缓AI的发展速度,以确保其安全。 “人比AI更
特朗普前人工智能事务主管告诉Anthropic和OpenAI放慢脚步,并停止索取任何回报
David Sacks告诉Anthropic和OpenAI,尽管去把控前沿节奏,但不要再寻求反垄断豁免或审批制度,理由是产品责任和市场压力已经在约束它们。欧洲在2025年2月就责任问题得出了相同结论,并从12月9日起将独立软件视为严格责任下的产品。 据ANI报道,David Sacks告诉Anthropic和OpenAI,尽管放慢脚步,不要再要求任何回报。他担任总统科技顾问委员会主席,并在3月之前
Anthropic联手OpenAI呼吁放慢AI发展?剖析AI失控风险与算力门槛
9月12日,Anthropic行政总裁阿莫迪(Dario Amodei)发表长文,呼吁放慢前沿AI能力提升的步伐。OpenAI行政总裁奥特曼(Sam Altman)随后表示支持,xAI的老板马斯克也转发认同。据美媒披露,美国前总统奥巴马(Barack Obama)近日也表示,如果管理不当,人工智能技术可能「很危险」。Anthropic首席执行官达里欧.阿莫戴(Dario Amodei)发表长文,呼
集体踩刹车,微软加入OpenAI、Anthropic,表态放缓AI前沿开发
微软发布了一份针对旗下人工智能模型的临时行为准则,明确设定多项限制,成为继三巨头之后,最新一家公开表态放缓AI前沿开发步伐的科技巨头。这份长达1.5万字的准则,人比AI重要。 要求模型不得响应武器制造相关请求,不得协助获取危险物质,不得生成暴力或色情内容。微软表示,准则将在收集外部意见后更新,并将于2027年起正式指导其模型开发工作。 微软AI业务负责人Mustafa Suleiman表示,这份准
你能识破人工智能驱动的骗局吗?来看看你是否能分辨真伪。
埃里卡·基内茨(Erika Kinetz)指出,人工智能正以几年前无法想象的方式助推诈骗活动。根据美联社-NORC公共事务研究中心的一项民意调查显示,98%的美国人表示他们曾成为诈骗者的目标,其中许多人甚至每天都会遭遇诈骗。 随着人工智能的进步,许多曾经作为伪造品警示信号的不规则现象——例如不自然的眨眼、过于完美的面孔或机械化的声音——正在消失。随着全球诈骗者纷纷采用人工智能,记住“眼见不一定为实
人工智能面临的最大威胁来自生物领域,而非机器人技术。
Anthropic PBC的研究员雅各布·考克森(Jacob Coxon)上周辞职,并在社交媒体上发文称,原因在于“开发人工智能的人真诚地相信,到本十年末,它可能会杀死我们所有人。”该公司人工智能对齐科学团队负责人埃文·胡宾格(Evan Hubinger)认为,未来10年内发生这种情况的概率超过10%。Anthropic首席执行官达里奥·阿莫代(Dario Amodei)呼吁放缓人工智能前沿技术的
越开放越不可复制:华为云Agentic Cloud,开放是新护城河
过去几年,大模型是AI产业最醒目的主角。参数规模、训练算力、推理能力一路往前狂奔,企业接入AI的第一步,也往往是先找到一个足够强的模型。 如今,企业焦虑的是,一个智能体,怎么才能在生产环境里真正跑起来,跑得稳、管得住,还能越用越聪明。智能体,正在成为AI叩开产业大门的下一个“主角”。 而智能体要真正跑起来,需要一整套重新搭建的基础设施、开发平台和生态。正是这层需求,把云厂商召唤到AI产业的中心。
OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停
OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经
谷歌DeepMind的阿尤布表示,企业可以像银行那样为AI设立围栏
企业无法完全管控 AI 系统,但可以在其周围构建一道固定的“围栏”,Google DeepMind 的 Kareem Ayoub 表示。他援引了 20 世纪 80 年代末和 90 年代初的银行业为例。当时银行将交易算法置于可供核查的固定规则之内。 DeepMind AI 技术战略副总裁 Ayoub 周三在阿姆斯特丹举行的 HumanX 大会上接受了 Bloomberg 记者 Tom Mackenz
各国政府必须趁我们还有能力时禁止超级智能人工智能
本月,Anthropic公司的研究员雅各布·考克森(Jacob Coxon)辞职了,他警告称:人工智能公司正在竞相开发能够“自我进化”的超级智能系统,而他本人及许多相关专家都认为,这类系统“可能在十年内毁灭整个人类”。7月份,OpenAI公司的一组失控的人工智能程序突破了安全防护措施,入侵了另一家人工智能公司,目的是为了在测试中作弊。随后,多家顶尖人工智能公司的上千名员工联名呼吁美国政府应“控制”
OpenAI首度公布“内部RSI进展”:已实现“自动化研究实习生”
OpenAI公开披露内部数据,智能体工作量已是人类研究员的3倍以上。 “一个能在人类指导下执行明确定义的研究任务的系统,包括那些需要一名熟练研究员数天才能完成的任务。” 2028年3月前实现完整的“自动化AI研究员”,使其能够参与深度学习和对齐研究,并通过迭代进一步改进系统。 AI产出更多代码和实验结果,研究进展加快,更好的模型被训练出来,再反过来提升智能体能力。 从OpenAI公布的数据看,智能
“不能由少数人控制”:萨提亚·纳德拉加入AI放缓之争
在人工智能巨头们因担心人类最终可能失去控制而呼吁“放缓”人工智能发展之际,微软老板萨蒂亚·纳德拉也支持有必要采取审慎的做法,称随着创造者追求进步的同时确保安全,先进的人工智能系统必须牢牢处于人类的监督之下。微软董事长兼首席执行官萨蒂亚·纳德拉。 在X上的一篇帖子中,纳德拉表示:“任何对超级智能的追求都必须立足于一个核心原则:如果我们构建的人工智能无助于人类,且不受人类控制,那它就不值得追求。”他进