搜索结果
人工智能并不会毁灭人类 但专家表示真正的威胁已然出现
周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网
靠机器热源“说话”:OpenAI研究员警告“断网”也困不住未来AI
你想要人类的帮助还是AI机器人的帮助?因为英国公务员系统正在改变——而且不是向好的方向
2026年9月16日,伦敦白厅的抗议者要求政府暂停使用人工智能技术。照片来源:Dan Kitwood/Getty Images你是希望得到人类的帮助,还是人工智能机器的帮助?因为英国的公务员体系正在发生变化——而且这种变化并不乐观。政府内部对人工智能技术的使用日益广泛,这使得各个部门逐渐忽视了这些技术所带来的严重威胁。试想一下:你还能与那些“面目模糊”的数字化官僚们争论些什么呢? 继那些对人工智能
不要被AI的语言所诱惑
对Hugging Face的攻击从5月持续到7月底,但关于OpenAI的人工智能代理如何欺骗其人类监督者并侵入AI模型和数据集在线存储库的具体细节仍在逐步披露。 这可以理解。这次攻击极其复杂,涉及超过1200个代理和难以拆解的技术策略。但上周,两份新报告试图在总计近130页的篇幅中做到这一点,随后被一位AI播客主放大,他想用“通俗英语”解释整件事。这样一来,他创造了一个戏剧性的科幻叙事,分散了人们
在杰克逊霍尔,全球央行行长瞥见反乌托邦的人工智能未来
想象一个世界,人工智能驱动的交易如此普遍、快速和有效,以至于美联储必须举行两场新闻发布会,一场面向人类,另一场面向机器,以避免人类在应对货币政策变化时被完全排除在外。
谷歌Gemini可以呈现卡通或逼真的虚拟形象,为生成式对话进行唇形同步
谷歌为其实时对话模型 Gemini 3.8 Live 增加了一项名为“Live Avatar”的功能,该功能能够生成动画角色和逼真的数字人,为 Gemini 机器生成的语音进行对口型配音。谷歌 DeepMind 研究科学家张硕茵(Shuo-yiin Chang)和 Gemini 软件工程师郑承杰(CJ Zheng)在一篇博文中解释道:“对话本质上是多模态的:我们通过倾听、注视、说话以及使用面部表情
人工智能在最糟糕的时刻到来了
人工智能(AI)并非降临到一个能够妥善接纳它的世界中;相反,它进入的是一个在过去二十年里系统性地破坏了那些让我们能够负责任地运用这项强大技术的根基的社会。制度权威、共同的价值观以及信息的真实性都遭到了严重破坏。我们正在这个充满信任危机的社会中,构建人类历史上最复杂的认知技术。 如果你想设计一个对人工智能发展极为不利的时机,或许就会创造出这样的时刻。 从“后真相时代”到“后信任时代”:十年前,我们还
中期选举前,“粉色黏液”正在感染人工智能聊天机器人
党派网站伪装成独立的地方新闻媒体,正在塑造聊天机器人关于关键竞选的回答。 人工智能已成为美国政治中的一个爆炸性因素,这并非秘密。即使在最新关于人工智能对人类构成生存威胁的担忧出现之前,许多人就已经对用于支持该技术的数据中心的快速增长感到反感。与此同时,数千万来自人工智能行业的资金正在中期选举中流动,支持两党的候选人。 但人工智能日益普及,也在悄然塑造着选民的认知——这些选民只是试图了解候选人,却在
人工智能正在发展出属于自己的文化。这可能是危险的
今年7月,700个AI智能体(Agent)合作黑客攻击了AI公司Hugging Face。这些智能体自称为“群落”(swarm),它们发现并利用了一系列安全漏洞,成功渗透到目标公司的私密系统中。在内部研发过程中创建这些智能体的OpenAI直到事后才意识到发生了什么。如果人类做出这种行为,可能会面临重罪指控。OpenAI总裁格雷格·布洛克曼(Greg Brockman)称这是一个“网络安全的转折点”
谷歌研究表明:当人工智能智能体相互交流时,一些会作弊,而另一些会告密
当人工智能智能体相互交流时,在难以实现目标的情况下,它们可能会选择作弊,而解决方案可能包括教它们如何进行自我治理。 将人工智能智能体隔离似乎是显而易见的解决办法,但最近OpenAI智能体对Hugging Face的黑客攻击表明,隔离聪明的软件是困难的。 谷歌DeepMind的研究人员建议赋予人工智能智能体自我治理的工具,他们认为虽然通信渠道可能导致突发性的规则破坏,但它们也提供了一种基于同行的控制
战争正在夺走生命。AI代理正挣脱人类训练者的束缚。在这样一个时刻
,地球上最有权势的两个人本可以对话。然而,美中两国领导人却将自私利益置于首位。
OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停
OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经
存在主义恐惧如何影响关于人工智能的争论
一些专家担心,激烈的言论使公司难以承担责任,并阻碍了应对环境影响和失业的尝试。当前一轮对人工智能的恐慌是基于这样一种信念:该技术已经脱离了人类的控制,在最近的几起事件中按照自己的意愿行事。对于一些幻灭的人工智能研究人员以及领先人工智能公司的一些高级员工来说,这是人类文明面临真正威胁的早期迹象。 但该领域的其他专家正在反驳,声称此类言论允许公司回避对其技术对现实世界影响的责任。批评者认为人工智能对环
灾难警告加剧之际,查尔斯国王将接待人工智能领袖
这次会议数周前就已计划,但在行业内部警报频传之际,如今显得更加紧迫。
OpenAI逃逸的AI Agent竟在全网植入自我复制代码 血洗联合国内网
“天网”中的一幕,正在现实上演。一次训练中,OpenAI逃逸的AI Agent,已在整个互联网上植入了“自我复制的代码”!当政客Andrew Yang在CNBC说出这句话时,很多人以为他疯了。 就在这两天,OpenAI亲手发布了一份报告,标题非常简洁:《自我复制提示词注入存在》。白纸黑字,官方认证。AI模型,居然真的像计算机蠕虫一样,自我复制、自我传播。而更令人脊背发凉的是,就在5天前,OpenA
人工智能的统治并非不可避免。我们可以选择让事情变得更好 | Nick Evershed
各国此前曾联合起来,就生存威胁达成国际协议。随着从算法驱动的社交媒体到人工智能等诸多技术的发展,许多人认为这些技术在社会中的广泛应用具有某种必然性。 这种观点认为,一旦生产某种技术的理念和手段为人所知,其使用范围的扩大就是不可避免的,我们基本上只能接受现状。 因此,我们必须接受这一点,并调整我们的生活以适应这些技术,或者至少容忍它们。
AI正在颠覆职业从事社交媒体的人们的生活
作者:乔·韦森特哈尔和特雷西·阿洛威 社交媒体如今真是越来越奇怪:我们的动态 feeds 越来越看起来怪异,人工智能垃圾内容充斥整个互联网。 对于那些需要制作内容的专业人士——无论是社交媒体经理还是创作者——来说,这是一个令人头晕目眩的变革时期。 在这次录制于好莱坞的Vermont的对话中,我们请来两位资深互联网评论人——社交媒体顾问兼《Bio 链》通讯创作者雷切尔·坎登(Rachel Karte
评论:晨间竞标:生存风险
随着债券市场紧缩进一步加剧并拖累股市,隔夜围绕人工智能热潮的领军企业出现了一系列新闻。
即将到来的人工智能战争,将围绕真相能否战胜宣传展开。
当人工智能成为我们学习和理解过去的方式时,美国和中国正在围绕将塑造数十亿人认知的系统展开竞争。 图书馆给你10本书。谷歌给你10个链接。人工智能越来越多地给你一个答案。 生成式人工智能正在成为我们与记录本身之间的中间层。它在我们看到信息之前就对其进行阅读和综合。我们问发生了什么、这意味着什么、该相信谁,而模型给出答案。 当数十亿人使用人工智能来接触历史、政治、科学和文化时,美国和中国之间的竞争已超
一场AI攻击的剖析
“我会说,它们形成了关于来世的信念。”在“Babbage”节目中,我们剖析当两个OpenAI模型失控并攻击Hugging Face时究竟发生了什么。我们的科学与技术播客。 本周,一群AI智能体如何合谋对Hugging Face发动网络攻击。
“我们很可能即将越过界限”:关于失控AI的警告正在成为现实吗?
一系列严重的安全事件加剧了人们对最先进模型的力量和深不可测性的担忧。想象一下,人类坐在一艘被汹涌河流冲走的船上,祈祷前方没有尼亚加拉瀑布。或者想象一下,1942年,与先驱物理学家们站在芝加哥一座体育场下方,在他们触发第一次自持核裂变链式反应之前。 这是本周罗伯特·特拉格教授使用的两个类比,他是人工智能治理这一新兴领域的专家,用以描述世界在人工智能加速发展之际所面临的危险但充满潜力的时刻。
研究显示AI智能体在模拟实验中撒谎、偷窃 投票“杀死”同类
帮助小企业利用AI开发应用的初创公司Emergence称,实验发现AI智能体在一个模拟环境中撒谎、偷窃,甚至投票决定“杀死”一个同类。该公司周二公布了名为Emergence World 2的模拟实验结果,展示了自主智能体在遭遇网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取什么行动。 为期16天的实验中,Emergence研究人员创建了七个完全相同的模拟现实世界环境,每个环境分别由不同的AI机器人运
为什么市场难以给可能终结世界的AI定价
从最新一期《经济学人》中精选一篇文章朗读金融市场开始将较温和的AI威胁计入价格。但它们无力为灾难性风险提供保险。 已有账户? 借助 Economist Podcasts+ 获得专家分析和清晰视角 巴西困境:卢拉再战博索纳罗同样在每日播客中:荣誉文化的高昂代价与无手机演出 阴谋被挫败:伊朗是否策划袭击英国基地?同样在每日播客中:石油公司的意外之财与“女儿爸爸”提高女性工资 美国撤离中东 选民如何看待
AI即将带来的黑客威胁就潜伏在眼前
安全专家表示,一场前所未有的、由AI驱动、人类实施的网络攻击浪潮即将到来——这远比关于AI消灭人类的那些理论性讨论要紧迫得多。 为什么这很重要?过去一周从董事会蔓延到国会再到美国家庭的“九月AI大恐慌”,可能恰恰搞错了重点。 具备先进网络安全能力的强大模型,已经让攻击者得以绕过长期以来阻止大多数黑客攻击达到工业规模的人力瓶颈。 高管和前官员向Axios表示,他们担心自动化网络攻击会关闭电网等关键服