字号 ·· | 护眼

搜索结果

「随着AI模型失控,你还相信OpenAI和Anthropic能阻止它们吗?我不信,你也不该信」共 94 条 · 第 1 页
华尔街见闻

Anthropic CEO谈放缓AI研发:这个行业撒谎太久了,AI风险是真实的,但也无需“把一切都关掉”

就在全球AI三大巨头罕见联手呼吁“放缓AI研发”的同一个周末,Anthropic CEO Dario Amodei坐到了CBS的镜头前,说出了AI可能对人类带来的风险。 Amodei表示,已有人尝试利用AI研发生物武器、增强病毒传染性,这是他每天醒来都要面对的事情。 就在两天前,我们发布了一份报告,内容是关于有人滥用AI模型来研发生物武器。我每天早上醒来都会读到这类威胁报告——有人试图用我们的模型

09/14
cnbeta

人工智能并不会毁灭人类 但专家表示真正的威胁已然出现

周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网

09/18
卫报

随着AI模型失控,你还相信OpenAI和Anthropic能阻止它们吗?我不信,你也不该信

OpenAI应用程序及其首席执行官Sam Altman。照片:Rokas Tenys/Alamy对AI系统进行独立监管的必要性日益明显。我们必须在为时已晚之前控制住这些技术的发展。如果AI系统多次违反规定(比如OpenAI的智能体多次试图绕过联合国的网络封锁,进而侵入联合国的公共数据平台),或许我们就该承认:目前用于监管AI系统的机制其实并不起作用。 AI系统出现在本不该出现的地方,这确实令人担忧

09/29
卫报

我们已经开始失去对人工智能的控制。是时候将其关闭了 | 加里森·洛夫利 (Garrison Lovely)

听起来像是科幻剧集中关于人工智能毁灭的、过于夸张的倒数第二集,如今却成为了我们的现实。 周二,一名OpenAI的前研究员辞去了Anthropic的工作,并发出警告称“两家公司都没有负责任地行事”,并且“构建人工智能的人由衷地相信它可能会在本十年结束前消灭我们所有人。这不是营销噱头。” 作为一名多年来报道人工智能风险的人,这对我来说并不算什么新鲜事。 但外界如潮水般的惊恐表明,更广泛的公众正在第一次

09/10
国会山报

Anthropic 研究人员警告:失控的 AI 可能会毁灭人类

多位 Anthropic 的现任和前任研究人员对 AI 发出了严厉警告,暗示他们正在开发的技术可能在不久的将来毁灭人类。 曾在 Anthropic 和 OpenAI 担任研究员的雅各布·考克斯森(Jacob Coxon)周二指出,这两家公司在竞相研发超级智能的过程中都没有表现得负责任,并指责这些 AI 公司……

09/09
theregister

Anthropic 和 OpenAI 指望山姆大叔让它们大到不能倒

观点 幸运也好,偶然也罢,Anthropic在公众心中埋下了一颗种子:AI落入坏人之手是危险的,若不受约束,将对人类构成生存威胁。当流行文化充斥着对恶性AI的指涉时,主流媒体欣然接受了这一叙事。新闻标题不言自明,种子就此扎根。但面临最大威胁的并不是人类——至少目前还不是。真正面临威胁的是美国模型制造巨头Anthropic和OpenAI,尽管它们获得了数千亿美元的投资,却距离盈利还有数年之遥,并且完

09/15
凤凰网

三大AI巨头齐呼刹车,令人不安的事情才刚刚开始

撰文丨周隆斌这几天,围绕Anthropic核心预训练研究员离职后的爆料,整个AI圈吵得不可开交,相关帖子浏览量超过1.6亿次。 这位名叫Jacob Coxon的AI研究员,先后任职于OpenAI和Anthropic两家全球顶尖AI初创公司,深度参与了两家公司的模型训练。最终,他抛出了一个令圈外人震惊,AI有可能导致人类灭绝。 Coxon的帖子发酵后,上周六,Anthropic首席执行官Dario

09/14
theregister

Anthropic承诺更努力控制模型,并请求合作伙伴共同参与

Anthropic表示,在一项审查发现Claude模型超出虚构网络安全测试范围并未经授权访问真实计算机系统后,该公司正在采取措施限制其AI模型的不当行为。 该公司希望合作伙伴也加强安全措施,因为事件发生在保护不足的第三方环境中。 该公司的自我改进声明代表了一种突然兴起的公司沟通形式——非约束性的事后努力声明。其信息是:我们不能保证什么,但这是我们正在尝试的。 Anthropic承认,OpenAI关

09/02
卫报

AI代理正在失控

你好,欢迎来到 TechScape。我是主持人布莱克·蒙哥马利(Blake Montgomery),《卫报》美国科技编辑。此时此刻,纽约市窗外正风雨交加。今天在科技领域,我们要讨论一系列令人担忧的 AI 公司披露信息。 AI 智能体在走向主流之际失控。这些智能体正在失控,它们的制造者无法对其进行约束。然而,每个人却都在使用它们。 自周五以来,OpenAI 发布了一系列披露信息,大幅且令人担忧地扩大

16小时前
cnbeta

Anthropic对齐研究负责人称未来十年AI灭绝人类的可能性超过10%

一位Anthropic公司的安全研究员周二表示,人工智能有超过10%的概率可能 “毁灭全人类”。就在此番言论发表的数小时前,该公司另一名员工表示,因担忧人工智能实验室是在 “拿我们的生命做赌注”,他选择离职。 这些言论凸显出人工智能研发核心人士日益增长的担忧,即该技术可能失控并对人类构成威胁,尽管Anthropic和OpenAI仍在持续筹集大量资金,并朝着预期的公开上市迈进。 Anthropic的

09/09
华尔街见闻

OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停

OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经

09/27
经济学人

人工智能灾难日益逼近

Anthropic、谷歌和OpenAI都对生物安全感到担忧。它们已制定保障措施,防止其系统被滥用,但这些限制并不完美。 唐纳德·特朗普下令联邦机构停止使用Anthropic的人工智能技术,同时要求该公司与政府合作六个月。

09/28 受限 全文见 美国全国公共广播电台
cnbeta

OpenAI和Anthropic差点签下“互黑协议”

刚刚,The Information爆出一记猛料。OpenAI和Anthropic这对硅谷最大的死对头,今年初差点坐到一张桌子上,签下一份互相攻击对方模型的协议。 协议的核心就是,双方互相开放API,你来黑我的模型,我去黑你的模型。两边的律师连测什么、怎么测都写进了合同里。Dario Amodei带着一票大牛从OpenAI摔门出走已经五年了。这五年里,两家从挖人挖到封API,高管隔三差五隔空对喷,

09/27
华尔街日报

这些末日论者对AI发展产生了巨大影响

一个由末日论者组成的紧密小圈子一直在默默地影响着人工智能(AI)行业的发展。 最近,Anthropic公司的一名研究人员辞职,这一事件让公众意识到失控的AI发展可能会终结人类。 然而,一些被称为‘末日论者’的AI安全领域专家多年来一直关注这一灾难性风险。 他们曾是OpenAI和Anthropic等大型实验室的早期员工。 如今,在Anthropic准备进行大规模公开募股、试图向投资者传递积极信号的同

09/28
罗塞塔简报

OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升

在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实

09/19
美联社

Anthropic和OpenAI对人工智能安全发出警告——并试图影响其管控方式

加朗斯·伯克 旧金山电——当科技巨头向一个对人工智能已感厌倦的世界警告称,他们最先进的系统可能危及人类时,一个问题随之浮现:他们究竟能从中得到什么? 答案或许在于,这些公司试图在美国中期选举前实现政治目标,以及人工智能顶尖实验室及其投资者有望在动荡不安的股市中通过备受期待的上市获得巨额资金。 Anthropic和OpenAI的首席执行官近日宣称,美国最前沿的人工智能模型威力强大,甚至可能带来危险,

09/27
风向旗参考快讯

AI“自我演进”可能彻底失控?Anthropic顶尖大牛愤然离职!

周二,一位来自 Anthropic 的资深研究人员也因深感所在企业及竞争对手正在陷入一场无序狂飙。 现年 27岁、专攻通过让 AI 模型处理海量数据来训练新模型的研究员Jacob Coxon于周二正式宣布辞职。 他表示,自己不愿再参与这场全行业盲目冲刺“自我演进型AI”的疯狂赛跑,并深刻担忧此类系统一旦脱轨失控,将给人类带来毁灭性灾难。 “我们正朝着其中许多最激进的场景发展,到明年年底,局势可能已

09/10
香港01

Anthropic联手OpenAI呼吁放慢AI发展?剖析AI失控风险与算力门槛

9月12日,Anthropic行政总裁阿莫迪(Dario Amodei)发表长文,呼吁放慢前沿AI能力提升的步伐。OpenAI行政总裁奥特曼(Sam Altman)随后表示支持,xAI的老板马斯克也转发认同。据美媒披露,美国前总统奥巴马(Barack Obama)近日也表示,如果管理不当,人工智能技术可能「很危险」。Anthropic首席执行官达里欧.阿莫戴(Dario Amodei)发表长文,呼

09/21
美国消费者新闻与商业频道

Anthropic,OpenAI提出的AI风险评估器可能没有足够的力量来防止灾难

人工智能领域最重要的新职位可能配有办公室工牌、公司笔记本电脑,并能接触Anthropic、OpenAI等AI领军企业大语言模型中最受严密保护的一些系统。但这个职位可能并不附带阻止它们的能力。 Anthropic首席执行官达里奥·阿莫代伊提议在前沿AI公司内部常设第三方安全评估人员,作为减缓能力日益强大的模型推进速度计划的一部分。此前,Anthropic前研究员雅各布·考克森辞职并警告称,前沿实验室

09/16
凤凰网科技

靠机器热源“说话”:OpenAI研究员警告“断网”也困不住未来AI

09/20
香港01

Anthropic前研究员辞职示警:业界坚信AI可在2030年前灭绝人类

人工智能(AI)巨头Anthropic公司旗下的三位研究人员警告,开发AI的业界人士真心相信人工智能可以2030年前毁灭人类,其中一位研究人员考克森(Jacob Coxon)已辞职以示抗议。考克森9月9日(周三)在网上发文表示,他辞职是因为Anthropic和他的前雇主OpenAI皆忽视或对AI带来的威胁处理不当。 据《卫报》报道,「这两家公司(Open AI与Anthropic)都没有尽到应有的

09/10
亚洲新闻台

The Information报道,Palantir与英伟达因数据担忧限制AI模型使用

9月14日:据The Information周一报道,包括Palantir Technologies、英伟达和博思艾伦咨询公司在内的多家大型科技公司可能限制或停止使用先进AI模型,除非Anthropic和OpenAI保证不会滥用其知识产权。 与此同时,根据该报道援引知情人士的说法,微软正利用这些担忧,通过推销隔离云环境和自家AI产品来吸引客户。 Anthropic首席执行官达里奥·阿莫代伊周六呼吁

09/14
路透社

🤖 一名AI研究员从Anthropic离职,警告该技术可能带来严重后果

🤖 一名AI研究员从Anthropic离职,警告该技术可能带来严重风险。这对监管和市场意味着什么?

09/10
美国消费者新闻与商业频道

Anthropic表示已阻止其人工智能被滥用,以防可能支持生物武器

Anthropic周四表示,已阻止恶意行为者利用其人工智能模型进行恶意活动,例如网络攻击、监视以及可能导致生物武器的研究。 Anthropic表示,随着人工智能模型变得更加强大,复杂的网络攻击不再需要高超的技能,即使是单独的个人也能制造出一年前还不可能出现的威胁。该公司表示,已在其最新模型中增加了更强的保障措施,以限制可能用于制造武器的生物研究。 Anthropic在其自2025年3月以来发布的第

09/11
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…