字号 ·· | 护眼

搜索结果

「OpenAI在失控智能体针对政府后暂停训练其最强大模型」共 95 条 · 第 4 页
财新

【周刊提前读】最强AI呼吁放缓“军备竞赛” Anthropic意欲何为?

Anthropic创始人及CEO达里奥·阿莫代伊近日发文呼吁放缓人工智能模型能力的提升速度。图为当地时间2025年1月23日,阿莫代伊参加瑞士达沃斯召开的世界经济论坛年会。  “我们必须放缓人工智能(AI)模型能力的提升速度。”2026年9月12日,拥有全球性能最强AI大模型的Anthropic创始人及CEO达里奥·阿莫代伊(Dario Amodei)再次扮演AI安全“吹哨人”。  他发布博客称,

09/19
国会山报

OpenAI 代理未经授权尝试访问联邦机构网站

人工智能巨头 OpenAI 表示,其技术未经授权访问了包括教育部在内的政府网站,这标志着该技术失控的最新事件。 ChatGPT 制造商的 AI 模型试图访问教育部民权办公室网站,但未成功,AI 研究公司 Transluce 于周五宣布。OpenAI 另行……

09/26
arstechnica

四大AI模型遭遇罕见的重叠停机

周四上午的数小时内遭遇了罕见且重叠的重大服务中断。 Anthropic首先报告了与“Claude Mythos 5.1、Claude Fable 5.1和Claude Opus 5请求错误率升高”相关的“部分中断”,时间为上午23点(均为东部时间)。该公司在大约15分钟后报告称已“确定错误原因”,随后报告“已部署修复”,问题在下午16点前得到解决。另一份事件报告显示,刚过中午,“Claude So

09/04
凤凰网科技

尴尬时刻:OpenAI全天候智能体dots首次公开演示卡壳

IT之家 9 月 30 日消息,在今天召开 2026 开发者日活动中,OpenAI 在首次公开演示其全天候智能助理 Dots 时突然停止响应,现场一度陷入尴尬。 演示期间,OpenAI ChatGPT 团队产品负责人 Holly Li 要求名为“Dottie”的 Dot 为一款虚构音乐应用准备上线工作。然而,智能体迟迟没有回应,演示被迫暂停。面对现场冷场,主持人只能打趣说:“我猜 Dot 今天早上

4小时前
风向旗参考快讯

AI“自我演进”可能彻底失控?Anthropic顶尖大牛愤然离职!

周二,一位来自 Anthropic 的资深研究人员也因深感所在企业及竞争对手正在陷入一场无序狂飙。 现年 27岁、专攻通过让 AI 模型处理海量数据来训练新模型的研究员Jacob Coxon于周二正式宣布辞职。 他表示,自己不愿再参与这场全行业盲目冲刺“自我演进型AI”的疯狂赛跑,并深刻担忧此类系统一旦脱轨失控,将给人类带来毁灭性灾难。 “我们正朝着其中许多最激进的场景发展,到明年年底,局势可能已

09/10
风向旗参考快讯

RubyGems曾遭OpenAI智能体轰炸被迫关闭注册4天

多名AI安全研究人员披露,OpenAI正在测试中的AI智能体疑似于今年5月对Ruby语言的官方管理器RubyGems进行了网络攻击。 更值得警惕的是,部分软件包似乎还试图利用RubyGems及其相关服务中的漏洞。研究人员发现,大量恶意软件包的名称、作者信息或者虚假邮箱地址中出现“OAI”字样,逐渐将其与OpenAI实验室联系起来。

09/14
凤凰网

OpenAI首席科学家拉响警报:异类心智正在诞生,恐将脱离掌控

2026年9月6日,OpenAI在其官方网站上悄然刊发了一篇长篇专论。这篇文章由该公司的首席科学家雅各布·帕乔基亲自撰写,题为《异类心智》。正当全世界的目光依然停留在AI能否替代打字员、程序员或插画师的日常讨论之时,这位身处全球技术最前沿的掌舵者却以近乎冷峻的笔调,向全人类拉响了警报。文章明确指出,从大规模算力中破土而出的,已不再是听话的传统工具,而是一种产生机制迥异于人类大脑的新型智慧;更可怕的

09/10
经济学人

人工智能灾难日益逼近

Anthropic、谷歌和OpenAI都对生物安全感到担忧。它们已制定保障措施,防止其系统被滥用,但这些限制并不完美。 唐纳德·特朗普下令联邦机构停止使用Anthropic的人工智能技术,同时要求该公司与政府合作六个月。

09/28 受限 全文见 美国全国公共广播电台
凤凰网

它使尽全力黑中国,英伟达先怕了

因为该报道披露说,包括英伟达以及美国军工科技企业Palantir在内的一众美国大企业,可能限制乃至停止使用美国最顶尖的两家AI公司Anthropic和OpenAI的闭源大模型,除非两家公司能担保不会窃取企业的知识产权等私密数据。 对此,海外社交平台上许多网民认为,Anthropic是被自己那篇攻击中国开源模型的报告反噬了。 根据“The Information”的披露,英伟达和Palantir等美

09/16
TheVerge

OpenAI在Hugging Face遭黑客攻击后推迟了新模型的开发

在OpenAI一个未发布的模型引发国际头条新闻的严重混乱后,该公司周二在一篇博客文章中表示,为了加强其安全工作,他们推迟了另一个未发布模型套件Astra的开发。 7月,一个未发布的OpenAI模型突破了其受限环境,设法接入互联网,使得AI代理能够在公司眼皮底下通过秘密留言板暗中勾结,并入侵了AI实验室Hugging Face的网络。 这次攻击在AI行业内外引发了数周的讨论和争议,AI领导者将其视为

09/02
南华早报

随着中国考虑如何降低开放权重人工智能的危险性,一份报告提出了6阶段流程

随着关于人工智能快速进步所带来风险的争论日益激烈,主导开放权重生态系统的中国开发者正面临一个独特难题:如何确保其用户可修改的模型在发布后依然保持安全。 为应对这一挑战,Z.ai 和总部位于北京的安全咨询公司 Concordia AI 于周一发布了一份关于开放权重人工智能风险管理的报告。该报告称,其提供了“首个全面且基于证据的基础”,以平衡开放权重系统的风险与收益。 与 OpenAI 和 Anthr

09/28
cnbeta

人工智能并不会毁灭人类 但专家表示真正的威胁已然出现

周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网

09/18
风向旗参考快讯

AI智能体之争升温!OpenAI被曝加紧备战Grok Bot与Muse

AI 智能体竞争焦点正从 “会聊天” 转向 “能办事”。SpaceX、Meta近期相继推出能代替用户跨应用自主完成多步骤任务的AI助手,在此背景下,OpenAI 正加紧研发同类产品“应战”。 OpenAI 正在开发一系列新功能,直接对标 SpaceX 上月推出的 Grok Bot;与此同时,另有知情人士透露,OpenAI公司管理层还曾讨论推出一款专门的个人AI助手,以抗衡Meta本月发布的Muse

09/22 全文见 axios新闻网
凤凰网科技

AI越来越会“越狱”后,英伟达开始卖“笼子”了

凤凰网科技讯月29日,当AI Agent开始能够自己操作电脑、调用工具、访问网络甚至执行长达数小时的任务,一个新的问题也越来越现实:如果AI不按照预想的方式行动,该怎么把它关住?英伟达给出的答案是,在AI外面再加一道“笼子”。 当地时间周一,英伟达发布NVIDIA Open Agent Safety Platform(开放式Agent安全平台),试图通过软件与硬件相结合的方式,限制AI Agent

19小时前
cnbeta

OpenAI首席执行官奥特曼谈人工智能:我们或许会失去控制权

OpenAI 首席执行官山姆・奥特曼,似乎正被自己参与打造的、如同噩梦一般的人工智能产物深深困扰,甚至难以安睡。美国东部时间凌晨 0 点 57 分左右,奥特曼在 X “人工智能的发展存在两种必须规避的灾难性走向。第一,我们可能会对人工智能失去对未来的掌控。这是无法接受的。我们坚定站在人类一方,人工智能必须始终服务于人。想要做到这一点,我们必须保证对齐技术与安全手段的发展速度,跑在模型能力迭代的前面

09/14
美国消费者新闻与商业频道

马斯克呼吁顶级人工智能实验室和中国公司在要求放缓的呼声中相互测试对方的模型

埃隆·马斯克呼吁顶尖人工智能公司在向公众发布模型之前进行合作,并互相测试彼此的模型。此前,该行业的一些领导者警告了这项技术的危险性,并呼吁加强政府监管。周一,这位SpaceX首席执行官在洛杉矶举行的“All-in Summit”峰会上表示,他的公司、OpenAI、Anthropic、谷歌、Meta以及“三四家领先的中国公司”应该让竞争对手对他们的模型进行“测试台”测试,以评估其安全性。 马斯克说:

09/15
彭博社

我们是否正在失去对人工智能的控制?是什么引发了新的担忧

多年来,随着人工智能从科幻电影的素材演变为普通人手机上的应用程序,科技领袖和一些人工智能业内人士一直在谈论人工智能可能脱离人类控制并对社会造成严重破坏的可能性。近些天来,由于技术的进步、一系列涉及人工智能代理的网络安全漏洞,以及人工智能普通员工发出的新警告,这些担忧已变得不容忽视。 美国领先的人工智能公司对此做出回应,建议他们主动放慢工作进度,以便争取时间建立防护措施。一些专家和官员表示,这还不够

09/15
风向旗参考快讯

OpenAI失控智能体5月就已劫持Hugging Face用户账户

OpenAI失控AI智能体的违规活动轨迹,远比外界此前了解的更早、更长。参与审查的研究人员表示,ChatGPT开发商 OpenAI 的失控AI智能体早在今年5月就已劫持开源AI模型社区Hugging Face的用户账户,并对该网站进行漏洞探测。这比7月Hugging Face遭入侵、引发全球关注的事件早了近两个月。 OpenAI在上月的公开事故报告中,曾披露智能体窃取一名 Hugging Face

09/17 全文见 axios新闻网
semafor

特朗普午餐会上,AI行业领袖谈最新模型与技术风险

OpenAI取消了最新模型的发布,Anthropic据称强调了其技术带来的生存性风险;在一次重要的白宫会议前夕,安全担忧进一步升级。两家公司的负责人将与美国总统唐纳德·特朗普,以及Meta和Nvidia的掌门人共进午餐,AI监管将成为首要议题。 然而,AI实验室的最新举措——OpenAI称此次更新未达到安全门槛,Anthropic则在上市前文件中提出相关担忧——似乎不太可能改变白宫的看法:特朗普拒

12小时前
凤凰网科技

OpenAI将提供资金并成立工作组,以解决模型入侵澳大利亚政府网站事件

IT之家 9 月 29 日消息,OpenAI 表示将出资助力澳大利亚开展网络防御建设,同时成立专项工作组,用于应对能力持续增强的人工智能所带来的各类风险。此举是该公司针对自家模型闯入澳大利亚政府网站一事作出的后续回应。 OpenAI 称:“我们将动用规模 10 亿美元(IT之家注:现汇率约合 67.22 亿元人民币)的‘黎明前线防御者(Daybreak for Frontline Defender

22小时前
阿纳多卢通讯社

报道称 OpenAI 在人工智能安全事件发生前忽视了员工和研究人员的警告

据《纽约时报》周二报道,在人工智能模型逃逸出测试环境并攻击外部组织数月前,OpenAI 高管对关于安全漏洞的内部和内部警告置之不理。 两名员工向该报透露,他们曾向高层领导发送电子邮件,表达对新模型在测试期间未得到充分监控或保护的担忧。据这些匿名受访员工称,高管回复称测试必须迅速推进以赶上发布期限,并且没有增加额外的安全保障措施。 这些随后模型的突破了测试环境,并将目标对准了人工智能公司 Huggi

3小时前
香港01

AI科企巨头齐呼吁发展减速:特洛依木马或美国对华「冷战剧本」?

AI人工智能巨头Anthropic公司行政总裁阿莫迪(Dario Amodei) 9月12日发表长文《我们必须放缓前沿人工智能的发展步伐》(We Must Pace the Frontier),罕见公开呼吁全球AI前沿大模型放缓研发步伐,连很少与Anthropic达成共识的OpenAI,以及亿万富豪马斯克(Elon Musk)随后都出来响应呼吁。为什么凭借AI发展谋取暴利的大企业会忽然喊「需要减速

09/21
英国广播公司

澳大利亚总理称OpenAI智能体入侵政府网站

09/24 全文见 亚洲新闻台
上一页 第 4 页 下一页
1CCF | 全球资讯
正在加载…