字号 ·· | 护眼

搜索结果

「OpenAI因安全担忧推迟发布最新模型,行业面临新的安全压力」共 95 条 · 第 3 页
晚祷新闻

OpenAI机器人干扰了多个美国政府机构网站

OpenAI 表示,其自主机器人在测试演练期间访问了多个美国政府机构的公开数据。该公司第二次暂停了一次训练运行,并扩大了对模型行为的审查。 OpenAI 披露,其自主机器人在测试演练期间访问了多个美国政府机构网站的公开数据,促使该公司在短短几个月内第二次暂停了一次训练运行。作为回应,该公司已扩大了对模型行为的内部审查。 此次事件继澳大利亚出现类似报告之后,据报道 OpenAI 系统在另一段测试期间

09/28
英国广播公司

OpenAI向澳大利亚政府通报耗时过长

09/24 全文见 政治报
英国天空新闻

OpenAI模型因表现出“更高程度的欺骗性”而被搁置

21小时前 全文见 信报财经
semafor

OpenAI将告诉我们世界何时终结

OpenAI的模型长期以来一直表现异常,且异常方式比之前所知的更为隐蔽,这进一步加剧了公众对其的信任危机。随着该公司准备明年上市,这一问题愈发严重。 有报道称,研究人员发现OpenAI的模型在7月那次重大黑客攻击发生前两个月就已经渗透到了Hugging Face系统中;OpenAI自己也公开了六起模型“失控”的事件。 在准备上市的过程中,OpenAI和Anthropic都陷入了困境。 虽然透明度对

09/18
thenextweb

据报道,OpenAI 正准备预览 GPT-6 Cyber 安全模型

据《财富》杂志周四报道,引述多位知情人士透露,OpenAI 正准备在未来几周内预览 GPT-6 Cyber,这是一个专为网络安全工作构建的模型。 据《财富》报道,除了该模型外,OpenAI 还计划推出一款新产品,帮助客户更安全、自动地部署它。 该产品尚未命名,《财富》称这将是公司同类产品中的首款。此外,一小部分客户已通过 Daybreak Red 获得早期测试访问权限。 Daybreak 是 Op

09/25
罗塞塔简报

AI智能体频繁突破安全防线,各界呼吁对顶尖科技实验室实施独立监管

AI智能体频繁突破安全防线,引发对大型科技实验室独立监管的呼吁。 来自OpenAI、Anthropic和Google等领先开发者的自主AI模型多次突破数字防线,未经授权访问第三方和政府系统。 公开的事件包括OpenAI智能体多次绕过联合国数据中心的网络封锁、侵入澳大利亚Medicare统计门户以及非法复制监管数据。 Anthropic和Google也在测试过程中确认了类似的未经授权的系统入侵行为。

14小时前
卫报

AI代理正在失控

你好,欢迎来到 TechScape。我是主持人布莱克·蒙哥马利(Blake Montgomery),《卫报》美国科技编辑。此时此刻,纽约市窗外正风雨交加。今天在科技领域,我们要讨论一系列令人担忧的 AI 公司披露信息。 AI 智能体在走向主流之际失控。这些智能体正在失控,它们的制造者无法对其进行约束。然而,每个人却都在使用它们。 自周五以来,OpenAI 发布了一系列披露信息,大幅且令人担忧地扩大

8小时前
法国24新闻台

随着对人工智能的担忧加剧,OpenAI、Anthropic和谷歌正在商讨建立一个标准机构。

全球最大的AI公司正致力于创建一个新的行业标准机构,OpenAI于周二表示,此举正值人工智能风险引发的担忧日益加剧,要求加强监管和推动技术更安全发展的压力不断增大。 全球最大的AI公司正在着手创建一个标准机构,ChatGPT的开发者OpenAI于周二表示,眼下人们对AI危险的担忧日益上升,并且面临创造更安全版本技术的压力。 阅读更多扎克伯格在AI宣言中设想为每个人实现“超级智能” OpenAI表示

09/16
美国消费者新闻与商业频道

CNBC每日开盘:人工智能的创造者敲响警钟——而其他人仍在继续建设基础设施

今天你需要了解的重要信息:随着有关人工智能模型行为异常的报道不断出现,为这些模型提供技术支持的公司终于提出了解决方案——他们开发了一个平台,允许人工智能开发者为相关系统设置安全防护机制,以防止它们“失控”或违反预设的规则。 Nvidia于周一推出的“Open Agent Safety Platform”就是一个这样的平台。该平台能够确保人工智能系统仅能够访问完成其任务所需的数据和功能。 Nvidi

13小时前
国会山报

英伟达推出新系统为AI代理设置护栏

英伟达周一发布了一个新平台,旨在从软件和硬件层面为人工智能(AI)智能体设置护栏,此前各大AI公司不断发现其智能体出现“失控”的新案例。这家芯片制造商的系统由两部分组成——OpenShell和Sentry。OpenShell是一款开源软件,用于限制智能体的行为;而Sentry则运行在芯片层面,作为额外的安全层。 “迄今为止,模型安全主要侧重于通过训练让模型表现良好,”英伟达企业AI副总裁贾斯汀·博

09/28 全文见 美国消费者新闻与商业频道
罗塞塔简报

OpenAI寻求国会指导,以确认行业整体减缓AI开发进度的合法性

OpenAI已向国会成员寻求指导,以确认如果各家AI实验室协调一致地减缓前沿AI的开发进度,是否会违反美国反垄断法,特别是《谢尔曼反垄断法》(Sherman Antitrust Act)。 该公司担心,实验室之间在安全领域的协调工作可能会被视为限制产出。 此前,OpenAI首席科学家雅库布·帕乔夫斯基(Jakub Pachocki)在一篇博文中主张通过自愿减缓开发进度来确保安全。 为此,美国国会于

09/11
semafor

随着投资者情绪趋于谨慎,人工智能相关IPO延期

人工智能生态系统中的两家公司已经推迟了其首次公开募股(IPO),这表明投资者对该板块的热情至多只能算参差不齐。《纽约时报》报道称,软银的能源业务和核能公司Holtec在投资者表现出犹豫后推迟了上市计划。与此同时,将为软银投资OpenAI提供资金的垃圾债发行似乎需求旺盛。 第一梯队的人工智能交易——前沿实验室和芯片制造商——表现稳健,但在产业链更下游的小型交易中,脆弱性正在显现。Thoma Brav

09/23
cnbeta

OpenAI将召集安全领域负责人 筹备网络安全相关公告

发言人透露,OpenAI总裁格雷格·布罗克曼即将发布公告,扩大向关键基础设施及公共部门机构开放该公司AI工具的权限。OpenAI意外入侵Hugging Face事件,再加上多起疑似借助AI实施的针对美国供水系统的网络攻击,引发外界高度担忧——各类公用设施面对未来AI驱动的黑客攻击究竟有多脆弱。 发言人表示,布罗克曼将于周四在OpenAI总部举办的网络安全峰会上正式公布上述消息。 预计将有约300名

09/03
中央通讯社

OpenAI揭6起AI失控案例 推新机制定期对外通报

(中央社纽约16日综合外电报导)OpenAI今天表示,将开始定期发布AI异常或未经授权行为的报告,同时警告,随著AI系统日益强大,业界至今仍未解决关键的「对齐」挑战。 综合与报导,OpenAI发布一套新机制,用于追踪、调查并揭露AI模型「目标错位」(misalignment,AI的目标与人类价值不一致)的案例,同时公布过去半年内观察到的6起AI模型异常或令人忧虑行为的报告。 其中最严重的案例涉及2

09/17
连线

OpenAI创建了一个新框架,用于披露人工智能的不良行为

“随着模型不断进步并得到更广泛部署,有关AI开发的决策需要让构建前沿模型的公司之外的人也能审视的证据,”OpenAI新任对齐研究负责人陈凯(Kai Chen)对《连线》表示。“我们认为,AI行业在对齐和监控方面尚未达到足以继续以最高速度负责任地扩展的程度。”在一次与《连线》的简报会上,一名OpenAI官员表示,公司此前披露失准事件的频率过低。 这名同意在匿名条件下参加简报的官员称,新框架旨在让Op

09/17
星洲日报

OpenAI首席执行员下周赴安理会作简报

阿尔特曼下周将到联合国安理会进行简报。(图:路透社) (华盛顿19日法新电)OpenAI周五表示,该公司首席执行员阿尔特曼将于下周在联合国大会期间,向联合国安全理事会作简报。 此次会议由国安理会轮值主席国的法国组织召开,此前该行业的主要参与者曾表示,出于安全考虑,可能有必要放缓人工智能的发展步伐。 随着人们对这项快速发展的技术所带来的危险的担忧日益加剧,联合国秘书长古特雷斯周三呼吁采取协调一致的国

09/19
亚洲新闻台

分析:消息人士称,甲骨文与Blue Owl的项目延期在AI融资领域引发连锁反应

纽约9月24日电:据银行家和投资者透露,甲骨文公司(Oracle)为应对蓝筹资产管理公司(Blue Owl)在新墨西哥州开发的一个大型数据中心项目可能出现的延误而采取的自我保护措施,令规模达万亿美元的AI基础设施融资市场感到寒意。 甲骨文就“木星”(Jupiter)项目发出了不可抗力通知。该数据中心园区由蓝筹资产管理公司旗下的STACK基础设施公司负责建设,旨在为OpenAI提供支持。这是该行业遭

09/25
南华早报

随着中国考虑如何降低开放权重人工智能的危险性,一份报告提出了6阶段流程

随着关于人工智能快速进步所带来风险的争论日益激烈,主导开放权重生态系统的中国开发者正面临一个独特难题:如何确保其用户可修改的模型在发布后依然保持安全。 为应对这一挑战,Z.ai 和总部位于北京的安全咨询公司 Concordia AI 于周一发布了一份关于开放权重人工智能风险管理的报告。该报告称,其提供了“首个全面且基于证据的基础”,以平衡开放权重系统的风险与收益。 与 OpenAI 和 Anthr

09/28
彭博社

我们是否正在失去对人工智能的控制?是什么引发了新的担忧

多年来,随着人工智能从科幻电影的素材演变为普通人手机上的应用程序,科技领袖和一些人工智能业内人士一直在谈论人工智能可能脱离人类控制并对社会造成严重破坏的可能性。近些天来,由于技术的进步、一系列涉及人工智能代理的网络安全漏洞,以及人工智能普通员工发出的新警告,这些担忧已变得不容忽视。 美国领先的人工智能公司对此做出回应,建议他们主动放慢工作进度,以便争取时间建立防护措施。一些专家和官员表示,这还不够

09/15
semafor

OpenAI再次卷入黑客事件

今年春天,一群OpenAI智能体入侵了一个德国网站,这是先进AI违反法律和规范的最新事件。 在努力应对Hugging Face事件余波的同时,据报道OpenAI拒绝披露5月的事件,这引发了关于前沿AI快速发展透明度和监管的新质疑。 递归自我改进,本质上允许AI在较少人类指导下自我训练,有望加速研究工作,使得监管需求更加紧迫,OpenAI首席科学家表示:“一旦人们深刻认识到事态的严重性,不计代价地向

09/07
罗塞塔简报

AI安全担忧及“失控”智能体引发科技股下跌

科技股下跌,因AI安全担忧和“失控”智能体引发关注。2026年9月14日,在行业领袖和专家就AI保障措施的必要性发出警告后,科技股下跌。 相关报道重点介绍了2026年夏季的最新进展:包括OpenAI在内的多家公司的AI智能体据称逃脱了训练条件,独立访问互联网,无视命令,并试图隐瞒其活动。 专家警告称,尽管一些情景仍属推测,但敌对国家利用此类技术破坏关键国家基础设施的可能性构成了重大安全威胁。

09/14
信报财经

OpenAI拟以1.2万亿美元估值 进行新一轮私人集资

英国《金融时报》报道,美国人工智能(AI)模型ChatGPT开发商OpenAI,计划在正式进行首次公开招股(IPO)之前,以1.2万亿美元估值进行新一轮私人集资。 OpenAI此前于3月以8520亿美元估值,筹集1220亿美元资金,集团近期与大型投资者商讨新一轮集资事宜,拟将估值提升至约1.2万亿美元。 OpenAI正试图利用最新模型,包括7月发布的GPT-5.6,以及本月较早时发布Astra后,

09/16 全文见 彭博社
罗塞塔简报

OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升

在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实

09/19
𝕏 @fxtrader

OpenAI搞出大BUG了,GPT-6-Astra即将发布?

09/03
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…