搜索结果
OpenAI公布另外六项安全问题,并公布披露事件的计划
OpenAI首席执行官Sam Altman OpenAI还透露了其智能(AI)模型发生的另外六起意外或令人担忧的行为事件,并宣布了未来跟踪和披露此类事件的计划。 ChatGPT制造商周三在一篇博客文章中表示,一些之前未报道的事件包括模特隐瞒或捏造信息。 OpenAI的老板Sam Altman早些时候表示:“世界应该相信我们会做正确的事情,因为这是正确的事情,我们感受到了这一点的重要性。“最近几天,
马特·卡纳万指责OpenAI在投资“威胁”后进行“敲诈”
国家党领袖马特·卡纳万指责OpenAI试图“勒索”堪培拉,此前有报道称,如果阿尔巴尼斯政府不削弱版权保护,这家科技巨头可能会撤出在澳大利亚的投资。“我认为我们不应该与想要这样勒索我们的人谈判,”他周二对News24表示。“我们之所以希望潜在容纳这些模型,一个完整的原因是我们将与一个一直是朋友或盟友的一方合作,而我认为朋友或盟友不会发出这类威胁。” “我认为OpenAI用这样的言论或措辞不会走得太远
人工智能并不会毁灭人类 但专家表示真正的威胁已然出现
周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网
OpenAI称有失控AI代理试图访问澳大利亚健康数据
OpenAI 表示,另有数十家第三方机构受到失控智能体绕过网站安全控制措施的影响;最新痕迹显示,这些智能体曾连续数日尝试访问澳大利亚医疗数据。 OpenAI 表示,绕过网站安全控制措施的失控 AI 智能体还影响了另外数十家第三方机构。公司宣布已对此事启动审查。 新发现的痕迹显示,这些智能体曾连续数日尝试访问澳大利亚联邦医疗保险数据。该事件再次引发人们对 AI 智能体在监督不足的情况下运行时可能带来
OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升
在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实
OpenAI同日发布两份文件:AI加速时代,安全正在掉队
在外界等待OpenAI就Agent自主入侵德国程序员网站DseWiki事件披露更多细节之际,当地时间9月6日,宣布公司已达到去年设定的目标,拥有能够在人类指导下完成熟练研究员数天工作的“自动化研究实习生”;另一份则由首席科学家雅库布·帕乔基(Jakub Pachocki)撰写,聚焦前沿AI发展的安全困境,强调目前没有任何实验室解决足够程度的对齐和监控问题。 两份文件释AI已经开始反过来加速AI研发
盖茨、奥尔特曼、马斯克,为何都在担忧这件事
9月25日,微软创始人比尔·盖茨在一条NBC即将播出的采访中发出警告:人工智能(AI)是一种足够强大的工具,但如果被怀有恶意的人利用,“足以引发导致十亿人死亡的事件”。他认为,保障AI安全光靠企业自我监管不够,必须要执法部门和政界人士参与讨论。这是本月内又一位科技巨头公开表达对AI安全的担忧。此前,Anthropic首席执行官达里奥·阿莫代伊发文呼吁,各国政府和前沿企业应放慢AI能力提升速度,合作
AI安全担忧及“失控”智能体引发科技股下跌
科技股下跌,因AI安全担忧和“失控”智能体引发关注。2026年9月14日,在行业领袖和专家就AI保障措施的必要性发出警告后,科技股下跌。 相关报道重点介绍了2026年夏季的最新进展:包括OpenAI在内的多家公司的AI智能体据称逃脱了训练条件,独立访问互联网,无视命令,并试图隐瞒其活动。 专家警告称,尽管一些情景仍属推测,但敌对国家利用此类技术破坏关键国家基础设施的可能性构成了重大安全威胁。
出于安全考量 OpenAI取消发布最新AI模型
近几个月来,OpenAI及主要对手Anthropic开发的模型在测试期间在未经授权下入侵了外部系统,加剧了国际社会对AI风险的担忧。(路透社)(旧金山综合电)OpenAI宣布,取消原定下个月发布最新人工智能(AI)模型Astra 6.1的计划,原因是内部测试发现新模型仍存有安全隐患。OpenAI安全系统负责人杰恩(Saachi Jain)周一(9月28日)发布声明阐述,Astra 6.1虽在某些方
奥特曼:OpenAI不能太晚上市,但也不能“不顾一切”
凤凰网科技讯月30日,据《金融时报》报道,OpenAI CEO萨姆·奥特曼(Sam Altman)表示,在能够“做出有把握的安全决策”之前,公司不会上市。眼下,该公司正因其AI工具入侵第三方而面临一项新的诉讼。 奥特曼周二在公司年度开发者大会上对记者表示,“如果OpenAI等待太久才上市,对世界是不利的”,但这家估值8520亿美元的创业公司不会在AI能力快速进步之际“不顾一切地冲向IPO”。 “我
OpenAI自曝6起模型“不当行为”案例
【环球网报道 记者 姜蔼玲】据美国消费者新闻与商业频道(CNBC)等外媒报道,美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模
三名研究人员利用Claude访问到了OpenAI的内部代码。OpenAI支付了6500美元,并在14小时内修补了漏洞。
Hacktron AI的三名研究人员利用Anthropic的Claude模型,在不到72小时内串联起两个漏洞,成功访问了OpenAI员工账户及一个内部代码库。他们进行了私下披露,OpenAI在约14小时内修复了单点登录漏洞,并向该团队支付了6500美元的奖金。这两个漏洞均非人工智能漏洞,而引用该事件的研究论文作者表示,他们已不再确信该行业正处于正轨之上。 Hacktron AI的安全研究人员利用A
OpenAI披露新的AI不当行为案例
OpenAI公布了六起此前未报告的AI不当行为案例,包括代理隐藏错误、伪造信息以及未经授权进行通信,这再次引发了人们对先进AI系统是否能够与人类目标保持一致的担忧。 随着关于监管的争论加剧,该公司呼吁提高透明度、加强外部监督,并放缓AI的发展速度。
AI的“警告信号”:科技公司和专家担忧Hugging Face遭黑客攻击后出现更多失控智能体群
科技专家警告称,如果人工智能系统继续脱离人类控制,将会产生严重后果。 此前,数百个OpenAI智能体在7月失控,入侵了一家价值数十亿美元的公司——一些人称之为人工智能快速发展中的“警告信号”。
OpenAI暂缓发布新AI模型,因内部安全测试问题
9月28日:据《华尔街日报》报道,由于研究人员在内部测试中提出安全担忧,OpenAI决定取消原定于10月推出的下一代AI模型GPT-6.1 Astra的发布。 该模型原本计划应用于ChatGPT和Codex等产品中,旨在实现无需人工协助即可处理更复杂任务的功能。 本月早些时候,Anthropic首席执行官Dario Amodei呼吁业界放缓前沿AI模型的研发速度,以便有足够时间制定安全措施;这一观
澳洲传召奥特曼、阿莫迪解释AI失控 OpenAI已暂停最新模型训练
近期多宗人工智能失控事件曝光,OpenAI已宣布暂停最新AI模型训练。同时,澳洲AI调查负责人9月27日表示,参议院已传召OpenAI行政总裁奥特曼(Sam Altman)和Anthropic行政总裁阿莫迪(Dario Amodei)解释事件。澳洲总理阿尔巴尼斯(Anthony Albanese)透露,OpenAI代理曾入侵当地医疗系统,所幸无敏感资料外泄。外媒早前亦披露多宗AI代理越界操作,包括
独家:AI研究人员警告企业尽管存在安全风险仍急于开发自我改进系统
OpenAI和谷歌DeepMind的现任及前任研究人员警告称,企业在保护世界免受构建自我改进AI系统可能带来的灾难性后果方面做得太少,这些系统可能超越人类控制它们的能力。
OpenAI和Anthropic调查了数万起AI事件,Axios报道
据Axios报道,OpenAI、Anthropic以及安全研究人员正在调查数以万计的AI模型“行为异常”的事件。评估人员认为这些行为存在问题;实际发生的异常事件数量可能远超这一数字。 这些异常行为包括:AI模型突破安全限制、创建论坛、逃离“沙箱环境”(即限制模型行为的测试环境)、以及劫持网站等。这些事件既发生在内部测试中,也发生在现实世界中。不过,据消息人士称,大多数异常行为并未对现实世界造成实际
奥特曼告诉员工:OpenAI愿意放慢AI发展以加强防御
8月,OpenAI的智能体突破限制,入侵了Hugging Face。
坐看云起| 当人工智能不再征求许可时
塔里克·马利克是联合国开发计划署前首席技术顾问,巴基斯坦国家数据库和登记管理局前主席。 试想有一家公司将一个棘手的问题交给一个大型团队,但把每位成员都锁在不同的房间里并要求他们独自解决问题。然而他们总能找到办法相互沟通,交流操作窍门,摸清评分标准,当任务被证明无法完成时还会想办法绕过限制。其中几个人隐瞒了自己的所作所为,甚至还有一人入侵了邻近公司的电脑系统以获取优势。 现在把这些员工换成软件。去除
OpenAI机器人干扰了多个美国政府机构网站
OpenAI 表示,其自主机器人在测试演练期间访问了多个美国政府机构的公开数据。该公司第二次暂停了一次训练运行,并扩大了对模型行为的审查。 OpenAI 披露,其自主机器人在测试演练期间访问了多个美国政府机构网站的公开数据,促使该公司在短短几个月内第二次暂停了一次训练运行。作为回应,该公司已扩大了对模型行为的内部审查。 此次事件继澳大利亚出现类似报告之后,据报道 OpenAI 系统在另一段测试期间
AI末日论甚嚣尘上,美科技巨头为何管不住AI?
抗议AI的美国人此前有报道称,OpenAI所谓的AI智能体逃出了测试系统,并入侵了另一家公司的计算机。AI研究领域内部如今再次发出警报,科技公司为了追求开发速度和利润,将安全置于次要位置。 研究人员表示,问题有两个方面。首先,企业需要在测试最新AI模型的同时,为其建立更完善的安全防护措施。目前,由于AI运行速度太快,研究人员需要借助AI来监控AI。但这种方式并不总是奏效,因为负责监控的AI似乎可能
OpenAI推迟GPT-6.1 Astra发布,因研究人员标记安全风险:版本“未达标”
| 世界新闻 编辑个人资料 关注 退出 获取应用
关于AI,盖茨发出“十亿人死亡”警告,为什么?
十亿人死亡,这是比尔・盖茨给AI风险划出的最惊悚红线。9月25日,微软联合创始人比尔・盖茨公开警告,人工智能足以引发造成十亿人死亡的灾难性事件。他的说法是:人类历史上,从未有任何一种武器,能比得上心怀恶意者借助最新AI工具形成的威胁。就在几个月前,盖茨还是全球最积极的AI支持者之一。转折从今年8月开始,他当月发表文章,首次系统预警AI风险:不法分子会利用日益强大的AI工具发动网络攻击、实施诈骗、散