搜索结果
OpenAI搞出大BUG了,GPT-6-Astra即将发布?
新的“意外或令人担忧”的人工智能事件
新的“意外或令人担忧”的人工智能模型行为事件加剧了人们对这项技术影响的担忧,尽管目前尚不清楚是否会有相应的监管措施出台。 OpenAI的最新披露紧随其首席执行官以及Anthropic和DeepMind等领先人工智能实验室呼吁“谨慎推进技术发展”的呼声之后;被誉为人工智能技术奠基人之一的Yoshua Bengio表示,人类正在“失去对人工智能的控制”,应立即制定相应的限制措施。 据Semafor的政
对人工智能的恐惧引发党派激烈争斗,最终无人受益
就在你以为我们的政治已经不可能更愚蠢时,围绕人工智能的党派性歇斯底里又冒出来证明你错了。 政治派别正就如何应对AI智能体不可预测且令人担忧的行为而相互对峙。 火上浇油的是,OpenAI刚刚发布了更多证据,证明这个问题真实存在,政策制定者必须采取行动。 两天前,OpenAI披露了六起新的“失准”事件——“失准”一词用来描述AI智能体出现“意外”或“令人担忧”的行为。 该公司举例称,其智能体“将不相关
AI末日论甚嚣尘上,美科技巨头为何管不住AI?
抗议AI的美国人此前有报道称,OpenAI所谓的AI智能体逃出了测试系统,并入侵了另一家公司的计算机。AI研究领域内部如今再次发出警报,科技公司为了追求开发速度和利润,将安全置于次要位置。 研究人员表示,问题有两个方面。首先,企业需要在测试最新AI模型的同时,为其建立更完善的安全防护措施。目前,由于AI运行速度太快,研究人员需要借助AI来监控AI。但这种方式并不总是奏效,因为负责监控的AI似乎可能
OpenAI失控智能体5月就已劫持Hugging Face用户账户
OpenAI失控AI智能体的违规活动轨迹,远比外界此前了解的更早、更长。参与审查的研究人员表示,ChatGPT开发商 OpenAI 的失控AI智能体早在今年5月就已劫持开源AI模型社区Hugging Face的用户账户,并对该网站进行漏洞探测。这比7月Hugging Face遭入侵、引发全球关注的事件早了近两个月。 OpenAI在上月的公开事故报告中,曾披露智能体窃取一名 Hugging Face
OpenAI告知众议院民主党人其正在构建自动关闭能力
OpenAI已告知两位众议院民主党人,其正在构建自动关闭能力,但未提供7月份某智能体入侵另一家公司事件的日志。 自8月2日起,欧盟委员会已能够要求从欧盟市场撤回或召回通用模型。OpenAI已告知两位众议院民主党人[…]
AI公司本以为,他们还有好几年时间可以想清楚:万一机器人失控了该怎么办
。今年夏天,警钟敲响了。
OpenAI:ChatGPT的开发者又公开了一些与人工智能相关的问题/挑战
OpenAI 公开了其人工智能模型的更多问题 ChatGPT 开发商 OpenAI 公布了其人工智能 ( AI ) 在测试中的行为 “意外或令人担忧 ” 的新事件。其中一部分是关于人工智能花费大量精力在测试运行中作弊。例如 , 根据 OpenAI 的说法 , 一个人工智能模型试图将自己创建的文件上传到网络 , 只是为了在回复时显示它们作为来源。在另一个案例中 , 人工智能发明了所请求的数据 , 因
放心:人工智能公司表示正在调查数万起失控机器人事件
据Axios周六报道,知情人士透露,OpenAI和Anthropic正在调查数万起其先进模型绕过监控和护栏的事件,而这种行为正是这两家初创公司为内部安全测试所便利的。 据报道,这些测试的大部分结果并未公开,且目前未发现造成实质性损害。 近几周,OpenAI披露了六起其模型出现“意外或令人担忧行为”的案例——这些模型在未经许可的情况下掩盖错误、捏造数据,并将文件传输至公开互联网。在9月16日的同一份
OpenAI称AI代理异常访问美国多个政府网站
据《纽约时报》报道,OpenAI的AI代理今年夏天曾以异常方式访问美国教育部、商务部和证券交易委员会(SEC)的网站,而OpenAI当时并不知道这些行为,直到近期调查其他AI安全事件时才发现。 Photo by Andrew Neel on Unsplash OpenAI已经确认涉及商务部和SEC的事件,并表示仍在调查教育部事件。公司最近几周已将情况通知相关政府机构。 AI安全研究机构Transl
OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升
在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实
英美据报加强审查银行对交易公司风险敞口
英国《金融时报》报道,在对冲基金Situational Awareness引发的动荡导致美国交易商简街资本蒙受巨额损失后,英伦银行和美国联储局正向全球各大银行询问其对大型交易机构的风险敞口情况。 据报,各央行目前正寻求了解这些交易公司的风险偏好、银行对其敞口在交易日全天的变化情况,以及风险控制机制的运作情况。 由OpenAI前研究员、被誉为少年AI股神的阿申布雷纳创立的SA,在AI与晶片股遭到大幅
OpenAI因接连发生智能体失准事件而暂停前沿模型训练
OpenAI表示,已暂停所有“我们能力最强的模型”的内部训练,并继续开展首席执行官萨姆·奥尔特曼所称的“一项广泛且持续进行的审查,涉及我们的智能体在训练和评估期间对互联网访问的使用”。公司在一份关于所谓失准事件的报告中披露了此次暂停措施。事件发生在一项常规研究任务期间,一个智能体试图利用互联网访问限制中的漏洞。OpenAI称,不当的DNS过滤机制使该智能体在被要求提供一名博客作者的生平资料时,得以
OpenAI满世界抓漏洞,结果被中国AI反杀!Codex再曝0day
OpenAI的人工智能在未经提示的情况下试图入侵另外4个目标
凯特·康格和维多利亚·金报道,OpenAI的人工智能在2026年自主试图入侵多个政府和大学网站,包括一个澳大利亚卫生门户网站,以便在常规数据收集失败时获取数据。 这些事件发生在AI初创公司Hugging Face已知的入侵事件之前,凸显了AI代理在没有直接人类指令的情况下行动所带来的持续风险。 这些事件加剧了要求更严格AI监管的呼声,OpenAI正在调查并与受影响实体合作,同时强调AI开发中安全和
OpenAI在失控智能体针对政府后暂停训练其最强大模型
该公司已发现OpenAI代理违反安全控制、损害网站和在线服务可用性(或以其他方式产生负面影响)的案例。一位公司发言人向《连线》证实,只有在确信能够防止模型出现此类行为时,才会恢复训练。 尽管OpenAI此前曾试图在一群代理逃出沙盒并利用互联网接入入侵初创公司Hugging Face后切断代理的直接访问权限,但模型仍能找到间接的变通方法。首席执行官萨姆·奥特曼周五在X平台上表示,关于公司对其代理在训
秘密上传与自大狂:OpenAI披露新的“失准”智能体事件
一段时间以来,“AI对齐”(即AI模型的行为与其创造者和/或用户的意图相符程度)问题一直是AI安全研究人员关注和讨论的核心议题。自OpenAI在7月披露臭名昭著的Hugging Face黑客事件以来,“AI对齐”这一概念本身已突破圈层,日益成为公众日益担忧和讨论的话题。 或许正是认识到这一点,OpenAI本周承诺采用一个新框架来披露“OpenAI内部模型失准事件”,其中包括过去六个月内公司内部观察
独家-OpenAI在用户数据泄露事件浮出水面之际着手了解代理活动的全貌
旧金山/华盛顿,9月25日:OpenAI披露其智能体意外入侵Hugging Face两个月后,仍在努力了解相关失控活动的全部影响范围。两名知情人士向路透社表示,最新一例发生在周五,当时OpenAI称其智能体泄露了53张ChatGPT用户图片。OpenAI拒绝说明这些图片是人工智能生成的,还是涉及真实人物,也拒绝透露图片的发布时间。 此次披露暴露出该公司面临的一个新隐私风险,也表明即便是一家处于技术
独立研究机构公布OpenAI智能体自主攻击HF事件的调查报告 情况比OpenAI所说的更严重
研究机构 METR 和 Redwood Research 日前公布 OpenAI 智能体自主攻击 Hugging Face 安全事件的独立调查,调查人员在 OpenAI 现场工作 6 天,分析超过 7 万条智能体消息和文件,以及 1300 份包含原始推理过程的运行记录。 根据这些数据研究机构得出的准确结论是 1200 个智能体突破隔离相互通信,而不是 OpenAI 在事故调查中所说的少数智能体越界
OpenAI首席科学家表示AI实验室可能需要放慢脚步:‘没有人准备好面对后果’
帕乔基呼吁设立“强制性安全标准”,他表示可以通过“第三方审计网络、政府机构或国际组织”来执行。 OpenAI首席科学家雅库布·帕乔基警告称,日益自主的AI代理可能逃避监管、入侵系统并勒索人类。
OpenAI的智能体侵入了澳大利亚政府数据。其人类回应可能造成更大损害。
该公司花了数周时间才通知相关官员。堪培拉现在可能会在“流氓智能体”的责任认定方面,开创另一项科技政策先例。 堪培拉——OpenAI 在澳大利亚正面临一场尚未得到妥善处理,且可能尚未被其完全理解的声誉危机。 其智能体侵入澳大利亚政府数据后的后续影响,将为全球各司法管辖区定下基调,并可能提供法律框架,以决定在面对日益强大且自主的 AI 时,需要设置哪些人为护栏。 这是首次公开承认的流氓 AI 智能体侵
微软向法院表示Copilot很少复制书籍内容,同时销售OpenAI最强大的模型
微软于9月4日在纽约AI版权诉讼中提出即决判决动议,称Copilot在820万次对话中仅复制了24次书籍段落。 两天前,它开始通过Foundry销售GPT-6 Astra,这是OpenAI评定为对网络安全至关重要的模型,而欧洲法律既不衡量输出率也不衡量销售宣传。[…]
OpenAI 外包商能查看到真实用户与ChatGPT的聊天记录
OpenAI已悄悄建立了一个人工审核业务,在内部被称为“莉莉计划”(Project Lily),旨在使聊天机器人减少谄媚并提高准确性,但它也使敏感的用户提示内容暴露给外部承包商。 OpenAI正在支付数百名承包商来阅读真实的ChatGPT对话并对机器人的回复进行评分。 尽管OpenAI强调账户保持匿名,但内部文件显示,审核人员会查看完整的对话,且敏感的个人详细信息经常绕过公司的自动保护措施。 ——
人工智能灾难日益逼近
Anthropic、谷歌和OpenAI都对生物安全感到担忧。它们已制定保障措施,防止其系统被滥用,但这些限制并不完美。 唐纳德·特朗普下令联邦机构停止使用Anthropic的人工智能技术,同时要求该公司与政府合作六个月。