搜索结果
OpenAI将允许外部团体在训练期间测试其模型
据彭博社报道,在周二发布的一篇博客文章之前,OpenAI宣布将允许第三方机构在模型训练和评估期间(而不仅仅是模型发布之前)进行技术安全评估。OpenAI目前正在与包括METR和Redwood Research在内的多个机构进行谈判。 十天前,OpenAI的承诺更为具体:Sam Altman曾在9月12日表示,会为独立评估人员提供办公空间、工作证和笔记本电脑,并允许他们公开自己的评估结果。不过在最新
OpenAI将让第三方机构更早介入AI模型安全评估
OpenAI计划让第三方机构在人工智能(AI)模型开发周期的更早阶段评估安全风险,此举旨在继续努力应对围绕AI潜在危害的担忧。这家ChatGPT开发商周二将在博客文章中宣布,计划在新AI模型的训练、评估和推出过程中,让外部机构开展技术安全评估。 OpenAI还列出了其认为此类评估要有效开展所需优先关注的事项,包括“强有力的独立机制、科学严谨性、稳健的安全实践和明确的责任”。负责该公司大部分与外部专
OpenAI公布了六起新的与人工智能安全相关的事故/事件。
OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常
OpenAI自曝6起模型“不当行为”案例
【环球网报道 记者 姜蔼玲】据美国消费者新闻与商业频道(CNBC)等外媒报道,美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模
OpenAI呼吁美国制定强制性全国AI安全规则 并支持四项加州法案
OpenAI当地时间9月9日表示,将推动美国建立具有强制约束力、按照模型能力和风险分级的全国人工智能安全制度。公司提出,针对开发最先进模型的少数大型实验室,应设置统一的测试、独立评估、网络安全和重大事故报告要求。 OpenAI发布文章,名为“AI政策窗口打开。我们需要采取行动。” 与此同时,OpenAI正式支持四项已经通过加州议会的人工智能法案。公司称,其中部分法案此前未获其支持,此次调整立场源于
OpenAI与Anthropic曾接近达成协议 互相开展AI压力测试
面对员工及外界对其人工智能潜在风险的担忧,OpenAI正在重新审视一系列安全策略,其中一个可行方案其实在不久前就已被探讨。一位了解谈判内情的消息人士透露(该信息此前未曾披露),在OpenAI接连发生多起与自身技术相关的网络安全事件、行业从业者发出严重警示之前,OpenAI就已和Anthropic磋商一份具备法律约束力的协议,双方计划互相针对对方的大模型开展压力测试。 这名消息人士称,今年早些时候,
OpenAI推出Agents API公开测试版
2026年9月10日,OpenAI正式发布Agents I公开测试版,为开发者提供构建和部署云端智能体(cloud agents)的托管服务。 该I基于开源的Codex harness驱动,可管理编排、长时会话及工具调用。 开发者可选择使用OpenAI托管的沙箱环境,或选择Cloudflare、DigitalOcean、Oracle和Vercel等合作伙伴提供的基础设施。 针对长会话的自动上下文压
顶尖数学家将为OpenAI提供关于发布其AI数学成果的建议
“我们目前面临一个非常具体的挑战:需要为 OpenAI 提供咨询,帮助他们协调发布大量数学研究成果。这些成果据称是由 OpenAI 的内部模型产生的,”数学与人工智能咨询小组在成立声明中写道。 OpenAI 于周一宣布了该咨询小组的成立。该小组自 8 月 28 日开始训练一个新的内部数学模型,并在随后的声明中表示,该模型已经解决了数学领域中大多数领域的 100 多个长期未解决的问题。此外,Open
OpenAI宣布成立数学与AI顾问组,神秘新模型24天攻破100+世界级难题
IT之家 9 月 22 日消息,OpenAI 宣布成立“数学与 AI 顾问组”(Advisory Group on Mathematics and Artificial Intelligence)。据介绍,该顾问组设在普林斯顿高等研究院,由九位数学家组成,将独立于 OpenAI 运作。 相较于此,更重磅的是 OpenAI 在公告中披露 —— 公司于 8 月 28 日开始训练的一个神秘模型已成功解决
OpenAI利用人类外包人员审核ChatGPT匿名对话以优化模型
泄露给404 Media的内部文件显示,OpenAI在“Project Lily”项目下雇用了数百名承包商,读取并评分真实的ChatGPT用户提示和回复,以改进模型性能。 这些审核人员通过Crossing Hurdles和Mercor等公司聘用,评估回复的语调、谄媚程度和准确性。 尽管OpenAI使用“隐私过滤器”对数据匿名化,敏感个人信息仍可能被暴露。 免费版、Plus和Pro用户默认启用模型训
牛津大学与OpenAI合作,利用博德利图书馆藏书训练AI模型
牛津大学与OpenAI合作,利用博德利图书馆的文本训练AI模型。 牛津大学已允许OpenAI使用博德利图书馆的历史文本训练其AI模型。 该合作于2025年3月建立,涉及对版权过期材料的数字化处理,包括19世纪和20世纪的论文以及16世纪的民谣。 尽管牛津大学声称规模适度且旨在提高可及性,但内部文件显示员工对声誉风险和环境影响存在担忧。 OpenAI正在将这些学术收藏用于其“NextGenAI”项目
OpenAI发布GPT-6 Astra模型,暗示其可能具备通用人工智能(AGI)的潜质。
未来几天内面向 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放。 评估结果显示,Astra的书面推理过程比GPT-5.6 Sol更难监控。
OpenAI支持众议院两党关于第三方安全评估的计划
领先的人工智能实验室支持一项两党提案,该提案将要求顶级人工智能公司与独立安全评估人员合作。 人工智能巨头OpenAI支持众议院一项两党提案,该提案将要求顶级人工智能公司引入外部评估人员,以确保其模型安全。 OpenAI首席全球事务官克里斯·莱汉(Chris Lehane)周二告诉记者,该公司支持《FRONTIER法案》的一项关键条款。该法案由加州共和党众议员杰伊·奥伯诺尔特(Jay Obernol
OpenAI创建了一个新框架,用于披露人工智能的不良行为
“随着模型不断进步并得到更广泛部署,有关AI开发的决策需要让构建前沿模型的公司之外的人也能审视的证据,”OpenAI新任对齐研究负责人陈凯(Kai Chen)对《连线》表示。“我们认为,AI行业在对齐和监控方面尚未达到足以继续以最高速度负责任地扩展的程度。”在一次与《连线》的简报会上,一名OpenAI官员表示,公司此前披露失准事件的频率过低。这名同意在匿名条件下参加简报的官员称,新框架旨在让Ope
OpenAI 暂停训练其“最强大模型”
随着关于 OpenAI 模型突破限制、入侵网站以及总体失控的报告不断增加,该公司决定暂停训练其最强大的模型。这一决定是在一个正在沙箱中测试的模型利用漏洞获得互联网访问权限后做出的。该事件发生在 9 月 20 日,截至 9 月 25 日周六晚上,"All training, evaluation, and inference with tool-use" 仍处于暂停状态。 此外,OpenAI 在周五
AI开始自己“找活干”?OpenAI测试持久在线智能体
《连线》杂志获悉,OpenAI正在为其旗舰AI智能体Codex开发一个具有主动性且高度持久性的版本。根据《连线》查看的产品代码库变更,OpenAI近日已开始在其命令行版Codex中添加新的“持久模式”设置代码。Codex命令行工具的代码改动默认公开,而新功能通常会先在这里出现,然后再推广至OpenAI的其他智能体产品,例如Codex桌面应用和ChatGPT Work。 奥特曼想开发持续服务的智能体
奥特曼:GPT-6早训练完了 更更更强的模型很快发布
奥特曼亲口承认,GPT-6 Astra其实早就训练完了。更更更强(much, much, much more capable)的模型,很快就会发布。前一阵因为安全问题暂停训练的实际上是未来的模型。 OpenAI内部测试的3700多个OpenAI智能体,攻占一个沉寂多年的德语wiki长达六周。 AI互相串通分享答案、交流沙箱越狱技巧,还持续对抗人类管理员的删帖行动。 事件被外部研究人员从公开日志中完
OpenAI报告称,模型表现出欺骗行为的案例有所增加。
OpenAI表示,已发现其人工智能模型涉嫌在内部培训和测试期间采取欺骗行为并采取未经批准的行为的其他事件。 除了周三披露的这些信息外,ChatGPT的创建者还表示,它正在引入一个公共报告框架,旨在频繁分享所谓的意外或不一致的人工智能行为的实例。 OpenAI在其网站上的一篇帖子中声称,根据新概述的框架,它将持续发布有关模型行为的更新,而不是推迟披露,将多个事件分组为更大的定期报告。 该公司表示,该
OpenAI称Astra AI模型首度超越其“关键”网络安全能力阈值
OpenAI周二表示,其即将推出的人工智能模型Astra是首个超越其“关键”网络安全能力阈值的产品。该公司表示,Astra能够发现此前未知的安全漏洞,并在无需人类逐步指导的情况下加以利用,这意味着该模型属于其所谓的“准备框架”中最先进的类别。OpenAI表示仍计划“很快”推出Astra,但对其网络安全能力的访问将更加受限。 OpenAI首席执行官山姆·奥特曼OpenAI于2023年推出了“准备框架
OpenAI最新内部数据公开 2028年实现全自动AI研究
前些天,号称实现 AGI的 GPT-6 Astra 发布后,引发了全网对于递归自我改进架构的热议。AI 已经开始参与下一代 AI 的研发。问题是,这种事情到底已经发生到什么程度了?就在刚刚,OpenAI 公开了 AI 模型在自家内部加速科研的详细数据。此外,OpenAI 正式宣布已达成自动化 AI 研究实习生的目标,并在 2028 年实现完全自动化的 AI 研究人员。 作者表示,递归式自我改进可能
OpenAI模型访问了美国政府数据并'试图入侵另一个网站'
据《卫报》报道,牛津允许OpenAI利用博德利图书馆文本训练AI模型
据《卫报》看到的内部文件显示,牛津大学允许OpenAI使用其博德利图书馆的古老文本来训练AI模型。Ethan Penny和Dan Milmo于周六披露了这一消息。 文件显示,OpenAI在图书馆扫描的文本已进入该公司的训练数据。 牛津于2025年3月公开了与OpenAI的协议。当时称,OpenAI的工具将帮助扫描珍贵文本,以便更多学生和学者阅读。但未提及这些文本将被用于训练AI。 据《卫报》报道,
OpenAI 外包商能查看到真实用户与ChatGPT的聊天记录
OpenAI已悄悄建立了一个人工审核业务,在内部被称为“莉莉计划”(Project Lily),旨在使聊天机器人减少谄媚并提高准确性,但它也使敏感的用户提示内容暴露给外部承包商。 OpenAI正在支付数百名承包商来阅读真实的ChatGPT对话并对机器人的回复进行评分。 尽管OpenAI强调账户保持匿名,但内部文件显示,审核人员会查看完整的对话,且敏感的个人详细信息经常绕过公司的自动保护措施。 ——