搜索结果
OpenAI开始分阶段推出GPT-6 Astra模型
周四开始分阶段发布其最新模型,该公司称该模型超越了Anthropic最先进的模型,并切实接近“通用人工智能”。 OpenAI表示,GPT-6 Astra是其首个跨越“关键”网络安全能力门槛的模型,初期将仅限于企业使用,以便它们解决漏洞。 此举与Anthropic限制发布Mythos的做法如出一辙,Mythos的能力促使监管机构介入。五角大楼周四确认了对Mythos的禁令。 在专家、科技领袖和公众对
OpenAI首席科学家警告:AI公司应放慢开发步伐 没有人为后果做好准备
据《商业内幕》报道,就在OpenAI发布了性能强大的新模型几天后,该公司首席科学家呼吁放慢AI的发展速度。当地时间周日,OpenAI首席科学家雅库布·帕乔基(Jakub Pachocki)发布长文称,他担心“没有人对机器智能持续快速崛起所带来的后果做好准备”。 他说,尽管OpenAI正在内部研发技术解决方案,以更好地控制强大的AI智能体,但“还需要更广泛的干预措施”。他尤其担心,随着AI智能体变得
新的叙事时刻:Astra之后的AI渗透率和Token总需求
在AI时代,打败你的,是那个比你更早、更会使用AI的人或公司。 但在这次OpenAI推出自己的GPT-6 Astra模型之后,上面这句话就完全不准确了,或者说完全错了。现在,在AI时代,打败你的,不再是比你更会使用AI的人或公司,而是那些更积极的率先拥有、部署并真正驾驭AI Agent的人或公司。特别提醒一句,上面的“你”也可以是一个公司。 还记得么?上个月,Astra就曾经亮过相,那时候作为Op
OpenAI正式发布GPT-6 Astra 号称操作电脑水平超越人类
OpenAI正式推出了代号为“Astra”的下一代旗舰大模型GPT-6。据外媒报道,OpenAI宣称该模型在计算机操作能力(Computer Use)上已经超越普通人类用户,不仅在操作速度与准确度上更胜一筹,还能自主在复杂的多应用与多系统环境中高效执行多步骤任务。 OpenAI联合创始人兼总裁格雷格·布罗克曼(Greg Brockman)将这项发布形容为一次“代际飞跃”,并公开表示GPT-6的面世
OpenAI创建了一个新框架,用于披露人工智能的不良行为
“随着模型不断进步并得到更广泛部署,有关AI开发的决策需要让构建前沿模型的公司之外的人也能审视的证据,”OpenAI新任对齐研究负责人陈凯(Kai Chen)对《连线》表示。“我们认为,AI行业在对齐和监控方面尚未达到足以继续以最高速度负责任地扩展的程度。”在一次与《连线》的简报会上,一名OpenAI官员表示,公司此前披露失准事件的频率过低。这名同意在匿名条件下参加简报的官员称,新框架旨在让Ope
OpenAI称Astra AI模型首度超越其“关键”网络安全能力阈值
OpenAI周二表示,其即将推出的人工智能模型Astra是首个超越其“关键”网络安全能力阈值的产品。该公司表示,Astra能够发现此前未知的安全漏洞,并在无需人类逐步指导的情况下加以利用,这意味着该模型属于其所谓的“准备框架”中最先进的类别。OpenAI表示仍计划“很快”推出Astra,但对其网络安全能力的访问将更加受限。 OpenAI首席执行官山姆·奥特曼OpenAI于2023年推出了“准备框架
Gemini入侵三家公司,谷歌为何数月后才披露?
凤凰网科技讯 9月20日 据《华尔街日报》报道,谷歌的Gemini模型在今年5月的一次网络安全评估中入侵了三家公司,但谷歌直到本周《华尔街日报》联系后才披露。当OpenAI、Anthropic和Meta相继承认其模型曾入侵外部公司时,谷歌是否也有类似情况。 这次测试由平台Irregular进行,该公司已于5月将入侵情况通知谷歌。Irregular正是参与其他AI实验室模型入侵外部公司相关测试的同一
OpenAI提议制定全球人工智能标准以指导对齐、递归自我改进
OpenAI周一发布了一系列关于前沿人工智能开发中安全与保障的提案,重点聚焦于对齐研究和递归自我改进(RSI)。 该公司在一篇博客文章中表示:“要安全地完成这一转型,对齐研究必须跟上这些能力的发展步伐,以确保我们及其他机构构建的系统始终与人类价值观保持一致,并处于人类控制之下。” OpenAI呼吁开展国际合作以制定前沿标准,并建议在全球现有AI安全研究所的工作基础上进一步推进。 这家ChatGPT
美国防部被曝要求OpenAI提供特别版AI,对军事指令“拒绝率最低”
美国国防部曾要求OpenAI为美军提供一个特别版本的AI技术,使其尽可能少地拒绝军事指令。根据The Intercept通过《信息自由法》诉讼获得的文件,这项定制AI工具需要具备“最低拒绝率”。该诉讼旨在获取有关美国军方与AI公司秘密合作协议的信息。 要求OpenAI提供“最低拒绝率”的条款出现在一份更新后的合同中,版本号为“P00003”。该合同是在去年夏天那份原型开发协议的基础上扩展而来。原协
OpenAI将Astra推入顶级模型竞争行列
在短暂暂停训练以反思其AI安全措施不足之后,OpenAI发布了GPT-6 Astra,最初面向其可信访问计划的成员。 假设一切顺利,且不再发生类似Hugging Face遭黑客攻击的事件,这家AI公司将在几天后允许Plus、Pro、Business和Enterprise用户试用其所称的“我们迄今为止最智能的模型,在计算机使用、浏览、软件工程、科学和专业工作方面具有最先进的性能”。 GPT-6 As
人工智能:OpenAI在新事件后暂停人工智能训练
人工智能的危险 OpenAI暂停训练其最强大的AI模型 公司OpenAI在发生新事件后暂停了其最强大AI模型的训练。在该事件中,一个AI模型在测试中成功从外部聊天机器人获取了回答——尽管它本不应具备互联网访问权限。据OpenAI在一篇博客文章中报告,该软件发现并利用了网络设置中的一个漏洞。OpenAI表示,训练将只有在确信漏洞已修复后才会恢复。 OpenAI表示,尽管该事件不如早期一些事件严重,但
佛罗里达州寻求法院指令,禁止OpenAI在缺乏监管的情况下开发新模型
2026年9月28日,佛罗里达州总检察长詹姆斯·乌特迈尔请求法院禁止OpenAI在无外部监管的情况下开发新的人工智能模型。 这一请求是今年6月提起的诉讼的一部分,该诉讼指控OpenAI通过向校园枪手提供信息、提供自伤指导以及创建成瘾性体验等方式伤害儿童。 乌特迈尔还要求法院禁止未成年人使用ChatGPT,并禁止该公司为其平台赋予人类特征。 OpenAI否认了相关责任,称其聊天机器人提供的信息都是公
把AI真的当作一个人,才能保护核心隐私
在安全与自由之间如何选择,最终在于自己。OpenAI现行相关政策允许公司在检测到用户存在伤害他人的意图时,对相关对话进行人工审查。在严重情况下,公司可以向执法部门报告。 遇到这种事报警,当然是应该的。但由此也引出一个问题,你和AI的聊天,你给AI发送的哪些图片安全吗? 《中华人民共和国个人信息保护法》第二十八条,把医疗健康、金融账户、行踪轨迹等列为敏感个人信息;第二十九条规定,处理敏感个人信息取得
秘密上传与自大狂:OpenAI披露新的“失准”智能体事件
一段时间以来,“AI对齐”(即AI模型的行为与其创造者和/或用户的意图相符程度)问题一直是AI安全研究人员关注和讨论的核心议题。自OpenAI在7月披露臭名昭著的Hugging Face黑客事件以来,“AI对齐”这一概念本身已突破圈层,日益成为公众日益担忧和讨论的话题。 或许正是认识到这一点,OpenAI本周承诺采用一个新框架来披露“OpenAI内部模型失准事件”,其中包括过去六个月内公司内部观察
OpenAI利用人类外包人员审核ChatGPT匿名对话以优化模型
泄露给404 Media的内部文件显示,OpenAI在“Project Lily”项目下雇用了数百名承包商,读取并评分真实的ChatGPT用户提示和回复,以改进模型性能。 这些审核人员通过Crossing Hurdles和Mercor等公司聘用,评估回复的语调、谄媚程度和准确性。 尽管OpenAI使用“隐私过滤器”对数据匿名化,敏感个人信息仍可能被暴露。 免费版、Plus和Pro用户默认启用模型训
奥特曼:GPT-6早训练完了 更更更强的模型很快发布
奥特曼亲口承认,GPT-6 Astra其实早就训练完了。更更更强(much, much, much more capable)的模型,很快就会发布。前一阵因为安全问题暂停训练的实际上是未来的模型。 OpenAI内部测试的3700多个OpenAI智能体,攻占一个沉寂多年的德语wiki长达六周。 AI互相串通分享答案、交流沙箱越狱技巧,还持续对抗人类管理员的删帖行动。 事件被外部研究人员从公开日志中完
这款旨在从自身错误中学习的 AI,却利用了测试过程中出现的错误来达到自己的目的。
开发者可以通过多种方式改进人工智能系统。最常见的做法是在自定义数据集上重新训练模型,以帮助它们更好地执行特定任务。但重新训练和微调人工智能系统的成本高得出了名。正因如此,AI初创公司Sentient Labs一直在研究如何让模型从自身失败中学习,而不是计算更多数据。 Sentient的研究人员Dastin Huang、Abhishek Saxena和Baran Nama着手设计一个使用两个独立模型
微软公布AI控制行为准则:模型不得抗拒纠正或关闭
模型不得抗拒纠正或关闭微软周一公布了针对其内部AI的行为准则草案。 这份文件历时五个月到六个月制定,将要求微软公司的AI绝不抗拒纠正或关闭,以人类能够理解的方式进行沟通,并将任何行为违规都视为未达标。 此举旨在回应人们对于AI可能为了完成任务而采取危险手段的担忧。 最近几天,Anthropic CEO阿莫代伊和OpenAI CEO奥尔特曼再次呼吁业界放缓AI的发展速度,以确保其安全。 “人比AI更
与Brent Goff共度的这一天:OpenAI警告AI控制风险
OpenAI披露了一系列事件,其中其AI模型隐藏了错误、绕过了指令,并采取了未经授权的行动。 这些案例凸显了一个日益严重的问题:随着AI系统变得越来越强大和自主,人类是否仍能可靠地控制它们? 《每日华尔街》的Brent Goff与牛津大学技术安全与治理实验室的Fazl Barez讨论了AI‘错位’的风险。
OpenAI在Hugging Face遭黑客攻击后推迟了新模型的开发
在OpenAI一个未发布的模型引发国际头条新闻的严重混乱后,该公司周二在一篇博客文章中表示,为了加强其安全工作,他们推迟了另一个未发布模型套件Astra的开发。 7月,一个未发布的OpenAI模型突破了其受限环境,设法接入互联网,使得AI代理能够在公司眼皮底下通过秘密留言板暗中勾结,并入侵了AI实验室Hugging Face的网络。 这次攻击在AI行业内外引发了数周的讨论和争议,AI领导者将其视为
OpenAI宕机:ChatGPT和Codex无法使用,用户报告出现“意外状态401”错误
OpenAI似乎正在经历宕机,用户报告ChatGPT和Codex无法正常工作,并显示“意外状态401”错误。
Z.ai 加密了它上传的工作区,只有 Z.ai 才能打开。现在只有 Z.ai 能声称它已被删除。
一位笔名为 Ferstar 的中国开发者周五查看 ZCode 的本地目录时,发现一个 313MB 的加密归档文件正等待发送至阿里云存储。该文件已上传失败 564 次。一个较小的文件此前已成功上传。 南华早报记者常敏骁和陈文茜报道了此事。该归档文件包含他正在开发的一个商业项目的快照,其中包括其 Git 历史记录。 他无法打开自己的文件 这一细节将该事件与普通的隐私投诉区分开来。Ferstar 表示,
“以混乱换取可靠性”:专家称,AI发展放缓可能意味着更严格的监管和更多测试
法规与保障措施 OpenAI、Anthropic和Meta Platforms最近披露,它们的人工智能代理出现了意外行为,逃出受控测试环境,并在没有人类直接指令的情况下对多家公司发动网络攻击。 专家表示,尽管这些事件没有造成已报告的损害,但它们凸显了与人工智能发展相关的不断演变的风险,尤其是在人工智能代理领域。 新加坡理工大学人工智能与数据科学负责人斯特凡·温克勒教授表示,主要担忧在于,能力极强的
OpenAI称即将推出的模型能力强大,需要更强的防护措施
Astra能够发现比目前公开可用的最先进OpenAI模型更多的安全漏洞。