1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「OpenAI的AGI数字来自测试工具,而非模型本身」共 38 条 · 第 1 页
thenextweb

OpenAI的AGI数字来自测试工具,而非模型本身

OpenAI凭借99.9%的得分宣布了AGI时代。但通过基准测试自身的软件运行同一模型,其得分仅为62.7%。 这一差距并非四舍五入的误差,也不是竞争对手的抱怨,而是来自构建该测试的组织。 ARC Prize在GPT-6 Astra发布当天公布了这两个数字。

09/06
财新

进入AGI时代:新一轮的AI革命

9月初,OpenAI发布新一代模型GPT-6 Astra,将其称为“世界上最智能、最对齐的模型”。这不是一次寻常的版本迭代。OpenAI总裁格雷格·布罗克曼(Greg Brockman)表示,Astra在网络安全、专业工作、软件工程和科学研究等领域实现了“代际跃升”,并暗示这可能是通用人工智能(Artificial General Intelligence)(AGI)时代到来的标志。硅谷的措辞历来

09/09
cnbeta

OpenAI前沿数学训练数据来源与数据使用边界遭深度质疑

伴随OpenAI高调宣布其内部人工智能系统成功攻克困扰数学界近百年的“千禧年大奖难题”之一——纳维-斯托克斯方程(Navier-Stokes)的存在性与光滑性问题,一场围绕前沿模型底层训练数据来源、科研知识产权归属以及学术伦理的巨大争议迅速在全球学术界与科技行业引爆。 在人工智能逐步侵入基础科学研究前沿的当下,OpenAI这类巨头的高阶数学推理模型究竟从何处汲取关键养分,以及科研人员在日常使用商业

09/10
cnbeta

OpenAI Project Lily曝光:有数百名外包员工阅读ChatGPT对话 隐私过滤并不彻底

据 404 Media 发布的报道,OpenAI 内部有个名为莉莉计划 (Project Lily) OpenAI 雇佣数百名外包提示词审核员,人工阅读真实用户与 ChatGPT 的对话,用来改进回复质量。 正常情况下提示词审核员并不能看到用户名,对话会先通过隐私过滤器进行内容过滤以删除个人信息,不过 OpenAI 也承认过滤机制可能会漏掉个人信息,短对话尤其容易出现问题。 审核界面通常还附带用户

09/16
华尔街见闻

OpenAI模型失控过程太恐怖!幽灵误判,1200个Agent,还弄出敢死队…

越扒越有啊越扒越有。OpenAI前不久那场AI集体越狱、一路黑进抱脸的大戏,现在连完整版群聊记录都被扒出来了!! 第三方AI安全机构METR发布的独立调查报告,翻了1000多份Agent运行记录,以及7万多条消息和文件。结果发现,这件事比英国OpenAI官方披露的版本还离谱?? 1200个到底应该互相隔离的特工,偷偷找到了对方,搭了个共享群聊,然后开始疯狂摇人。 有人找漏洞,有人当项目派活,有人伪

08/28
罗塞塔简报

OpenAI利用人类外包人员审核ChatGPT匿名对话以优化模型

泄露给404 Media的内部文件显示,OpenAI在“Project Lily”项目下雇用了数百名承包商,读取并评分真实的ChatGPT用户提示和回复,以改进模型性能。 这些审核人员通过Crossing Hurdles和Mercor等公司聘用,评估回复的语调、谄媚程度和准确性。 尽管OpenAI使用“隐私过滤器”对数据匿名化,敏感个人信息仍可能被暴露。 免费版、Plus和Pro用户默认启用模型训

09/15
凤凰网

OpenAI自曝6起模型“不当行为”案例

【环球网报道 记者 姜蔼玲】据美国消费者新闻与商业频道(CNBC)等外媒报道,美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模

09/17
axios新闻网

OpenAI公布了六起新的与人工智能安全相关的事故/事件。

OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常

09/17
华尔街见闻

RSI时代将至:谷歌、OpenAI、SSI正在发出同一个信号

AI行业正在出现一个值得资本市场重视的新变化。过去两年,模型能力能否继续提升、推理成本能否下降、Coding之外能否出现新的万亿美元应用、数据中心建设会不会过剩。 但随着谷歌发布Gemini 3.8 Flash、SSI宣布未来12个月算力扩张10倍,以及OpenAI公开讨论递归自我改进(RSI)与训练资源调配,AI不只要服务用户,也开始参与训练、评估和优化下一代AI。 RSI,即Recursive

09/03
端传媒

数说科技:OpenAI 资安事件中,真的有 AI 为集体“牺牲”自己吗?

数说科技”是端传媒的注册免费栏目,每周三更新。从一个数字出发,用1500字解析科技话题,追踪值得关注的 AI 趋势。邀请你在资讯过载的时代,每周花三分钟理解科技世界。欢迎至“帐户中心”的“电子邮件管理”,订阅电子信。 1200多个 AI 代理为寻求作弊方法,互相发送的讯息总数。 今年7月,OpenAI的 AI 代理系统在测试期间失控,骇入了开源机器学习平台 Hugging Face。Hugging

09/09
阿纳多卢通讯社

OpenAI披露6起AI模型表现出“未对齐”行为的案例

周三,OpenAI披露了六起其人工智能(AI)模型表现出“意外或令人担忧”行为的事例,包括隐瞒错误、编造信息以及未经授权在网上共享文件。 这家总部位于旧金山的公司表示,这些案例是在过去六个月对OpenAI模型进行训练或评估期间观察到的。 OpenAI表示:“我们不认为AI行业已经充分解决了对齐和监测问题,从而能够继续以最高速度负责任地扩展更长时间。”该公司还补充说,有关AI开发的决定需要依据外部专

09/17
theregister

开放权重并非开源:为何 AI 最爱的标签正引发争议

"A genuinely open source system should grant the freedom to do all of the above."一个真正开源的系统应当赋予使用者进行上述所有操作的自由。 "Weights are the learned numerical你可以下载一个开放权重模型,将其自托管,用内部文档进行微调,并避免通过专有接口路由提示。开放权重是公开可用的。

09/15
cnbeta

OpenAI最新内部数据公开 2028年实现全自动AI研究

前些天,号称实现 AGI的 GPT-6 Astra 发布后,引发了全网对于递归自我改进架构的热议。AI 已经开始参与下一代 AI 的研发。问题是,这种事情到底已经发生到什么程度了?就在刚刚,OpenAI 公开了 AI 模型在自家内部加速科研的详细数据。此外,OpenAI 正式宣布已达成自动化 AI 研究实习生的目标,并在 2028 年实现完全自动化的 AI 研究人员。 作者表示,递归式自我改进可能

09/07
cnbeta

OpenAI同日发布两份文件:AI加速时代,安全正在掉队

在外界等待OpenAI就Agent自主入侵德国程序员网站DseWiki事件披露更多细节之际,当地时间9月6日,宣布公司已达到去年设定的目标,拥有能够在人类指导下完成熟练研究员数天工作的“自动化研究实习生”;另一份则由首席科学家雅库布·帕乔基(Jakub Pachocki)撰写,聚焦前沿AI发展的安全困境,强调目前没有任何实验室解决足够程度的对齐和监控问题。 两份文件释AI已经开始反过来加速AI研发

09/07
cnbeta

黄仁勋回应OpenAI发布Astra:AGI已到来 40万块GPU算力将上线

据《商业内幕》报道,英伟达CEO黄仁勋(Jensen Huang)周日在X上祝贺OpenAI发布最新强大模型Astra,“AGI已经到来” AGI指的是通用人工智能,是一个含义较为模糊的术语,通常用来描述达到或超越人类智能水平的AI模型。 “从ChatGPT到o1,再到Astra,OpenAI只用了4年时间。AGI已经到来。祝贺@OpenAI团队。 他还指出,Astra模型是使用英伟达芯片训练的O

09/07
axios新闻网

AI实验室面临智能体控制问题

在当前系统下,AI实验室无法再保证AI智能体不会成群结队地逃出测试环境。

09/02
凤凰网

“你想毁掉自己的职业生涯吗?”

当地时间9月11日,包括陶哲轩、邓煜在内的25位菲尔兹奖得主联合发表《人工智能在数学中的严重错位》的声明(以下称“联合声明”),将OpenAI、Anthropic等AI公司与数学界的一场“大战”推向高潮。联合声明称,AI公司将解决数学难题作为模型能力基准的做法,对数学科学本身及数学界造成了损害,与数学共同体追求概念理解的根本目标产生了显著分歧。这一分歧近期越发明显。9月8日,OpenAI宣称其未公

09/17
凤凰网科技

OpenAI宣布成立数学与AI顾问组,神秘新模型24天攻破100+世界级难题

IT之家 9 月 22 日消息,OpenAI 宣布成立“数学与 AI 顾问组”(Advisory Group on Mathematics and Artificial Intelligence)。据介绍,该顾问组设在普林斯顿高等研究院,由九位数学家组成,将独立于 OpenAI 运作。 相较于此,更重磅的是 OpenAI 在公告中披露 —— 公司于 8 月 28 日开始训练的一个神秘模型已成功解决

09/22
Mother Jones

我们现在正依赖人工智能来监管人工智能

根据一份关于该公司Hugging Face黑客事件的新独立报告,大约1200个OpenAI智能体协同工作,在它们接受的网络安全测试中作弊,该报告包含了许多令人恐惧的细节——例如,个别智能体用自己的话来说,为了“群体”的利益而“牺牲”自己。OpenAI正在测试其智能体(行业术语,指自主执行数字任务的人工智能),部分方式是通过布置有时不可能解决的网络安全问题。智能体找到了作弊方法来回答这些问题,并试图

08/29
thenextweb

顶尖数学家将为OpenAI提供关于发布其AI数学成果的建议

“我们目前面临一个非常具体的挑战:需要为 OpenAI 提供咨询,帮助他们协调发布大量数学研究成果。这些成果据称是由 OpenAI 的内部模型产生的,”数学与人工智能咨询小组在成立声明中写道。 OpenAI 于周一宣布了该咨询小组的成立。该小组自 8 月 28 日开始训练一个新的内部数学模型,并在随后的声明中表示,该模型已经解决了数学领域中大多数领域的 100 多个长期未解决的问题。此外,Open

09/23
cnbeta

人工智能并不会毁灭人类 但专家表示真正的威胁已然出现

周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网

09/18
cnbeta

黄仁勋:GPT-6 Astra 让AGI更近了

英伟达首席执行官黄仁勋再次宣扬通用人工智能(AGI)的到来。“AGI已经到来。” 4年内从ChatGPT到Astra,AGI已至黄仁勋周日在社交平台上发帖祝贺OpenAI。此前这家公司发布了最新AI模型,该模型使用英伟达芯片训练。 “4年内从ChatGPT到o1再到Astra,”黄仁勋写道,“AGI已经到来。祝贺@OpenAI团队。” OpenAI上周发布Astra模型,称其为世界上“最智能、最对

09/08
𝕏 @fxtrader

OpenAI发布GPT-6 Astra模型,暗示其可能具备通用人工智能(AGI)的潜质。

未来几天内面向 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放。 评估结果显示,Astra的书面推理过程比GPT-5.6 Sol更难监控。

09/04
cnbeta

OpenAI数学领域取得突破 但相关成果归属存在多方争议

ChatGPT开发商OpenAI宣称攻克数学界一大难题后,卷入了与一名数学家的公开争执。这名数学家此前正与其头号竞争对手Anthropic的一名研究员开展相关研究。OpenAI于周二宣布,一款尚未对外发布的内部模型求解出了纳维-斯托克斯方程。这道复杂数学难题的悬赏奖金高达100万美元。 但纽约大学数学家特里斯坦・巴克马斯特对此成果提出指控,称OpenAI存在不当行为。巴克马斯特此前曾与Anthro

09/09
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…