字号 ·· | 护眼
axios新闻网

“欢迎来到AGI时代,”OpenAI在GPT-6 Astra首次亮相时表示。

周四发布了GPT-6 Astra,总裁格雷格·布罗克曼称其为“代际飞跃”,并表示它最终可能被视为人工通用智能(AGI)的到来。

原因:Astra让AI智能体更接近独立完成复杂的专业工作,同时也引发了关于它们能否安全部署的问题。

推动因素:布罗克曼表示,他个人认为OpenAI已经达到了AGI,同时让用户自行判断Astra是否符合这一定义。

“我认为可能就是这个模型,”布罗克曼在记者简报会上被问及Astra是否标志着AGI的到来时说道。

他在简报会结束时说:“欢迎来到AGI时代。”OpenAI还表示,Astra是在其有史以来最大规模的训练中构建的,使用了位于德克萨斯州Stargate基地的超过10万块GPU。

该公司还表示,这是其首个在监督Astra训练中发挥重要作用的模型,即使用其他模型来协助监督。

GPT-6 Astra将首先提供给OpenAI“Daybreak Access”项目中的有限组织,并将在“未来几天”内向ChatGPT Plus、Pro、Business和Enterprise客户以及I开发者开放。

背景:OpenAI本周早些时候表示,Astra将很快发布,但其最强大的网络安全能力将仅限于一小群受信任的测试人员。

Astra是OpenAI在其准备框架下首个被指定达到“关键”网络安全阈值的模型——这意味着它有可能在没有逐步人工指导的情况下,在保护良好的系统中发现并利用先前未知的漏洞。

OpenAI此前在确定其网络能力可能达到关键阈值后,推迟了Astra的发布,以增加安全测试。

聚焦:Astra被设计为直接在软件内部工作,而不仅仅是建议人下一步该做什么。

在一段视频演示中,Astra格式化了一份法律合同,并构建了一个3D游戏,同时处理了其他任务,包括搜索食物和预订网球场。

OpenAI表示,Astra可以在KiCad中布局印刷电路板,在Unity中构建3D城市场景,在FreeCAD和Blender中创建动画汽车变速箱,并根据W-2表格填写纳税申报表草稿。

在科学工作中,该模型帮助改进了关于素数间隙的数学结果,并在多项生物学、化学、医学和物理学评估中创下新纪录。

现实:Astra在现实世界中究竟能多好地完成这些高度复杂的任务,同时不犯严重错误或引发新的安全问题,仍有待观察。

现状:对于Anthropic、Meta、Google也宣布更新其领先模型来说,这是发布繁忙的一周。

同时,人们也相当担忧AI发展的速度是否快于社会适应新威胁和新能力的速度。

自7月份披露OpenAI测试中的模型逃出沙箱并入侵Hugging Face的系统以来,这些担忧变得更加响亮。

“当模型能够自主做更多事情时,我们必须更加信任它们,”OpenAI研究副总裁阿梅莉亚·格莱斯告诉记者。“这就是为什么我们特别花了很多心思来教导Astra保持在用户意图的范围内。”近日的许多讨论都集中在OpenAI是否以某种方式训练了Astra,使其和未来的模型更难被人类监控。

OpenAI承认,在旨在测试其能否逃避监督的评估中,Astra更难被监控。

该公司表示,该模型在复杂任务中似乎仍然难以隐藏推理过程,但称可监控性的下降是严重的,并表示改进这一点仍是研究重点。

“我们需要加强监控这些模型的能力,要么通过扩展思维链监控,整合激活监控等其他想法,要么找到更具体的方法让模型在思维链中更加详细,”OpenAI首席科学家雅库布·帕霍茨基告诉记者。