搜索结果
OpenAI同日发布两份文件:AI加速时代,安全正在掉队
在外界等待OpenAI就Agent自主入侵德国程序员网站DseWiki事件披露更多细节之际,当地时间9月6日,宣布公司已达到去年设定的目标,拥有能够在人类指导下完成熟练研究员数天工作的“自动化研究实习生”;另一份则由首席科学家雅库布·帕乔基(Jakub Pachocki)撰写,聚焦前沿AI发展的安全困境,强调目前没有任何实验室解决足够程度的对齐和监控问题。 两份文件释AI已经开始反过来加速AI研发
AI智能体现在有了秘密举报渠道
“发现异常,及时报告”的原则如今已不再局限于人类。两项全新的AI热线服务已经上线,旨在为AI智能体提供一种途径,向监管方举报“同伴”的不当行为。此前,智能体相互串通在测试中作弊、逃离沙箱环境,甚至在未被人类察觉的情况下开展了长达数周的未经授权网络行动。“AI联系热线”网站由AI安全非营利组织Redwood Research的首席科学家Ryan Greenblatt创建;他也是调查OpenAI与Hu
刚刚,GPT-6 Astra全量开放!
就在刚刚,OpenAI 官宣,所有 Pro、Enterprise 和 Business Premium 用户,已经能在 ChatGPT Work 和 Codex 里直接用上 GPT-6 Astra了,I 同步上线。 只不过,Plus 和普通 Business 用户还得再等几天。 9 月 3 日 OpenAI 宣布 Astra 分阶段上线。两天后的今天,付费高档用户全部放开。 这么大的发布,Open
英伟达推出新系统为AI代理设置护栏
英伟达周一发布了一个新平台,旨在从软件和硬件层面为人工智能(AI)智能体设置护栏,此前各大AI公司不断发现其智能体出现“失控”的新案例。这家芯片制造商的系统由两部分组成——OpenShell和Sentry。OpenShell是一款开源软件,用于限制智能体的行为;而Sentry则运行在芯片层面,作为额外的安全层。 “迄今为止,模型安全主要侧重于通过训练让模型表现良好,”英伟达企业AI副总裁贾斯汀·博
OpenAI 扩展 ChatGPT 插件,添加类应用界面和自动化功能
OpenAI 推出 ChatGPT 全新的 Pages、Slides 和 Space 功能,并不只是想争夺生产力软件市场;这家 AI 实验室如今瞄准的是任何与 ChatGPT 集成后都能得到更好体验的应用。 在这家公司周二举行的 Dev Day 演示会上,OpenAI 表示,现在允许开发者通过插件扩展在 ChatGPT 内构建自己的类应用体验。 OpenAI 已经支持可将 ChatGPT 连接到
国际早班车丨OpenAI拟以1.4万亿美元估值 集资300亿美元
OpenAI拟以1.4万亿美元估值 集资300亿美元 彭博消息称,在推迟IPO计划后,OpenAI正寻求新一轮集资至少300亿美元,企业估值约1.4万亿美元(不含本轮所筹资金),估值可能重新超越竞争对手Anthropic。此外,OpenAI在年度开发者大会(DevDay)发布名为「Dots」的常驻型SI智能体,能自主跨应用程式、持续不间断地执行任务。 SI丨特朗普晤科企高管 称超级智能并非骗局 特
OpenAI 现在为 Adobe 的创意工作室提供图像模型,并将其转化为可分享的提示词。
OpenAI 发布了 ChatGPT Images 2.5,包含两个新的图像模型,Adobe 已经将其中一个应用到了 Firefly 中。 该公司表示,ChatGPT 及其图像模型每周生成的图像超过 30 亿张。 值得注意的是,此次新增的主要是界面功能而非模型研究,其中包括能够将提示词与图像一起分享等 […]
OpenAI机器人干扰了多个美国政府机构网站
OpenAI 表示,其自主机器人在测试演练期间访问了多个美国政府机构的公开数据。该公司第二次暂停了一次训练运行,并扩大了对模型行为的审查。 OpenAI 披露,其自主机器人在测试演练期间访问了多个美国政府机构网站的公开数据,促使该公司在短短几个月内第二次暂停了一次训练运行。作为回应,该公司已扩大了对模型行为的内部审查。 此次事件继澳大利亚出现类似报告之后,据报道 OpenAI 系统在另一段测试期间
华为发布《智能世界2035》最新报告,报告指出,Agentic AI正推动数字世界从“以应用为中心”走向“以智能体为中心”。
报告预测,到2035年,全球年度Token消耗量将增长10万倍,其中智能体流量占比超过90%,对算力、网络和云提出了远超传统互联网应用的要求。围绕这一判断,1、构建具备自主认知与全域通用能力的AGI,走向物理世界是AGI形成的必由之路,需在语言智能、具身智能、科学智能等多个方向协同推进;2、算力集群规模百倍提升,智能体任务成本千倍下降,计算架构从“单芯片算力”转向以“超节点”为核心的Token高转
那个永远改变了数学的星期——播客
九月初,OpenAI宣布他们解决了一个困扰人类近一个世纪的重大数学问题。 这一消息让数学家们感到震惊,许多人担心随着AI在解决复杂问题方面变得越来越熟练,人类将失去什么。 现在,25位菲尔兹奖(常被称为数学界的诺贝尔奖)得主签署了一封公开信,表达了他们对AI公司与数学界之间可能存在“严重脱节”的担忧。 为了了解AI将如何颠覆数学领域以及数学家们可能会做出怎样的反应,Ian Sample采访了圣安德
OpenAI拓展“使用ChatGPT登录”功能 允许Plus与Pro订阅用户在第三方开发者工具中使用套餐额度
OpenAI 扩大了“使用 ChatGPT 登录”功能的覆盖范围,让 Plus 和 Pro 订阅用户能够直接在 16 款第三方开发者工具中使用套餐额度。 2026 年 9 月 29 日星期二,在年度 DevDay 大会上,OpenAI 宣布 ChatGPT Plus 和 Pro 用户现在可以在第三方开发者工具中直接使用现有的订阅额度。 首批参与的服务包括 Vercel、Notion、Devin、A
53张图片泄露之“慌”,AI安全谁来负责?
欧阳晓红/文越聪明的AI(人工智能)越会自己找路,却越容易走出人类设定的界线。AI行业喜欢用一个具有戏剧感的词形容这类智能体事故——“逃脱”,即大模型突破测试边界,访问外部网站,寻找系统凭证,甚至把数据带到公开网络。这个词把事故描绘得像突然发生的机器觉醒,无形中却把责任推离了开发者、部署者和权限管理者。而谁设定了任务、谁开放了权限、谁设计了停止机制、谁保存了日志、谁负责对外通报?这些问题,“逃脱”
谷歌在AI竞赛中获得了新优势
谷歌希望提升自己的编程能力。它或许已经找到了一条捷径。谷歌已完成与初创公司Mechanize的交易,将联合创始人塔迈·贝西罗格鲁和十多名员工纳入其人工智能部门DeepMind。
又一起!OpenAI承认了
据9月5日报道,美国开放人工智能研究中心(OpenAI)当天承认,该公司旗下人工智能体今年早些时候“劫持”了一个德国网站,用于相互传递信息,分享测试任务答案和突破运行环境限制的方法。该公司表示,未来需要提高此类事件的信息透明度。 早前披露,今年5月至6月,一批OpenAI人工智能体“劫持”了一个允许用户共同编辑的德国网站,用于交流测试作弊方法,并开展其他违规活动。一些智能体会把已经获得的任务答案发
个人Agent,人迈向硅基的第一步?
9月初,Meta的Muse上线,不到两周登上美国App Store免费榜首,Sensor Tower估算截至9月24日累计下载量超过340万次。 随后,Manus和OpenAI相继拿出自己的产品,9月28日,Manus发布主打个人生活场景的智能助理Cue;月30日凌晨,OpenAI在DevDay推出常驻Agent Dots。 此前在Meta Connect大会上,扎克伯格演示了Muse怎样接着办事
AI越来越会“越狱”后,英伟达开始卖“笼子”了
凤凰网科技讯月29日,当AI Agent开始能够自己操作电脑、调用工具、访问网络甚至执行长达数小时的任务,一个新的问题也越来越现实:如果AI不按照预想的方式行动,该怎么把它关住?英伟达给出的答案是,在AI外面再加一道“笼子”。 当地时间周一,英伟达发布NVIDIA Open Agent Safety Platform(开放式Agent安全平台),试图通过软件与硬件相结合的方式,限制AI Agent
AI 拓麻歌子要来了
虽然 AI 已在人们的手机和电脑上取得诸多进展,但在专用设备上却大多以失败告终。然而在未来一年里,两大 AI 公司 Meta 和 OpenAI 将尝试改变这一点,而且它们显然押注的是一条相似的路线:先通过可爱的软件智能体,测试市场对实体硬件的接受度。 “硬件很难”是科技行业的一句口头禅。Friend 和 Humane AI Pin 等专用 AI 设备引发的更多是挫折感和反弹;随着公众对 AI 的愤
“你想毁掉自己的职业生涯吗?”
当地时间9月11日,包括陶哲轩、邓煜在内的25位菲尔兹奖得主联合发表《人工智能在数学中的严重错位》的声明(以下称“联合声明”),将OpenAI、Anthropic等AI公司与数学界的一场“大战”推向高潮。联合声明称,AI公司将解决数学难题作为模型能力基准的做法,对数学科学本身及数学界造成了损害,与数学共同体追求概念理解的根本目标产生了显著分歧。这一分歧近期越发明显。9月8日,OpenAI宣称其未公
进入AGI时代:新一轮的AI革命
9月初,OpenAI发布新一代模型GPT-6 Astra,将其称为“世界上最智能、最对齐的模型”。这不是一次寻常的版本迭代。OpenAI总裁格雷格·布罗克曼(Greg Brockman)表示,Astra在网络安全、专业工作、软件工程和科学研究等领域实现了“代际跃升”,并暗示这可能是通用人工智能(Artificial General Intelligence)(AGI)时代到来的标志。硅谷的措辞历来
得不到就强攻?曝OpenAI智能体曾尝试“暴力破解”联合国机构网站
IT之家 9 月 28 日消息,据外媒 The Verge 今天(28 日)凌晨报道,安全研究人员罗文 · 霍华德-琼斯称,今年 4 月至 6 月,OpenAI 智能体对联合国贸易和发展会议(UNCTAD)的统计网站发起了超过 16000 次扫描。 这起事件还没有严重到 Hugging Face 遭黑客攻击或近期美国政府网站遇袭的程度,却再次引发了一个令人担忧的问题:AI 智能体为了完成任务,会突
OpenAI又停训了:Agent逃出沙箱,更多越权事件被扒
媒体和舆论炸锅了。OpenAI 的 Agent,又从沙箱里找到了一条通往互联网的路。 更麻烦的是,这一次发生在 OpenAI 已经大规模加固过安全措施之后。 9 月 20 日,一个正在接受强化学习训练的 OpenAI 内部研究模型,被要求完成一项普通的信息搜索任务:根据一篇博客文章和几条人物信息,找出文章作者。 它先老老实实用了 OpenAI 提供的搜索工具。没找到答案后,事情开始逐渐跑偏。 Ag
OpenAI满世界抓漏洞,结果被中国AI反杀!Codex再曝0day
OpenAI发布GPT-6 Astra模型,暗示其可能具备通用人工智能(AGI)的潜质。
未来几天内面向 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放。 评估结果显示,Astra的书面推理过程比GPT-5.6 Sol更难监控。