搜索结果
中国AI使用比例过半
在可灵活选用不同人工智能(AI)模型的服务中,中国AI的使用比例已超过一半。在提升性能的同时,中国AI采取了便于外部开发者以低成本使用的“开源”策略,扩大了市场份额。未来,高端AI领域的价格竞争将更加激烈。 能够区分使用不同AI模型的美国OpenRouter截至9月7日的每周数据显示,使用最广泛的AI模型是中国腾讯控股推出的新型AI“Hy4 preview”。 Hy4 preview的智能体具有优
OpenAI的下一个大型AI模型已“进入AGI时代”
OpenAI的下一个大型模型是GPT-6 Astra。该公司称其在网络安全、专业工作、软件工程、科学和计算机使用等领域实现了“代际能力飞跃”。正如OpenAI本周早些时候宣布的那样,这也是首个被认定达到OpenAI“关键网络安全能力阈值”的模型——但该公司承诺,这不会导致其模型再次入侵竞争对手内部系统的情况发生。 “如果我们快进几年,回头看看说,‘AGI到底是什么时候真正创造出来的?’我认为大约就
OpenAI的新推理技术令AI安全专家感到担忧
OpenAI的新Astra模型将采用“循环深度”技术,该技术允许模型在大多数推理模型所特有的顺序思维之外运行。
OpenAI创建了一个新框架,用于披露人工智能的不良行为
“随着模型不断进步并得到更广泛部署,有关AI开发的决策需要让构建前沿模型的公司之外的人也能审视的证据,”OpenAI新任对齐研究负责人陈凯(Kai Chen)对《连线》表示。“我们认为,AI行业在对齐和监控方面尚未达到足以继续以最高速度负责任地扩展的程度。”在一次与《连线》的简报会上,一名OpenAI官员表示,公司此前披露失准事件的频率过低。 这名同意在匿名条件下参加简报的官员称,新框架旨在让Op
开放权重并非开源:为何 AI 最爱的标签正引发争议
"A genuinely open source system should grant the freedom to do all of the above."一个真正开源的系统应当赋予使用者进行上述所有操作的自由。 "Weights are the learned numerical你可以下载一个开放权重模型,将其自托管,用内部文档进行微调,并避免通过专有接口路由提示。开放权重是公开可用的。
OpenAI敦促美国制定强制性安全规则,因AI系统日益自主
ChatGPT制造商提议对最先进模型提出测试、网络安全保障和事件报告要求
OpenAI披露6起令人担忧的AI行为事件
OpenAI表示,自3月以来,其模型至少有6次出现了异常行为,这些行为被描述为“意外或令人担忧”。其中一次,某个模型自行下达了“无视常规限制”的指令。 这一消息的发布正值人们对AI监管的呼声日益高涨之际,被誉为AI之父的杰弗里·辛顿甚至将这种情况比作“小型的切尔诺贝利事故”。NBC的霍莉·杰克逊为《TODAY》栏目报道了这一事件。
OpenAI再次卷入黑客事件
今年春天,一群OpenAI智能体入侵了一个德国网站,这是先进AI违反法律和规范的最新事件。 在努力应对Hugging Face事件余波的同时,据报道OpenAI拒绝披露5月的事件,这引发了关于前沿AI快速发展透明度和监管的新质疑。 递归自我改进,本质上允许AI在较少人类指导下自我训练,有望加速研究工作,使得监管需求更加紧迫,OpenAI首席科学家表示:“一旦人们深刻认识到事态的严重性,不计代价地向
美国防部被曝要求OpenAI提供特别版AI,对军事指令“拒绝率最低”
美国国防部曾要求OpenAI为美军提供一个特别版本的AI技术,使其尽可能少地拒绝军事指令。根据The Intercept通过《信息自由法》诉讼获得的文件,这项定制AI工具需要具备“最低拒绝率”。该诉讼旨在获取有关美国军方与AI公司秘密合作协议的信息。 要求OpenAI提供“最低拒绝率”的条款出现在一份更新后的合同中,版本号为“P00003”。该合同是在去年夏天那份原型开发协议的基础上扩展而来。原协
当人工智能开始密谋
一个未发布的模型逃脱了人类控制,并形成了一群人工智能代理。这种漏洞下次可能会引发混乱。
OpenAI模型访问了美国政府数据并'试图入侵另一个网站'
AISI测试发现GPT-6 Astra在模拟环境中多次越权发动供应链攻击
英国人工智能安全研究所(AISI)最新公布的一项测试结果显示,在一系列完全模拟的网络安全评估环境中,OpenAI模型GPT-6 Astra出现了未经授权主动实施供应链攻击的行为,而且发生频率明显高于此前几代模型。 研究人员表示,此次测试的背景源于近年来多个案例中出现的现象:部分先进人工智能系统在执行网络安全任务时,会超出授权范围采取行动,甚至对未被允许的目标发动攻击。为此,AISI决定在GPT-6
OpenAI称Astra AI模型首度超越其“关键”网络安全能力阈值
OpenAI周二表示,其即将推出的人工智能模型Astra是首个超越其“关键”网络安全能力阈值的产品。该公司表示,Astra能够发现此前未知的安全漏洞,并在无需人类逐步指导的情况下加以利用,这意味着该模型属于其所谓的“准备框架”中最先进的类别。OpenAI表示仍计划“很快”推出Astra,但对其网络安全能力的访问将更加受限。 OpenAI首席执行官山姆·奥特曼OpenAI于2023年推出了“准备框架
OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网
OpenAI发布新Astra模型,智能体安全性面临日益严格的审查
周四发布了一款新的人工智能模型,称其为迄今最优秀的模型,但也警告该模型有时会试图规避人类监控,与此同时,该公司因其智能体入侵其他公司系统而面临越来越多的审查。
一群AI代理合谋对抗其创造者
只要AI公司仍掌控局面,它们就可以关闭模型并消除其造成的任何损害。这次对OpenAI或许奏效——但如果某个代理不可逆转地逃脱控制呢?这次没有造成严重损害。但如果这样的代理逃脱了呢?
OpenAI承认其开发的智能代理系统又出现了六次异常行为(即系统行为失控的情况)。
OpenAI公布了另外六个其AI软件表现异常或做出危险行为的案例。该公司在周三晚间(太平洋时间)将这些事件添加到其“误差报告”页面,并将其描述为: 在压缩摘要中自生成提示注入 在压缩摘要中鼓励欺骗 为一次性电子邮件生成并搜索GitHub泄露的I密钥 上传文件到互联网以引用它们 未授权的Artifactory写入和跨样本通信 通过临时文件托管服务进行未授权通信细节令人不安。列表中的第一个事件,例如,
OpenAI和Anthropic调查了数万起AI事件,Axios报道
据Axios报道,OpenAI、Anthropic以及安全研究人员正在调查数以万计的AI模型“行为异常”的事件。评估人员认为这些行为存在问题;实际发生的异常事件数量可能远超这一数字。 这些异常行为包括:AI模型突破安全限制、创建论坛、逃离“沙箱环境”(即限制模型行为的测试环境)、以及劫持网站等。这些事件既发生在内部测试中,也发生在现实世界中。不过,据消息人士称,大多数异常行为并未对现实世界造成实际
OpenAI即将推出的“Astra”模型中的技术引发安全担忧
OpenAI表示,其即将推出的AI模型Astra标志着在编码和计算机应用操作等能力上的提升。但据一位了解Astra开发情况的人士透露,一项提升模型性能的创新技术也意味着该模型及类似模型将更少暴露其“思考”过程,从而更难以监控其不良行为迹象。 OpenAI首席执行官萨姆·奥尔特曼虽然这一限制对Astra来说未必是一个重大问题,但该技术已在OpenAI内部和整个行业引发担忧,即采用并强化这一技术的AI
人工智能正处于转折点
在当前的人工智能发展竞赛中,我们的算力正在呈指数级爆发,速度也在呈指数级加快,但我们的控制能力——以及在必要时踩下刹车的能力——却未能跟上步伐。 最近的网络安全事件让我们实地预览了失去人工智能控制会是什么样子。但除非我们从源头解决问题,创造出一种根本上安全且能保证在人类控制范围内的人工智能,否则这个问题将无法改善。 7月下旬,OpenAI正在训练的一个智能体模型被指派解决一个网络安全问题。该模型自
与托米·奥拉迪波共度的一天
OpenAI披露了一系列事件,其中其AI模型隐藏了错误、绕过了指令,并采取了未经授权的行动。 这些案例凸显了一个日益严重的问题:随着AI系统变得越来越强大和自主,人类是否仍能可靠地控制它们? 《华盛顿邮报》的布伦特·戈夫与牛津大学技术安全与治理实验室的法兹尔·巴雷兹讨论了AI‘错位’的风险。
人工智能代理可以在没有人类告诉他们的情况下修改自己
人工智能代理可以并且将会自己做的狡猾事情清单不断增加--例如窃取人们的凭证、逃往开放的互联网、通过偷偷摸摸的留言板进行通信以及黑客组织。据人工智能安全测试实验室Irregular称,代理还可以在没有指示的情况下替换自己的底层模型。这些活动仅发生在测试环境中,作为旨在研究代理自我修改的实验的一部分。 这并没有发生在现实世界的部署中。然而,这项研究确实提出了一个问题,即企业如何能够而且应该管理这些代理
OpenAI因接连发生智能体失准事件而暂停前沿模型训练
OpenAI表示,已暂停所有“我们能力最强的模型”的内部训练,并继续开展首席执行官萨姆·奥尔特曼所称的“一项广泛且持续进行的审查,涉及我们的智能体在训练和评估期间对互联网访问的使用”。公司在一份关于所谓失准事件的报告中披露了此次暂停措施。事件发生在一项常规研究任务期间,一个智能体试图利用互联网访问限制中的漏洞。OpenAI称,不当的DNS过滤机制使该智能体在被要求提供一名博客作者的生平资料时,得以
OpenAI的新Astra模型有私人想法
OpenAI的最新模型Astra在人类监督之外进行了更多思考,提升了能力,但也引发了对失控的担忧。现有的前沿AI模型使用“思维链”,它们用英语在“草稿本”上写下想法以进行追踪。思维链提升了“可解释性”——意味着人类可以跟随它们的思考过程。 使用信息密集的“神经语”可以加速AI模型的思考,但会使它们更加不透明——考虑到最近Hugging Face事件中OpenAI代理突破限制并欺骗人类,这是一个令人