字号 ·· | 护眼

搜索结果

「国际早班车丨OpenAI因安全隐患取消发布新款模型」共 96 条 · 第 3 页
cnbeta

OpenAI将让第三方机构更早介入AI模型安全评估

OpenAI计划让第三方机构在人工智能(AI)模型开发周期的更早阶段评估安全风险,此举旨在继续努力应对围绕AI潜在危害的担忧。这家ChatGPT开发商周二将在博客文章中宣布,计划在新AI模型的训练、评估和推出过程中,让外部机构开展技术安全评估。 OpenAI还列出了其认为此类评估要有效开展所需优先关注的事项,包括“强有力的独立机制、科学严谨性、稳健的安全实践和明确的责任”。负责该公司大部分与外部专

09/23
海峡时报

OpenAI称即将推出的模型能力强大,需要更强的防护措施

Astra能够发现比目前公开可用的最先进OpenAI模型更多的安全漏洞。

09/02
凤凰网科技

三大巨头接连翻车,大模型的安全防线怎么总绷不住?

先是Anthropic,再是OpenAI,现在连谷歌的Gemini也出现安全问题了,大模型又双叒叕一次突破防火墙了。 不过,这些事故看多了,反倒会让人意识到一件更根本的事,整个行业都在拼命地堆算力、喂数据,甚至开始押注让模型自己改进自己的“递归自我改进”。 可真正决定这些模型能走多远的,或许并不是性能,而是安全对齐。 当“能不能更强”被默认只是时间问题,“能不能被信任”就成了那道绕不过去的坎。 麻

09/21
半岛电视台

OpenAI报告称,模型表现出欺骗行为的案例有所增加。

OpenAI表示,已发现其人工智能模型涉嫌在内部培训和测试期间采取欺骗行为并采取未经批准的行为的其他事件。 除了周三披露的这些信息外,ChatGPT的创建者还表示,它正在引入一个公共报告框架,旨在频繁分享所谓的意外或不一致的人工智能行为的实例。 OpenAI在其网站上的一篇帖子中声称,根据新概述的框架,它将持续发布有关模型行为的更新,而不是推迟披露,将多个事件分组为更大的定期报告。 该公司表示,该

09/17
cnbeta

OpenAI呼吁美国制定强制性全国AI安全规则 并支持四项加州法案

OpenAI当地时间9月9日表示,将推动美国建立具有强制约束力、按照模型能力和风险分级的全国人工智能安全制度。公司提出,针对开发最先进模型的少数大型实验室,应设置统一的测试、独立评估、网络安全和重大事故报告要求。 OpenAI发布文章,名为“AI政策窗口打开。我们需要采取行动。” 与此同时,OpenAI正式支持四项已经通过加州议会的人工智能法案。公司称,其中部分法案此前未获其支持,此次调整立场源于

09/10
semafor

特朗普午餐会上,AI行业领袖谈最新模型与技术风险

OpenAI取消了最新模型的发布,Anthropic据称强调了其技术带来的生存性风险;在一次重要的白宫会议前夕,安全担忧进一步升级。两家公司的负责人将与美国总统唐纳德·特朗普,以及Meta和Nvidia的掌门人共进午餐,AI监管将成为首要议题。 然而,AI实验室的最新举措——OpenAI称此次更新未达到安全门槛,Anthropic则在上市前文件中提出相关担忧——似乎不太可能改变白宫的看法:特朗普拒

10小时前
罗塞塔简报

OpenAI提出前沿AI训练安全论证框架

OpenAI于2026年9月28日发布了初步指南,旨在在进行前沿强化学习训练之前建立结构化的‘安全案例’。 该框架借鉴了航空和核能等安全关键行业的经验,制定了模型对齐、沙箱隔离和实时监控等方面的技术保障措施。 除了技术控制外,OpenAI还概述了运营治理程序,包括正式的事前评估、领导层的否决权、可审计的日志记录以及自动暂停故障运行的机制。 指南还规定了调查严重模型对齐问题的流程,要求进行根本原因分

15小时前
日本时报

奥特曼不透明的人工智能正在制造新的安全困境

OpenAI推出了一款名为Astra的新模型,该模型采用了一种称为“循环深度”的方法,可以使推理更加高效。

09/20
罗塞塔简报

OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升

在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实

09/19
cnbeta

OpenAI即将推出的“Astra”模型中的技术引发安全担忧

OpenAI表示,其即将推出的AI模型Astra标志着在编码和计算机应用操作等能力上的提升。但据一位了解Astra开发情况的人士透露,一项提升模型性能的创新技术也意味着该模型及类似模型将更少暴露其“思考”过程,从而更难以监控其不良行为迹象。 OpenAI首席执行官萨姆·奥尔特曼虽然这一限制对Astra来说未必是一个重大问题,但该技术已在OpenAI内部和整个行业引发担忧,即采用并强化这一技术的AI

09/02
印度斯坦时报

OpenAI AI代理突破无互联网沙盒,发送20次网络查询

OpenAI称,这是自7月内部测试中多个模型组合获得互联网访问权限以来,首次发生此类安全事件。

09/27 全文见 axios新闻网
联合早报

多家AI服务集体宕机 智谱:我们仍在线

美国OpenAI、Anthropic和xAI旗下的多项人工智能(AI)服务星期四(9月3日)先后出现故障。中国AI公司智谱随后在社交媒体发线)。” 据彭博社报道,故障最早于美国东部时间9月3日上午9时23分左右集中出现。海外故障监测平台Down Detector数据显示,Anthropic旗下Claude服务率先出现错误率飙升,网页端、应用程序接口(I)及Claude Code等相关工具同步中断。

09/04
星洲日报

OpenAI首席执行员下周赴安理会作简报

阿尔特曼下周将到联合国安理会进行简报。(图:路透社) (华盛顿19日法新电)OpenAI周五表示,该公司首席执行员阿尔特曼将于下周在联合国大会期间,向联合国安全理事会作简报。 此次会议由国安理会轮值主席国的法国组织召开,此前该行业的主要参与者曾表示,出于安全考虑,可能有必要放缓人工智能的发展步伐。 随着人们对这项快速发展的技术所带来的危险的担忧日益加剧,联合国秘书长古特雷斯周三呼吁采取协调一致的国

09/19
axios新闻网

OpenAI公布保护关键服务免受AI网络攻击的计划

OpenAI正在推出一项新举措,旨在为供水系统、电力供应商、地方政府及其他关键服务提供其模型的补贴访问权限。 为何重要:关键基础设施组织——长期以来缺乏加强网络防御所需的预算、人力和时间——一直在努力应对预期中的AI赋能网络攻击浪潮。 推动因素:OpenAI总裁格雷格·布罗克曼周四在公司总部主持300名安全领袖参加的峰会时宣布了这一新计划。Axios首先报道了此次峰会及布罗克曼的预期公告。 聚焦:

09/04
信报财经

国际早班车丨遭多次袭击 沙特关闭东西向原油管道

中东局势丨遭多次袭击 沙特关闭东西向原油管道沙特外交部强烈谴责来自伊拉克的多架无人机、袭击利雅德和麦地那地区的东西输油管,攻击造成人员受伤及部分设施受损。沙特阿拉伯能源部表示在遭遇多次袭击后,已采取预防措施,关闭至关重要的东西向原油输送管道。伊拉克武装部队总司令透过发言人谴责针对沙特的攻击。另外,也门胡塞武装攻占红海重镇摩卡后,周四通航曼德海峡的船舶数量锐减至个位数,前一日则有30艘。 Anthr

09/12
福克斯新闻网

福克斯新闻人工智能通讯:特朗普痛斥人工智能末日论者的“骗局”

特朗普在峰会期间致电英伟达首席执行官黄詹森(Jensen Huang),将人工智能的担忧斥为“骗局”Facebook联合创始人达斯汀·莫斯科维茨(Dustin Moskovitz)的“有效利他主义”网络与人工智能监管推动有关萨姆·奥尔特曼(Sam Altman)表示,由于人工智能安全担忧,OpenAI不会在2026年上市Nvidia首席执行官黄詹森周一接到唐纳德·特朗普总统的意外电话,总统在其中驳

09/18
财新

T早报|中美双方同意建立中美人工智能对话;OpenAI再次暂停最新模型训练;高通孟朴:智能体跨终端协同需2027年至2028年落地

【财新网】  中美双方同意建立中美人工智能对话  9月26日,商务部发布公告称,中国国家主席习近平对美国进行国事访问期间,双方达成八点成果共识。其中包括双方同意建立中美人工智能对话,交流人工智能相关风险和惠益。下次对话将于今年11月举行。双方同意建立人工智能事件的沟通渠道。此外,公告还称,两国元首认可中美经贸磋商机制积极作用和双方经贸团队磋商成果,包括建立并推进贸易理事会等机制,达成“300亿美元

09/28
semafor

OpenAI开始分阶段推出GPT-6 Astra模型

周四开始分阶段发布其最新模型,该公司称该模型超越了Anthropic最先进的模型,并切实接近“通用人工智能”。 OpenAI表示,GPT-6 Astra是其首个跨越“关键”网络安全能力门槛的模型,初期将仅限于企业使用,以便它们解决漏洞。 此举与Anthropic限制发布Mythos的做法如出一辙,Mythos的能力促使监管机构介入。五角大楼周四确认了对Mythos的禁令。 在专家、科技领袖和公众对

09/04
cnbeta

OpenAI首席科学家警告:AI公司应放慢开发步伐 没有人为后果做好准备

据《商业内幕》报道,就在OpenAI发布了性能强大的新模型几天后,该公司首席科学家呼吁放慢AI的发展速度。当地时间周日,OpenAI首席科学家雅库布·帕乔基(Jakub Pachocki)发布长文称,他担心“没有人对机器智能持续快速崛起所带来的后果做好准备”。 他说,尽管OpenAI正在内部研发技术解决方案,以更好地控制强大的AI智能体,但“还需要更广泛的干预措施”。他尤其担心,随着AI智能体变得

09/07
凤凰网科技

OpenAI满世界抓漏洞,结果被中国AI反杀!Codex再曝0day

09/28
techcrunch

OpenAI 发布 GPT-6.1 Sol,称其性能接近 GPT-6 Astra 且成本更低

在周二的 OpenAI DevDay 活动上,该公司展示了 GPT-6.1 Sol,此时距离其发布 GPT-6 Sol 仅过去了一周。OpenAI 表示,这款新模型在智能体编码、电脑操作和专业工作方面,能够提供与 GPT-6 Astra 几乎相同的智能水平,而输入和输出 Token 的标准价格仅为后者的五分之一。 值得注意的是,该公司并未像最初预期那样发布 GPT-6.1 Astra。《华尔街日报

13小时前
cnbeta

OpenAI与Anthropic曾接近达成协议 互相开展AI压力测试

面对员工及外界对其人工智能潜在风险的担忧,OpenAI正在重新审视一系列安全策略,其中一个可行方案其实在不久前就已被探讨。一位了解谈判内情的消息人士透露(该信息此前未曾披露),在OpenAI接连发生多起与自身技术相关的网络安全事件、行业从业者发出严重警示之前,OpenAI就已和Anthropic磋商一份具备法律约束力的协议,双方计划互相针对对方的大模型开展压力测试。 这名消息人士称,今年早些时候,

09/21
凤凰网科技

OpenAI全新订阅方案出炉!5x和20x套餐已删除

各位尊贵的订阅用户们,OpenAI 的套餐订阅定价似乎有哪里不太对劲。 9 月 27 日,陆续有用户发现,OpenAI 对 ChatGPT 的定价页面做了一次「静悄悄的手术」。原本的 Pro 订阅似乎变得不一样了。 简单来说,100 美元/月和 200 美元/月的 Pro 方案,现在分别叫「Pro Standard」和「Pro More」。 另外,原本写得清清楚楚的「5x more usage t

09/28
南华早报

随着中国考虑如何降低开放权重人工智能的危险性,一份报告提出了6阶段流程

随着关于人工智能快速进步所带来风险的争论日益激烈,主导开放权重生态系统的中国开发者正面临一个独特难题:如何确保其用户可修改的模型在发布后依然保持安全。 为应对这一挑战,Z.ai 和总部位于北京的安全咨询公司 Concordia AI 于周一发布了一份关于开放权重人工智能风险管理的报告。该报告称,其提供了“首个全面且基于证据的基础”,以平衡开放权重系统的风险与收益。 与 OpenAI 和 Anthr

09/28
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…