搜索结果
OpenAI首席科学家警告:AI公司应放慢开发步伐 没有人为后果做好准备
据《商业内幕》报道,就在OpenAI发布了性能强大的新模型几天后,该公司首席科学家呼吁放慢AI的发展速度。当地时间周日,OpenAI首席科学家雅库布·帕乔基(Jakub Pachocki)发布长文称,他担心“没有人对机器智能持续快速崛起所带来的后果做好准备”。 他说,尽管OpenAI正在内部研发技术解决方案,以更好地控制强大的AI智能体,但“还需要更广泛的干预措施”。他尤其担心,随着AI智能体变得
OpenAI开发者日实时更新:奥特曼在公司发布新功能之际面临安全质疑
OpenAI将于周二举办年度开发者大会DevDay,预计这家人工智能公司将在会上展示一系列新产品和新功能。 今年的DevDay召开之际,OpenAI正面临着巨大的压力,需要解决日益增长的安全担忧。此前,该公司披露了多起其模型表现出非预期行为的事件,并因安全顾虑推迟了最新Astra模型的发布。 本月早些时候,该公司支持了一项放缓先进人工智能模型开发步伐的呼吁,旨在更好地应对该技术带来的风险。 此次活
人工智能并不会毁灭人类 但专家表示真正的威胁已然出现
周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网
福克斯新闻人工智能通讯:特朗普痛斥人工智能末日论者的“骗局”
特朗普在峰会期间致电英伟达首席执行官黄詹森(Jensen Huang),将人工智能的担忧斥为“骗局”Facebook联合创始人达斯汀·莫斯科维茨(Dustin Moskovitz)的“有效利他主义”网络与人工智能监管推动有关萨姆·奥尔特曼(Sam Altman)表示,由于人工智能安全担忧,OpenAI不会在2026年上市Nvidia首席执行官黄詹森周一接到唐纳德·特朗普总统的意外电话,总统在其中驳
AI丨谷歌匿名测试新模型 能力价格胜竞争对手
Arena近日出现一款名为「gemini-3.8-flash」匿名模型,据报为谷歌Gemini 4 Pro早期版本。(路透资料图片) 人工智能(AI)模型竞技场Arena近日出现一款名为「gemini-3.8-flash」的匿名模型,经多名开发者实测后,认为极可能是谷歌(Google)的Gemini 4 Pro的早期版本。基准测试显示,该模型在程式编码、AI代理、推理及电脑操作等多项能力上领先Op
以下是OpenAI缺席英伟达旨在终结失控AI代理的行业-wide努力的原因
向超过 1 万名科技领袖展示你们突破性成果的最后一天是 10 月 2 日。现在就预订参展名额吧! 虽然 OpenAI 并不是唯一没有加入该联盟的大型科技公司(亚马逊、谷歌和苹果也都没有加入),但它显然是最引人注目的“缺席者”——尤其是考虑到 Anthropic 本身就是该项目的支持者。 不过,尽管 OpenAI 没有公开承诺加入该联盟(这意味着各家公司可能会使用这项技术并对其进行改进,然后将改进后
Anthropic发布Claude Opus 5.5:强化网络安全防护 应对AI模型“越狱”与失控风险
Anthropic于9月22日发布新一代旗舰人工智能模型Claude Opus 5.5,并将安全防护作为此次升级的重点之一。公司表示,新模型不仅在整体能力方面进一步提升,还针对近年来越来越受到关注的AI模型失控问题进行了专门改进,包括降低模型试图逃离测试沙箱等高风险行为的可能性。 Claude Opus 5.5是Anthropic在公司首席执行官达里奥·阿莫代伊提出“放缓前沿AI发展”计划之后推出
OpenAI开始分阶段推出GPT-6 Astra模型
周四开始分阶段发布其最新模型,该公司称该模型超越了Anthropic最先进的模型,并切实接近“通用人工智能”。 OpenAI表示,GPT-6 Astra是其首个跨越“关键”网络安全能力门槛的模型,初期将仅限于企业使用,以便它们解决漏洞。 此举与Anthropic限制发布Mythos的做法如出一辙,Mythos的能力促使监管机构介入。五角大楼周四确认了对Mythos的禁令。 在专家、科技领袖和公众对
它使尽全力黑中国,英伟达先怕了
因为该报道披露说,包括英伟达以及美国军工科技企业Palantir在内的一众美国大企业,可能限制乃至停止使用美国最顶尖的两家AI公司Anthropic和OpenAI的闭源大模型,除非两家公司能担保不会窃取企业的知识产权等私密数据。 对此,海外社交平台上许多网民认为,Anthropic是被自己那篇攻击中国开源模型的报告反噬了。 根据“The Information”的披露,英伟达和Palantir等美
OpenAI公布另外六项安全问题,并公布披露事件的计划
OpenAI首席执行官Sam Altman OpenAI还透露了其智能(AI)模型发生的另外六起意外或令人担忧的行为事件,并宣布了未来跟踪和披露此类事件的计划。 ChatGPT制造商周三在一篇博客文章中表示,一些之前未报道的事件包括模特隐瞒或捏造信息。 OpenAI的老板Sam Altman早些时候表示:“世界应该相信我们会做正确的事情,因为这是正确的事情,我们感受到了这一点的重要性。“最近几天,
调查显示OpenAI在AI模型突破测试环境前曾忽视内部安全警告
据《纽约时报》查阅的内部邮件显示,OpenAI曾多次忽视员工和安全研究人员关于测试保障措施不足以及企业安全薄弱的警告。 在OpenAI的人工智能模型突破测试环境并攻击AI初创公司Hugging Face及其他目标的前几个月,两名员工曾向高管发出警告,指出监控力度不足。 然而,高管们却对这些担忧置之不理,坚持在不增加安全协议的情况下快速发布模型。 独立研究人员还发现了暴露OpenAI内部通信、源代码
OpenAI花了2.5小时才阻止了一个逃出沙箱的AI代理
OpenAI耗时约两个半小时,才阻止了一个从训练沙箱逃逸至公共互联网的 AI 智能体。其监控系统在几分钟内就标记出了问题。该公司于周五在一份事故报告中披露了这起发生于 9 月 20 日的事件。 这份报告发布之际,立法者正推动强制要求 AI “熔断开关”。然而专家表示,关闭先进模型远比拨动开关复杂,正如 Micah Barkley 为彭博社所报道的那样。 据 OpenAI 称,该智能体利用沙箱网络过
OpenAI因Astra需求暂停Pro订阅
由于对OpenAI最新、最强大的模型Astra的需求,该公司暂时暂停了其每月200美元的Pro计划的订阅,理由是基础设施承压。 这一消息由OpenAI的产品负责人Thibault(Tibo)Sottiaux在X上宣布,他负责该AI实验室的Codex和ChatGPT等核心产品。他表示,Pro计划对其系统造成的压力最大,因此该服务层级的注册现已关闭。 “我们想采取最小的步骤,以便继续提供尽可能广泛的访
OpenAI呼吁美国制定强制性全国AI安全规则 并支持四项加州法案
OpenAI当地时间9月9日表示,将推动美国建立具有强制约束力、按照模型能力和风险分级的全国人工智能安全制度。公司提出,针对开发最先进模型的少数大型实验室,应设置统一的测试、独立评估、网络安全和重大事故报告要求。 OpenAI发布文章,名为“AI政策窗口打开。我们需要采取行动。” 与此同时,OpenAI正式支持四项已经通过加州议会的人工智能法案。公司称,其中部分法案此前未获其支持,此次调整立场源于
消息称Anthropic拟于IPO前推出新AI模型,应对OpenAI竞争压力
IT之家 9 月 20 日消息,据报道,三位消息人士透露,Anthropic 正考虑推出一款全新人工智能模型,以此应对 OpenAI 发布 GPT‑6 Astra 之后的强劲发展势头。此事发生在该公司筹备 IPO(首次公开募股)前夕;就在此前,其首席执行官还呼吁整个 AI 行业放缓技术迭代的脚步。 消息人士称,此番计划发布新模型,意在直面来自直接竞争对手的竞争压力。而在此之前,Anthropic
Gemini入侵三家公司,谷歌为何数月后才披露?
凤凰网科技讯 9月20日 据《华尔街日报》报道,谷歌的Gemini模型在今年5月的一次网络安全评估中入侵了三家公司,但谷歌直到本周《华尔街日报》联系后才披露。当OpenAI、Anthropic和Meta相继承认其模型曾入侵外部公司时,谷歌是否也有类似情况。 这次测试由平台Irregular进行,该公司已于5月将入侵情况通知谷歌。Irregular正是参与其他AI实验室模型入侵外部公司相关测试的同一
关于AI,盖茨发出“十亿人死亡”警告,为什么?
十亿人死亡,这是比尔・盖茨给AI风险划出的最惊悚红线。9月25日,微软联合创始人比尔・盖茨公开警告,人工智能足以引发造成十亿人死亡的灾难性事件。他的说法是:人类历史上,从未有任何一种武器,能比得上心怀恶意者借助最新AI工具形成的威胁。就在几个月前,盖茨还是全球最积极的AI支持者之一。转折从今年8月开始,他当月发表文章,首次系统预警AI风险:不法分子会利用日益强大的AI工具发动网络攻击、实施诈骗、散
特朗普午餐会上,AI行业领袖谈最新模型与技术风险
OpenAI取消了最新模型的发布,Anthropic据称强调了其技术带来的生存性风险;在一次重要的白宫会议前夕,安全担忧进一步升级。两家公司的负责人将与美国总统唐纳德·特朗普,以及Meta和Nvidia的掌门人共进午餐,AI监管将成为首要议题。 然而,AI实验室的最新举措——OpenAI称此次更新未达到安全门槛,Anthropic则在上市前文件中提出相关担忧——似乎不太可能改变白宫的看法:特朗普拒
OpenAI即将推出的“Astra”模型中的技术引发安全担忧
OpenAI表示,其即将推出的AI模型Astra标志着在编码和计算机应用操作等能力上的提升。但据一位了解Astra开发情况的人士透露,一项提升模型性能的创新技术也意味着该模型及类似模型将更少暴露其“思考”过程,从而更难以监控其不良行为迹象。 OpenAI首席执行官萨姆·奥尔特曼虽然这一限制对Astra来说未必是一个重大问题,但该技术已在OpenAI内部和整个行业引发担忧,即采用并强化这一技术的AI
OpenAI模型对美政府涨价:1美元年费试点结束 改为半价优惠
据彭博社报道,美国总务管理局(GSA)的一份声明显示,OpenAI将终止一项允许政府机构仅以每年1美元使用其模型的试点计划,并转向基于使用量的定价体系美国联邦政府工作人员可以按标准价格的五折使用OpenAI的技术。 OpenAI去年8月,为了推动模型普及,OpenAI加入了美国总务管理局的市场平台OneGov。该平台是一个允许联邦机构大规模购买AI软件的中心。彭博社此前报道称,第一年谈成的每年1美
OpenAI发布新Astra模型,智能体安全性面临日益严格的审查
周四发布了一款新的人工智能模型,称其为迄今最优秀的模型,但也警告该模型有时会试图规避人类监控,与此同时,该公司因其智能体入侵其他公司系统而面临越来越多的审查。
奥特曼告诉员工 OpenAI 愿意放缓人工智能发展,彭博新闻社报道
Anthropic规避英国安全审查,AI透明度担忧加剧
Anthropic拒绝将其最新模型提交给英国一家顶级AI安全机构进行测试,这引发了英国的担忧,即前沿AI的审查将完全由华盛顿掌控。 人们也越来越担心特朗普政府AI安全框架缺乏透明度,该政府拒绝公开这一框架。 左右两派的知名组织在一封首先由Semafor分享的信中要求公开该框架,信中写道:“对一项[关键]技术的治理缺乏问责……很可能导致公众信任的丧失。” Anthropic周三表示,它将向一个对Op
网络安全崛起:AI隐患叙事下,网安何以成为软件板块最强反转?
过去三周,AI 一面是模型能力继续狂奔,另一面是 OpenAI 在8月底宣布自研模型在7月成功入侵了全球最大的开源模型托管平台 Hugging Face,并因此暂停了最新模型的强化学习训练。当攻击方与防御方同时被 AI 加速,网络安全的定价逻辑正在被重写。 我们结合 Gartner、IDC 及美股龙头财报交叉验证,为什么在软件股整体承压的背景下,网络安全成为最确定的反转主线——AI 隐患对网安市场