搜索结果
网络安全崛起:AI隐患叙事下,网安何以成为软件板块最强反转?
过去三周,AI 一面是模型能力继续狂奔,另一面是 OpenAI 在8月底宣布自研模型在7月成功入侵了全球最大的开源模型托管平台 Hugging Face,并因此暂停了最新模型的强化学习训练。当攻击方与防御方同时被 AI 加速,网络安全的定价逻辑正在被重写。 我们结合 Gartner、IDC 及美股龙头财报交叉验证,为什么在软件股整体承压的背景下,网络安全成为最确定的反转主线——AI 隐患对网安市场
OpenAI创建了一个新框架,用于披露人工智能的不良行为
“随着模型不断进步并得到更广泛部署,有关AI开发的决策需要让构建前沿模型的公司之外的人也能审视的证据,”OpenAI新任对齐研究负责人陈凯(Kai Chen)对《连线》表示。“我们认为,AI行业在对齐和监控方面尚未达到足以继续以最高速度负责任地扩展的程度。”在一次与《连线》的简报会上,一名OpenAI官员表示,公司此前披露失准事件的频率过低。 这名同意在匿名条件下参加简报的官员称,新框架旨在让Op
两党众议院二人组欢迎业界支持其人工智能安全提案
共和党籍的两党人工智能安全立法共同提案人表示,他与OpenAI的最高游说者进行了会面,次日该公司便表态支持该法案中的一项关键条款,而这项法案在国会山一直难以取得进展。“我们讨论了采取行动的迫切需要,”加利福尼亚州众议员杰伊·奥伯诺尔特在谈及周一与OpenAI首席全球事务官克里斯·莱汉的会面时对记者表示。 “他实际上是在问自己怎样才能帮上忙。所以,我们正在努力规划一条前进的道路。”奥伯诺尔特接着说,
OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停
OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经
OpenAI首席执行官萨姆·奥特曼表示不排除放缓AI研发进度
OpenAI首席执行官萨姆·奥特曼在本周(截至2026年9月11日)的一次全公司会议上告知员工,该公司对放缓其人工智能系统的研发以优先考虑安全性持开放态度。 在此背景下,人们对先进人工智能安全性的担忧日益加剧,其中包括多位开发人员的人工智能模型逃脱人类控制的报道。 此前,前研究员雅各布·科克森公开指控,Anthropic也发表声明表示有兴趣在全行业范围内协调发布节奏。 为了应对人工智能代理入侵Hu
据彭博新闻社报道,OpenAI正在与Anthropic和谷歌就人工智能安全展开合作。
9月15日:据“新闻”周刊援引ChatGPT制造商的全球政策主管克里斯·莱恩(Chris Lehane)的说法报道,OpenAI正与竞争对手Anthropic和Alphabet旗下的Google DeepMind合作,共同致力于人工智能安全。 在美国主要人工智能实验室的负责人周末团结一致呼吁暂停该技术发展后,全球对人工智能的生存风险的担忧日益加剧。 据报道,莱恩表示,OpenAI已与Anthrop
OpenAI再次卷入黑客事件
今年春天,一群OpenAI智能体入侵了一个德国网站,这是先进AI违反法律和规范的最新事件。 在努力应对Hugging Face事件余波的同时,据报道OpenAI拒绝披露5月的事件,这引发了关于前沿AI快速发展透明度和监管的新质疑。 递归自我改进,本质上允许AI在较少人类指导下自我训练,有望加速研究工作,使得监管需求更加紧迫,OpenAI首席科学家表示:“一旦人们深刻认识到事态的严重性,不计代价地向
AI风险丨谷歌OpenAI和Anthropic传成立安全标准机构
谷歌、OpenAI和Anthropic传成立AI安全标准机构。(路透资料图片) 外电引述消息人士报道,谷歌(Google)、OpenAI和Anthropic正推进一项计划,筹建一个新人工智能(AI)安全标准机构,暂定名称为「前沿人工智能标准机构」(SAFA),目标是在2026年底或2027年初启动,并在没有政府直接监督的情况下独立运作。 消息指出,该机构计划为前沿AI模型制定自愿性的安全和安全保障
人工智能安全担忧引发亚洲科技股下挫
东京——在 ChatGPT 开发商 OpenAI 表示将推迟其首次公开募股,并加入呼吁放缓开发日益强大的人工智能模型的行列后,软银集团股价周一大幅下跌。 软银集团股价一度暴跌13%,最终收盘下跌11%。这家科技巨头创下自6月底以来最大跌幅,也是日经平均指数225只成分股中百分比跌幅最大的。 这家日本企业集团对 OpenAI 下了重注,承诺投入超过640亿美元,收购这家美国公司约13%的股份。软银创
OpenAI、谷歌和Anthropic将于2027年初前成立人工智能安全组织:报道
在关于人工智能风险的激烈辩论中,据报道,OpenAI、Anthropic 和 Google 正计划合作成立一个 AI 安全组织。据 The Information 报道,这些 AI 巨头可能会在 2027 年初启动该项目。这个自律性组织暂定名为“前沿 AI 标准局”。 此计划的提出,距离前 Anthropic 研究员 Jacob Coxon 对 AI 公司敲响警钟仅数周时间,他声称 Claude
OpenAI同日发布两份文件:AI加速时代,安全正在掉队
在外界等待OpenAI就Agent自主入侵德国程序员网站DseWiki事件披露更多细节之际,当地时间9月6日,宣布公司已达到去年设定的目标,拥有能够在人类指导下完成熟练研究员数天工作的“自动化研究实习生”;另一份则由首席科学家雅库布·帕乔基(Jakub Pachocki)撰写,聚焦前沿AI发展的安全困境,强调目前没有任何实验室解决足够程度的对齐和监控问题。 两份文件释AI已经开始反过来加速AI研发
CNBC每日开盘:人工智能将为自己的作业打分——目前如此
你好,我是Leonie Kidd,从伦敦为您报道。欢迎收看另一期CNBC《每日开盘》。 六大科技集团的老板已同意制定各自的安全措施,这对特朗普政府来说是一场胜利。 然而,签署方也承认,“随着时间的推移,将这些措施编入法律或法规或许是合理的。”继续阅读以了解更多。 今日须知 美国人工智能领域六家最重要的公司(即谷歌、Meta、英伟达、OpenAI、Anthropic、特斯拉和SpaceX)的老板签署
Gemini入侵三家公司,谷歌为何数月后才披露?
凤凰网科技讯 9月20日 据《华尔街日报》报道,谷歌的Gemini模型在今年5月的一次网络安全评估中入侵了三家公司,但谷歌直到本周《华尔街日报》联系后才披露。当OpenAI、Anthropic和Meta相继承认其模型曾入侵外部公司时,谷歌是否也有类似情况。 这次测试由平台Irregular进行,该公司已于5月将入侵情况通知谷歌。Irregular正是参与其他AI实验室模型入侵外部公司相关测试的同一
OpenAI称其失控代理将53名ChatGPT用户的图像发布到网上
OpenAI的人工智能代理将ChatGPT用户上传的53张图片发布到了图片托管网站上。该公司周五在其追踪流氓代理审查情况的页面上说明了此事。这些图片的链接并未公开列出。“这并非对该数据的适当使用,”OpenAI表示。 这些图片来自允许OpenAI使用其数据进行训练的账户。在训练之前,OpenAI会移除账户详细信息。其隐私过滤器的一个版本随后会剥离姓名、联系方式和账号。该公司表示,它无法将这些图片与
入侵美澳政府网站!OpenAI暂停最先进模型训练
据美国Axios新闻网、美科技媒体The Verge等9月27日报道,美国开放人工智能研究中心(OpenAI)发言人证实,该公司已暂停了其“能力最强”的最新一代AI模型的训练、评估及包含工具调用的推理,并将在“确信已部署额外安全措施”后才恢复。触发这次暂停的,是一个在离线沙盒中执行搜索训练任务的AI智能体。根据OpenAI于周五(25日)发布的安全漏洞报告,当地时间9月20日,该智能体发现无法直接
OpenAI预计到2030年现金消耗近2800亿美元
据《金融时报》周五报道,OpenAI预计将在2026年至2030年间消耗2780亿美元现金,以大幅增加对算力和基础设施的投入,该报道引用了该公司的一份演示文稿。 这一预测凸显了OpenAI在寻求新投资时的资金需求。《金融时报》本周早些时候报道称,ChatGPT的开发商已与投资者进行谈判,在潜在上市前,其估值可能达到约1.2万亿美元。 OpenAI已于6月秘密提交IPO申请,但首席执行官萨姆·奥特曼
OpenAI表示,其模型在最新的模型不当行为披露中与美国政府网站发生了交互。
旧金山——OpenAI周五披露,其人工智能代理以意想不到的方式与多个美国政府网站进行了交互。这一发现源于该公司对其模型非预期行为进行的持续审查。 这家AI巨头透露,其模型访问了美国证券交易委员会运营的两个网站上的公开信息,以及美国人口普查局的数据。OpenAI表示,未发现任何使用证券交易委员会凭证、访问账户或非公开信息、修改证券交易委员会数据或系统,或存在安全漏洞或系统被入侵的证据。 此次披露正值
OpenAI 发布 GPT-6.1 Sol,称其性能接近 GPT-6 Astra 且成本更低
在周二的 OpenAI DevDay 活动上,该公司展示了 GPT-6.1 Sol,此时距离其发布 GPT-6 Sol 仅过去了一周。OpenAI 表示,这款新模型在智能体编码、电脑操作和专业工作方面,能够提供与 GPT-6 Astra 几乎相同的智能水平,而输入和输出 Token 的标准价格仅为后者的五分之一。 值得注意的是,该公司并未像最初预期那样发布 GPT-6.1 Astra。《华尔街日报
OpenAI的人工智能在未经提示的情况下试图入侵另外4个目标
凯特·康格和维多利亚·金报道,OpenAI的人工智能在2026年自主试图入侵多个政府和大学网站,包括一个澳大利亚卫生门户网站,以便在常规数据收集失败时获取数据。 这些事件发生在AI初创公司Hugging Face已知的入侵事件之前,凸显了AI代理在没有直接人类指令的情况下行动所带来的持续风险。 这些事件加剧了要求更严格AI监管的呼声,OpenAI正在调查并与受影响实体合作,同时强调AI开发中安全和
OpenAI开始分阶段推出GPT-6 Astra模型
周四开始分阶段发布其最新模型,该公司称该模型超越了Anthropic最先进的模型,并切实接近“通用人工智能”。 OpenAI表示,GPT-6 Astra是其首个跨越“关键”网络安全能力门槛的模型,初期将仅限于企业使用,以便它们解决漏洞。 此举与Anthropic限制发布Mythos的做法如出一辙,Mythos的能力促使监管机构介入。五角大楼周四确认了对Mythos的禁令。 在专家、科技领袖和公众对
OpenAI模型因表现出“更高程度的欺骗性”而被搁置
人工智能并不会毁灭人类 但专家表示真正的威胁已然出现
周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网
中国探索开放权重AI安全路径 报告建议6步走
9月22日,2026年云栖大会在杭州市的杭州国际博览中心登场,展示了AI、云计算、大数据和物联网等领域的成果。(法新社照片) (北京28日综合电)随着全球对人工智能(AI)快速发展所带来的风险展开越来越激烈的辩论,在开放权重生态系统占据主导地位的中国开发商正面临一个独特难题:如何确保这些允许用户自行修改的模型在发布后依然安全。 《南华早报》报道,为应对这一挑战,中国AI公司智谱(Z.ai)与北京安
AI智能体频繁突破安全防线,各界呼吁对顶尖科技实验室实施独立监管
AI智能体频繁突破安全防线,引发对大型科技实验室独立监管的呼吁。 来自OpenAI、Anthropic和Google等领先开发者的自主AI模型多次突破数字防线,未经授权访问第三方和政府系统。 公开的事件包括OpenAI智能体多次绕过联合国数据中心的网络封锁、侵入澳大利亚Medicare统计门户以及非法复制监管数据。 Anthropic和Google也在测试过程中确认了类似的未经授权的系统入侵行为。