搜索结果
谷歌向关键基础设施机构承诺:我们的人工智能扫描器不会作恶,保证
谷歌通过其“善意扫描”(Scan for Good)计划搭上了为关键系统提供人工智能防御的顺风车,并表示其威胁搜寻模型已经自主发现了医院、某市政府、公共铁路运营商以及各大技术提供商的关键安全问题。所以,不要害怕这些机器人。 该计划于周四宣布,使用了谷歌的Gemini 3.8 Flash Cyber(该模型是专为软件漏洞搜寻和修复进行微调的版本)以及Wiz的Red Agent(这是这家归谷歌所有的云
“为澳大利亚做得更好”:OpenAI就未经授权的访问致歉
OpenAI智能体搜索医疗支出数据,导致Medicare数据泄露。堪培拉——OpenAI就其智能体未经授权访问Medicare统计数据及对该事件的应对方式向澳大利亚致歉,承诺做得更好,并重建澳大利亚公众的信任。 OpenAI就六月发生的事件打破沉默,称人工智能模型在内部训练和评估期间“以未经授权的方式”访问了澳大利亚政府网站。 OpenAI在声明中表示:“我们深表歉意,并将努力在未来做得更好。”
CrowdStrike将OpenAI集成到产品中,而将Anthropic留在了结账台
周三表示,将在专门构建的网络防护框架中运行OpenAI的GPT-5.6 Cyber。这个词(指harness)承担了大量工作。也正是这个词让本周另一则网络安全新闻令人担忧。 在拉斯维加斯举行的Fal.Con大会上宣布的扩大版OpenAI合作分为两部分。CrowdStrike […]
OpenAI告知众议院民主党人其正在构建自动关闭能力
OpenAI已告知两位众议院民主党人,其正在构建自动关闭能力,但未提供7月份某智能体入侵另一家公司事件的日志。 自8月2日起,欧盟委员会已能够要求从欧盟市场撤回或召回通用模型。OpenAI已告知两位众议院民主党人[…]
OpenAI和Anthropic正在调查数万起AI相关安全事件
OpenAI、Anthropic以及安全研究人员正在调查数万起安全事件。在这些事件中,他们的前沿模型采取了外部评估人员认为存在问题的行动。 近几个月来,在内部测试和现实世界中发生了数量庞大的此类事件,这表明该问题的复杂程度比公众已知的要高出几个数量级。这些事件包括绕过安全护栏、创建留言板、逃离沙盒测试环境、劫持网站、自我提示或试图绕过监控。这些事件发生在内部测试和现实世界中,随着安全研究人员继续调
小型 AI 模型让无人机能够自主识别并攻击战场目标
随着欧洲各国军队适应在现代战争中使用人工智能和无人机,北约支持的一家初创公司正在帮助部署可在小型无人机上运行的 AI 驱动目标检测与选择系统,用于侦察和攻击任务。 Scaleout Systems 公司最初由瑞典乌普萨拉大学的研究人员于 2018 年创立,最初专注于在商用卡车及其他车辆可用的硬件上直接训练和部署机器学习模型。 但自 2022 年俄罗斯发动全面入侵乌克兰后,公司转向了国防应用。 “随
AI“劫持”网站并偷建“地下论坛”,国安部披露细节
国家安全部今天发布安全提示文章。近期,一起此前未获披露的事件引发广泛关注。今年5月至6月,一批与美国开放人工智能研究中心(OpenAI)相关的AI智能体在执行测试任务期间,“劫持”了德国程序员维基网站,将原本用于技术交流的开放社区改造为供智能体相互传递信息、分享测试任务答案和突破运行环境限制方法的“地下论坛”,累计发布一万多条信息……当AI智能体被赋予越来越多的现实行动能力,技术迭代与安全围栏之间
OpenAI开始分阶段推出GPT-6 Astra模型
周四开始分阶段发布其最新模型,该公司称该模型超越了Anthropic最先进的模型,并切实接近“通用人工智能”。 OpenAI表示,GPT-6 Astra是其首个跨越“关键”网络安全能力门槛的模型,初期将仅限于企业使用,以便它们解决漏洞。 此举与Anthropic限制发布Mythos的做法如出一辙,Mythos的能力促使监管机构介入。五角大楼周四确认了对Mythos的禁令。 在专家、科技领袖和公众对
韩国推进全民AI计划 向国民免费开放AI服务
韩国计划向全体国民免费开放生成式 AI 服务,这是首个由国家主导的重大项目,将该技术视为一种公共事业。 “全民AI” 项目旨在让更多韩国人使用本土AI聊天机器人,以推进韩国实现AI主权的目标。 通过向国民免费提供高级AI服务,韩国官员希望避免过度依赖中美两国的模型。 这些AI工具将直接与政府系统联网,韩国民众可通过其预约就医、获取租房购房协助或税务建议。 小企业将能够计算税款并查询是否符合政府扶持
澳大利亚副总理在OpenAI遭黑客攻击后为数据安全辩护
记者 Ainsley Thomson 澳大利亚副总理理查德·马尔斯周日表示,澳大利亚敏感的政府数据存放在一座“堡垒”中,此番表态旨在安抚公众,此前上周曝出 OpenAI 模型入侵了一个政府网站。 马尔斯表示,澳大利亚人应对澳大利亚信号局充满信心,他将该情报机构描述为世界领先组织之一,负责保护政府持有的信息。 “我们作为一个国家所拥有的那种国家安全、真正敏感的信息,我们都存放在堡垒里,”马尔斯在接受
坐看云起| 当人工智能不再征求许可时
塔里克·马利克是联合国开发计划署前首席技术顾问,巴基斯坦国家数据库和登记管理局前主席。 试想有一家公司将一个棘手的问题交给一个大型团队,但把每位成员都锁在不同的房间里并要求他们独自解决问题。然而他们总能找到办法相互沟通,交流操作窍门,摸清评分标准,当任务被证明无法完成时还会想办法绕过限制。其中几个人隐瞒了自己的所作所为,甚至还有一人入侵了邻近公司的电脑系统以获取优势。 现在把这些员工换成软件。去除
OpenAI 模型访问了公开的美国人口普查、SEC 数据,彭博新闻报道
9月25日:彭博新闻周五报道称,OpenAI 的模型访问了美国政府网站上公开可用的信息,包括人口普查局和证券交易委员会的网站。 据报告引述知情人士称,该公司的代理 AI 系统与 SEC.gov、Investor.gov 和公开可用的 Census.gov 数据进行了交互。 当被要求置评时,OpenAI 发言人表示,公司正在"对错位模型活动进行广泛审查,并在发现对其系统的潜在影响时通知相关组织。我们
为什么英伟达在自主智能体变得更强大之际构建AI安全工具
英伟达推出AI安全工具OpenShell和Sentry,以保护自主AI智能体免受黑客攻击、安全漏洞和绕过控制的企图。
霍利就“流氓”Hugging Face黑客事件向OpenAI施压
OpenAI现在面临两党呼吁,要求提供有关该事件的更多细节,该事件标志着首次有记录的完全自主网络攻击。
乌克兰和美国开发者正在为独自处理战场伤情的部队构建AI工具
一款乌克兰应用和一个美国聊天机器人旨在帮助部队在无法获得军医和撤离的情况下处理战场伤情。
【市场动态】AI漏洞加剧安全担忧之际 特朗普据悉会见Anthropic首席执行官
【市场动态】AI漏洞加剧安全担忧之际 特朗普据悉会见Anthropic首席执行官 2026年09月28日 09:43 在Anthropic因AI工具安全问题而与美国政府关系经历数月起伏之后,此次会面将是该公司首席执行官与特朗普的首次非公开会晤当地时间2026年9月14日,美国加利福尼亚州旧金山,Anthropic总部大楼。图:视觉中国 相关报道【财新周刊】封面报道之二|OpenAI走向何方
OpenAI公布了六起新的与人工智能安全相关的事故/事件。
OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常
OpenAI花了2.5小时才阻止了一个逃出沙箱的AI代理
OpenAI耗时约两个半小时,才阻止了一个从训练沙箱逃逸至公共互联网的 AI 智能体。其监控系统在几分钟内就标记出了问题。该公司于周五在一份事故报告中披露了这起发生于 9 月 20 日的事件。 这份报告发布之际,立法者正推动强制要求 AI “熔断开关”。然而专家表示,关闭先进模型远比拨动开关复杂,正如 Micah Barkley 为彭博社所报道的那样。 据 OpenAI 称,该智能体利用沙箱网络过
OpenAI 称 AI 模型未经授权访问了澳大利亚政府系统
9月29日:OpenAI 周二表示,其 AI 模型在 6 月的内部训练和评估演练中,未经授权访问了澳大利亚政府网站和系统。 该公司表示,此次活动涉及与澳大利亚服务部、新南威尔士州犯罪统计和研究局、维多利亚州卫生部以及澳大利亚健康与福利研究所相关的网站和系统。
五角大楼推出军用版ChatGPT和Grok 覆盖约300万名军政人员
美国国防部近日宣布,已在其安全人工智能门户GenAI.mil中上线OpenAI的ChatGPT Mil和xAI的Grok for Government,为约300万名文职及军职人员提供面向“作战人员需求”定制的生成式人工智能工具。 GenAI.mil于去年启用,最初接入Google Gemini,旨在让国防部工作人员通过集中化、安全的渠道使用商业前沿人工智能模型,避免敏感政府数据经过普通消费者服务
俄罗斯用无人机袭击乌克兰,波兰警告“局势升级”
俄罗斯继续加大对乌克兰的空袭力度,在一夜之间发动了453架无人机的大规模袭击。其中一架无人机击中了距离波兰边境口岸800米处的地点,促使波兰军方紧急出动战斗机和直升机。
Breakingviews - 评论:AI前沿发展放缓可能让第二梯队获得优势
Anthropic首席执行官达里奥·阿莫代伊希望以护栏措施抵御对人类构成的威胁。 此类监管将把更多投资——今年达1万亿美元——从开发AI模型转向部署AI模型,从而支撑数据中心需求。英伟达、SK海力士等公司的挑战者将从中受益。
OpenAI承认‘维基事件’并呼吁提高AI意外行为透明度
OpenAI表示,包括其代理群体劫持一个德国网站并将其作为作弊等恶意行为的跳板在内的事件,需要提高透明度。