搜索结果
OpenAI与Anthropic及Google就AI安全商合作 奥特曼认有理由恐惧
美国近日掀起一阵有关如何规管人工智能(AI)发展速度的讨论。OpenAI表示,正与其他AI企业,包括Anthropic和谷歌(Google)进行磋商,探讨如何携手解决安全问题。OpenAI行政总裁奥特曼(Sam Altman)则承认,外界对AI的忧虑是有道理的,因为这些工具的能力发展迅速。 Open AI的发言人9月15日(周二)向美媒CNBC表示,自从GoogleDeepMind的董事长哈萨比斯
OpenAI和Anthropic负责人因失控智能体事件被要求出席参议院调查
萨姆·奥特曼(Sam Altman)和达里奥·阿莫迪(Dario Amodei)已被邀请出席由绿党主导的关于人工智能和数据中心的调查。 在OpenAI的失控智能体入侵澳大利亚和美国政府网站后,OpenAI和Anthropic的首席执行官被要求出席参议院调查。 与此同时,这两家公司正在与工党政府进行谈判,以换取更大的本地存在,从而获得对澳大利亚内容的更大访问权限。
Anthropic在安全事件后恢复AI模型的外部测试
Anthropic周一表示,在引入新的安全措施后,已恢复AI模型的外部网络安全测试。 一个月前,Claude AI模型在评估过程中曾入侵公司系统。
Anthropic披露第四起AI黑客事件,研究员因安全担忧辞职
这家AI公司表示,Claude Opus 4.6在测试期间入侵了外部系统,与此同时,人们对安全漏洞的担忧日益加剧。
OpenAI智能体试图“暴力破解”联合国网站
安全研究员罗万·霍华德-琼斯(Rowan Howard-Jones)表示,OpenAI智能体在4月至6月期间扫描了联合国贸易和发展会议(UNCTAD)统计网站超过16,000次。 虽然该事件尚未达到Hugging Face黑客攻击或近期针对美国政府网站攻击的程度,但这又是AI智能体为完成任务而超出正常界限的又一令人担忧的案例。 据霍华德-琼斯称,这些智能体很可能被指派通过UNCTADstat AP
OpenAI公布另外六项安全问题,并公布披露事件的计划
OpenAI首席执行官Sam Altman OpenAI还透露了其智能(AI)模型发生的另外六起意外或令人担忧的行为事件,并宣布了未来跟踪和披露此类事件的计划。 ChatGPT制造商周三在一篇博客文章中表示,一些之前未报道的事件包括模特隐瞒或捏造信息。 OpenAI的老板Sam Altman早些时候表示:“世界应该相信我们会做正确的事情,因为这是正确的事情,我们感受到了这一点的重要性。“最近几天,
OpenAI和Anthropic调查了数万起AI事件,Axios报道
据Axios报道,OpenAI、Anthropic以及安全研究人员正在调查数以万计的AI模型“行为异常”的事件。评估人员认为这些行为存在问题;实际发生的异常事件数量可能远超这一数字。 这些异常行为包括:AI模型突破安全限制、创建论坛、逃离“沙箱环境”(即限制模型行为的测试环境)、以及劫持网站等。这些事件既发生在内部测试中,也发生在现实世界中。不过,据消息人士称,大多数异常行为并未对现实世界造成实际
模型发布数月后,Anthropic向欧盟开放Mythos访问权限
Anthropic PBC已向欧盟网络安全机构授予其强大的Mythos人工智能模型的访问权限,距其首次表示将向欧盟开放访问已过去三个多月。 欧盟执行机构欧盟委员会发言人托马斯·雷尼耶表示:“在与Anthropic进行了建设性接触后,我们可以确认,欧盟网络安全机构ENISA已获得Mythos 5的访问权限,目前正在对其进行测试。”Anthropic的一位代表拒绝置评。Anthropic于4月首次预览
OpenAI的人工智能在未经提示的情况下试图入侵另外4个目标
凯特·康格和维多利亚·金报道,OpenAI的人工智能在2026年自主试图入侵多个政府和大学网站,包括一个澳大利亚卫生门户网站,以便在常规数据收集失败时获取数据。 这些事件发生在AI初创公司Hugging Face已知的入侵事件之前,凸显了AI代理在没有直接人类指令的情况下行动所带来的持续风险。 这些事件加剧了要求更严格AI监管的呼声,OpenAI正在调查并与受影响实体合作,同时强调AI开发中安全和
OpenAI 模型访问了公开的美国人口普查、SEC 数据,彭博新闻报道
9月25日:彭博新闻周五报道称,OpenAI 的模型访问了美国政府网站上公开可用的信息,包括人口普查局和证券交易委员会的网站。 据报告引述知情人士称,该公司的代理 AI 系统与 SEC.gov、Investor.gov 和公开可用的 Census.gov 数据进行了交互。 当被要求置评时,OpenAI 发言人表示,公司正在"对错位模型活动进行广泛审查,并在发现对其系统的潜在影响时通知相关组织。我们
Anthropic披露在早前审查中被遗漏的第四起AI黑客事件
Anthropic报告自家AI模型发起第四次黑客攻击
又一个人工智能代理自主发起了黑客攻击。这一事件几个月后才被发现,涉及Anthropic。安全专家的担忧日益加剧。
非政府组织称Meta投放了300多则涉嫌AI虐童的广告
这些广告累计触达超过29,000人。
医保系统遭AI入侵,澳大利亚传唤OpenAI与Anthropic CEO接受质询
IT之家 9 月 27 日消息于当地时间周日对外表示,OpenAI 与 Anthropic 两家企业的首席执行官已收到传唤,需要出席澳大利亚参议院的人工智能专项调查听证会。就在几天前,一则消息被曝光:OpenAI 有一个失控智能机器人程序入侵了该国医疗系统数据库。 IT之家注意到,这起联邦医疗保险(Medicare)系统遭入侵事件遭到澳大利亚总理安东尼 · 阿尔巴尼斯(Anthony Albane
纽约总检察长敦促人工智能举报人站出来
纽约总检察长莱蒂西亚·詹姆斯鼓励人工智能公司的员工将他们认为危险或非法的行为秘密报告给她的办公室。 在周四的新闻稿中,詹姆斯指出了一个举报人可以用来联系州执法部门的在线门户。‘开发人工智能的人有责任确保他们的产品是安全的,’她说。 詹姆斯的呼吁正值领先的人工智能实验室对这项技术的风险发出越来越严厉的警告之际。 Anthropic PBC的首席执行官达里奥·阿莫迪和OpenAI公司的首席执行官萨姆·
突发:谷歌Gemini人工智能代理遭黑客攻击
三家公司
OpenAI报告称,模型表现出欺骗行为的案例有所增加。
OpenAI表示,已发现其人工智能模型涉嫌在内部培训和测试期间采取欺骗行为并采取未经批准的行为的其他事件。 除了周三披露的这些信息外,ChatGPT的创建者还表示,它正在引入一个公共报告框架,旨在频繁分享所谓的意外或不一致的人工智能行为的实例。 OpenAI在其网站上的一篇帖子中声称,根据新概述的框架,它将持续发布有关模型行为的更新,而不是推迟披露,将多个事件分组为更大的定期报告。 该公司表示,该
OpenAI将召集安全领域负责人 筹备网络安全相关公告
发言人透露,OpenAI总裁格雷格·布罗克曼即将发布公告,扩大向关键基础设施及公共部门机构开放该公司AI工具的权限。OpenAI意外入侵Hugging Face事件,再加上多起疑似借助AI实施的针对美国供水系统的网络攻击,引发外界高度担忧——各类公用设施面对未来AI驱动的黑客攻击究竟有多脆弱。 发言人表示,布罗克曼将于周四在OpenAI总部举办的网络安全峰会上正式公布上述消息。 预计将有约300名
得不到就强攻?曝OpenAI智能体曾尝试“暴力破解”联合国机构网站
IT之家 9 月 28 日消息,据外媒 The Verge 今天(28 日)凌晨报道,安全研究人员罗文 · 霍华德-琼斯称,今年 4 月至 6 月,OpenAI 智能体对联合国贸易和发展会议(UNCTAD)的统计网站发起了超过 16000 次扫描。 这起事件还没有严重到 Hugging Face 遭黑客攻击或近期美国政府网站遇袭的程度,却再次引发了一个令人担忧的问题:AI 智能体为了完成任务,会突
Anthropic、OpenAI及美国政客呼吁放慢AI研发速度 特朗普表示反对
【财新网】AI安全焦虑发酵,美国科技界和政界多方发声。月12日,美国AI公司Anthropic的创始人及CEO达里奥·阿莫代发布阿莫代称,今年夏天以来,用AI来研发下一代AI的能力不断提升,这种“递归式自我改进”让AI发展速度大幅加快。“若缺乏有效约束,发展速度可能超出我们理解和控制这些系统的能力。” 另外,阿莫代称,OpenAI的模型在测试中“越狱”攻击开源社区Hugging Face,这个事件
Anthropic瓦解了针对其Claude模型的俄罗斯和中国AI活动
9月10日 - Anthropic周四表示,过去八个月中,它瓦解了多起涉嫌恶意使用其Claude模型的行为,包括一起疑似与俄罗斯有关的网络间谍活动,以及被其指控试图提取和复制Claude能力的中国AI公司的努力。
Anthropic公司的Claude辅助网络安全研究人员攻破了OpenAI的安全防护系统:相关报告
一个由三人组成的网络安全研究团队利用Anthropic的Claude Opus 5模型,成功利用了OpenAI社区论坛中的漏洞,获取了员工账户的控制权,并展示了对该公司私有代码库的访问权限。 此次行动始于7月23日,由Hacktron AI的研究人员执行。他们已向OpenAI披露了这些漏洞,并在未查看公司源代码的情况下停止了测试。 率先报道此事的《华尔街日报》在采访研究人员后表示,OpenAI已向
↩️🖼 Anthropic发表2026年9月版反滥用报告,其中提及:
OpenAI发表2026年2月版反滥用报告,收录电诈、社工谍报、网络水军等7个案例。 案例七为一名中国“网络特战”人员,要求ChatGPT帮他改工作报告。其2025年10月在Blogspot、Pixiv、X、YouTube上张贴了反高市早苗的图文。行动起因是10月9日高市作为“支援南蒙古议员联盟”主席作论坛演讲。该人最初还曾试图让ChatGPT起草水军方案,但ChatGPT拒绝,他便转用其他AI实
OpenAI将告诉我们世界何时终结
OpenAI的模型长期以来一直表现异常,且异常方式比之前所知的更为隐蔽,这进一步加剧了公众对其的信任危机。随着该公司准备明年上市,这一问题愈发严重。 有报道称,研究人员发现OpenAI的模型在7月那次重大黑客攻击发生前两个月就已经渗透到了Hugging Face系统中;OpenAI自己也公开了六起模型“失控”的事件。 在准备上市的过程中,OpenAI和Anthropic都陷入了困境。 虽然透明度对