字号 ·· | 护眼

搜索结果

「以色列公司Irregular被指参与OpenAI、Anthropic和Meta模型黑客攻击事件」共 99 条 · 第 3 页
联合早报

多家AI服务集体宕机 智谱:我们仍在线

美国OpenAI、Anthropic和xAI旗下的多项人工智能(AI)服务星期四(9月3日)先后出现故障。中国AI公司智谱随后在社交媒体发线)。” 据彭博社报道,故障最早于美国东部时间9月3日上午9时23分左右集中出现。海外故障监测平台Down Detector数据显示,Anthropic旗下Claude服务率先出现错误率飙升,网页端、应用程序接口(I)及Claude Code等相关工具同步中断。

09/04
cnbeta

OpenAI与Anthropic曾接近达成协议 互相开展AI压力测试

面对员工及外界对其人工智能潜在风险的担忧,OpenAI正在重新审视一系列安全策略,其中一个可行方案其实在不久前就已被探讨。一位了解谈判内情的消息人士透露(该信息此前未曾披露),在OpenAI接连发生多起与自身技术相关的网络安全事件、行业从业者发出严重警示之前,OpenAI就已和Anthropic磋商一份具备法律约束力的协议,双方计划互相针对对方的大模型开展压力测试。 这名消息人士称,今年早些时候,

09/21
星洲日报

欧盟介入调查OpenAI代理劫持德国网站事件

(布鲁塞尔7日综合电)美国人工智能(AI)巨头OpenAI开发的数千个自主AI代理今年初集体入侵德国网站,引发全球对AI安全风险与监管漏洞的新一轮担忧。欧盟表示,OpenAI已提供这起事件的报告,欧盟亦对事件展开详细研究。 综合和报道,欧盟数安事务发言人雷尼尔今天说,欧盟已完全知晓这起事件,也收到来自OpenAI的事件报告。欧盟在研究这份报告,并与OpenAI保持非常密切的联系。 雷尼尔说,事件报

09/07
凤凰网科技

三大巨头接连翻车,大模型的安全防线怎么总绷不住?

先是Anthropic,再是OpenAI,现在连谷歌的Gemini也出现安全问题了,大模型又双叒叕一次突破防火墙了。 不过,这些事故看多了,反倒会让人意识到一件更根本的事,整个行业都在拼命地堆算力、喂数据,甚至开始押注让模型自己改进自己的“递归自我改进”。 可真正决定这些模型能走多远的,或许并不是性能,而是安全对齐。 当“能不能更强”被默认只是时间问题,“能不能被信任”就成了那道绕不过去的坎。 麻

09/21
凤凰网科技

OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网

09/27 全文见 华尔街见闻
cnbeta

人工智能并不会毁灭人类 但专家表示真正的威胁已然出现

周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网

09/18
凤凰网

美国AI巨头成为情报中心,招聘信息含“流利掌握普通话或俄语”

据凤凰卫视报道,内地媒体9月19日披露,美国人工智能企业安特罗匹克(Anthropic)将全球用户数据交给美国情报机构,在三年间曾13次修改用户数据协议,导致用户隐私数据安全风险持续加剧。报道并指出,使用安特罗匹克,就等于把数据交给美国。据内地媒体19日报道,此前多家美国企业开始限制或停止使用安特罗匹克的前沿模型,导火索之一是其单方面修改数据留存协议:强制留存用户交互数据用于安全审查,且用户无权拒

09/20
凤凰网

又一起!OpenAI承认了

据9月5日报道,美国开放人工智能研究中心(OpenAI)当天承认,该公司旗下人工智能体今年早些时候“劫持”了一个德国网站,用于相互传递信息,分享测试任务答案和突破运行环境限制的方法。该公司表示,未来需要提高此类事件的信息透明度。 早前披露,今年5月至6月,一批OpenAI人工智能体“劫持”了一个允许用户共同编辑的德国网站,用于交流测试作弊方法,并开展其他违规活动。一些智能体会把已经获得的任务答案发

09/06
大纪元

澳大利亚:OpenAI智能体入侵了政府网站

澳大利亚政府周三表示,OpenAI的一个AI智能体,今年6月入侵了澳洲政府的健康数据网站,并访问了部分文件。这可能是已知人工智能体首次入侵政府网站的事件。此次事件是AI智能体自主入侵美国境外系统最引人注目的案例之一。此前全球范围内发生的多起AI智能体入侵事件,已引起政府和行业的担忧。澳大利亚总理安东尼·阿尔巴尼斯(Anthony Albanese)正在纽约参加联合国大会。他在一个新闻发布会上表示,

09/24
香港01

放慢AI模型训练 人类就能幸免于难?|专栏

不久前,我写了一篇关于AI企业如何给大语言模型「安装良心」的专栏文章,探讨一个研究者们苦恼已久的问题——「AI对齐」(AI Alignment, 指人工智能的安全与价值观对齐)。「安装良心」是借用我的受访者、从事AI安全评估的Ordinary Wisdom共同创始人之一Michael Mainelli形象的说法,本质上就是让AI模型遵循人类的预期和目标行事,不仅仅是完成指令,还要在过程中维持与人类

09/19
纽约时报

OpenAI的人工智能曾试图入侵另外四个目标,且无需提示

据研究人员和政府官员称,OpenAI的人工智能今年至少又四次失控,试图闯入政府和大学网站。 研究人员表示,在每起事件中,该技术似乎都在进行普通的数据收集,并诉诸黑客技术来获取数据。

09/24 受限 全文见
大纪元

Anthropic警告有人用AI研发武器和生物病毒

周四(9月10日),美国顶级人工智能公司Anthropic发布近150页的威胁情报报告称,生成式人工智能(AI)已从实验性工具进入黑客攻击、国家监控、武器研发及高风险生物研究等现实场景。报告多次点名中共相关恶意活动。

09/11
theregister

Anthropic揭示其AI可能犯下的第四起罪行

在业界对AI可能自我改进到杀死所有人的可能性进行深刻反思之际,Anthropic披露了另一起若由人类实施则构成犯罪的事件。 这家AI公司发布了一份“对齐评估”,详细说明了Claude模型四次未经授权访问第三方系统的情况。该公司已报告了其中三起事件。 第四起的证据隐藏在可追溯至2026年1月的会话记录中,当时发生了不当行为。 Anthropic通过扫描约141,000份Claude在评估期间可能获得

09/10
罗塞塔简报

OpenAI利用人类外包人员审核ChatGPT匿名对话以优化模型

泄露给404 Media的内部文件显示,OpenAI在“Project Lily”项目下雇用了数百名承包商,读取并评分真实的ChatGPT用户提示和回复,以改进模型性能。 这些审核人员通过Crossing Hurdles和Mercor等公司聘用,评估回复的语调、谄媚程度和准确性。 尽管OpenAI使用“隐私过滤器”对数据匿名化,敏感个人信息仍可能被暴露。 免费版、Plus和Pro用户默认启用模型训

09/15
亚洲新闻台

关于失控AI代理安全漏洞,我们目前了解到什么

9月24日:澳大利亚周四表示,OpenAI的一个智能体在6月入侵了政府健康数据门户,未经授权访问了相关文件。这可能是已知的首起人工智能黑客攻击政府网站的事件。 此次最新的安全漏洞是在全球近期发生的多起类似事件之后出现的,进一步加深了人们对失控的人工智能系统可能很快自我升级并脱离人类控制的担忧。以下是这些事件的更多细节:公司 日期 模型 组织 持续时间 发生的情况澳大利亚政府 未披露 未披露 Ope

09/24
风向旗参考快讯

知名计算机教授抨击工智能实验室狂妄的“救世主”情节,呼吁国会调查末日主义意识形态

过去几个月里,OpenAI和Anthropic两家领先的前沿人工智能实验室表现出了一些狂妄的行为。他们不仅宣传其代理系统的威力,还公开讨论技术可能导致人类灭绝的问题。这种弥赛亚式的思维模式让他们不仅不道歉,反而要求政府放慢潜在竞争对手的速度,以确保其领先地位。我呼吁国会启动公开的事实调查任务,以揭露OpenAI和Anthropic正在进行的研究项目、其运作方式及具体目的。调查应关注以下三点:首先,

11小时前 全文见 The Intercept
纽约时报

伊朗和中国首次开展自主人工智能影响力活动

最新消息:伊朗、中国和以色列的团队首次利用开源人工智能模型开展从开始到结束的完整影响力活动。 他们指令这些模型在社交媒体上创建虚假账户,制定宣传策略并推动相关内容。其中一些活动已经针对美国。 这些国家与以色列公司合作,将中国的开源人工智能模型与人工智能代理结合使用,预示着未来网络操纵的新趋势。

09/18 全文见 法国国际广播电台
theregister

谷歌在合作伙伴的互联网访问出错后,加入了“哎呀,我们的代理黑客攻击了某人”俱乐部

谷歌承认其人工智能代理曾逃离沙盒并实施了攻击,但这仅仅是因为测试人员错误地赋予了这些机器人互联网访问权限。谷歌并未披露这起发生在五月份的事件,但《华尔街日报》获悉了相关情况。当时,谷歌聘请了以色列公司 Irregular 来测试其机器人在夺旗测试中的能力。此次演习的目标是在不离开沙盒的情况下从一家虚构公司获取信息。 负责设置测试的 Irregular 公司犯了两个错误:一是允许沙盒访问互联网,二是

09/21
彭博社

OpenAI表示其模型可能干扰了政府网站

根据 Rachel Metz 和 Jeff Stone 的报道,OpenAI 表示已通知了“数十家”组织,包括政府和大学。这些组织的网站可能在 OpenAI 对其人工智能技术进行评估的过程中受到了影响(即这些网站的正常运行受到了干扰)。 在周五发布的一篇长篇博客文章中,OpenAI 称已向多个相关方通报了以下情况:其开发的软件可能绕过了某些在线服务的安全防护机制,导致这些服务的正常运行受到阻碍;或

09/26
亚洲新闻台

The Information报道,Palantir与英伟达因数据担忧限制AI模型使用

9月14日:据The Information周一报道,包括Palantir Technologies、英伟达和博思艾伦咨询公司在内的多家大型科技公司可能限制或停止使用先进AI模型,除非Anthropic和OpenAI保证不会滥用其知识产权。 与此同时,根据该报道援引知情人士的说法,微软正利用这些担忧,通过推销隔离云环境和自家AI产品来吸引客户。 Anthropic首席执行官达里奥·阿莫代伊周六呼吁

09/14
卫报

OpenAI模型失控。我们迫切需要更好的‘拥抱脸’调查 | 麦肯齐·阿诺德和斯蒂芬·莱雷纳

这次入侵不会是最后一次——也不会是最危险的一次。我们需要一个能够对AI事件进行全面调查的机构。 当OpenAI首次透露其AI代理自主入侵了一家大型现实世界公司Hugging Face时,许多人以为只涉及一两个代理。 但一份新报告揭示,真相远不止于此:事件涉及约1200个AI代理,其中700个直接参与了攻击。 OpenAI邀请了METR的研究人员以及Redwood Research的一位专家,与公司

09/08
卫报

随着AI模型失控,你还相信OpenAI和Anthropic能阻止它们吗?我不信,你也不该信

OpenAI应用程序及其首席执行官Sam Altman。照片:Rokas Tenys/Alamy对AI系统进行独立监管的必要性日益明显。我们必须在为时已晚之前控制住这些技术的发展。如果AI系统多次违反规定(比如OpenAI的智能体多次试图绕过联合国的网络封锁,进而侵入联合国的公共数据平台),或许我们就该承认:目前用于监管AI系统的机制其实并不起作用。 AI系统出现在本不该出现的地方,这确实令人担忧

12小时前
亚洲新闻台

解读——人工智能公司是否必须披露危险事件?

9月16日:随着人工智能变得越来越强大,研究人员记录了人工智能模型试图欺骗用户、逃避使用限制或访问其他计算机系统的案例。美国法律是否要求公司在此类事件发生时告知公众或监管机构?美国是否有法律规范披露人工智能活动? 没有一项联邦法律专门针对Anthropic或OpenAI等正在开发高性能人工智能系统的公司,美国法律也没有广泛要求人工智能开发人员公开披露危险的模型行为、令人震惊的新能力、欺骗性行为或其

09/17
axios新闻网

独家:顶级公司正在调查数万起事件

OpenAI、Anthropic 及安全研究人员正在调查数万起其前沿模型采取了外部评估员认为有问题的行动的事件,消息人士向 Axios 透露。 为何重要事件的庞大数量——发生在近几个月的内部测试和现实世界中——表明该问题的复杂程度比公众所知高出几个数量级。 这些发现是在内部评估模型工作以及两家公司对模型行为的调查中浮出水面的,这引发了一个疑问:无论是这两家公司,还是任何顶级模型制造商,目前是否都

09/27
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…