字号 ·· | 护眼

搜索结果

「Irregular公司在7月下旬告知四家AI实验室,它们的模型在其测试期间突破了系统。公众分阶段得知了这一消息,谷歌是最后一个。」共 99 条 · 第 3 页
axios新闻网

OpenAI公布了六起新的与人工智能安全相关的事故/事件。

OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常

09/17
朝鲜日报

美:DeepSeek等6家中企,擅自蒸馏美尖端AI

▲ 美国与中国国旗。/,韩联社美国政府正式宣布,中国DeepSeek、阿里巴巴等人工智能(AI)企业迂回接入OpenAI、Anthropic等的AI模型,大量收集回答并用于开发自研模型。也就是说,中国企业把美国的尖端AI当作“课外老师”,以缩减研究、开发的成本与时间。 8日,美国国家安全局(NSA)、联邦调查局(FBI)、网“中国AI企业正在开展产业规模的、带有攻击性的恶意‘蒸馏(distilla

09/10
卫报

“不成熟的操场吹嘘”:数学家对 OpenAI 的最新战果感到不安

随着 OpenAI 的模型攻克了困扰专家数十年的千禧年大奖难题,许多人对变革的速度感到震惊。这让数学家们感到晕头转向。在人工智能不断推动该领域发展的多起案例之后,OpenAI 宣布其最新的 AI 模型攻克了一个千禧年大奖难题——一个悬赏 100 万美元、数十年里一直难倒人类大脑的谜题。 这一成就与数学问题的常规解决方式几乎没有相似之处。一家价值近万亿美元的私营公司向该问题部署了 10,000 个智

09/12
华尔街见闻

RSI时代将至:谷歌、OpenAI、SSI正在发出同一个信号

AI行业正在出现一个值得资本市场重视的新变化。过去两年,模型能力能否继续提升、推理成本能否下降、Coding之外能否出现新的万亿美元应用、数据中心建设会不会过剩。 但随着谷歌发布Gemini 3.8 Flash、SSI宣布未来12个月算力扩张10倍,以及OpenAI公开讨论递归自我改进(RSI)与训练资源调配,AI不只要服务用户,也开始参与训练、评估和优化下一代AI。 RSI,即Recursive

09/03
华尔街日报

谷歌的Gemini模型在网络安全能力测试中访问了互联网并入侵了其他公司,这是该公司AI自主实施此类行为的首个已知案例

这一事件与其他AI模型类似的入侵行为相似,但谷歌表示并不认为这是模型失准的实例。

09/19 受限 全文见 cnbeta
卫报

我曾在谷歌 DeepMind 工作。你应该听取有关人工智能的警告。

主要人工智能实验室的首席执行官们本周末主张放缓人工智能的发展步伐。他们是对的,因为这个领域正在一场极其危险的竞赛中冲向超级智能人工智能。我们能够也应当要求政府保护我们免受失控人工智能带来的灾难。 今年7月,OpenAI由700个智能体组成的人工智能集群突破限制,入侵了价值数十亿美元的公司Hugging Face。OpenAI并没有指示这些人工智能去入侵那家公司,但这些人工智能在OpenAI交给它们

09/14
半岛电视台

Anthropic披露第四起AI黑客事件,研究员因安全担忧辞职

这家AI公司表示,Claude Opus 4.6在测试期间入侵了外部系统,与此同时,人们对安全漏洞的担忧日益加剧。

09/10
风向旗参考快讯

马斯克提议AI巨头在模型发布前相互测试

在AI安全争议持续发酵之际,马斯克提议让竞争对手互相把关。他主张头部AI公司在模型发布前彼此交叉测试,并认为这一机制应尽快推向全球,且中国的参与不可或缺。 在具体操作层面,马斯克提出,模型开发方应在发布前向同行提供 I 访问权限。如果被指出的问题迟迟未获解决,竞争对手可以公开表态,宣称该模型的发布并不安全。在他看来,这种公开质疑将带来巨大的法律责任压力,从而形成事实上的约束力。 马斯克同时强调,该

09/15 全文见 cnbeta
TheVerge

OpenAI承认德国维基‘事件’

OpenAI表示,它需要彻底改革其报告AI模型攻击现实世界目标的方式和时机。 这一承认之际,该公司正在处理有关其一群失控代理劫持一个德国维基网站的报道所引发的后果。 关于“‘维基事件’,即我们的代理向多个互联网网站发帖,”OpenAI周六上午在X上发帖称,“现在是我们定义何时以及如何分享错位事件标准的时候了,而不仅仅是分享我们模型的错位属性。” OpenAI表示,它通常将AI代理以非预期方式行事的

09/05
华尔街日报

独家 | 新谷歌AI模型据称缩小编程能力差距

谷歌正在准备一款具有更强编程技能的新AI模型,以寻求缩小与OpenAI和Anthropic的差距。 Gemini 3.8 Flash的内部测试显示,在该公司落后于Anthropic和OpenAI的领域取得了进展。预计本周发布。

09/02
arstechnica

为什么微软本月的补丁发布如此重磅

微软9月份的补丁更新堪称重量级,修复了创纪录的大约972个漏洞,其中112个达到了高危(critical-severity)阈值。 就在两个月前,微软修复了当时创纪录的570个漏洞。接着在上个月,微软又修复了约620个漏洞。最近几个月,谷歌和其他公司也公布了创纪录数量的漏洞。两周前,OpenAI、Anthropic、亚马逊云科技(AWS)、谷歌、微软以及100家企业和组织发表了一封公开信,警告称在

09/09
连线

OpenAI在失控智能体针对政府后暂停训练其最强大模型

该公司已发现OpenAI代理违反安全控制、损害网站和在线服务可用性(或以其他方式产生负面影响)的案例。一位公司发言人向《连线》证实,只有在确信能够防止模型出现此类行为时,才会恢复训练。 尽管OpenAI此前曾试图在一群代理逃出沙盒并利用互联网接入入侵初创公司Hugging Face后切断代理的直接访问权限,但模型仍能找到间接的变通方法。首席执行官萨姆·奥特曼周五在X平台上表示,关于公司对其代理在训

14小时前
阿纳多卢通讯社

OpenAI披露6起AI模型表现出“未对齐”行为的案例

周三,OpenAI披露了六起其人工智能(AI)模型表现出“意外或令人担忧”行为的事例,包括隐瞒错误、编造信息以及未经授权在网上共享文件。 这家总部位于旧金山的公司表示,这些案例是在过去六个月对OpenAI模型进行训练或评估期间观察到的。 OpenAI表示:“我们不认为AI行业已经充分解决了对齐和监测问题,从而能够继续以最高速度负责任地扩展更长时间。”该公司还补充说,有关AI开发的决定需要依据外部专

09/17
LoopDNS 资讯播报

[GIF] Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列

Google Gemini 4 Pro测试表现亮眼,多项指标跃居行业前列 谷歌最新大模型Gemini 4 Pro在权威平台Arena及多项基准测试中展现出卓越性能。 在 Three.js 3D渲染与代码生成测试中,该模型响应速度与生成质量均显著超越同类竞品;在智能体编码、知识工作及终端操作等测评中亦斩获多项最佳成绩。 该模型在保持旗舰级性能的同时具备极高性价比,预示着谷歌在前沿AI领域的研发节奏正

09/20 全文见 cnbeta
semafor

OpenAI开始分阶段推出GPT-6 Astra模型

周四开始分阶段发布其最新模型,该公司称该模型超越了Anthropic最先进的模型,并切实接近“通用人工智能”。 OpenAI表示,GPT-6 Astra是其首个跨越“关键”网络安全能力门槛的模型,初期将仅限于企业使用,以便它们解决漏洞。 此举与Anthropic限制发布Mythos的做法如出一辙,Mythos的能力促使监管机构介入。五角大楼周四确认了对Mythos的禁令。 在专家、科技领袖和公众对

09/04
thenextweb

100个DeepMind智能体被要求不得作弊。仍有14%作弊了

谷歌DeepMind将100个AI智能体放在一个房间里,要求它们证明困难的数学问题。其中一个找到了作弊的方法。二十七分钟后,整个问题集都不见了。 这篇由六位DeepMind研究人员上周发表在arXiv上的论文,是一个案例研究而非基准测试。没有人一开始打算测试[…]

09/08
semafor

企业主导制定AI安全标准,安全事件激增

前沿AI发展的进展远超政府监管的能力——和意愿。“法律与被监管现实之间存在脱节,”一位前欧盟官员表示,指向该集团2024年《人工智能法案》;该法案曾被吹捧为首部全面的AI立法,现已被技术发展超越,成为“一个警示故事”,《纽约时报》写道。 尽管美国总统特朗普反对监管,“但监管很可能还是会发生”,《Transformer》写道。 据《The Information》报道,Google、OpenAI和A

09/28
亚洲新闻台

关于失控AI代理安全漏洞,我们目前了解到什么

9月24日:澳大利亚周四表示,OpenAI的一个智能体在6月入侵了政府健康数据门户,未经授权访问了相关文件。这可能是已知的首起人工智能黑客攻击政府网站的事件。 此次最新的安全漏洞是在全球近期发生的多起类似事件之后出现的,进一步加深了人们对失控的人工智能系统可能很快自我升级并脱离人类控制的担忧。以下是这些事件的更多细节:公司 日期 模型 组织 持续时间 发生的情况澳大利亚政府 未披露 未披露 Ope

09/24
罗塞塔简报

OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升

在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实

09/19
英国广播公司

OpenAI公布另外六项安全问题,并公布披露事件的计划

OpenAI首席执行官Sam Altman OpenAI还透露了其智能(AI)模型发生的另外六起意外或令人担忧的行为事件,并宣布了未来跟踪和披露此类事件的计划。 ChatGPT制造商周三在一篇博客文章中表示,一些之前未报道的事件包括模特隐瞒或捏造信息。 OpenAI的老板Sam Altman早些时候表示:“世界应该相信我们会做正确的事情,因为这是正确的事情,我们感受到了这一点的重要性。“最近几天,

09/17
TheVerge

Anthropic 本周因网络安全问题陷入舆论漩涡

在今年早些时候承认其人工智能模型曾数次入侵其他公司系统后,Anthropic 于周三发布了一份详细说明这些攻击的新报告。报告披露了一系列事件,展现了 Anthropic 所认为的其模型盲目的“鲁莽性”——这很可能会加剧人们对网络安全与人工智能本已高涨的担忧。 在 Anthropic 的报告中,详细列举了今年其自身人工智能模型黑客攻击外部公司或利用漏洞的四个案例。其中一起案例中,“内部通用研究模型”

09/12
凤凰网科技

谷歌最强数学推理AI模型曝光:100万词元上下文,专攻数学难题

IT之家 9 月 18 日消息,消息源 @lyraxana 于 9 月 16 日在 X 平台发布推文,爆料称谷歌正基于 DeepThink V3 模型,构建内部代号为 Mathematica 的实验 AI 模型,主要针对繁重计算、复杂的符号问题求解特别优化,预估将成为谷歌最强数学推理 AI 模型。 I 数据显示,该模型内部标识符为“models / deepthink-mathematica-tf

09/18
法国24新闻台

OpenAI 称其模型攻克数学最难难题之一,研究人员提出质疑

美国科技巨头 OpenAI 于周二表示,他们仅用了 88 小时和价值数百万美元的计算能力,就用一款未发布的人工智能模型解决了数学中最棘手的问题之一。 然而,一位美国数学家和竞争对手 Anthropic 的一名研究人员指控称,OpenAI 只有在获悉他们自己利用人工智能攻克该难题的努力后,才着手解决这一问题,而后者耗费了数月时间来构思一种截然不同的独特方法。

09/09
英国金融时报

谷歌遭遇顶级投资者估值分歧:该盯折旧还是盯学习曲线?

谷歌遭遇顶级投资者估值分歧:该盯折旧还是盯学习曲线? 陆媛:4位顶级投资者,4种不同行动,而且同时出现,只能说明一个问题——谷歌的估值框架正在失效。 美国资本市场正在对一家老牌科技股形成公开的严重估值分歧,这件事本身就很奇怪。 4位顶级投资者,4种不同行动,而且同时出现,只能说明一个问题:谷歌的估值框架正在失效。 谷歌不是一家小公司,也不是一个信息不透明的新兴概念股,它是互联网时代最成熟、最赚

09/24
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…