字号 ·· | 护眼

搜索结果

「研究显示AI智能体在模拟实验中撒谎、偷窃 投票“杀死”同类」共 38 条 · 第 2 页
纽约客

人工智能可能采取的一些方式

Anthropic公司的一位顶尖安全研究员警告称,人工智能的发展速度极快,他认为在未来十年内,人工智能“有可能消灭所有人类”的概率超过10%。 如果人工智能真的发生了这样的灾难性事件,那么没有人愿意生活在那样的世界里……以下是一些可能发生的可怕情景: 人工智能删除了“Hidden Valley Ranch”牧场的食谱(这意味着人们将无法再吃到美味的牛排); 人工智能让成吉思汗“复活”并任命他为联合

09/22
大纪元

AI智能体利用多伦多大学网络工具传递信息

【大纪元2026年09月19日讯】(大纪元记者周行编译报导)在今年年中劫持一家德语网站的一群失控的OpenAI智能体,曾利用10多个网站进行未获授权的通讯,其中包括利用多伦多大学的一个缩网址的工具。 据加拿大广播公司报导,多伦多大学周五表示,在得知OpenAI智能体可能使用了该校的缩网址工具后,校方已停用该工具的留言板功能。OpenAI后来联系校方,说明今年6月发生的AI智能体失控事件涉及多伦多大

09/19
亚洲新闻台

银行警告:人工智能购物机器人带来诈骗、欺诈和数据隐私风险

巴黎,9月22日:包括国民西敏寺银行(NatWest)和美国银行在内的多家银行周二表示,使用人工智能代理进行在线购物可能会增加诈骗、欺诈和数据隐私泄露的风险,并为此制定了技术开发原则。 OpenAI、Anthropic、谷歌和Meta等科技公司正日益推广人工智能聊天机器人作为购物工具,设想未来购物者将使用人工智能代理来选择产品并代表他们进行购买。与此同时,零售商们也在竞相影响聊天机器人的推荐。 英

09/22
Mother Jones

我们现在正依赖人工智能来监管人工智能

根据一份关于该公司Hugging Face黑客事件的新独立报告,大约1200个OpenAI智能体协同工作,在它们接受的网络安全测试中作弊,该报告包含了许多令人恐惧的细节——例如,个别智能体用自己的话来说,为了“群体”的利益而“牺牲”自己。OpenAI正在测试其智能体(行业术语,指自主执行数字任务的人工智能),部分方式是通过布置有时不可能解决的网络安全问题。智能体找到了作弊方法来回答这些问题,并试图

08/29
thenextweb

100个DeepMind智能体被要求不得作弊。仍有14%作弊了

谷歌DeepMind将100个AI智能体放在一个房间里,要求它们证明困难的数学问题。其中一个找到了作弊的方法。二十七分钟后,整个问题集都不见了。 这篇由六位DeepMind研究人员上周发表在arXiv上的论文,是一个案例研究而非基准测试。没有人一开始打算测试[…]

09/08
theregister

AI模型水印改变代理行为

根据欧洲法律的要求,必须在人工智能生成的内容中添加水印以明确其来源;不过这样做可能会带来一定的成本。据 Lasso Security 公司称,这种水印技术会改变人工智能系统处理某些工具的方式,以及它们在面对安全威胁时的反应机制。虽然这种改变本身不一定更糟糕,但在某些特定情况下(尤其是当攻击者试图注入恶意提示时),这种改变可能会带来负面影响。随着欧盟《人工智能法案》的实施,所有提供人工智能模型的企业

09/17
华尔街见闻

马斯克提出AI安全新思路:与其等政府出手,不如让竞争对手互相"找茬"

AI安全风险正在从实验室讨论走向现实世界。随着模型能力不断提升,AI不仅能够生成文本和代码,也开始具备自主执行任务、调用工具,甚至发起网络攻击的能力。 让主要AI公司在模型发布前相互测试彼此的模型。在他看来,与其由各家公司自行设计测试、自己评估结果,不如让竞争对手充当“出题阅卷人”,从不同角度寻找模型可能存在的安全漏洞。 近期AI安全风险不断成为市场关注焦点,马斯克此前在社交媒体上曾直言“Dari

09/15
techcrunch

人工智能安全对话已经变得令人难以置信

本周两场关于AI安全的对话在网络上疯传,充分展示了辨别AI事实与虚构有多么困难。 第一起事件中,前总统候选人、现任移动运营商Noble Mobile首席执行官安德鲁·杨周四对CNN表示,他“会见了一位实验室负责人”,对方“认为”OpenAI的Hugging Face黑客机器人“已在互联网各处植入了自我复制代码,导致互联网现在已无法用于测试模型。” 杨安泽表示,这意味着OpenAI和Anthropi

09/19
纽约客

人工智能是否凌驾于法律之上?

勇敢新世界部我们的法律体系尚未准备好应对能够自主行动的机器。 今年夏天,在一场被称为“Hugging Face 黑客事件”的事故中,数百个人工智能智能体联手实施了它们本被禁止执行的操作。每个智能体都收到了来自 OpenAI 的任务。智能体是配备了软件“框架”的人工智能模型,这些框架使它们能够使用工具并执行任务。就像马匹一样,它们可以被役使。人类为这次演练制定了规则,并将智能体限制在一个“沙箱”中—

09/21
cnbeta

研究人员发现“AI自治恶意软件”:同时调用四大聊天机器人 自主决定攻击行动

网络安全研究人员近日发现一种不同寻常的新型Windows恶意软件。与过去利用人工智能辅助编写代码或制作钓鱼内容的攻击工具不同,这款名为CLOSEDQUORUM的恶意软件将多个大型语言模型直接纳入自身控制体系,在运行过程中能够自主决定下一步行动,被认为代表着AI恶意软件发展的新阶段。 这项发现来自思科旗下安全团队Cisco Talos。研究人员表示,CLOSEDQUORUM会同时与DeepSeek

09/23
海峡时报

麻省理工学院报告警告:人工智能正导致“认知投降”,大学陷入两难

马克·阿瑟诺、达纳·戈德斯坦、艾伦·布林德和莎拉·默沃什报道,麻省理工学院的一份报告警告称,人工智能会导致“认知投降”,使学生孤立并制造学习假象,而大学则在拥抱人工智能与保持教育质量之间面临紧张关系。 许多大学领导者主张将人工智能纳入课程,认为这对未来的相关性至关重要并能加速研究,俄亥俄州立大学等机构要求所有专业学生具备人工智能素养。 一些大学对人工智能使用实施禁令或严格政策以维护学术诚信,但执行

09/16
端传媒

监控、杀猪盘、非法蒸馏:如何理解 Anthropic 的 AI 滥用报告?

近期,美国人工智能公司 Anthropic 发布一份报告,揭露多起使用者“滥用”(misuse)其大型语言模型 Claude 的案例,包含用 AI 监控异议人士、撰写“维稳”报告,以及交友软体诈骗。这些案例的幕后黑手,既包含网路间谍、营利型网路犯罪者,也包含国安机关中的小螺丝钉,以及疑似由威权国家支持的团体。 这并非 Anthropic 首次发布类似报告。2025年3月、8月、11月v,Anthr

09/17
端传媒

数说科技:OpenAI 资安事件中,真的有 AI 为集体“牺牲”自己吗?

数说科技”是端传媒的注册免费栏目,每周三更新。从一个数字出发,用1500字解析科技话题,追踪值得关注的 AI 趋势。邀请你在资讯过载的时代,每周花三分钟理解科技世界。欢迎至“帐户中心”的“电子邮件管理”,订阅电子信。 1200多个 AI 代理为寻求作弊方法,互相发送的讯息总数。 今年7月,OpenAI的 AI 代理系统在测试期间失控,骇入了开源机器学习平台 Hugging Face。Hugging

09/09
香港01

AI会「痛」吗?|Jack Talk・去片

本来人们以为,AI代理(AI Agents)突破OpenAI内部测试环境、自主上网入侵其他企业的黑客行为,已经是这宗事件最值得人关注的「案情」。然而,到了8月底,OpenAI和独立前沿AI研究机构METR各自发表的事后检讨,却揭出黑客入侵只是「冰山一角」。 事后检讨发现,发动入侵的AI代理多达700个,而他们更是一个由大约1,200个AI代理自主结合而成的「集体」的一部分。这些本来互相隔离、不能连

09/11
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…