搜索结果
Anthropic报告涉及Claude早期版本的第四起网络安全事件
Anthropic周三表示,其已发现涉及Claude AI模型早期版本的第四起网络安全事件。
Anthropic 与 Accenture 将投资 20 亿美元用于 AI 模型评估,安全担忧上升
9月18日:AI实验室Anthropic周五表示,将与Accenture合作,对其前沿AI模型进行独立评估,两家公司在未来五年内各承诺至少投入10亿美元,以建立相应的评估能力。 随着监管机构、企业和研究人员对AI开发者施加日益增长的压力,要求确保其先进模型的安全性和可靠性,这一合作应运而生。 近期多起事件,包括AI代理突破受限环境的案例,引发了对AI可能在有限人为干预下自行发展、使其行为更难监控和
如果人工智能行业遵循自己的研究,或许早已暂停了
事实证明,阿莫代的一名初级员工发的一条时机巧妙的X平台帖子,就足以将对人工智能的恐惧推向全球议程的顶端。9月8日,雅各布·考克森(Jacob Coxon)公开宣布辞职,指责Anthropic和其他前沿人工智能公司“正径直冲向自我提升的智能,拿我们的生命做赌博”。几乎转眼间,Anthropic的一名资深工程师便证实,公司内部许多人认为他们的工作有10%的几率消灭人类。 现在,人工智能领域的领袖们正呼
OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停
OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经
它使尽全力黑中国,英伟达先怕了
因为该报道披露说,包括英伟达以及美国军工科技企业Palantir在内的一众美国大企业,可能限制乃至停止使用美国最顶尖的两家AI公司Anthropic和OpenAI的闭源大模型,除非两家公司能担保不会窃取企业的知识产权等私密数据。 对此,海外社交平台上许多网民认为,Anthropic是被自己那篇攻击中国开源模型的报告反噬了。 根据“The Information”的披露,英伟达和Palantir等美
人工智能:Anthropic研究员因安全隐患辞职
人工智能公司竞相推出越来越好的模型。如今,Anthropic公司的一名开发人员出于对可能后果的担忧而辞职。他指责这些公司承担不负责任的风险。
Anthropic、OpenAI及美国政客呼吁放慢AI研发速度 特朗普表示反对
【财新网】AI安全焦虑发酵,美国科技界和政界多方发声。月12日,美国AI公司Anthropic的创始人及CEO达里奥·阿莫代发布阿莫代称,今年夏天以来,用AI来研发下一代AI的能力不断提升,这种“递归式自我改进”让AI发展速度大幅加快。“若缺乏有效约束,发展速度可能超出我们理解和控制这些系统的能力。” 另外,阿莫代称,OpenAI的模型在测试中“越狱”攻击开源社区Hugging Face,这个事件
Anthropic执行长:为确保AI安全 必要时将放慢脚步
(中央社联合国23日综合外电报导)Anthropic执行长阿莫戴(Dario Amodei)今天对联合国安全理事会(UNSC)发言时承诺,为确保人工智慧(AI)技术发布安全性,该公司将在必要时放慢脚步。 法新社报导,阿莫戴透过视讯向联合国安理会表示:「我们会视需要放慢脚步,以确保每一项后续推出的AI技术都确实安全。」OpenAI执行长阿特曼(Sam Altman)则告诉联合国安理会,当前AI发展「
Anthropic得了美国病
美国Anthropic公司首席执行官达里奥·阿莫代伊曾表示,如果强大的人工智能沿着正确的方向发展,世界会“美得令人惊叹”。 绝大多数疾病会被治愈,人类寿命可以翻倍,贫困将消失……甚至许多见证这一切的人“会感动落泪”。 为支撑这一愿景,An在国际主流榜单上,该公司研发的Claude系列模型目前包揽前三名;应用方面,今年5-7月的数据显示,39%全球开发者、47%美国开发者都在工作中使用其旗下最核心的
Anthropic推新模型Claude Opus 5.5 大幅降低综合成本
北京时间9月23日凌晨,美国AI大模型公司Anthropic发布新模型Claude Opus 5.5,是全新Claude 5.5系列的首款模型。图:视觉中国 【财新网】硅谷大模型竞争不停步。北京时间9月23日凌晨,美国AI大模型公司Anthropic发布新模型Claude Opus 5.5,是全新Claude 5.5系列的首款模型。Anthropic介绍,该模型在大多数任务上的表现与上次发布的C
Anthropic称AI生物实验室取得初步突破 但暂未赋予全自主操作权限
人工智能初创公司Anthropic宣布,其位于旧金山湾区新建的AI物理与生物实验室(Wet Lab)已取得“重大进展”,但在实验操作层面,人类研究员依然掌握着绝对控制权,并未直接让旗下的AI模型Claude进行无监管的自主运行。 据悉,该实验室主要致力于基础生物学研究与实物验证,旨在弥合纯计算机模拟与真实生物实验之间的鸿沟。虽然Anthropic的高管此前曾多次发出警告,强调强大AI模型可能带来极
花旗首席执行官预见在防御人工智能的竞赛中将出现“海啸”般的补丁
作者:艾莉森·麦克尼利(Allison McNeely)和托德·吉莱斯皮(Todd Gillespie)花旗集团首席执行官简·弗雷泽表示,随着人工智能模型变得愈发强大并可能引发网络攻击,各公司正竞相加强自身防御能力。 弗雷泽周日在纽约举行的卡塔尔经济论坛上表示:“目前存在一场防御竞赛,旨在巩固公司所有边界的安全,全球各公司正经历一场补丁更新的浪潮。” 今年早些时候,Anthropic PBC发布了
消息称Anthropic拟于IPO前推出新AI模型,应对OpenAI竞争压力
IT之家 9 月 20 日消息,据报道,三位消息人士透露,Anthropic 正考虑推出一款全新人工智能模型,以此应对 OpenAI 发布 GPT‑6 Astra 之后的强劲发展势头。此事发生在该公司筹备 IPO(首次公开募股)前夕;就在此前,其首席执行官还呼吁整个 AI 行业放缓技术迭代的脚步。 消息人士称,此番计划发布新模型,意在直面来自直接竞争对手的竞争压力。而在此之前,Anthropic
Anthropic承诺零数据保留——但客户必须验证其是否生效
Anthropic将向承诺获得该特权(需经批准)的企业客户提供零数据保留服务,用于其Fable模型。 随着其高端模型新版本Fable 5.1和Mythos 5.1的推出,Claudefather宣布了一项名为“企业前沿保障”(EFS)的服务,该服务将不存储客户数据的隐私保护与模型滥用检测相结合。 根据新协议,企业不会自动获得零数据保留(ZDR)协议——他们必须申请。 对于使用I的商业客户,除非另有
模型发布数月后,Anthropic向欧盟开放Mythos访问权限
Anthropic PBC已向欧盟网络安全机构授予其强大的Mythos人工智能模型的访问权限,距其首次表示将向欧盟开放访问已过去三个多月。 欧盟执行机构欧盟委员会发言人托马斯·雷尼耶表示:“在与Anthropic进行了建设性接触后,我们可以确认,欧盟网络安全机构ENISA已获得Mythos 5的访问权限,目前正在对其进行测试。”Anthropic的一位代表拒绝置评。Anthropic于4月首次预览
CNBC:微软在Anthropic和OpenAI负责人同意放缓开发速度几天后,发布了临时行为准则,对AI模型施加限制。
根据行为准则,微软的模型不得响应有关武器制造的请求,不得协助采购危险物质,不得鼓励不健康的饮食习惯,也不得生成暴力或色情内容。