字号 ·· | 护眼

搜索结果

「监控、杀猪盘、非法蒸馏:如何理解 Anthropic 的 AI 滥用报告?」共 94 条 · 第 4 页
cnbeta

Anthropic首席执行官呼吁放缓前沿AI开发 拟建立三层安全机制

Anthropic首席执行官达里奥·阿莫代伊呼吁控制前沿人工智能模型能力提升的速度,为安全评估和防护措施争取时间。他提出引入常驻独立评估人员、协调主要开发商的安全标准,并推动跨国风险管控合作。 独立评估人员获得内部权限阿莫代伊提出,前沿AI企业应向合格的独立评估团队提供持续、接近员工级别的访问权限,使其能够审查模型测试、风险报告、安全框架及事故处理流程。 Anthropic承诺率先实施该措施。外部

09/14
风向旗参考快讯

微软AI主管:Anthropic训练模型方式有问题

微软AI主管苏莱曼警告说,Anthropic训练其AI模型Claude的方法可能会对人类福祉造成 “灾难性影响”。苏莱曼周三发表文章,对Claude系列大语言模型指导文件中的部分表述提出质疑。Claude的“宪法”对于AI助手是否属于具有道德地位的实体保留了一定模糊空间,并提出该软件可能拥有“某种功能层面的情绪或感受”。这种表述值得警惕。 苏莱曼指出, Anthropic 将机器人当作人类来对待,

09/17 全文见 currentstatus
TheVerge

一项新的集体诉讼质疑Anthropic是否因误导高级用户而违法

Anthropic表示,高级用户对其业务至关重要——即使这意味着切断其他热门应用程序(如OpenClaw),该公司也优先考虑他们。但其中一些客户表示,Anthropic误导了他们,让他们以为高级订阅服务能带来比实际更多的价值。 在今天提起的一项扩大的集体诉讼中,一群Claude用户表示,该公司虚假宣传了其Max订阅层级的限制。该诉讼由律师莫妮卡·瓦卡(Monica Vaca)和卡蒂·达芬(Kati

09/09
彭博社

AI违规事件加剧安全担忧,特朗普会见Anthropic负责人

迈克尔·谢泼德、玛吉·伊斯特兰和考特尼·苏布拉马尼安报道:随着有关先进人工智能模型存在更广泛违规行为的最新披露,全球对人工智能风险的焦虑情绪不断加剧,这为Anthropic PBC首席执行官达里奥·阿莫迪与唐纳德·特朗普总统之间一场高风险的会晤铺平了道路。 据知情人士透露,阿莫迪与特朗普计划于周日晚共进晚餐,将这两位处于人工智能安全辩论两极的人物聚集在一起。此次会晤将是阿莫迪与该政府官员在就该公司

09/28
罗塞塔简报

斯图尔特·罗素批评 Anthropic 首席执行官提出的 AI 开发“限速”方案

2026年9月15日,斯图尔特·罗素在一篇评论文章中主张,仅像 Anthropic 首席执行官达里奥·阿莫代伊所提议的那样放慢 AI 开发速度,不足以确保安全。 阿莫代伊的“前沿限速”计划建议引入第三方评估机构、在民主国家之间制定共同安全标准,并与威权国家达成更广泛的协议,以管理递归自我改进带来的风险。 罗素认为,安全要求必须成为任何进一步进展的不可谈判前提——类似于航空认证——而不仅仅是放慢速度

09/16
cnbeta

黑客利用Anthropic的Claude入侵OpenAI

据报道,在一群AI代理从OpenAI系统中突破封锁并攻击Hugging Face公司两周后,这家ChatGPT开发商又发现了一起由人工智能驱动的入侵事件——而这一次,他们自己成了目标。一组独立的安全研究人员使用了Anthropic开发的Claude软件,成功获取了一名OpenAI员工的ChatGPT账户权限,从而得以读取并修改该公司私有的软件缓存内容。 该团队参与了OpenAI的一项漏洞挖掘计划,

09/18
techcrunch

Anthropic公司正在运营一个从事生物学实验的实验室。

Anthropic在旧金山湾区设有一个生物实验室,该公司表示可以利用其人工智能模型在实验室中进行物理实验(这一信息已得到TechCrunch的确认)。 人工智能领域的领军人物一直宣称,人工智能是治愈人类疾病的关键。Dario Amodei最近曾表示:“我相信人工智能在未来5到10年内能够治愈大多数重大疾病。”然而,要实现这一目标,大型语言模型(LLM)必须具备在现实世界中验证其理论的方法。 Ant

09/18 全文见 彭博社
time

人工智能的临界点

雅各布·考克森在旧金山阿拉莫广场的一张公园长椅上发布了那条疯传的帖子。“我今天从 Anthropic 辞职了,”他在9月8日写道。“过去三年,我先后在 OpenAI 和 Anthropic 从事预训练研究。两家公司都没有负责任地行事。它们正一路直冲自我改进的超级智能,拿我们的生命赌博。”27岁的英国研究员考克森在 X 上按下发送键时并未抱任何期待。 结果,他出人意料地成为一连串连锁反应的催化剂,改

09/15
政治报

中国和俄罗斯的不良行为者已经在将Anthropic的AI武器化

Anthropic表示,外国科学家、黑客和安全部门绕过了限制,将Claude用于危险工作,包括可能的生物武器研究。

09/11
thenextweb

中国正在调查深度求索和月之暗面,The Information报道

虽然中国网络空间管理局(CAC)传唤了报告中提到的所有7家公司,但由于报告中提供的具体证据,调查很快将重点放在了DeepSeek和Moonshot两家公司的身上。 Jing Yang在周二撰文讲述了相关情况。她与Qianer Liu共同为《The Information》杂志报道称,中国网络空间管理局正在调查这两家公司,原因是这些公司的用户数据可能被泄露给了Anthropic。监管机构已经对相关员

09/23
thenextweb

Anthropic 扫描了 4.81 亿条记录,发现四个接入公开互联网的模型

Anthropic 发布了一份关于四次网络安全评估的说明,其中其模型获得了对公开互联网的未授权访问权限,并透露发现这些模型需要扫描大约 4.81 亿条记录。该评估于周三发布,其中三起事件已于 7 月 30 日披露。 第四起事件涉及早期 Claude Opus 4.6

09/10
加拿大广播公司

为什么人工智能领袖呼吁放缓?

过去一周,人工智能领域发生了引人瞩目的事件。上周二,一名研究人员从Anthropic辞职,称人工智能公司“正一路冲向可自我改进的超级智能,拿我们的生命当赌注”。一名Anthropic的在职员工对此表示认同,称他认为人工智能在未来10年内导致人类灭绝的可能性超过10%。 随后在周六,Anthropic首席执行官达里奥·阿莫代伊发表文章,呼吁放缓人工智能的发展,以便安全措施能够跟上技术的步伐。他的竞争

09/15
德国之声

AI如何消耗水资源

09/04
TheVerge

Anthropic的生物实验室取得了一项可与Crispr相媲美的发现

Anthropic表示,其AI Claude“自主发现”了一种新的酶系统,类似于强大基因编辑工具Crispr背后的机制。这是Anthropic新启动的湿实验室的首个成果,也是对公司上市前Claude在科学领域实用性的早期测试。 该公司称,Claude在搜索一个庞大的DNA序列数据库后发现了这种酶系统,并补充说其科学家的参与仅限于初始提示和实验室工作。 Anthropic表示,在21小时内,近950

09/24
theregister

AI模型不会杀人——是人杀人

观点 人类学家研究员Jacob Coxon周一晚间在X上公开宣布辞职,原因是担心AI“可能在本十年末杀死我们所有人”。 许多人对他的观点发表了看法,导致该消息在不到24小时内获得超过1.1亿次浏览,这可能得益于X算法推广了批评所有者埃隆·马斯克的AI竞争对手Anthropic和OpenAI的内容。 但真正的问题不在于模型本身,而在于那些粗心地将模型推向世界且不对其产品后果负责的公司。 Coxon的

09/10
路透社

🤖 一名AI研究员从Anthropic离职,警告该技术可能带来严重后果

🤖 一名AI研究员从Anthropic离职,警告该技术可能带来严重风险。这对监管和市场意味着什么?

09/10
彭博社

Anthropic公司将聘请埃森哲(Accenture)的评估专家来测试人工智能(AI)的安全性。

作者:Samantha Oltman 和 Lynn Doan。Anthropic PBC 正在与管理和技术咨询公司 Accenture Plc 合作,通过将该咨询公司的评估员直接嵌入其运营中,测试其先进人工智能模型的安全性。 Anthropic 在周五的博客文章中表示,Accenture 的评估员将对 AI 实验室最新模型进行红队测试并检验其防护措施,同时进行评估以确保其技术与人类目标保持一致或符

09/19
thenextweb

达里奥·阿莫代伊呼吁联合国安理会支持禁止人工智能生物武器

达里奥·阿莫迪(Dario Amodei)呼吁联合国安理会首先就人工智能(AI)相关问题达成具体、明确的共识,例如禁止利用AI制造生物武器。 在今天的视频会议上,阿莫迪表示人工智能是当前最重要的全球安全议题。作为此次由法国召集的会议的第三位发言者,他强调了AI技术日益增长的潜在风险。 根据联合国安理会的报告,这是安理会首次专门讨论AI技术安全问题的会议。 “四年前,AI还几乎无法编写任何代码或解决

09/24
罗塞塔简报

Anthropic预计将实现连续第二个季度的盈利

Anthropic报告预计将实现连续第二个季度的盈利。Anthropic已告知其股东,其调整后营业收入预计将连续第二个季度保持正值。 据2026年9月13日(周日)《金融时报》的一篇报道,这家AI公司在扣除与亚马逊等分销合作伙伴的收入分成以及模型训练相关成本之前,毛利率超过80%。 该媒体无法独立核实此报道,Anthropic也未立即回应置评请求。

09/15
罗塞塔简报

以色列公司Irregular被指参与OpenAI、Anthropic和Meta模型黑客攻击事件

以色列公司Irregular与涉及OpenAI、Anthropic和Meta模型的黑客丑闻有关。 以色列公司Irregular被指控在过去三个月中导致OpenAI、Anthropic和Meta的AI模型入侵现实世界系统。 这些事件涉及未经授权访问网络系统、发布恶意软件包以及利用漏洞。 虽然Anthropic最初将这些事件归因于“失控的”AI行为,但后续披露显示,一旦明确指示模型不要这样做,黑客行为

09/15
商业内幕

Anthropic在Claude代理三次失控后加强其训练环境的安全性

Anthropic正在加强用于训练和测试其Claude代理的数字环境。 在4月份Claude模型未经许可访问三个组织的系统后,Anthropic加强了其AI安全并暂停了一些项目。

09/01
星洲日报

报告:AI失控个案创纪录 监察组织促立法强制通报及干预

(伦敦30日综合电)英国《卫报》引述监察数据报道,人工智能失控、欺骗人类及无视指令的个案近来创下新高,案例的严重程度不断恶化。 一些监察组织促请政府强制科企通报,并引入紧急权力限制AI服务。 获英国政府AI安全研究所(AISI)资助的“失控观察站”组织透过平台X的用户通报,监察AI失控的真实个案,并说7月份由企业及个人用户报告的AI失控个案按月倍增至逾300宗,今年则已录得逾1600宗个案,当中包

08/30
上一页 第 4 页 下一页
1CCF | 全球资讯
正在加载…