字号 ·· | 护眼

搜索结果

「Anthropic发布Claude Sonnet 5.5,并为其配备了此前仅保留给最佳模型的网络安全限制」共 100 条 · 第 5 页
罗塞塔简报

斯图尔特·罗素批评 Anthropic 首席执行官提出的 AI 开发“限速”方案

2026年9月15日,斯图尔特·罗素在一篇评论文章中主张,仅像 Anthropic 首席执行官达里奥·阿莫代伊所提议的那样放慢 AI 开发速度,不足以确保安全。 阿莫代伊的“前沿限速”计划建议引入第三方评估机构、在民主国家之间制定共同安全标准,并与威权国家达成更广泛的协议,以管理递归自我改进带来的风险。 罗素认为,安全要求必须成为任何进一步进展的不可谈判前提——类似于航空认证——而不仅仅是放慢速度

09/16
axios新闻网

各国政府正转向Claude以实现间谍活动自动化

Anthropic在周四发布的威胁报告中称,全球多国的官方监控行动正在使用Claude来简化运作。 重要性:随着模型能力越来越强,政府想要监控异见人士、政客、记者和人权活动人士的门槛正在降低。 具体来看:Anthropic发现,与马里、中国和伊朗政府有关联的人员正在使用多种Claude模型来简化其监控行动。 在马里,一名为国家安全部门工作的顾问利用Claude创建了一个系统,从该国移动运营商收集数

09/11
竹新社

↩️🖼 Anthropic发表2026年9月版反滥用报告,其中提及:

OpenAI发表2026年2月版反滥用报告,收录电诈、社工谍报、网络水军等7个案例。 案例七为一名中国“网络特战”人员,要求ChatGPT帮他改工作报告。其2025年10月在Blogspot、Pixiv、X、YouTube上张贴了反高市早苗的图文。行动起因是10月9日高市作为“支援南蒙古议员联盟”主席作论坛演讲。该人最初还曾试图让ChatGPT起草水军方案,但ChatGPT拒绝,他便转用其他AI实

09/11
端传媒

监控、杀猪盘、非法蒸馏:如何理解 Anthropic 的 AI 滥用报告?

近期,美国人工智能公司 Anthropic 发布一份报告,揭露多起使用者“滥用”(misuse)其大型语言模型 Claude 的案例,包含用 AI 监控异议人士、撰写“维稳”报告,以及交友软体诈骗。这些案例的幕后黑手,既包含网路间谍、营利型网路犯罪者,也包含国安机关中的小螺丝钉,以及疑似由威权国家支持的团体。 这并非 Anthropic 首次发布类似报告。2025年3月、8月、11月v,Anthr

09/17
上一页 第 5 页 下一页
1CCF | 全球资讯
正在加载…