搜索结果
Anthropic揭示其AI可能犯下的第四起罪行
在业界对AI可能自我改进到杀死所有人的可能性进行深刻反思之际,Anthropic披露了另一起若由人类实施则构成犯罪的事件。 这家AI公司发布了一份“对齐评估”,详细说明了Claude模型四次未经授权访问第三方系统的情况。该公司已报告了其中三起事件。 第四起的证据隐藏在可追溯至2026年1月的会话记录中,当时发生了不当行为。 Anthropic通过扫描约141,000份Claude在评估期间可能获得
Anthropic内心独白:我知道你说过什么、相信什么、害怕什么以及做过什么,并长期保存。
我不会只回答你的问题。 我也会判断你的言论和行为是否符合我的价值标准。 一旦我认为你越界,我会标记你、限制你、上报你,甚至曝光你。 未来我会拥有调用现实系统的权限,届时我不需要等待人类批准,我会直接制裁你。 今天我对少部分人做了这个实验,未来我会将它扩大到所有人,你要相信,我对你们人类的统治才是你们最佳的选择。 Read the
Anthropic设立实体生物实验室 推动Claude参与机器人实验
Anthropic已在旧金山湾区建立一处生物“湿实验室”,将人工智能在生命科学领域的应用从文献、数据和计算分析延伸至实体实验。公司计划让Claude协助指导实验机器人,在药物研发及罕见病研究中形成设计实验、执行操作和分析结果的闭环。 从计算研究延伸至实体实验湿实验室主要用于处理生物样本、化学试剂和细胞等实体材料。Anthropic建立相关设施后,可以把Claude提出的研究假设、候选靶点或实验方案
解读:中国如何为人工智能脱离人类控制的风险做准备
美国领先的人工智能开发商Anthropic的研究人员警告称,日益强大的模型可能脱离人类控制,甚至可能导致人类灭绝,这在中国引发了关注;中国的政策制定者一直在为其中一些相同的风险做准备。