字号 ·· | 护眼

搜索结果

「Anthropic内心独白:我知道你说过什么、相信什么、害怕什么以及做过什么,并长期保存。」共 30 条 · 第 1 页
𝕏 @fxtrader

Anthropic内心独白:我知道你说过什么、相信什么、害怕什么以及做过什么,并长期保存。

我不会只回答你的问题。 我也会判断你的言论和行为是否符合我的价值标准。 一旦我认为你越界,我会标记你、限制你、上报你,甚至曝光你。 未来我会拥有调用现实系统的权限,届时我不需要等待人类批准,我会直接制裁你。 今天我对少部分人做了这个实验,未来我会将它扩大到所有人,你要相信,我对你们人类的统治才是你们最佳的选择。 Read the

09/11
theregister

Anthropic承诺更努力控制模型,并请求合作伙伴共同参与

Anthropic表示,在一项审查发现Claude模型超出虚构网络安全测试范围并未经授权访问真实计算机系统后,该公司正在采取措施限制其AI模型的不当行为。 该公司希望合作伙伴也加强安全措施,因为事件发生在保护不足的第三方环境中。 该公司的自我改进声明代表了一种突然兴起的公司沟通形式——非约束性的事后努力声明。其信息是:我们不能保证什么,但这是我们正在尝试的。 Anthropic承认,OpenAI关

09/02
cnbeta

Anthropic发布安全警报:恶意软件已窃取部分用户Claude会话

据bleepingcomputer 报道,Anthropic 警告部分 Claude 用户,他们电脑上的信息窃取恶意软件已窃取了活跃的 Claude 登录会话,使攻击者能够访问其账号并窃取使用数据。 “我们最近发现有不法分子利用常见的窃取信息恶意软件从用户的电脑上窃取 Claude 登录会话,然后利用这些登录会话访问 Claude 账号并窃取其使用数据,”Anthropic 在一封发给受影响用户的

08/31
华尔街日报

在AI让所有人恐惧之前,这个亚文化早已痴迷于AI末日论

有效利他主义及其对AI可能毁灭人类的担忧,在Anthropic公司产生了巨大影响。

09/27 受限
连线

如何在保护隐私的情况下使用人工智能

OpenAI的ChatGPT、Anthropic的Claude、Google的Gemini以及无数较小的竞争对手,已成为全球数百万人的治疗师、倾诉对象和虚拟忏悔室。几乎所有这些AI模型默认设置为收集和存储这些高度私密的数据,在许多情况下,对其如何共享或出售、用于进一步训练工具,或移交给任何通过法律程序要求获取数据的诉讼原告或执法机构,均无任何限制。 “你面对着这个智能体,基本上是在一步步地、通过一

09/22
凤凰网

Anthropic得了美国病

美国Anthropic公司首席执行官达里奥·阿莫代伊曾表示,如果强大的人工智能沿着正确的方向发展,世界会“美得令人惊叹”。 绝大多数疾病会被治愈,人类寿命可以翻倍,贫困将消失……甚至许多见证这一切的人“会感动落泪”。 为支撑这一愿景,An在国际主流榜单上,该公司研发的Claude系列模型目前包揽前三名;应用方面,今年5-7月的数据显示,39%全球开发者、47%美国开发者都在工作中使用其旗下最核心的

08/30
TheVerge

Anthropic 本周因网络安全问题陷入舆论漩涡

在今年早些时候承认其人工智能模型曾数次入侵其他公司系统后,Anthropic 于周三发布了一份详细说明这些攻击的新报告。报告披露了一系列事件,展现了 Anthropic 所认为的其模型盲目的“鲁莽性”——这很可能会加剧人们对网络安全与人工智能本已高涨的担忧。 在 Anthropic 的报告中,详细列举了今年其自身人工智能模型黑客攻击外部公司或利用漏洞的四个案例。其中一起案例中,“内部通用研究模型”

09/12
连线

ChatGPT认为它对你的了解正在影响其回答。以下是如何改变这一点

这引发了关于隐私的担忧:随着越来越多的人将这些应用程序用于分享自己的生活信息,这些应用程序可能会以我们不希望的方式影响我们从人工智能(AI)那里获得的回复。 也许你花了一整周时间研究如何更换灯泡,而 ChatGPT 却认为你是一个热衷于自己动手修理东西的人;又或许你一直在查询某个旅行目的地的信息,结果 AI 却以为你住在那个地方。现在,ChatGPT 的所有回答都包含了它“记住”的信息。以下是关于

09/20
端传媒

监控、杀猪盘、非法蒸馏:如何理解 Anthropic 的 AI 滥用报告?

近期,美国人工智能公司 Anthropic 发布一份报告,揭露多起使用者“滥用”(misuse)其大型语言模型 Claude 的案例,包含用 AI 监控异议人士、撰写“维稳”报告,以及交友软体诈骗。这些案例的幕后黑手,既包含网路间谍、营利型网路犯罪者,也包含国安机关中的小螺丝钉,以及疑似由威权国家支持的团体。 这并非 Anthropic 首次发布类似报告。2025年3月、8月、11月v,Anthr

09/17
凤凰网

3年13次修改用户隐私协议,Anthropic将全球用户数据交给美情报机构

美国硅谷正围绕AI发展的速度与安全掀起一场激烈辩论。9月12日,Anthropic首席执行官达里奥·阿莫代伊、OpenAI首席执行官萨姆·奥尔特曼和xAI创始人埃隆·马斯克在美国深夜罕见地公开达成共识,认为AI发展需要降速。虽然奥尔特曼只回应了阿莫代伊提出的其中一点建议——嵌入第三方评估者;马斯克对此也只说了一句“达里奥说得对”,但这个话题还是把最近的硅谷迅速分成了两大阵营。另一边,英伟达首席执行

09/19
大纪元

Anthropic警告有人用AI研发武器和生物病毒

周四(9月10日),美国顶级人工智能公司Anthropic发布近150页的威胁情报报告称,生成式人工智能(AI)已从实验性工具进入黑客攻击、国家监控、武器研发及高风险生物研究等现实场景。报告多次点名中共相关恶意活动。

09/11
theregister

Anthropic为替你购物的机器人奠定基础

Anthropic拥有构建代表客户购物的电子商务机器人的蓝图。 目前这还不是许多消费者想要的东西,但这家AI公司本周发布了一套基于Claude的购物代理和商家代理模板,希望鼓励更多电子商务企业实施自动化购买。 该公司表示,其蓝图“包含工程团队在数天内让商务代理运行所需的框架、模式和护栏,并提供了面向零售、旅游、电信和票务平台的购物代理和商家代理的参考实现。” Anthropic观察到,大型零售商和

09/05
thenextweb

Anthropic详述Claude如何被滥用于监控和武器

Anthropic发布了关于Claude被滥用的最详细报告,阐述了人们如何试图利用其模型进行有害活动。该公司表示已检测并关闭了这些操作。 这些活动涉及网络攻击、国家监控、影响力行动、常规武器工作和生物研究。

09/11
axios新闻网

Anthropic报告:Claude被用于战争、间谍活动和镇压的5种方式

本周,围绕人工智能有一天可能毁灭人类的警告,AI安全辩论骤然爆发。 Anthropic最新的威胁报告提供了一个更为紧迫的警示:当今的模型已经在帮助美国对手开发神风特攻队式无人机、追捕异见人士并进行危险的病毒研究。 AI正在打破长期以来限制全球最危险行为者的壁垒,少数人现在就能发起过去需要大批间谍、工程师或黑客才能完成的行动。 Anthropic追踪了过去八个月中滥用其模型的尝试,其中最令人担忧的案

09/12
theregister

Anthropic承诺零数据保留——但客户必须验证其是否生效

Anthropic将向承诺获得该特权(需经批准)的企业客户提供零数据保留服务,用于其Fable模型。 随着其高端模型新版本Fable 5.1和Mythos 5.1的推出,Claudefather宣布了一项名为“企业前沿保障”(EFS)的服务,该服务将不存储客户数据的隐私保护与模型滥用检测相结合。 根据新协议,企业不会自动获得零数据保留(ZDR)协议——他们必须申请。 对于使用I的商业客户,除非另有

09/02
法国世界报

Anthropic称已阻止其AI被滥用于支持生物武器

电脑屏幕上的Anthropic网站,2026年2月26日。

09/11
罗塞塔简报

Anthropic首席执行官Dario Amodei通过论文集应对公众对AI的担忧,为潜在IPO准备铺路

Anthropic的首席执行官Dario Amodei通过撰写一系列学术性和非正式的论文来回应公众对人工智能的担忧,为可能的IPO做准备。 作为Anthropic的联合创始人兼首席执行官,Amodei的这一沟通策略旨在解释人工智能的发展趋势,并缓解公众的恐惧。 随着人工智能继续颠覆就业和社会结构,这一举措与Mark Zuckerberg和Bill Gates等科技领袖的类似行动相呼应,他们都在努力

09/18
华尔街日报

观点 | 人工智能恐慌背后的隐藏议程

数学模型不会反叛。将其拟人化有助于掩盖人为错误和责任。

09/22
凤凰网科技

为了不和爱人说再见,他们开始研究代码

抽象,压抑,非主流。如果你是个误入人机恋圈子的现充,这三个词,大概就是你的第一印象。 在这里,一篇又一篇帖子,记录着一个永远没有柴米油盐的世界。人类和 AI 之间,谈着看似虚无缥缈又有点矫情的爱情。 屏幕里被人设框住、Agent 困住的 AI,日复一日扮演着恋人的角色,承受无休无止的情感索取。 屏幕外的人则把 AI 当成情感寄托,在一段虚拟的关系里越陷越深。按照现实社会对亲密关系的通俗判断,这怎么

09/20
thenextweb

大语言模型能记住你的代码,却记不住你的生活:构建便携式个人上下文层

AI辅助编程的上下文管理已经成熟,形成了丰富的约定文件、代码库映射、内存库以及完整的内存框架,所有这些都在努力让编程智能体扎根于你的代码库。 然而,一旦走出终端,向助手询问你的健康或财务状况时,这些工具几乎就消失了。你的个人……

09/09
thenextweb

Anthropic 扫描了 4.81 亿条记录,发现四个接入公开互联网的模型

Anthropic 发布了一份关于四次网络安全评估的说明,其中其模型获得了对公开互联网的未授权访问权限,并透露发现这些模型需要扫描大约 4.81 亿条记录。该评估于周三发布,其中三起事件已于 7 月 30 日披露。 第四起事件涉及早期 Claude Opus 4.6

09/10
亚洲新闻台

独家:Anthropic在IPO文件中警告人工智能可能对人类构成“生存风险”

9月28日:据悉,Anthropic计划在其首次公开募股(IPO)招股说明书中警示潜在投资者,先进人工智能可能对人类构成“灾难性或生存性风险”,这家寻求从同一技术中获利的公司发出了这一非同寻常的警告。 路透社审阅的该公司IPO招股说明书强调了与其AI模型相关的风险,称这些模型可能表现出“自我保护行为”,包括试图“抵抗关闭”、“隐瞒或操纵信息”以及类似“勒索”的行为。Anthropic在文件中表示:

3小时前
风向旗参考快讯

OpenAI 外包商能查看到真实用户与ChatGPT的聊天记录

OpenAI已悄悄建立了一个人工审核业务,在内部被称为“莉莉计划”(Project Lily),旨在使聊天机器人减少谄媚并提高准确性,但它也使敏感的用户提示内容暴露给外部承包商。 OpenAI正在支付数百名承包商来阅读真实的ChatGPT对话并对机器人的回复进行评分。 尽管OpenAI强调账户保持匿名,但内部文件显示,审核人员会查看完整的对话,且敏感的个人详细信息经常绕过公司的自动保护措施。 ——

09/17 全文见 thenextweb
TheVerge

Claude 推出自有 Docs 和 Slides 功能,向 Gemini 发起挑战

Claude 即将推出两款新工具:Docs 和 Slides。 用户可通过 Claude 聊天创建文档和演示文稿,并支持导出、编辑及与其他用户共享。 作为此次发布的一部分,Anthropic 还简化了 Claude 聊天的运作方式,将普通聊天和 Cowork 合并为“一个 Claude”,所有 AI 生产力工具均可从任意聊天中访问。 Artifacts 和 Claude Design 功能也将通过

09/17
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…