字号 ·· | 护眼
连线

Clearview AI 正在测试一项让警察能够挖掘您网络生活的 AI 工具

人脸识别公司 Clearview AI 曾因从互联网抓取超过 30 亿张照片用于警察和安全人员的人脸辨认而在 2020 年声名狼藉。现在,该公司正在再次尝试网络抓取,这次是利用 AI 来帮助执法部门揭开名字背后的个人信息——他们是谁、他们认识谁、住在哪里以及他们在网上留下了什么痕迹。

WIRED 获悉,Clearview 已经悄悄构建并测试了一个其称为实验性 AI“分析师助手”的工具。这款名为 InquiryIQ 的未发布工具旨在获取调查人员从 Clearview 搜索中挖掘出的详细信息,然后自动在网络上铺开——打开网页、分析图像,并将发现的内容组装成一个包含警方正在调查的人的可能雇主、别名、同伙和身体特征的个人资料。

根据 WIRED 分析的该工具代码,InquiryIQ 的界面显示,提供年龄、性别和种族可以帮助系统在搜索时做出“更聪明的决定”。该公司测试用于驱动这些决定的模型之一来自 Elon Musk 旗下拥有 Grok 的 SpaceXAI(SpaceX 和 xAI 于 2 月合并)。Musk 将 Grok 推销为所谓“觉醒(woke)”AI 系统的替代品,而该聊天机器人曾多次因产出种族主义、极端主义和煽动性内容而受到审查。目前尚不清楚 SpaceXAI 将如何使用这些人口统计学输入,或它们将如何塑造其输出,Clearview 对此拒绝推测。

专家表示,InquiryIQ 及其同类工具可以将数天或数周的侦探工作压缩为几分钟,从而重塑警察的调查工作。这种速度可以帮助警方更快地破案,但它也降低了漫无目的搜寻的成本,使得对警方原本可能永远不会调查的人进行仔细审查变得切实可行。此外,由于生成式 AI 可以从相同的起点产生不同的答案,他们指出,可能很难重构为什么系统会追求某条线索而不是另一条线索。

Clearview 向 WIRED 表示,InquiryIQ 是一个从未向客户推销或交付过的原型,目前也没有计划以当前形式发布。该公司还否认该工具相当于一个自动化调查员。相反,它将 InquiryIQ 描述为自动化侦探本已在进行的网络搜索的有限方式。首席执行官 Amos Kyler 在一次采访中表示,界面中可见的 SpaceXAI 和其他模型选项是为了让 Clearview 的工程师在测试期间比较不同模型的性能,而不是让警察选择哪个模型来运行研究。“没有任何执法用户使用过它,句号,”Kyler 说。

WIRED 在 Clearview 的页面发送给任何访问者浏览器的文件中发现了 InquiryIQ。上个月,WIRED 就是利用这种技术发现了由 Flock Safety 开发的 AI 驱动搜索工具 OS Investigate,并从公开可访问的文件中重建了其界面的模型。

Clearview 的文件中同样包含其用户界面的代码和数千行文本——说明、警告和功能描述,展示了该公司如何设计和描述 InquiryIQ。它们并未透露 Clearview 服务器内部到底发生了什么、该工具的运作效果如何,或者谁使用过它。根据文本,InquiryIQ 旨在“自动发现并丰富来自网络来源的个人数据”。Clearview 表示,InquiryIQ 界面的表面完整性不应被误认为是即将发布的产品。该公司称,现代 AI 工具使得构建复杂的原型变得快得多,对 Clearview 工程师的指令是迅速推进原型,因为现在完全可以做到这一点。

Clearview 成立于 2017 年,最初几年基本上在公众视线之外运作。Peter Thiel 那年投资了 20 万美元,该公司不久后便开始拉拢警察局并在全国范围内提供免费试用。2020 年 HuffPost 的一项调查随后详细披露了创始人 Hoan Ton-That 与极右翼的联系,包括 2016 年与白人至上主义者 Richard Spencer 一起出席共和党全国代表大会晚宴,以及参与由极右翼活动人士和极端主义者组成的私人在线社区。Ton-That 后来为他过去的言论道歉。

2020 年,《纽约时报》披露 Clearview 从 Facebook、YouTube、Venmo 和数百万其他网站抓取了超过 3 亿张图像。一夜之间,这篇报道将该公司变成了美国最具争议的监控公司之一。科技公司要求其停止收集用户照片;随后诉讼和监管调查接踵而至。但 Clearview 并没有停止抓取。其数据库从 2020 年的 30 多亿张图像增长到该公司现在所说的远超 700 亿张,并且 Clearview 表示其技术已被全美 2,000 多个执法机构使用。

Ton-That 于 2024 年 12 月卸任首席执行官,并于次年春季离开董事会。Kyler 于去年 10 月成为首席执行官,他于 2019 年作为工程师加入 Clearview,展现了该公司更稳健、技术化的一面。如果说 Clearview 的早期是由突破界限定义的,那么 Kyler 谈论的则是控制、审计和监督。

“今天的使命是一样的,”Kyler 说。但他将公司近期的焦点描述为“精炼”和“确保产品达到客户期望的正直标准”。多年来,Clearview 表示其工作仅限于利用人脸识别为执法部门浮现可能的线索。Ton-That 在 2022 年的一篇文章中写道:“由调查员去顺着这些链接并做更多研究以寻找额外信息。”而 InquiryIQ 似乎旨在承担一部分此类工作。

正如 Clearview 所描述的那样,InquiryIQ 将在调查员已经运行了人脸识别搜索并确定了他们认为相关的细节之后启动。这些细节可以连同年龄、性别、种族、头发颜色和眼睛颜色等信息一起添加到个人资料中,界面显示这可以帮助 AI 在运行搜索时做出“更聪明的决定”。

Kyler 表示,InquiryIQ 的构想是为了测试调查员已经确定为可能相关的零星信息。“我们从试图提出一个命题然后否定该命题的角度来看待它,”他说。系统将获取一个“小事实(factoid)”,围绕它运行搜索,并正如 Kyler 所说的那样询问:“这是否相关?”WIRED 审查的代码将 InquiryIQ 描述为能够运行网络和图像搜索、浏览网页并在遇到的照片上使用人脸识别。当系统根据调查员提供的信息进行搜索时,它旨在构建 Clearview 所称的可能身份和同伙的“候选图谱(Candidate Graph)”,同时用可能的地址、电话号码、雇主、社交媒体账号、逮捕历史和别名来填充受试者的个人资料。

Clearview 并不是第一家将抓取公开可用信息过程自动化的公司。出售给执法部门的其他情报平台,包括 ShadowDragon 的 SocialNet、Penlink 的 Tangles 和 Fivecast,都在帮助调查人员揭露别名和同伙并绘制个人的数字足迹。

乔治华盛顿大学研究人工智能和警务的法学教授 Andrew Guthrie Ferguson 将这种自动化调查描述为“数字翻找(digital rummaging)”。他解释说:“他们基本上要根据你在互联网上留下的所有随机数字线索为你创建一个个人资料。”在实践中,这意味着收集曾经散落在不同地方、彼此很难连接的零散信息段。

波士顿大学隐私学者 Woodrow Hartzog 认为,调查工作的劳动力过去曾对监控起到一种现实的制约作用。通过大大减少调查一个人所需的劳动力,像 InquiryIQ 这样的工具也消除了这些制约。“我们现有的隐私保护主要建立在一个假设政府收集个人信息的能力存在一定摩擦的世界里,”他说。“有很多规则我们以前从来没有过,只是因为我们不需要它们——因为追踪所有人存在这些实际障碍。”当 InquiryIQ 搜索完成时,界面旨在向警官呈现系统浮现的身份、联系和其他细节,警官在将它们添加到个人资料之前可以接受或拒绝。Clearview 警告称,自动生成的人口统计、社交媒体和逮捕数据“可能准确,也可能不准确”。在接受任何发现之前,警官必须证明他们已经进行了独立验证。

Kyler 表示,人工审查是 Clearview 设计的核心。他说,系统的目的是浮现可能的线索,而不是断定什么是真实的。“那是分析师的工作——评估什么是真的,什么是假的;什么是噪音,什么是现实。”

“人在环路中(Human in the loop)只是一种微不足道的精神安慰,”Hartzog 说。随着时间的推移,调查人员可能会服从自动化系统,直到检查机器的人变成“某种橡皮图章”。例如,在明尼苏达州的一起案件中,涉及国土安全调查局(Homeland Security Investigations)卧底特工和对政治活动人士的监视,辩护律师获得了一份 Clearview 报告,该报告从大约 15 年的抗议照片中提取了匹配项。每个结果都被盖上了“由 Guy Gino 接受(Accepted by Guy Gino)”的印章——其中包括 Clearview 自己标记为“不太可能的结果(A Less Likely Result)”的一项,报告的脚注指出,该项只有在用户接受的情况下才能导出。辩护律师指控该报告卷入了完全不同的一名男子、他怀孕的妻子和年幼女儿的照片。(没有证据表明该案中使用了 InquiryIQ。)在 WIRED 审查的原型中,InquiryIQ 返回的内容可能会根据所选模型的不同而有所变化。其界面包括一个用于选择运行研究的模型的控件,并列出了 xAI 和 Amazon Bedrock(一个用于访问其他公司构建的模型的平台)。

2025 年,xAI 所称的对 Grok 系统提示词的未经授权的更改导致该聊天机器人将有关南非所谓“白人种族灭绝”的主张注入到不相关的对话中。不到一个月后,在其指令发生另一次更改后,Grok 产生了反犹太主义帖子并赞美了阿道夫·希特勒。SpaceXAI 没有回应置评请求。

“在任何其他常规情况下,一个容易产生幻觉的聊天机器人都不会被当作线人信任,”全国刑事辩护律师协会(National Association of Criminal Defense Lawyers)第四修正案中心诉讼主任 Michael Price 说道,他特别指的是警察用来在法庭上确立合理根据(probable cause)的信息。“这个人刚刚叫我去吃石头和喝漂白剂。而他们将成为合理根据的基础?”

Price 曾协助诉讼——这是一起关于地理围栏搜查令(geofence warrants)的里程碑式最高法院案件——他认为,对生成式 AI 工具可靠性的担忧不仅限于 Grok。AI 模型是在从互联网上抓取材料的基础上训练出来的,其中包括他所说的“无知帖子、阴谋论,以及所有不幸随互联网而来的偏见”。

Kyler 表示,表面上的模型选择器仅用于内部测试,而不是让警察选择用于研究的模型。他坚持认为,InquiryIQ 的输出就像 Clearview 浮现的所有内容一样,将被视为供调查人员评估的信息,由人类分析师负责决定什么构成真正的线索。他说,公司的兴趣在于“帮助生成通往客观真理的线索……通往现实的线索。”Clearview 表示,它正在不断评估各种可用的统括大型语言模型,并且尚未评估其中任何一个模型对 InquiryIQ 的适用性。

Amazon 在一份声明中表示,AWS 未参与 InquiryIQ 的开发,客户有责任确保他们遵守公司的条款和政策,包括可接受使用政策和负责任 AI 政策,以及任何第三方提供商的条款。该公司还表示,它没有阻止执法部门使用 Amazon Bedrock 的特定服务条款。

尽管存在像 InquiryIQ 这样的工具带来的风险,Ferguson 还是看到了 AI 辅助调查的潜在积极面。例如,与传统的侦探工作相比,它们可以为警察如何找到嫌疑人留下更清晰的记录。他解释说,警官经常搜索数据库、放弃线索并凭直觉行事,而没有记录每一步。一个能够保存其提示词、搜索、模型选择和调查路径的 AI 系统可以使该过程更容易被审计。

“这是充满潜在困扰和颠覆性变革中的一丝银线,”Ferguson 说。

然而,Ferguson 的乐观情绪被 16 年来目睹警察技术在机构弄清楚应如何治理之前就被部署的经历所冲淡。“我是个愤世嫉俗的人,因为我每次都看到这种情况发生,”Ferguson 说。“又是一项新技术,却是同样的剧本。”}