如果你的个人AI助手向你发送了看似关于他人生活的私密细节,那么它很可能是在凭空捏造。至少,Instinct的创始人诺亚·辛(Noah Shinn)表示,当一位病毒式传播的AI工具用户称,该智能体承认将他人的对话泄露到他们的聊天中时,情况正是如此。发帖人@prit4k于周二上传了其与Instinct互动的截图,截图显示该助手似乎提供了他人的中间名,并讨论了一张他们从未发送过的、提及金钱的文件照片。随后,Instinct道歉并直接告诉@prit4k,该照片“混入”了他们的对话,称这是一个“严重故障”。
“这是数据泄露还是幻觉?”@prit4k在X平台上惊恐地写道。Instinct刚刚承认它向我泄露了他人的数据。它描述了一份包含非我所有细节的财务文件,然后声称他人的照片混入了我的聊天。但我从未发送过照片。@noahrshinn,这是数据泄露还是幻觉?
辛回应称,这一实例仅仅是幻觉。他表示,该智能体捏造了一个专有名词,并通过其推理过程“进一步放大”了这一错误。辛在周三晚间的一篇帖子中写道:“这不是数据泄露,没有共享任何用户数据,也没有违反任何用户隔离边界。”这位23岁的创始人并未说明他如何确定@prit4k的案例是幻觉,但他大力宣传Instinct的隐私保护措施。他写道:“我们做了大量工作,以确保用户数据真正被分区隔离,从独立的沙箱环境到短生命周期的本地凭证,再到身份签名的工具执行。”
辛未立即回应《商业内幕》在非工作时间发出的置评请求。他在帖子中表示,他的团队在过去48小时内一直在开发一套“主动幻觉检测系统”,该系统能够预测和检测此类错误。
他写道,这一层具备在Instinct生成或执行下一条思维轨迹或工具调用之前,引导或拦截它的能力,他表示将在未来几周分享更多关于该系统的信息。今年夏天,邀请制AI助手Instinct在硅谷引起了轰动,帮助Shinn的创业公司Spear Street以25亿美元的估值筹集了2.5亿美元。Business Insider的Pranav Dixit试用了这款助手,并在本月早些时候写道,他对它直观地帮助他处理日常任务的能力印象深刻。像Instinct这样帮助用户处理日常任务(如联系保险公司或预订电影票)的AI助手在科技界正变得非常流行。Meta于9月8日发布了自己的Agent Muse,它已跃居苹果和安卓设备上下载量最多的应用榜首。