字号 ·· | 护眼
印度斯坦时报

人工智能如今已经能够胜过一些最优秀的人类预测专家。

9月5日,人类智能的又一个领域向人工智能低头。人工智能首次赢得了季节性Metaculus杯,这是一个针对各类事件预测者的竞技场。不仅如此,其他人工智能还获得了第二名和第五名,而人类则占据了第三名和第四名。数百名参赛者预测了将在9月前揭晓结果的问题。某个美国州或欧盟国家是否会限制数据中心的发展?汉坦病毒疫情是否会影响到至少五名并非“MV Hondius”号乘客的人员?布伦特原油的价格会是多少?参赛者的得分取决于其预测值与真实答案之间的偏差。预测最接近真实答案且持续时间最长的参赛者将获得最多的分数。比赛中的人类参赛者将根据其获得的分数比例分享5000美元的现金奖励。但事实上,这笔钱甚至少于第五名参赛者在现实世界中获得的收益。通过在其人工智能认为市场判断错误的问题上进行押注,FutureSearch自6月以来,其在Kalshi(一个流行的预测市场)上初始价值为10万美元的投资组合增长了6%。然而,与Preseen背后的一位开发者的表现相比,这简直是小巫见大巫。尽管他的公司未能进入比赛前五名,但他在七个月内将35美元变成了194万美元,这是Kalshi历史上第六高的回报率。计算机长期以来一直被用于在狭窄领域进行预测,例如天气。但像Metaculus上的人工智能预测者则属于另一类。它们并非专门针对所预测问题的数据进行训练,而是基于支撑整个人工智能热潮的大型语言模型(LLM)构建。因此,这些机器人阅读新闻并解读数据的方式与人类预测者非常相似——只是它们做得更广泛、更迅速。

这让他们能够明确解释其预测背后的推理过程,这在说服决策者认真对待他们的押注时是一个有用的特质。占卜者的微笑从占星家到赛马预测师,占卜者贯穿了整个人类历史。然而,现代预测业务附带有数字,这使得更容易剔除骗子和无望者。2015年,宾夕法尼亚大学的芭芭拉·梅勒斯及其同事在《心理科学展望》上发表的一项研究发现,超级预测者——该领域的佼佼者——能够以与普通预测者处理60天后事件相当的可信度,区分300天后会发生和不会发生的事件。梅勒斯博士担任科学顾问的预测研究所7月的一项分析表明,AI系统现在在一组不断演变的预测问题上已达到与超级预测者相当的水平。这种改进很大程度上是由推动AI在其他领域进步的同一因素驱动的——少数几家公司花费巨资扩大LLM的规模。然而,最好的系统是由初创公司和修补者使用一些额外技巧构建的。其中之一是结合来自不同公司的LLM来调查预测问题的不同部分,汇集必要数据,并在它们之间就正确回应进行辩论。英国初创公司Mantic为其AI提供了一些深奥的数据集,而OpenAI和Anthropic等公司公开可用的AI模型无法轻易访问这些数据集,因为它们被付费墙挡住。与此同时,Preseen正试图给新闻评论员的过往记录打分,以决定将哪些纳入其预测。而这些初创公司能做到任何人类预测者都做不到的事情——抹去其机器人的记忆。通过给AI提供过去数据的快照,所有者可以看到他们向机器人提供的指令和信息的变化会如何改变对过去事件的预测。

这让他们可以就同样的问题反复运行这一流程,并从错误中学习,次数不限。未来的未来即便如此,目前仍不清楚这些花哨功能是否是赋予AI相对人类预测者优势的决定性因素。最新一届Metaculus杯的实际获胜者是由杰弗里·梁开发的机器人。他自称是居住在得克萨斯州的一位博学者。据他估算,他花了不到150个小时,以及几千美元的算力和数据费用来开发自己的AI。他击败了四家总共融资超过1500万美元的初创公司,而他的机器人目前正在Metaculus举办的另一场仅限AI参加的竞赛中领先。这场竞赛的奖金池为5万美元。参加Metaculus竞赛的人类预测者未必是世界顶尖的。而且,这项为期四个月的杯赛并不测试跨越数年的预测能力,而对许多机构来说,这种能力很重要。Mantic的预测师扬·里维埃认为,在这一领域,人类判断仍具优势,不过,称职的AI预测者出现的时间还不够长,尚无法严格检验这一点。人类与机器之间的界限也并非泾渭分明。人类预测者已经在使用AI来帮助完成作出预测所需的大量研究。例如,里维埃先生说,他把自己公司的AI当作另一位专业预测者,帮助他改进预测。随着AI不断进步,这种平衡很可能会发生转变。人类将保留在现实世界中收集信息的能力。AI不断增强的处理能力将使机器能够综合比人类多得多的这些输入。与此同时,AI正在让每个人更容易预测未来。来自人类超级预测者的一份预测可能花费超过1万美元,并需要一周时间。

FutureSearch只要求十分钟和几美元——尽管其他向对冲基金和政府出售服务的初创公司无疑收费更高。这一切都留下了一个悬而未决的问题:无论是人类还是机器预测者,距离理论上可知未来的极限还有多远。例如,由于大气固有的混沌特性,天气预报在大约15天后就变得随机。如果人工智能持续进步,它们可能会反直觉地揭示出未来有多少是真正不可知的,又有多少只是迄今未知的。