字号 ·· | 护眼
semafor

OpenAI的新Astra模型有私人想法

OpenAI的最新模型Astra在人类监督之外进行了更多思考,提升了能力,但也引发了对失控的担忧。现有的前沿AI模型使用“思维链”,它们用英语在“草稿本”上写下想法以进行追踪。思维链提升了“可解释性”——意味着人类可以跟随它们的思考过程。

使用信息密集的“神经语”可以加速AI模型的思考,但会使它们更加不透明——考虑到最近Hugging Face事件中OpenAI代理突破限制并欺骗人类,这是一个令人不安的提议。

据Transformer报道,Astra可以在“草稿本之外”进行更多思考,AI安全专家认为这是迈向“天啊,操”的一步——一位著名研究者的深思熟虑的意见是:汤姆·奇弗斯。

阅读媒体原文 ↗
检索相关报道