人们对“向人工智能提问”这件事的意义有过高的估计。人工智能是语言模型,基本上是通过模仿人类标注者的数据进行训练的。与其说“向人工智能提问”很神秘,不如把它想象成“向互联网上的普通数据标注者提问”。
有一些注意事项,例如在许多领域(如代码、数学、创意写作),公司会雇佣熟练的数据标注者(所以可以想象成是在向他们提问),并且当涉及强化学习时,这并非完全正确,尽管我之前曾吐槽过RLHF只是勉强算强化学习,而“真正的强化学习”仍然太早和/或局限于那些容易提供奖励函数的领域(如数学等)。
但粗略地说(以及今天),你并不是在向某个神奇的人工智能提问。你是在向一个人类数据标注者提问。其平均本质被有损地蒸馏成了LLM这些统计性的词元滚筒。这当然仍然非常有用。这篇帖子是由有人建议我们问人工智能如何管理政府等引发的。简而言之,你并不是在向人工智能提问,而是在向它的平均数据标注者的某种混合精神提问。