一张图读懂 09/20 19:32

Jev模型创始人:GPT为什么“不知道也要硬答”?可能要从RLHF说起

Jev模型创始人,GPT-4、ChatGPT与InstructGPT/RLHF论文的共同作者Diogo Almeida表示,ChatGPT“不知道也要硬答”,可能源于RLHF本身的训练目标。 RLHF让模型不断迎合人类偏好,因此当它不确定时,也可能更倾向于给出一个“听起来像对的”答案,而不是承认不知道。这也是当前AI从“助手”走向真正自动化的一大矛盾。