大语言模型的智能体检:帝国理工学院提出让AI提前知道自己不知道的神奇方法
帝国理工学院的研究团队提出了一种新的方法,名为“查询级不确定性”,旨在让大型语言模型(LLM)在回答问题之前,能够自我评估其知识边界。该方法通过分析AI内部各层的自信程度,判断其是否真正了解问题答案,而无需进行额外的训练。这种“提前体检”式的方法,类似于给AI装上“诚实检测器”,使其在生成答案之前评估自身知识的局限性。实验结果表明,该方法能够有效区分AI的已知和未知领域,并在智能检索和模型级联等实...