跳转到内容
← AI 人物志
基础与架构

Jason Wei

魏杰森

思维链 · 指令微调

Jason Wei 是语言模型研究者,代表工作包括思维链提示和指令微调。他关注模型怎样利用提示与训练任务,在新的问题上表现出更好的推理和泛化能力。

思维链研究在提示示例中加入中间推导步骤,观察模型在算术、常识与符号推理任务上的变化。相关实验表明,在适当模型和任务条件下,展示解题过程可以帮助模型得到更好的答案。

他也参与 FLAN 等指令微调研究,将多个任务写成自然语言指令,用于训练模型适应新任务。生成的推理文本并不必然忠实反映模型的内部计算,步骤看似合理也可能出错,因此最终答案与过程都需要独立验证。