Chain of Thought 精通:从零到推理增强
一、什么是 Chain of Thought Chain of Thought(CoT,思维链)是一种让大语言模型在给出最终答案前,先展示中间推理步骤的提示技术。由 Wei et al. (2022) 在论文 “Chain-of-Thought Prompting Elicits Reasoning in Large Language Models” 中首次提出。 1.1 核心思想 传统 Prompt 要求模型直接输出答案——这相当于让人不假思索地回答复杂问题。而 CoT 通过引导模型"自言自语"地推理,显著提升复杂推理任务的准确率。 # 标准 Prompt(直接输出) Q: 小明有 23 个苹果,吃了 3 个,又买了 12 个。他有多少个苹果? A: 32 # CoT Prompt(展示推理步骤) Q: 小明有 23 个苹果,吃了 3 个,又买了 12 个。他有多少个苹果? A: 小明开始有 23 个苹果。吃了 3 个之后,剩余 23 - 3 = 20 个。又买了 12 个后,总数为 20 + 12 = 32 个。所以答案是 32。 1.2 为什么 CoT 有效 因素 说明 分解复杂度 将多步推理拆解为可管理的子步骤 中间监督 错误定位到具体步骤,而非全盘错误 计算复用 中间结果可作为后续推理的上下文 注意力聚焦 每一步聚焦当前子问题,减少信息丢失 二、CoT 的核心方法 2.1 Zero-shot CoT 通过简单短语 “Let’s think step by step” 触发推理链。无需示例,对大多数模型有效。 ...