TalentMe
How To
🗺️
AI Industry Map
NEW
Knowledge ▾
Intro & Usage
Machine Learning Repo
Data Science Repo
Resources ▾
Intro & Usage
AI Tech Vault (Tech Wiki)
Industry News
Tech Blogs
Research Papers
Open Source Projects
Tools Hub ▾
🛠️ Tools & Skills Overview
🌐 Interactive Web Tools
🗺️ AI Industry & Career Map
🧭 AI Career Transition Navigator & Roadmap
📚 AI Multi-Module Practice Hub
🎯 AI Skill Assessment
🧠 AI Skills Library
AI Skills & Prompts Overview
Local Agent Guide
Cloud Skills Templates
⚡ MCP Tools Suite
TalentMe MCP Guide
CLI Tools & Commands
Services ▾
🚀 Services & Plans Suite
🧭 1v1 Coaching & Services
💎 Plans & Pricing
💬 Contact & Consultation
Contact Us
💬 Discord
🌐
中
☀️
🔑
Login / Register
☰
技术知识库
›
复习路线图
›
大语言模型 思维导图
›
思维链 CoT
← 返回 大语言模型 思维导图
中文
·
English
⚡ 大语言模型
ID:
cot
思维链 CoT
Chain-of-Thought
🎯
核心定义
CoT (Chain-of-Thought, 思维链) 提示法:在示例中显式给出中间推理步骤,引导模型把复杂问题分解为逐步推理而非直接给答案。少样本形式是在 2-8 个示例中展示完整推理链 (few-shot CoT),零样本形式是追加一句 “Let's think step by step” 触发逐步推理。关键实证:CoT 能力在参数量约
≥
100
B
\geq 100B
≥
100
B
时才显著涌现,小模型收益甚微。
💡
使用场景
数学、逻辑、多步推理任务;与 self-consistency 结合(采样多条 CoT 推理路径,多数投票选答案)可进一步提升准确率;也是 o1 类推理模型的基础思想。
⚡
解决的核心痛点
直接生成答案在复杂任务上准确率低且无法定位错误;CoT 把“一步大 O 推理”转为多步小步推理,给模型显式的中间计算过程,降低错误中间状态的影响,同时推理过程可解释、可调试。
🎯
5 个高频面试考点 (Exam Points)
1
Few-shot CoT 与 Zero-shot CoT 各是什么?为什么 “Let's think step by step” 有效?
2
CoT 的涌现性与参数量有什么关系?为什么小模型收益不大?
3
Self-consistency 的原理?为什么多数投票能提高准确率?
4
CoT 的局限有哪些?什么时候 CoT 无效甚至有害?
5
CoT 与推理时扩展 (test-time compute) 的关系?
📖 关联深度指南:
📄 reasoning-and-cot →
更新于 2026-08-12
🎯
检验攻克程度:针对「思维链 CoT」专属刷题排雷
做单选排雷题、推导选项机制,答错自动收录进专属错题本。
🚀 开始本考点专项刷题 ➔
← 上一个知识点
Dense vs MoE 对比
下一个知识点 →
推理时扩展
🔗 更多 大语言模型 知识点卡片
Agent 与工具调用
对齐税与偏好数据
缩放点积注意力
注意力变体 MHA/MQA/GQA