概念 ›Context Window(上下文窗口)
概述
上下文窗口(Context Window)是大型语言模型能够一次处理的 token 数量上限,决定了模型可以"记住"和利用的信息量。它包括整个对话历史、模型读取的每个文件和每个命令输出。上下文窗口的大小直接影响模型处理长文档、进行复杂分析和维持长对话的能力。Anthropic 从最初 Claude 的 9K tokens 大幅扩展到 200K tokens(Projects 功能),再到 Opus 4.6 的 1M tokens(Beta),不断提升模型的信息处理能力。
关键信息
发展历程
- 2023 年 5 月:从 9K 扩展到 100K tokens(约 75,000 字),可在不到一分钟内处理相当于人类 5+ 小时的阅读量
- 2024 年 6 月:Projects 功能提供 200K 上下文窗口(相当于 500 页书籍)
- 2026 年:Claude Opus 4.6 首次在 Opus 级模型上实现 1M token 上下文窗口(Beta)
性能影响
- 上下文填满时性能下降:当上下文窗口接近满载时,模型可能开始"遗忘"早期指令或犯更多错误
- 位置效应:文档开头和中间的信息召回通常优于末尾(尤其在长上下文场景中)
- Opus 4.6 突破:在 8-needle 1M 变体的 MRCR v2 测试中,Opus 4.6 得分 76%,而 Sonnet 4.5 仅 18.5%
长上下文 Q&A 最佳实践
- 使用 scratchpad:让 Claude 在回答前先提取相关引用
- 提供上下文示例:来自同一文档的正确回答示例比通用示例更有效
- 更多示例更好:5 个示例优于 2 个
- 指令放在提示末尾:最大化指令的召回率
- 避免模糊引用:明确指定相关段落而非使用"本文档"等模糊表述
上下文管理策略(Claude Code 中)
- 在不相关任务之间频繁使用
/clear重置上下文 - 自动压缩功能在接近上下文限制时触发
- 使用
/compact <instructions>自定义压缩行为 - 使用子代理进行调查,保持主对话上下文清洁
使用场景
- 消化、总结和解释密集文档(财务报表、研究论文)
- 基于年报分析公司的战略风险和机会
- 阅读数百页开发者文档并回答技术问题
- 将整个代码库放入上下文进行快速原型开发
- 分析约 6 小时的音频转录内容
相关概念
来源
anthropic-100k-context-windows.md原始路径
anthropic-prompting-long-context.md原始路径
anthropic-projects.md原始路径