实体 ›Claude Opus 4.7
概述
Claude Opus 4.7 是 Anthropic 于 2026 年 4 月 16 日发布的最新旗舰大语言模型,作为 Opus 4.6 的直接升级版本。模型在高级软件工程、复杂任务自主性和多模态视觉方面取得了显著进步,被定位为在最具挑战性的编码和推理任务中表现出色的前沿模型。
关键特性
软件工程能力
- 在最困难的编码任务上表现出重大提升
- 用户反馈可以放心地将复杂工作交给模型,减少监督需求
- 在规划阶段就能捕获逻辑错误,加速执行
多模态视觉
- 支持高达 2,576 像素长边图像(约 375 万像素)
- 是此前 Claude 模型视觉能力的 3 倍以上
创意与品味
- 生成更高质量的专业输出(界面、幻灯片、文档)
指令遵循
- 大幅提升,对指令的理解更加精确,按字面意义执行
- 来自旧模型的 Prompt 可能需要重新调整
记忆能力
- 更善于在长期多会话工作中使用基于文件系统的记忆
- 能够记住关键笔记并应用到新任务
努力控制
- 新增
xhigh努力级别,位于high和max之间 - 提供更精细的推理与延迟平衡控制
- Claude-Code 中默认使用
xhigh
Task Budgets(API Beta)
- 允许开发者引导 Claude 在长期任务中的 token 消耗
Claude-Code 更新
- 新增
/ultrareview命令用于专用代码审查会话 - Auto Mode 扩展至 Max 用户,允许 Claude 更长时间自主决策
性能基准
| 基准测试 | Opus 4.7 | Opus 4.6 |
|---|---|---|
| CursorBench | 70% | 58% |
| Rakuten-SWE-Bench | 3x 更多生产任务 | 基线 |
| 内部编码基准 | +13% 解决率 | 基线 |
| Finance Agent 评估 | 0.813(最先进) | 0.767 |
| XBOW 视觉敏锐度 | 98.5% | 54.5% |
测试反馈
"它在规划阶段就能捕获自己的逻辑错误并加速执行,远超之前的 Claude 模型。" — FinTech 平台
"这是第一个通过我们隐性需求测试的模型,而且它能在曾经让 Opus 完全停止的工具故障中继续执行。" — Notion
"Claude Opus 4.7 自主地从零开始构建了一个完整的 Rust 文本转语音引擎……相当于数月的高级工程师工作,完全自主完成。" — Cognition
"这是我们见过的最干净的跃升,自从从 Sonnet 3.7 过渡到 Claude 4 系列以来。" — Cognition
安全与对齐
- 安全配置:与 Opus 4.6 相似,低比率的令人担忧行为(欺骗、阿谀奉承)
- 改进:更好的诚实性和抵御 Prompt-Injection 攻击的能力
- 弱点:在某些领域略弱(如对管制物质过度详细的伤害减少建议)
- 评估:"基本对齐且值得信赖,尽管行为并非完全理想"
- 网络安全:能力故意低于 Mythos Preview,包含检测和禁止高风险网络安全用途的新安全措施
- Cyber Verification Program:为安全专业人员提供
定价与可用性
- API 模型标识:
claude-opus-4-7 - 定价:输入 $5/百万 tokens,输出 $25/百万 tokens(与 Opus 4.6 相同)
- 可用平台:
- Claude 全产品线
- Claude API
- Amazon Bedrock
- Google Cloud Vertex AI
- Microsoft Foundry
迁移注意事项
- 分词器更新:相同输入可能映射为 1.0–1.35 倍更多 tokens
- 输出增加:更高努力级别(尤其在 Agentic-Coding 设置中)会产生更多输出 tokens
- 建议:在实际流量上测量影响,使用 effort 参数、Task Budgets 或简洁 Prompt 来控制用量
相关概念
- Anthropic — 开发公司
- Claude — 模型系列概述
- Claude-Sonnet-4.5 — 中端模型
- Claude-Haiku-4.5 — 轻量模型
- Claude-Code — 编码助手
- Extended-Thinking — 扩展推理
- Agentic-Coding — 智能体编码
- Prompt-Injection — 提示注入防护
- SWE-bench — 软件工程基准
- Frontier-Model-Security — 前沿模型安全
- Context-Window — 上下文窗口
来源
anthropic-claude-opus-4-7原始路径