实体 Claude Opus 4.7

Claude Opus 4.7

实体 4 min read · 2026-05-02 #model#anthropic

概述

Claude Opus 4.7Anthropic 于 2026 年 4 月 16 日发布的最新旗舰大语言模型,作为 Opus 4.6 的直接升级版本。模型在高级软件工程、复杂任务自主性和多模态视觉方面取得了显著进步,被定位为在最具挑战性的编码和推理任务中表现出色的前沿模型。

关键特性

软件工程能力

  • 在最困难的编码任务上表现出重大提升
  • 用户反馈可以放心地将复杂工作交给模型,减少监督需求
  • 在规划阶段就能捕获逻辑错误,加速执行

多模态视觉

  • 支持高达 2,576 像素长边图像(约 375 万像素)
  • 是此前 Claude 模型视觉能力的 3 倍以上

创意与品味

  • 生成更高质量的专业输出(界面、幻灯片、文档)

指令遵循

  • 大幅提升,对指令的理解更加精确,按字面意义执行
  • 来自旧模型的 Prompt 可能需要重新调整

记忆能力

  • 更善于在长期多会话工作中使用基于文件系统的记忆
  • 能够记住关键笔记并应用到新任务

努力控制

  • 新增 xhigh 努力级别,位于 highmax 之间
  • 提供更精细的推理与延迟平衡控制
  • Claude-Code 中默认使用 xhigh

Task Budgets(API Beta)

  • 允许开发者引导 Claude 在长期任务中的 token 消耗

Claude-Code 更新

  • 新增 /ultrareview 命令用于专用代码审查会话
  • Auto Mode 扩展至 Max 用户,允许 Claude 更长时间自主决策

性能基准

基准测试Opus 4.7Opus 4.6
CursorBench70%58%
Rakuten-SWE-Bench3x 更多生产任务基线
内部编码基准+13% 解决率基线
Finance Agent 评估0.813(最先进)0.767
XBOW 视觉敏锐度98.5%54.5%

测试反馈

"它在规划阶段就能捕获自己的逻辑错误并加速执行,远超之前的 Claude 模型。" — FinTech 平台

"这是第一个通过我们隐性需求测试的模型,而且它能在曾经让 Opus 完全停止的工具故障中继续执行。" — Notion

"Claude Opus 4.7 自主地从零开始构建了一个完整的 Rust 文本转语音引擎……相当于数月的高级工程师工作,完全自主完成。" — Cognition

"这是我们见过的最干净的跃升,自从从 Sonnet 3.7 过渡到 Claude 4 系列以来。" — Cognition

安全与对齐

  • 安全配置:与 Opus 4.6 相似,低比率的令人担忧行为(欺骗、阿谀奉承)
  • 改进:更好的诚实性和抵御 Prompt-Injection 攻击的能力
  • 弱点:在某些领域略弱(如对管制物质过度详细的伤害减少建议)
  • 评估:"基本对齐且值得信赖,尽管行为并非完全理想"
  • 网络安全:能力故意低于 Mythos Preview,包含检测和禁止高风险网络安全用途的新安全措施
  • Cyber Verification Program:为安全专业人员提供

定价与可用性

  • API 模型标识claude-opus-4-7
  • 定价:输入 $5/百万 tokens,输出 $25/百万 tokens(与 Opus 4.6 相同)
  • 可用平台
    • Claude 全产品线
    • Claude API
    • Amazon Bedrock
    • Google Cloud Vertex AI
    • Microsoft Foundry

迁移注意事项

  • 分词器更新:相同输入可能映射为 1.0–1.35 倍更多 tokens
  • 输出增加:更高努力级别(尤其在 Agentic-Coding 设置中)会产生更多输出 tokens
  • 建议:在实际流量上测量影响,使用 effort 参数、Task Budgets 或简洁 Prompt 来控制用量

相关概念

来源

anthropic-claude-opus-4-7原始路径