Claude Opus 5.5 effort 实测:从 low 到 max

Jonhisking · 2026 年 10 月 9 日

Claude Opus 5.5 effort 实测:从 low 到 max

Claude Opus 5.5 有一个控制思考深度的 effort 设置,共五个等级:low、medium、high、xhigh 和 max。等级越高,结果理应越好,但官方文档并没有给出每提高一级要多花多少时间和费用。于是我们在 2026 年 10 月 9 日用同一个做游戏的请求,在每个等级各跑了一次,对比耗时、token、费用和成品。最快的等级只用了 32 秒,最慢的用了 22 分钟。下面逐级看看发生了什么变化、什么任务该用哪个等级,并附上实际使用体验。

effort 是什么

测试方法

结果:耗时、token 和费用

结果:耗时、token 和费用: Effort, 耗时, 输出 token, 总 token, 费用, 游戏代码

Effort 耗时 输出 token 总 token 费用 游戏代码
low 32 秒 3,368 129,315 $0.48 138 行
medium(默认) 52 秒 6,299 133,428 $0.56 358 行
high 1 分 50 秒 12,376 222,854 $0.75 523 行
xhigh 4 分 32 秒 32,435 472,082 $1.36 639 行
max 22 分 22 秒 160,033 2,504,957 $5.25 1,121 行

各 effort 等级的耗时与费用:从 low 的 32 秒、$0.48 到 max 的 22 分 22 秒、$5.25

ccusage 测量记录:Opus 5.5 五个 effort 等级的 token 与费用

五个游戏横向对比

用 Opus 5.5 各 effort 等级做出的五个打砖块游戏并排对比

五个游戏都能正常运行、没有报错,也都满足了要求:2 个关卡、分数、3 条命、键盘和鼠标操作。区别在于各个等级额外加了什么。

Effort 额外加入的内容
low 单色砖块,画面最朴素,没有暂停
medium 彩虹砖块、暂停、重新开始
high + 粒子特效、保存最高分
xhigh 粒子特效、更精致的设计(没有保存最高分)
max + 音效、关卡名称、入侵者造型的第 2 关、屏幕震动、通关烟花

逐级点评

我们亲自玩了每个游戏,并对照模型最后留下的总结和代码本身进行核对。

low:32 秒,$0.48

effort low 做出的游戏的开始画面和游戏画面

medium:52 秒,$0.56(默认)

effort medium 做出的游戏的开始画面和游戏画面

high:1 分 50 秒,$0.75

effort high 做出的游戏的开始画面和游戏画面

xhigh:4 分 32 秒,$1.36

effort xhigh 做出的游戏的开始画面和游戏画面

max:22 分 22 秒,$5.25

effort max 做出的游戏的开始画面和游戏画面

实际体验:日常用 medium,写代码用 high

我(Jaehyun)用 Claude Max 20x 套餐里的 Opus 5.5 做游戏。以下是日常使用的感受,不是测量结果。

和测量结果对照来看,low 实际上是最快的,但成品最朴素,所以"不太灵光"的感觉来自产出而不是速度。high 结果更好、xhigh 和 max 很少需要,这两点感受都与数据一致。

Anthropic 的建议

什么任务用哪个 effort

什么任务用哪个 effort: 任务, 推荐 effort, 理由

结合测量结果、Jaehyun 的使用体验和 Anthropic 的指导,我们的建议如下:

任务 推荐 effort 理由
简单修改、重命名、整理文件 low 或 medium 又快又便宜,但 low 的成品比较朴素
日常编程和新功能开发 medium(默认) 52 秒、$0.56 就能得到可用的结果
游戏或应用原型、重视质量的编程 high 多花 34%,成品明显更好
运行超过 30 分钟的任务、大规模重构 xhigh 依据 Anthropic 的指导
其他等级都解决不了的难题 max 只在必要时使用:时间和费用都会跳涨

结论:默认用 medium,重要时用 high

常见问题

Opus 5.5 的默认 effort 是什么? medium。Opus 5 的默认值是 high。没有设置 effort 的 API 请求,在 Opus 5.5 上会以 medium 运行。

max 总是更好吗? 在我们的测试中,它加入的功能和打磨最多,但用了 22 分钟、$5.25,而 medium 只用了 52 秒、$0.56。对简单工作来说太过了。

low 能省很多吗? 在我们的测试中,low 只比 medium 便宜 14%。考虑到成品更朴素,medium 是更好的选择。

算算你自己的工作

在编程智能体费用计算器中输入任务规模和每天的任务数量,即可查看使用 Opus 5.5 一个月的费用。单个提示词的费用可以用Token 计数器查看。关于 Opus 5 和 5.5 在价格与性能上的差异,请参阅 Claude Opus 5 vs 5.5(英文)。

测量于 2026 年 10 月 9 日。费用为 ccusage 按 API 价格换算的结果;随着模型和 Claude Code 的更新,结果可能会变化。

来源

更多文章

输入任务规模和每天的任务数量,对比 Opus 5.5、Sonnet 5.5 和 GPT-6 Sol 一个月的费用。

打开编程智能体费用计算器 →