Opus 5 reasoning effort not always better: medium setting peaks performance
An analysis reveals that setting Opus 5's reasoning effort to maximum degrades performance on many tasks, with medium being optimal for coding benchmarks. The model tends to over-engineer solutions when given excessive reasoning budget, leading to unnecessary code refactoring and increased costs. Anthropic recommends using low or medium effort for most tasks to balance quality and cost.