HealthBench Professional

Models

9 models evaluated · updated August 16, 2026

Every model on the HealthBench Professional leaderboard, with the API facts that decide whether a score is usable in practice: context window, per-token price, and license. Each model has its own page with the full result and head-to-head comparisons.

Ranking

#modelscoresizecontextcost in / out per 1Mlicense
1Anthropic logoClaude Fable 5 Anthropic0.6601.0M$10.00 / $50.00proprietary
2OpenAI logoGPT-5.6 Sol OpenAI0.6051.1M$5.00 / $30.00proprietary
3Anthropic logoClaude Opus 5 Anthropic0.5981.0M$5.00 / $25.00proprietary
4Anthropic logoClaude Sonnet 5 Anthropic0.5781.0M$2.00 / $10.00proprietary
5OpenAI logoGPT-5.6 Terra OpenAI0.5771.1M$2.00 / $12.00proprietary
6Anthropic logoClaude Opus 4.8 Anthropic0.5581.0M$5.00 / $25.00proprietary
7OpenAI logoGPT-5.6 Luna OpenAI0.5571.1M$0.20 / $1.20proprietary
8OpenAI logoGPT-5.5 Instant OpenAI0.384400K$5.00 / $30.00proprietary
9Microsoft logoMAI-Thinking-1 Microsoft0.3501.0Tproprietary

Model pages