For Developers/Leaderboard
Auto-updated

AI Coding Leaderboard

Rankings by benchmark. Scores sourced from official provider release posts and updated automatically.

Real-world GitHub issues resolved autonomously. The best proxy for agentic coding ability.

#ModelSWE-bench Verified
đŸ„‡Claude Fable 595.0%
đŸ„ˆClaude Mythos 5.193.9%
đŸ„‰Claude Opus 4.888.6%
#4Claude Opus 4.787.6%
#5Claude Sonnet 5~85.2%
#6GPT-5.582.6%
#7DeepSeek V480.6%
#8Claude Sonnet 4.679.6%
#9Muse Glimmer76.0
#10GPT-574.9%
#11Claude Haiku 4.573.3%

Scores sourced from official provider release posts. Tilde (~) prefix indicates approximate figures. Rankings update automatically when new benchmark results are published. Data last updated 2026-10-01. View full model specs →