LLMBoard ranking
This agent model leaderboard compares the current ranking from the LLMBoard Agent Score, eligible agent benchmarks, official token pricing and supporting task evidence.
Data as of 2026-08-17
This leaderboard ranking orders models by their domain-specific LLMBoard score aggregated from eligible benchmark evidence. Pricing, coverage and the source signal remain separate.
Rank | Model | LLMBoard Agent Score | Official input / 1M | Official output / 1M | Score updated |
|---|
| Rank01 | ModelAN | LLMBoard Agent Score87.3 | Official input / 1M$10 | Official output / 1M$50 | Score updated |
| Rank02 | ModelAN | LLMBoard Agent Score85.8 | Official input / 1M$5 | Official output / 1M$25 | Score updated |
| Rank03 | ModelOP | LLMBoard Agent Score85.7 | Official input / 1M$5 | Official output / 1M$30 | Score updated |
| Rank04 | ModelMA | LLMBoard Agent Score85.3 | Official input / 1M$3 | Official output / 1M$15 | Score updated |
| Rank05 | ModelOP | LLMBoard Agent Score77.7 | Official input / 1M$5 | Official output / 1M$30 | Score updated |
| Rank06 | ModelXA | LLMBoard Agent Score77.0 | Official input / 1M$2 | Official output / 1M$6 | Score updated |
| Rank07 | ModelAN | LLMBoard Agent Score75.7 | Official input / 1M$5 | Official output / 1M$25 | Score updated |
| Rank08 | ModelAN | LLMBoard Agent Score75.6 | Official input / 1M$5 | Official output / 1M$25 | Score updated |
| Rank09 | ModelZA | LLMBoard Agent Score74.6 | Official input / 1M$1.4 | Official output / 1M$4.4 | Score updated |
| Rank10 | ModelOP | LLMBoard Agent Score71.7 | Official input / 1M$2.5 | Official output / 1M$15 | Score updated |
| Rank11 | ModelAN | LLMBoard Agent Score69.6 | Official input / 1M$2 | Official output / 1M$10 | Score updated |
| Rank12 | ModelAC | LLMBoard Agent Score67.0 | Official input / 1M$2 | Official output / 1M$6 | Score updated |
| Rank13 | ModelOP | LLMBoard Agent Score66.9 | Official input / 1M$2 | Official output / 1M$12 | Score updated |
| Rank14 | ModelOP | LLMBoard Agent Score66.7 | Official input / 1M$0.20 | Official output / 1M$1.2 | Score updated |
| Rank15 | ModelDE | LLMBoard Agent Score63.6 | Official input / 1M$0.14 | Official output / 1M$0.28 | Score updated |
| Rank16 | ModelAN | LLMBoard Agent Score62.9 | Official input / 1M$5 | Official output / 1M$25 | Score updated |
| Rank17 | ModelAN | LLMBoard Agent Score58.1 | Official input / 1M$3 | Official output / 1M$15 | Score updated |
| Rank18 | ModelMA | LLMBoard Agent Score55.5 | Official input / 1M$0.95 | Official output / 1M$4 | Score updated |
| Rank19 | ModelME | LLMBoard Agent Score54.3 | Official input / 1M$1.25 | Official output / 1M$4.25 | Score updated |
| Rank20 | ModelMA | LLMBoard Agent Score49.4 | Official input / 1M$0.95 | Official output / 1M$4 | Score updated |
| Rank21 | ModelGO | LLMBoard Agent Score48.4 | Official input / 1M$2 | Official output / 1M$12 | Score updated |
| Rank22 | ModelAC | LLMBoard Agent Score45.0 | Official input / 1M$2.5 | Official output / 1M$7.5 | Score updated |
| Rank23 | ModelZA | LLMBoard Agent Score43.6 | Official input / 1M$1.4 | Official output / 1M$4.4 | Score updated |
| Rank24 | ModelGO | LLMBoard Agent Score41.5 | Official input / 1M$1.5 | Official output / 1M$9 | Score updated |
| Rank25 | ModelDE | LLMBoard Agent Score41.1 | Official input / 1M$0.435 | Official output / 1M$0.87 | Score updated |
| Rank26 | ModelAC | LLMBoard Agent Score35.3 | Official input / 1M$0.50 | Official output / 1M$3 | Score updated |
| Rank27 | ModelMI | LLMBoard Agent Score35.2 | Official input / 1M$0.30 | Official output / 1M$1.2 | Score updated |
| Rank28 | ModelXI | LLMBoard Agent Score32.0 | Official input / 1M$0.435 | Official output / 1M$0.87 | Score updated |
| Rank29 | ModelTE | LLMBoard Agent Score32.0 | Official input / 1MN/A | Official output / 1MN/A | Score updated |
| Rank30 | ModelTHInklingThinkingmachines | LLMBoard Agent Score26.0 | Official input / 1M$1.87 | Official output / 1M$4.68 | Score updated |
| Rank31 | ModelXA | LLMBoard Agent Score25.6 | Official input / 1M$1 | Official output / 1M$2 | Score updated |
| Rank32 | ModelXA | LLMBoard Agent Score23.7 | Official input / 1M$1.25 | Official output / 1M$2.5 | Score updated |
| Rank33 | ModelGO | LLMBoard Agent Score20.9 | Official input / 1M$0.50 | Official output / 1M$3 | Score updated |
| Rank34 | ModelGO | LLMBoard Agent Score20.3 | Official input / 1MN/A | Official output / 1MN/A | Score updated |
| Rank35 | ModelMI | LLMBoard Agent Score19.7 | Official input / 1M$0.30 | Official output / 1M$1.2 | Score updated |
| Rank36 | ModelUP | LLMBoard Agent Score19.2 | Official input / 1M$0.30 | Official output / 1M$1.2 | Score updated |
| Rank37 | ModelMA | LLMBoard Agent Score19.2 | Official input / 1M$1.5 | Official output / 1M$7.5 | Score updated |
| Rank38 | ModelGO | LLMBoard Agent Score15.8 | Official input / 1M$0.30 | Official output / 1M$2.5 | Score updated |
| Rank39 | ModelNV | LLMBoard Agent Score14.4 | Official input / 1M$0.50 | Official output / 1M$2.5 | Score updated |
This leaderboard overview connects current LLMBoard leaders with benchmark coverage and supporting source activity.
Use confidence and observed task volume to judge how firmly each leaderboard position is supported; these source proportions remain separate from benchmark coverage.
Vendor representation among the top-ranked models in this leaderboard.
A practical summary of the first five entries in this agent AI model leaderboard, with benchmark evidence and pricing kept in context.
Ranking basisThis agent AI model leaderboard uses the domain-specific LLMBoard score, evidence coverage and status. The leaderboard ranking keeps matched price and speed data separate from benchmark evidence.
Selection summary
Claude Fable 5 currently leads the agent ranking at 87.3. Compare evidence coverage, source activity and price separately before choosing a model for production.
Use this leaderboard with the supporting benchmark results and coverage details above. A leaderboard position summarizes the selected ranking signal; it does not replace workload-specific testing.
Common questions about the Agent Model Leaderboard.
Claude Fable 5 is currently ranked first with a LLMBoard Agent Score of 87.3.
The LLMBoard score converts eligible source categories and benchmark families to comparable dimension scores, applies domain weights and reports coverage separately. The leaderboard ranking follows that score.
This page currently compares 39 models.
A model appears only after LLMBoard has calculated a score for the domain used by this ranking. A source Arena result is optional supporting evidence and does not control whether a scored model appears.