llmboard.aiAI model intelligence
Home

Model Rankings

OverallOpen ModelsAgentCodingReasoningMathKnowledgeInstruction FollowingTextVision
Image GenerationImage Editing
Video GenerationImage to VideoVideo Editing
Text to SpeechSpeech to Text
Embeddings

Efficiency

Chat Token PricingImage PricingVideo PricingAudio Pricing
Chat Speed & LatencyProvider Reliability

Benchmarks

GPQAMMLU-ProAIME 2025SWE-Bench VerifiedMMLUHumanity's Last ExamLiveCodeBenchMATHHumanEvalMMMU-Pro
All Benchmarks

Tools

Model DirectoryCompare Models

Scoring & Data

Scoring & Data
393 models668 benchmarks

Leaderboard Center

Overall RankingCodingCore BenchmarksPrice & ValueRuntime Performance

Modalities

All ModelsImage GenerationImage EditingVideo GenerationImage-to-VideoVideo EditingText-to-SpeechSpeech-to-TextEmbeddings

Data & Methods

Scoring MethodAll BenchmarksReasoningMath

Vendors

All VendorsOpenAIAnthropicGoogle
llmboard.aiCopyright 2026 llmboard.ai

Arena benchmark

LM Arena Webdev Leaderboard

LM Arena Webdev model ratings and results.

Updated Aug 17, 2026. Data as of 2026-08-17

Models92
Categories5
Result typerating

On this page

  • Ranking
  • Highlights
  • Distribution
  • Top models
  • About
  • FAQ

Webdev Ranking

Models are ordered by their Arena rank.

30 of 92 rows
Columns

Show columns

Sort by
Rank
Model
Organization
Rating / score
Votes
Observations
Result date
Rank01ModelANClaude Opus 5AnthropicOrganizationanthropicRating / score1691.5Votes6,448ObservationsN/AResult dateAug 14, 2026
Rank02ModelMAKimi K3Moonshot AIOrganizationmoonshotRating / score1673.9Votes4,546ObservationsN/AResult dateAug 14, 2026
Rank03ModelACQwen3.8 MaxAlibaba Cloud / Qwen TeamOrganizationalibabaRating / score1666.7Votes2,855ObservationsN/AResult dateAug 14, 2026
Rank06ModelANClaude Fable 5AnthropicOrganizationanthropicRating / score1626.9Votes7,867ObservationsN/AResult dateAug 14, 2026
Rank07ModelOPGPT-5.6 SolOpenAIOrganizationopenaiRating / score1621.6Votes8,595ObservationsN/AResult dateAug 14, 2026
Rank09ModelZAGLM-5.2Zhipu AIOrganizationzaiRating / score1585.0Votes8,142ObservationsN/AResult dateAug 14, 2026
Rank11ModelDEDeepSeek-V4-Flash-0731DeepSeekOrganizationdeepseekRating / score1581.2Votes2,936ObservationsN/AResult dateAug 14, 2026
Rank13ModelANClaude Opus 4.7AnthropicOrganizationanthropicRating / score1558.3Votes13,855ObservationsN/AResult dateAug 14, 2026
Rank15ModelXAGrok 4.5xAIOrganizationxaiRating / score1554.9Votes5,721ObservationsN/AResult dateAug 14, 2026
Rank17ModelANClaude Sonnet 5AnthropicOrganizationanthropicRating / score1540.1Votes6,578ObservationsN/AResult dateAug 14, 2026
Rank18ModelANClaude Opus 4.8AnthropicOrganizationanthropicRating / score1539.0Votes9,906ObservationsN/AResult dateAug 14, 2026
Rank19ModelMEMuse Spark 1.1MetaOrganizationmetaRating / score1537.7Votes5,605ObservationsN/AResult dateAug 14, 2026
Rank20ModelANClaude Opus 4.6AnthropicOrganizationanthropicRating / score1537.4Votes17,556ObservationsN/AResult dateAug 14, 2026
Rank22ModelMEMuse Spark 1.2MetaOrganizationmetaRating / score1534.7Votes2,055ObservationsN/AResult dateAug 14, 2026
Rank23ModelANClaude Sonnet 4.6AnthropicOrganizationanthropicRating / score1523.7Votes19,588ObservationsN/AResult dateAug 14, 2026
Rank24ModelTEHy3TencentOrganizationtencentRating / score1521.7Votes2,284ObservationsN/AResult dateAug 14, 2026
Rank25ModelBYSeed 2.1 ProByteDanceOrganizationbytedanceRating / score1521.7Votes7,121ObservationsN/AResult dateAug 14, 2026
Rank26ModelOPGPT-5.6 TerraOpenAIOrganizationopenaiRating / score1521.1Votes5,003ObservationsN/AResult dateAug 14, 2026
Rank27ModelACQwen3.7 MaxAlibaba Cloud / Qwen TeamOrganizationalibabaRating / score1516.7Votes8,373ObservationsN/AResult dateAug 14, 2026
Rank28ModelOPGPT-5.6 LunaOpenAIOrganizationopenaiRating / score1516.7Votes5,066ObservationsN/AResult dateAug 14, 2026
Rank29ModelZAGLM-5.1Zhipu AIOrganizationzaiRating / score1510.1Votes8,817ObservationsN/AResult dateAug 14, 2026
Rank30ModelMAKimi K2.6Moonshot AIOrganizationmoonshotRating / score1508.9Votes9,589ObservationsN/AResult dateAug 14, 2026
Rank31ModelOPGPT-5.5OpenAIOrganizationopenaiRating / score1507.4Votes12,970ObservationsN/AResult dateAug 14, 2026
Rank32ModelGOGemini 3.5 FlashGoogleOrganizationgoogleRating / score1499.4Votes6,840ObservationsN/AResult dateAug 14, 2026
Rank34ModelMIMiniMax M3MiniMaxOrganizationminimaxRating / score1489.8Votes10,053ObservationsN/AResult dateAug 14, 2026
Rank37ModelALQwen3.6 Max PreviewAlibabaOrganizationalibabaRating / score1479.0Votes2,603ObservationsN/AResult dateAug 14, 2026
Rank38ModelXIMiMo-V2.5-ProXiaomiOrganizationxiaomiRating / score1474.2Votes13,299ObservationsN/AResult dateAug 14, 2026
Rank39ModelMAKimi K2.7 CodeMoonshot AIOrganizationmoonshotRating / score1472.8Votes4,672ObservationsN/AResult dateAug 14, 2026
Rank40ModelANClaude Opus 4.5AnthropicOrganizationanthropicRating / score1468.2Votes12,921ObservationsN/AResult dateAug 14, 2026
Rank41ModelDEDeepSeek-V4-Pro-MaxDeepSeekOrganizationdeepseekRating / score1464.0Votes12,397ObservationsN/AResult dateAug 14, 2026
Rank42ModelOPGPT-5.4OpenAIOrganizationopenaiRating / score1463.1Votes1,279ObservationsN/AResult dateAug 14, 2026
Rank43ModelACQwen3.6 PlusAlibaba Cloud / Qwen TeamOrganizationalibabaRating / score1460.1Votes15,670ObservationsN/AResult dateAug 14, 2026
Rank45ModelGOGemini 3.5 Flash-LiteGoogleOrganizationgoogleRating / score1449.2Votes228ObservationsN/AResult dateAug 14, 2026
Rank46ModelGOGemini 3.1 ProGoogleOrganizationgoogleRating / score1446.8Votes20,884ObservationsN/AResult dateAug 14, 2026
Rank47ModelDEDeepSeek V4 ProDeepSeekOrganizationdeepseekRating / score1445.9Votes13,178ObservationsN/AResult dateAug 14, 2026
Rank49ModelGOGemini 3 FlashGoogleOrganizationgoogleRating / score1437.9Votes10,472ObservationsN/AResult dateAug 14, 2026
Rank50ModelXIMiMo-V2.5XiaomiOrganizationxiaomiRating / score1437.8Votes12,261ObservationsN/AResult dateAug 14, 2026
Rank51ModelGOGemini 3 ProGoogleOrganizationgoogleRating / score1437.8Votes13,585ObservationsN/AResult dateAug 14, 2026
Rank52ModelMAKimi K2.5Moonshot AIOrganizationmoonshotRating / score1436.2Votes17,819ObservationsN/AResult dateAug 14, 2026
Rank53ModelZAGLM-5Zhipu AIOrganizationzaiRating / score1435.6Votes7,065ObservationsN/AResult dateAug 14, 2026
Rank54ModelZAGLM-4.7Zhipu AIOrganizationzaiRating / score1434.3Votes3,814ObservationsN/AResult dateAug 14, 2026
Rank55ModelXIMiMo-V2-ProXiaomiOrganizationxiaomiRating / score1433.5Votes6,975ObservationsN/AResult dateAug 14, 2026
Rank57ModelOPGPT-5 MediumOpenAIOrganizationopenaiRating / score1418.7Votes3,040ObservationsN/AResult dateAug 14, 2026
Rank58ModelOPGPT-5.2OpenAIOrganizationopenaiRating / score1417.8Votes1,057ObservationsN/AResult dateAug 14, 2026
Rank59ModelOPGPT-5.3 CodexOpenAIOrganizationopenaiRating / score1408.6Votes2,525ObservationsN/AResult dateAug 14, 2026
Rank61ModelTHInklingThinkingmachinesOrganizationthinkyRating / score1404.8Votes6,463ObservationsN/AResult dateAug 14, 2026
Rank62ModelACQwen3.5-397B-A17BAlibaba Cloud / Qwen TeamOrganizationalibabaRating / score1400.1Votes17,926ObservationsN/AResult dateAug 14, 2026
Rank63ModelZAGLM-5V-TurboZhipu AIOrganizationzaiRating / score1399.6Votes2,181ObservationsN/AResult dateAug 14, 2026
Rank64ModelMIMiniMax M2.7MiniMaxOrganizationminimaxRating / score1397.2Votes13,625ObservationsN/AResult dateAug 14, 2026
Rank65ModelOPGPT-5.4 miniOpenAIOrganizationopenaiRating / score1397.0Votes11,290ObservationsN/AResult dateAug 14, 2026
Rank67ModelOPGPT-5.1 MediumOpenAIOrganizationopenaiRating / score1391.1Votes4,755ObservationsN/AResult dateAug 14, 2026
Rank69ModelANClaude Opus 4.1AnthropicOrganizationanthropicRating / score1388.6Votes6,786ObservationsN/AResult dateAug 14, 2026
Rank70ModelMIMiniMax M2.1MiniMaxOrganizationminimaxRating / score1387.0Votes7,293ObservationsN/AResult dateAug 14, 2026
Rank71ModelANClaude Sonnet 4.5AnthropicOrganizationanthropicRating / score1385.5Votes15,198ObservationsN/AResult dateAug 14, 2026
Rank72ModelMIMiniMax M2.5MiniMaxOrganizationminimaxRating / score1384.0Votes7,219ObservationsN/AResult dateAug 14, 2026
Rank74ModelXAGrok-4.20 Beta ReasoningxAIOrganizationxaiRating / score1373.6Votes14,587ObservationsN/AResult dateAug 14, 2026
Rank75ModelUPSolar Pro 4UpstageOrganizationupstageRating / score1371.3Votes1,400ObservationsN/AResult dateAug 14, 2026
Rank77ModelGOGemma 4 31BGoogleOrganizationgoogleRating / score1364.5Votes8,588ObservationsN/AResult dateAug 14, 2026
Rank78ModelGOGemma 4 26B-A4BGoogleOrganizationgoogleRating / score1361.9Votes1,443ObservationsN/AResult dateAug 14, 2026
Rank79ModelDEDeepSeek-V3.2 (Thinking)DeepSeekOrganizationdeepseekRating / score1360.4Votes6,654ObservationsN/AResult dateAug 14, 2026
Rank80ModelMEMuse Glimmer-30BMetaOrganizationmetaRating / score1359.0Votes1,506ObservationsN/AResult dateAug 14, 2026
Rank81ModelACQwen3.5-122B-A10BAlibaba Cloud / Qwen TeamOrganizationalibabaRating / score1357.8Votes7,866ObservationsN/AResult dateAug 14, 2026
Rank82ModelACQwen3.5-27BAlibaba Cloud / Qwen TeamOrganizationalibabaRating / score1357.5Votes7,438ObservationsN/AResult dateAug 14, 2026
Rank84ModelXAGrok 4.3xAIOrganizationxaiRating / score1354.3Votes12,269ObservationsN/AResult dateAug 14, 2026
Rank85ModelPOLaguna M.1PoolsideOrganizationpoolsideRating / score1347.2Votes5,056ObservationsN/AResult dateAug 14, 2026
Rank86ModelOPGPT-5.1OpenAIOrganizationopenaiRating / score1340.7Votes10,344ObservationsN/AResult dateAug 14, 2026
Rank87ModelZAGLM-4.6Zhipu AIOrganizationzaiRating / score1340.1Votes6,607ObservationsN/AResult dateAug 14, 2026
Rank88ModelOPGPT-5.2 CodexOpenAIOrganizationopenaiRating / score1338.3Votes6,423ObservationsN/AResult dateAug 14, 2026
Rank89ModelOPGPT-5.1 CodexOpenAIOrganizationopenaiRating / score1336.4Votes4,870ObservationsN/AResult dateAug 14, 2026
Rank90ModelXIMiMo-V2-FlashXiaomiOrganizationxiaomiRating / score1330.2Votes5,416ObservationsN/AResult dateAug 14, 2026
Rank91ModelANClaude Haiku 4.5AnthropicOrganizationanthropicRating / score1326.4Votes26,061ObservationsN/AResult dateAug 14, 2026
Rank92ModelDEDeepSeek-V3.2DeepSeekOrganizationdeepseekRating / score1324.5Votes8,984ObservationsN/AResult dateAug 14, 2026
Rank93ModelMAKimi K2 Thinking TurboMoonshot AIOrganizationmoonshotRating / score1323.1Votes12,670ObservationsN/AResult dateAug 14, 2026
Rank94ModelPOLaguna XS.2PoolsideOrganizationpoolsideRating / score1302.6Votes3,933ObservationsN/AResult dateAug 14, 2026
Rank95ModelMIMiniMax M2MiniMaxOrganizationminimaxRating / score1297.0Votes6,534ObservationsN/AResult dateAug 14, 2026
Rank97ModelACQwen3-Coder 480B A35B InstructAlibaba Cloud / Qwen TeamOrganizationalibabaRating / score1273.2Votes12,292ObservationsN/AResult dateAug 14, 2026
Rank98ModelDEDeepSeek-V3.2-ExpDeepSeekOrganizationdeepseekRating / score1271.7Votes3,871ObservationsN/AResult dateAug 14, 2026
Rank99ModelMAMistral Medium 3.5Mistral AIOrganizationmistralRating / score1265.2Votes2,154ObservationsN/AResult dateAug 14, 2026
Rank101ModelGOGemini 3.1 Flash-LiteGoogleOrganizationgoogleRating / score1254.1Votes13,663ObservationsN/AResult dateAug 14, 2026
Rank102ModelACQwen3.5-35B-A3BAlibaba Cloud / Qwen TeamOrganizationalibabaRating / score1249.7Votes1,540ObservationsN/AResult dateAug 14, 2026
Rank103ModelOPGPT-5.1 Codex MiniOpenAIOrganizationopenaiRating / score1243.6Votes1,133ObservationsN/AResult dateAug 14, 2026
Rank104ModelXAGrok-4.1 Fast ReasoningxAIOrganizationxaiRating / score1240.0Votes5,331ObservationsN/AResult dateAug 14, 2026
Rank105ModelAATrinity Large ThinkingArcee AiOrganizationUnknownRating / score1238.6Votes1,303ObservationsN/AResult dateAug 14, 2026
Rank106ModelALQwen3.5 FlashAlibabaOrganizationalibabaRating / score1238.2Votes1,271ObservationsN/AResult dateAug 14, 2026
Rank107ModelMAMistral Large 3Mistral AIOrganizationmistralRating / score1230.1Votes815ObservationsN/AResult dateAug 14, 2026
Rank108ModelGOGemini 2.5 ProGoogleOrganizationgoogleRating / score1225.5Votes2,676ObservationsN/AResult dateAug 14, 2026
Rank109ModelXAGrok-4.1 ThinkingxAIOrganizationxaiRating / score1209.8Votes948ObservationsN/AResult dateAug 14, 2026
Rank110ModelMADevstral 2Mistral AIOrganizationmistralRating / score1193.5Votes1,144ObservationsN/AResult dateAug 14, 2026
Rank112ModelINMercury 2InceptionOrganizationinception-aiRating / score1166.3Votes908ObservationsN/AResult dateAug 14, 2026
Rank113ModelXAGrok Code Fast 1xAIOrganizationxaiRating / score1164.4Votes783ObservationsN/AResult dateAug 14, 2026
Rank114ModelXAGrok-4 Fast ReasoningxAIOrganizationxaiRating / score1161.2Votes732ObservationsN/AResult dateAug 14, 2026
Rank115ModelMADevstral MediumMistral AIOrganizationmistralRating / score1080.0Votes831ObservationsN/AResult dateAug 14, 2026

Arena highlights

Rank #1Claude Opus 51691.5 ratingRank #2Kimi K31673.9 ratingRank #3Qwen3.8 Max1666.7 ratingRank #6Claude Fable 51626.9 rating

Webdev Rating Distribution

A closer view of the leading model ratings.

Webdev

The Top AI Models for Webdev

The first five models in this source ranking, with price and output speed included when a canonical model match is available.

Ranking basisThis webdev AI model leaderboard uses the source rating and Arena rank. The leaderboard ranking keeps matched price and speed data separate from benchmark evidence.

  1. 01
    AN
    Claude Opus 5Anthropic
    rating
    1,692
    Price
    $5.0 input / $25 output per 1M tokens
    Speed
    Up to 3.3 tok/s via Anthropic

    Strengths

    • Ranks #1 on Webdev
    • 6,448 votes support the result
    • Matched official PAYG token pricing is available

    Considerations

    • Arena results are independent from the LLMBoard capability score
  2. 02
    MA
    Kimi K3Moonshot AI
    rating
    1,674
    Price
    $3.0 input / $15 output per 1M tokens
    Speed
    Up to 26 tok/s via Fireworks

    Strengths

    • Ranks #2 on Webdev
    • 4,546 votes support the result
    • Matched official PAYG token pricing is available

    Considerations

    • Arena results are independent from the LLMBoard capability score
  3. 03
    AC
    Qwen3.8 MaxAlibaba Cloud / Qwen Team
    rating
    1,667
    Price
    $2.0 input / $6.0 output per 1M tokens

    Strengths

    • Ranks #3 on Webdev
    • 2,855 votes support the result
    • Matched official PAYG token pricing is available

    Considerations

    • Arena results are independent from the LLMBoard capability score
  4. 06
    AN
    Claude Fable 5Anthropic
    rating
    1,627
    Price
    $10 input / $50 output per 1M tokens
    Speed
    Up to 9.1 tok/s via Anthropic

    Strengths

    • Ranks #6 on Webdev
    • 7,867 votes support the result
    • Matched official PAYG token pricing is available

    Considerations

    • Arena results are independent from the LLMBoard capability score
  5. 07
    OP
    GPT-5.6 SolOpenAI
    rating
    1,622
    Price
    $5.0 input / $30 output per 1M tokens
    Speed
    Up to 27 tok/s via OpenAI

    Strengths

    • Ranks #7 on Webdev
    • 8,595 votes support the result
    • Matched official PAYG token pricing is available

    Considerations

    • Arena results are independent from the LLMBoard capability score

Selection summary

Best AI Models for Webdev

Claude Opus 5 currently leads Webdev at 1,692. The best AI model for this use case may change when price, speed and independent benchmark capability are considered.

Use this leaderboard with the supporting benchmark results and coverage details above. A leaderboard position summarizes the selected ranking signal; it does not replace workload-specific testing.

Arena rank #1Claude Opus 5$5.0 input / $25 output per 1M tokensArena rank #2Kimi K3$3.0 input / $15 output per 1M tokensArena rank #3Qwen3.8 Max$2.0 input / $6.0 output per 1M tokens

What is the Webdev Arena?

What Webdev measures and how to read its results.

Webdev reports rating values and currently defines 5 evaluation categories.

Arena results are preference or task-outcome signals. They are not automatically equivalent to capability benchmark scores.

FAQ

Common questions about Webdev.

Which model leads Webdev?

Claude Opus 5 is currently ranked first.

What does Webdev measure?

This Arena reports rating values across 5 configured evaluation categories.

Does this result affect the LLMBoard score?

No. Arena results remain a separate preference or task-outcome signal.

How many models are included?

92 model results are currently shown.