llmboard.aiAI model intelligence
Home

Model Rankings

OverallOpen ModelsAgentCodingReasoningMathKnowledgeInstruction FollowingTextVision
Image GenerationImage Editing
Video GenerationImage to VideoVideo Editing
Text to SpeechSpeech to Text
Embeddings

Efficiency

Chat Token PricingImage PricingVideo PricingAudio Pricing
Chat Speed & LatencyProvider Reliability

Benchmarks

GPQAMMLU-ProAIME 2025SWE-Bench VerifiedMMLUHumanity's Last ExamLiveCodeBenchMATHHumanEvalMMMU-Pro
All Benchmarks

Tools

Model Directory

Scoring & Data

Scoring & Data
1224 models729 benchmarks

Leaderboard Center

Overall RankingCodingCore BenchmarksPrice & ValueRuntime Performance

Modalities

All ModelsImage GenerationImage EditingVideo GenerationImage-to-VideoVideo EditingText-to-SpeechSpeech-to-TextEmbeddings

Data & Methods

Scoring MethodAll Benchmarks
llmboard.aiCopyright 2026 llmboard.ai

Anthropic model product

Claude Sonnet 4.5

5 is an LLM from Anthropic with coding, agent-building, computer-use, reasoning, and math capabilities.

Updated Sep 8, 2026. Default version: Claude Sonnet 4.5

LLMBoard Score55.5Claude Sonnet 4.5
Coverage0%8 benchmark families
Context window200KTokens
Official input price$3Anthropic API

On this page

  • Capability
  • Benchmarks
  • Arena
  • Pricing
  • Runtime
  • Specification
  • Versions
  • Similar models
  • About
  • FAQ

Claude Sonnet 4.5 Capability Profile

This profile uses the model's current scored version. Arena ratings and prices are shown separately.

Claude Sonnet 4.5 LLMBoard score breakdown

Claude Sonnet 4.5 Benchmark Results

Benchmark scores for Claude Sonnet 4.5.

18 rows
Columns

Show columns

Sort by
Benchmark
Score
Rank
Participants
Percentile
Evidence
Evaluated
BenchmarkSWE-bench Verified (Agentic Coding)Score77.20%Rank01Participants2Percentile100.00%EvidenceCEvaluatedSep 8, 2026
BenchmarkTAU-bench AirlineScore70.00%Rank01Participants23Percentile100.00%EvidenceCEvaluatedSep 8, 2026
BenchmarkTAU-bench RetailScore86.20%Rank01Participants25Percentile100.00%EvidenceCEvaluatedSep 8, 2026
BenchmarkTerminal-BenchScore50.00%Rank01Participants25Percentile100.00%EvidenceCEvaluatedSep 8, 2026
BenchmarkMMMUvalScore77.80%Rank03Participants4Percentile33.33%EvidenceCEvaluatedSep 8, 2026
BenchmarkOSWorldScore61.40%Rank08Participants20Percentile63.16%EvidenceCEvaluatedSep 8, 2026
BenchmarkMMMLUScore89.10%Rank13Participants49Percentile75.00%EvidenceCEvaluatedSep 8, 2026
BenchmarkLM Arena DocumentScore1,446.19 ratingRank18Participants33Percentile46.88%EvidenceAEvaluatedJul 30, 2026
BenchmarkLM Arena SearchScore1,158.46 ratingRank20Participants28Percentile29.63%EvidenceAEvaluatedAug 24, 2026
BenchmarkLM Arena Search FactualityScore1,160.34 ratingRank20Participants28Percentile29.63%EvidenceAEvaluatedAug 24, 2026
BenchmarkLM Arena Search Style ControlScore1,175.19 ratingRank20Participants28Percentile29.63%EvidenceAEvaluatedAug 24, 2026
BenchmarkLM Arena Document Style ControlScore1,446.38 ratingRank23Participants33Percentile31.25%EvidenceAEvaluatedJul 30, 2026
BenchmarkLM Arena Text Style ControlScore1,456.27 ratingRank43Participants210Percentile79.90%EvidenceAEvaluatedSep 2, 2026
BenchmarkLM Arena Text FactualityScore1,448.19 ratingRank47Participants121Percentile61.67%EvidenceAEvaluatedSep 2, 2026
BenchmarkLM Arena TextScore1,438.27 ratingRank52Participants210Percentile75.60%EvidenceAEvaluatedSep 2, 2026
BenchmarkAIME 2025Score87.00%Rank58Participants119Percentile51.69%EvidenceCEvaluatedSep 8, 2026
BenchmarkLM Arena WebdevScore1,392.36 ratingRank62Participants97Percentile36.46%EvidenceAEvaluatedSep 5, 2026
BenchmarkGPQAScore83.40%Rank74Participants247Percentile70.33%EvidenceCEvaluatedSep 8, 2026

Claude Sonnet 4.5 Arena Results

Preference and agent-evaluation results for the default version.

30 of 95 rows
Columns

Show columns

Sort by
Arena
Category
Rank
Rating / score
Votes
Observations
Result date
Arenatext factualityCategorycodingRank17Rating / score1,522.34Votes12,838ObservationsN/AResult dateSep 2, 2026
Arenatext factualityCategoryspanishRank17Rating / score1,457.55Votes1,411ObservationsN/AResult dateSep 2, 2026
ArenadocumentCategoryoverallRank18Rating / score1,446.19Votes28,634ObservationsN/AResult dateJul 30, 2026
Arenatext factualityCategoryhard prompts englishRank19Rating / score1,499.00Votes13,253ObservationsN/AResult dateSep 2, 2026
Arenatext factualityCategorylonger queryRank19Rating / score1,487.22Votes17,414ObservationsN/AResult dateSep 2, 2026
ArenasearchCategoryoverallRank20Rating / score1,158.46Votes127,378ObservationsN/AResult dateAug 24, 2026
Arenasearch factualityCategoryoverallRank20Rating / score1,160.34Votes127,193ObservationsN/AResult dateAug 24, 2026
Arenasearch style controlCategoryoverallRank20Rating / score1,175.19Votes127,378ObservationsN/AResult dateAug 24, 2026
Arenatext style controlCategorycreative writingRank21Rating / score1,453.54Votes11,851ObservationsN/AResult dateSep 2, 2026
ArenatextCategorylonger queryRank22Rating / score1,476.36Votes25,043ObservationsN/AResult dateSep 2, 2026
Arenatext factualityCategorykoreanRank22Rating / score1,407.62Votes603ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategorylonger queryRank22Rating / score1,486.22Votes24,677ObservationsN/AResult dateSep 2, 2026
Arenadocument style controlCategoryoverallRank23Rating / score1,446.38Votes28,634ObservationsN/AResult dateJul 30, 2026
ArenatextCategoryinstruction followingRank23Rating / score1,459.17Votes23,301ObservationsN/AResult dateSep 2, 2026
ArenatextCategorycodingRank24Rating / score1,488.80Votes19,125ObservationsN/AResult dateSep 2, 2026
Arenatext factualityCategoryinstruction followingRank24Rating / score1,467.84Votes16,351ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategorycodingRank24Rating / score1,519.79Votes19,125ObservationsN/AResult dateSep 2, 2026
Arenatext factualityCategorycreative writingRank25Rating / score1,446.34Votes7,268ObservationsN/AResult dateSep 2, 2026
Arenatext factualityCategoryexpertRank25Rating / score1,495.15Votes3,333ObservationsN/AResult dateSep 2, 2026
Arenatext factualityCategoryindustry mathematicalRank26Rating / score1,461.22Votes2,259ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryspanishRank26Rating / score1,464.47Votes2,443ObservationsN/AResult dateSep 2, 2026
ArenatextCategorycreative writingRank27Rating / score1,441.37Votes11,851ObservationsN/AResult dateSep 2, 2026
ArenatextCategoryexpertRank27Rating / score1,483.75Votes5,659ObservationsN/AResult dateSep 2, 2026
ArenatextCategorymulti turnRank27Rating / score1,465.31Votes13,940ObservationsN/AResult dateSep 2, 2026
ArenatextCategoryspanishRank27Rating / score1,454.88Votes2,443ObservationsN/AResult dateSep 2, 2026
Arenatext factualityCategorymulti turnRank27Rating / score1,472.98Votes8,750ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryexpertRank27Rating / score1,499.13Votes5,659ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryhard prompts englishRank27Rating / score1,495.63Votes20,406ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryindustry entertainment and sports and mediaRank27Rating / score1,444.69Votes15,513ObservationsN/AResult dateSep 2, 2026
Arenatext factualityCategorygermanRank28Rating / score1,403.29Votes614ObservationsN/AResult dateSep 2, 2026

Claude Sonnet 4.5 Pricing

Official vendor API pricing appears first, followed by individual provider offers.

Official API
$3 input, $15 output per 1M
Official provider
Anthropic
Lowest third-party
From $0.43 input, $2.14 output per 1M via QiHang
Tracked offerings
41
30 of 39 rows
Columns

Show columns

Sort by
Provider
Provider model ID
Region
Input / 1M
Output / 1M
Context
Updated
ProviderQiHangProvider model IDclaude-sonnet-4-5-20250929RegionglobalInput / 1M$0.43Output / 1M$2.14Context200KUpdatedSep 8, 2026
ProviderPoeProvider model IDanthropic/claude-sonnet-4.5RegionglobalInput / 1M$2.6Output / 1M$13Context983KUpdatedSep 8, 2026
ProviderJiekou.AIProvider model IDclaude-sonnet-4-5-20250929RegionglobalInput / 1M$2.7Output / 1M$13.5Context200KUpdatedSep 8, 2026
ProviderCortecsProvider model IDclaude-4-5-sonnetRegionglobalInput / 1M$2.99Output / 1M$14.95Context200KUpdatedSep 8, 2026
ProviderOrcaRouterProvider model IDanthropic/claude-sonnet-4.5RegionglobalInput / 1M$3Output / 1M$15Context1MUpdatedSep 8, 2026
ProviderNanoGPTProvider model IDclaude-sonnet-4-5-20250929RegionglobalInput / 1M$3Output / 1M$15Context1MUpdatedSep 8, 2026
ProviderVertexProvider model IDclaude-sonnet-4-5@20250929RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderImpossiblProvider model IDanthropic/claude-sonnet-4-5RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderOpenRouterProvider model IDanthropic/claude-sonnet-4.5RegionglobalInput / 1M$3Output / 1M$15Context1MUpdatedSep 8, 2026
ProviderVertex (Anthropic)Provider model IDclaude-sonnet-4-5@20250929RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderAnthropicProvider model IDclaude-sonnet-4-5-20250929RegionglobalInput / 1M$3Output / 1M$15Context1MUpdatedSep 8, 2026
ProviderAnthropicProvider model IDclaude-sonnet-4-5RegionglobalInput / 1M$3Output / 1M$15Context1MUpdatedSep 8, 2026
ProviderDatabricksProvider model IDdatabricks-claude-sonnet-4RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderDatabricksProvider model IDdatabricks-claude-sonnet-4-5RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderAmazon BedrockProvider model IDanthropic.claude-sonnet-4-5-20250929-v1:0RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderOpperProvider model IDanthropic/claude-sonnet-4-5RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderLLM GatewayProvider model IDanthropic/claude-sonnet-4-5-20250929RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderLLM GatewayProvider model IDanthropic/claude-sonnet-4-5RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderNEAR AI CloudProvider model IDanthropic/claude-sonnet-4-5RegionglobalInput / 1M$3Output / 1M$15.5Context200KUpdatedSep 8, 2026
ProviderMerge GatewayProvider model IDanthropic/claude-sonnet-4-5-20250929RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderCloudflare AI GatewayProvider model IDanthropic/claude-sonnet-4.5RegionglobalInput / 1M$3Output / 1M$15Context1MUpdatedSep 8, 2026
ProviderZenMuxProvider model IDanthropic/claude-sonnet-4.5RegionglobalInput / 1M$3Output / 1M$15Context1MUpdatedSep 8, 2026
ProviderPerplexity AgentProvider model IDanthropic/claude-sonnet-4-5RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderOfoxProvider model IDanthropic/claude-sonnet-4.5RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderHeliconeProvider model IDclaude-sonnet-4-5-20250929RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderNeonProvider model IDclaude-sonnet-4-5RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderAzure Cognitive ServicesProvider model IDclaude-sonnet-4-5RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
Provider302.AIProvider model IDclaude-sonnet-4-5-20250929RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
Provider302.AIProvider model IDclaude-sonnet-4-5RegionglobalInput / 1M$3Output / 1M$15Context200KUpdatedSep 8, 2026
ProviderOpenCode ZenProvider model IDclaude-sonnet-4-5RegionglobalInput / 1M$3Output / 1M$15Context1MUpdatedSep 8, 2026

Claude Sonnet 4.5 Runtime Performance

Provider-specific output speed and catalog latency for Claude Sonnet 4.5. Runtime does not affect the capability score.

1 row
Columns

Show columns

Sort by
Provider
Output Speed
Catalog Latency
Max Input
Max Output
Updated
ProviderAnthropicOutput Speed42.00 tok/sCatalog Latency0.40 sMax Input200KMax Output64KUpdatedSep 8, 2026

Output Speed is generated output tokens received per second. Catalog latency is reported separately from observed provider TTFT.

Claude Sonnet 4.5 Specifications

Technical details for the model's default version.

Version
Claude Sonnet 4.5
Released
Sep 29, 2025
Knowledge cutoff
Jan 31, 2025
Parameters
N/A
Context window
200K
Max output
64K
Inputs
audio, image, text, video
Outputs
text
Open weights
No
License
Proprietary

Claude Sonnet 4.5 Versions

Available versions of this model. The score column identifies the version used in the overall ranking.

1 row
Columns

Show columns

Sort by
Version
Released
LLMBoard
Parameters
Context
Max output
Open weights
License
VersionClaude Sonnet 4.5ReleasedSep 29, 2025LLMBoard55.54ParametersN/AContext200KMax output64KOpen weightsNoLicenseProprietary

Models similar to Claude Sonnet 4.5

Recommendations prioritize the same model type and family, then the closest LLMBoard score.

#101-4.40
AN

Claude Opus 4.1

Anthropic

51.14 LLMBoard

Details
#119-10.04
AN

Claude Opus 4

Anthropic

45.50 LLMBoard

Details
#121-10.86
AN

Claude Haiku 4.5

Anthropic

44.68 LLMBoard

Details
#50+12.68
AN

Claude Opus 4.5

Anthropic

68.22 LLMBoard

Details
#43+15.83
AN

Claude Sonnet 4.6

Anthropic

71.37 LLMBoard

Details
#150-16.83
AN

Claude Sonnet 4

Anthropic

38.71 LLMBoard

Details

What is Claude Sonnet 4.5?

Key information about Claude Sonnet 4.5 and its available data.

5 is a large language model from Anthropic. The source describes it as supporting coding, complex agents, computer use, reasoning, and math tasks.

Data as of 2026-09-08.

FAQ

Common questions about Claude Sonnet 4.5.

When was Claude Sonnet 4.5 released?

Claude Sonnet 4.5's default version was released on Sep 29, 2025.

How much does Claude Sonnet 4.5 cost?

Claude Sonnet 4.5's official API price is $3 per million input tokens and $15 per million output tokens via Anthropic. The lowest tracked third-party offer starts at $0.43 input and $2.14 output via QiHang.

Who created Claude Sonnet 4.5?

Claude Sonnet 4.5 was created by Anthropic.

What is the context window for Claude Sonnet 4.5?

The default version has a 200K token context window.

Is Claude Sonnet 4.5 open weight?

No. The default version is not marked as having publicly available weights.

How many API providers offer Claude Sonnet 4.5?

Official prices use only the vendor's configured official Provider and positive standard USD PAYG rates. Third-party offers remain explicitly labeled.

41 provider offerings are linked to the default version.