llmboard.aiAI model intelligence
Home

Model Rankings

OverallOpen ModelsAgentCodingReasoningMathKnowledgeInstruction FollowingTextVision
Image GenerationImage Editing
Video GenerationImage to VideoVideo Editing
Text to SpeechSpeech to Text
Embeddings

Efficiency

Chat Token PricingImage PricingVideo PricingAudio Pricing
Chat Speed & LatencyProvider Reliability

Benchmarks

GPQAMMLU-ProAIME 2025SWE-Bench VerifiedMMLUHumanity's Last ExamLiveCodeBenchMATHHumanEvalMMMU-Pro
All Benchmarks

Tools

Model Directory

Scoring & Data

Scoring & Data
1224 models729 benchmarks

Leaderboard Center

Overall RankingCodingCore BenchmarksPrice & ValueRuntime Performance

Modalities

All ModelsImage GenerationImage EditingVideo GenerationImage-to-VideoVideo EditingText-to-SpeechSpeech-to-TextEmbeddings

Data & Methods

Scoring MethodAll Benchmarks
llmboard.aiCopyright 2026 llmboard.ai

OpenAI model product

GPT-4-Turbo

GPT-4-Turbo is an OpenAI large language model with updated knowledge, improved performance, faster response times, and more affordable pricing than previous versions.

Updated Sep 8, 2026. Default version: GPT-4 Turbo

LLMBoard Score12.6GPT-4 Turbo
Coverage20%6 benchmark families
Context window128KTokens
Official input price$10OpenAI API

On this page

  • Capability
  • Benchmarks
  • Arena
  • Pricing
  • Runtime
  • Specification
  • Versions
  • Similar models
  • About
  • FAQ

GPT-4-Turbo Capability Profile

This profile uses the model's current scored version. Arena ratings and prices are shown separately.

GPT-4 Turbo LLMBoard score breakdown

GPT-4-Turbo Benchmark Results

Benchmark scores for GPT-4 Turbo.

10 rows
Columns

Show columns

Sort by
Benchmark
Score
Rank
Participants
Percentile
Evidence
Evaluated
BenchmarkDROPScore86.00%Rank05Participants30Percentile86.21%EvidenceCEvaluatedSep 8, 2026
BenchmarkMGSMScore88.50%Rank11Participants31Percentile66.67%EvidenceCEvaluatedSep 8, 2026
BenchmarkMMLUScore86.50%Rank29Participants101Percentile72.00%EvidenceCEvaluatedSep 8, 2026
BenchmarkHumanEvalScore87.10%Rank30Participants66Percentile55.38%EvidenceCEvaluatedSep 8, 2026
BenchmarkMATHScore72.60%Rank33Participants71Percentile54.29%EvidenceCEvaluatedSep 8, 2026
BenchmarkLM Arena VisionScore1,089.86 ratingRank91Participants107Percentile15.09%EvidenceAEvaluatedAug 27, 2026
BenchmarkLM Arena Vision Style ControlScore1,112.18 ratingRank92Participants107Percentile14.15%EvidenceAEvaluatedAug 27, 2026
BenchmarkLM Arena Text Style ControlScore1,324.05 ratingRank164Participants210Percentile22.01%EvidenceAEvaluatedSep 2, 2026
BenchmarkLM Arena TextScore1,271.47 ratingRank179Participants210Percentile14.83%EvidenceAEvaluatedSep 2, 2026
BenchmarkGPQAScore48.00%Rank197Participants247Percentile20.33%EvidenceCEvaluatedSep 8, 2026

GPT-4-Turbo Arena Results

Preference and agent-evaluation results for the default version.

30 of 64 rows
Columns

Show columns

Sort by
Arena
Category
Rank
Rating / score
Votes
Observations
Result date
ArenavisionCategorychineseRank83Rating / score1,044.18Votes937ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategorychineseRank86Rating / score1,063.27Votes937ObservationsN/AResult dateAug 27, 2026
ArenavisionCategoryoverallRank91Rating / score1,089.86Votes13,391ObservationsN/AResult dateAug 27, 2026
ArenavisionCategoryenglishRank92Rating / score1,096.33Votes8,417ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategoryoverallRank92Rating / score1,112.18Votes13,391ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategoryenglishRank93Rating / score1,112.10Votes8,417ObservationsN/AResult dateAug 27, 2026
Arenatext style controlCategorypolishRank117Rating / score1,363.32Votes178ObservationsN/AResult dateSep 2, 2026
ArenatextCategorypolishRank131Rating / score1,301.75Votes178ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategorycreative writingRank140Rating / score1,322.54Votes14,396ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryjapaneseRank140Rating / score1,250.77Votes2,112ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategorykoreanRank141Rating / score1,263.28Votes2,668ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategorygermanRank143Rating / score1,311.45Votes3,359ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryindustry writing and literature and languageRank143Rating / score1,329.44Votes24,529ObservationsN/AResult dateSep 2, 2026
ArenatextCategoryjapaneseRank145Rating / score1,193.88Votes2,112ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryindustry entertainment and sports and mediaRank146Rating / score1,313.57Votes14,793ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryspanishRank148Rating / score1,314.04Votes1,430ObservationsN/AResult dateSep 2, 2026
ArenatextCategorygermanRank149Rating / score1,259.18Votes3,359ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryfrenchRank149Rating / score1,335.34Votes1,402ObservationsN/AResult dateSep 2, 2026
ArenatextCategorykoreanRank152Rating / score1,186.39Votes2,668ObservationsN/AResult dateSep 2, 2026
ArenatextCategoryfrenchRank153Rating / score1,275.22Votes1,402ObservationsN/AResult dateSep 2, 2026
ArenatextCategoryspanishRank158Rating / score1,259.18Votes1,430ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategorymathRank162Rating / score1,296.27Votes13,217ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryrussianRank163Rating / score1,312.75Votes9,938ObservationsN/AResult dateSep 2, 2026
ArenatextCategoryindustry entertainment and sports and mediaRank164Rating / score1,258.06Votes14,793ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryoverallRank164Rating / score1,324.05Votes98,114ObservationsN/AResult dateSep 2, 2026
ArenatextCategorycreative writingRank165Rating / score1,268.30Votes14,396ObservationsN/AResult dateSep 2, 2026
ArenatextCategorymathRank165Rating / score1,271.59Votes13,217ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryindustry legal and governmentRank165Rating / score1,336.29Votes5,381ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryenglishRank166Rating / score1,340.99Votes55,116ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategorychineseRank167Rating / score1,317.00Votes10,827ObservationsN/AResult dateSep 2, 2026

GPT-4-Turbo Pricing

Official vendor API pricing appears first, followed by individual provider offers.

Official API
$10 input, $30 output per 1M
Official provider
OpenAI
Lowest third-party
N/A
Tracked offerings
1
1 row
Columns

Show columns

Sort by
Provider
Provider model ID
Region
Input / 1M
Output / 1M
Context
Updated
ProviderOpenAIProvider model IDgpt-4-turboRegionglobalInput / 1M$10Output / 1M$30Context128KUpdatedSep 8, 2026

Official prices use only the vendor's configured official Provider and positive standard USD PAYG rates. Third-party offers remain explicitly labeled.

GPT-4-Turbo Runtime Performance

Provider-specific output speed and catalog latency for GPT-4 Turbo. Runtime does not affect the capability score.

2 rows
Columns

Show columns

Sort by
Provider
Output Speed
Catalog Latency
Max Input
Max Output
Updated
ProviderOpenAIOutput Speed100.00 tok/sCatalog Latency0.50 sMax Input128KMax Output4.1KUpdatedSep 8, 2026
ProviderAzureOutput Speed97.00 tok/sCatalog Latency0.60 sMax Input128KMax Output4.1KUpdatedSep 8, 2026

Output Speed is generated output tokens received per second. Catalog latency is reported separately from observed provider TTFT.

GPT-4-Turbo Specifications

Technical details for the model's default version.

Version
GPT-4 Turbo
Released
Apr 9, 2024
Knowledge cutoff
Dec 31, 2023
Parameters
N/A
Context window
128K
Max output
4.1K
Inputs
text
Outputs
text
Open weights
No
License
Proprietary

GPT-4-Turbo Versions

Available versions of this model. The score column identifies the version used in the overall ranking.

1 row
Columns

Show columns

Sort by
Version
Released
LLMBoard
Parameters
Context
Max output
Open weights
License
VersionGPT-4 TurboReleasedApr 9, 2024LLMBoard12.63ParametersN/AContext128KMax output4.1KOpen weightsNoLicenseProprietary

Models similar to GPT-4-Turbo

Recommendations prioritize the same model type and family, then the closest LLMBoard score.

#224+2.47
OP

o1 mini

OpenAI

15.10 LLMBoard

Details
#253-6.34
OP

GPT-4o-mini

OpenAI

6.29 LLMBoard

Details
#259-8.38
OP

GPT-4

OpenAI

4.25 LLMBoard

Details
#205+10.01
OP

GPT-4o

OpenAI

22.64 LLMBoard

Details
#263-10.15
OP

GPT-4.1-nano

OpenAI

2.48 LLMBoard

Details
#199+10.94
OP

GPT-4.1-mini

OpenAI

23.57 LLMBoard

Details

What is GPT-4-Turbo?

Key information about GPT-4-Turbo and its available data.

GPT-4-Turbo is a GPT-4 model from OpenAI. It is described as having updated knowledge, improved performance, enhanced capabilities, faster response times, and more affordable pricing than previous versions.

Data as of 2026-09-08.

FAQ

Common questions about GPT-4-Turbo.

When was GPT-4-Turbo released?

GPT-4-Turbo's default version was released on Apr 9, 2024.

How much does GPT-4-Turbo cost?

GPT-4-Turbo's official API price is $10 per million input tokens and $30 per million output tokens via OpenAI.

Who created GPT-4-Turbo?

GPT-4-Turbo was created by OpenAI.

What is the context window for GPT-4-Turbo?

The default version has a 128K token context window.

Is GPT-4-Turbo open weight?

No. The default version is not marked as having publicly available weights.

How many API providers offer GPT-4-Turbo?

1 provider offerings are linked to the default version.