llmboard.aiAI model intelligence
Home

Model Rankings

OverallOpen ModelsAgentCodingReasoningMathKnowledgeInstruction FollowingTextVision
Image GenerationImage Editing
Video GenerationImage to VideoVideo Editing
Text to SpeechSpeech to Text
Embeddings

Efficiency

Chat Token PricingImage PricingVideo PricingAudio Pricing
Chat Speed & LatencyProvider Reliability

Benchmarks

GPQAMMLU-ProAIME 2025SWE-Bench VerifiedMMLUHumanity's Last ExamLiveCodeBenchMATHHumanEvalMMMU-Pro
All Benchmarks

Tools

Model Directory

Scoring & Data

Scoring & Data
1224 models729 benchmarks

Leaderboard Center

Overall RankingCodingCore BenchmarksPrice & ValueRuntime Performance

Modalities

All ModelsImage GenerationImage EditingVideo GenerationImage-to-VideoVideo EditingText-to-SpeechSpeech-to-TextEmbeddings

Data & Methods

Scoring MethodAll Benchmarks
llmboard.aiCopyright 2026 llmboard.ai

Mistral AI model product

Mistral Small 3.1 24B

1 24B is a 24-billion-parameter large language model from Mistral AI with vision understanding and context capabilities up to 128k tokens.

Updated Sep 8, 2026. Default version: Mistral Small 3.1 24B Instruct

LLMBoard Score6.5Mistral Small 3.1 24B Instruct
Coverage20%9 benchmark families
Context windowN/ATokens
Official input priceN/AOfficial price unavailable

On this page

  • Capability
  • Benchmarks
  • Arena
  • Pricing
  • Runtime
  • Specification
  • Versions
  • Similar models
  • About
  • FAQ

Mistral Small 3.1 24B Capability Profile

This profile uses the model's current scored version. Arena ratings and prices are shown separately.

Mistral Small 3.1 24B Instruct LLMBoard score breakdown

Mistral Small 3.1 24B Benchmark Results

Benchmark scores for Mistral Small 3.1 24B Instruct.

13 rows
Columns

Show columns

Sort by
Benchmark
Score
Rank
Participants
Percentile
Evidence
Evaluated
BenchmarkTriviaQAScore80.50%Rank05Participants18Percentile76.47%EvidenceCEvaluatedSep 8, 2026
BenchmarkMBPPScore74.71%Rank18Participants33Percentile46.88%EvidenceCEvaluatedSep 8, 2026
BenchmarkHumanEvalScore88.41%Rank20Participants66Percentile70.77%EvidenceCEvaluatedSep 8, 2026
BenchmarkSimpleQAScore10.43%Rank41Participants47Percentile13.04%EvidenceCEvaluatedSep 8, 2026
BenchmarkMATHScore69.30%Rank42Participants71Percentile41.43%EvidenceCEvaluatedSep 8, 2026
BenchmarkMMMUScore59.27%Rank48Participants64Percentile25.40%EvidenceCEvaluatedSep 8, 2026
BenchmarkMMLUScore80.62%Rank57Participants101Percentile44.00%EvidenceCEvaluatedSep 8, 2026
BenchmarkLM Arena VisionScore1,136.87 ratingRank83Participants107Percentile22.64%EvidenceAEvaluatedAug 27, 2026
BenchmarkLM Arena Vision Style ControlScore1,127.62 ratingRank86Participants107Percentile19.81%EvidenceAEvaluatedAug 27, 2026
BenchmarkMMLU-ProScore66.76%Rank104Participants138Percentile24.82%EvidenceCEvaluatedSep 8, 2026
BenchmarkLM Arena TextScore1,277.31 ratingRank177Participants210Percentile15.79%EvidenceAEvaluatedSep 2, 2026
BenchmarkLM Arena Text Style ControlScore1,302.99 ratingRank181Participants210Percentile13.88%EvidenceAEvaluatedSep 2, 2026
BenchmarkGPQAScore45.96%Rank203Participants247Percentile17.89%EvidenceCEvaluatedSep 8, 2026

Mistral Small 3.1 24B Arena Results

Preference and agent-evaluation results for the default version.

30 of 80 rows
Columns

Show columns

Sort by
Arena
Category
Rank
Rating / score
Votes
Observations
Result date
ArenavisionCategorycaptioningRank25Rating / score1,154.71Votes261ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategorycaptioningRank26Rating / score1,135.13Votes261ObservationsN/AResult dateAug 27, 2026
ArenavisionCategorycreative writingRank27Rating / score1,143.49Votes777ObservationsN/AResult dateJan 9, 2026
Arenavision style controlCategorycreative writingRank28Rating / score1,132.03Votes777ObservationsN/AResult dateJan 9, 2026
ArenavisionCategoryentity recognitionRank38Rating / score1,154.17Votes242ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategoryentity recognitionRank39Rating / score1,130.02Votes242ObservationsN/AResult dateAug 27, 2026
ArenavisionCategoryhumorRank66Rating / score1,141.78Votes935ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategoryhumorRank67Rating / score1,119.92Votes935ObservationsN/AResult dateAug 27, 2026
ArenavisionCategorycreative writing visionRank71Rating / score1,125.29Votes774ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategorycreative writing visionRank71Rating / score1,111.00Votes774ObservationsN/AResult dateAug 27, 2026
ArenavisionCategorychineseRank72Rating / score1,152.81Votes1,256ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategorychineseRank74Rating / score1,148.37Votes1,256ObservationsN/AResult dateAug 27, 2026
ArenavisionCategoryhomeworkRank75Rating / score1,157.75Votes813ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategoryhomeworkRank77Rating / score1,160.38Votes813ObservationsN/AResult dateAug 27, 2026
ArenavisionCategoryocrRank79Rating / score1,132.21Votes7,225ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategoryocrRank79Rating / score1,133.62Votes7,225ObservationsN/AResult dateAug 27, 2026
ArenavisionCategorydiagramRank80Rating / score1,120.64Votes1,632ObservationsN/AResult dateAug 27, 2026
ArenavisionCategoryenglishRank81Rating / score1,157.56Votes14,782ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategorydiagramRank81Rating / score1,130.19Votes1,632ObservationsN/AResult dateAug 27, 2026
ArenavisionCategoryoverallRank83Rating / score1,136.87Votes28,559ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategoryenglishRank86Rating / score1,139.23Votes14,782ObservationsN/AResult dateAug 27, 2026
Arenavision style controlCategoryoverallRank86Rating / score1,127.62Votes28,559ObservationsN/AResult dateAug 27, 2026
ArenatextCategoryjapaneseRank138Rating / score1,211.03Votes797ObservationsN/AResult dateSep 2, 2026
ArenatextCategorykoreanRank142Rating / score1,205.33Votes697ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategoryjapaneseRank143Rating / score1,241.98Votes797ObservationsN/AResult dateSep 2, 2026
ArenatextCategoryspanishRank146Rating / score1,282.94Votes803ObservationsN/AResult dateSep 2, 2026
ArenatextCategorygermanRank147Rating / score1,266.37Votes874ObservationsN/AResult dateSep 2, 2026
ArenatextCategorypolishRank148Rating / score1,241.83Votes2,792ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategorypolishRank149Rating / score1,279.16Votes2,792ObservationsN/AResult dateSep 2, 2026
Arenatext style controlCategorykoreanRank150Rating / score1,240.69Votes697ObservationsN/AResult dateSep 2, 2026

Mistral Small 3.1 24B Pricing

Official vendor API pricing appears first, followed by individual provider offers.

Official API
N/A
Official provider
N/A
Lowest third-party
From $0.10 input, $0.30 output per 1M via NanoGPT
Tracked offerings
2
2 rows
Columns

Show columns

Sort by
Provider
Provider model ID
Region
Input / 1M
Output / 1M
Context
Updated
ProviderNanoGPTProvider model IDmistral-small-31-24b-instructRegionglobalInput / 1M$0.10Output / 1M$0.30Context128KUpdatedSep 8, 2026
ProviderCloudflare Workers AIProvider model ID@cf/mistralai/mistral-small-3.1-24b-instructRegionglobalInput / 1M$0.351Output / 1M$0.555Context128KUpdatedSep 8, 2026

Official prices use only the vendor's configured official Provider and positive standard USD PAYG rates. Third-party offers remain explicitly labeled.

Mistral Small 3.1 24B Runtime Performance

Provider-specific output speed and catalog latency for Mistral Small 3.1 24B Instruct. Runtime does not affect the capability score.

No runtime data

No provider-specific speed or latency record is linked to the default version yet.

Output Speed is generated output tokens received per second. Catalog latency is reported separately from observed provider TTFT.

Mistral Small 3.1 24B Specifications

Technical details for the model's default version.

Version
Mistral Small 3.1 24B Instruct
Released
Mar 17, 2025
Knowledge cutoff
Unknown
Parameters
24B
Context window
N/A
Max output
N/A
Inputs
image, text
Outputs
text
Open weights
Yes
License
Apache 2.0

Mistral Small 3.1 24B Versions

Available versions of this model. The score column identifies the version used in the overall ranking.

2 rows
Columns

Show columns

Sort by
Version
Released
LLMBoard
Parameters
Context
Max output
Open weights
License
VersionMistral Small 3.1 24B BaseReleasedMar 17, 2025LLMBoardN/AParameters24BContext128KMax output128KOpen weightsYesLicenseApache 2.0
VersionMistral Small 3.1 24B InstructReleasedMar 17, 2025LLMBoard6.55Parameters24BContextN/AMax outputN/AOpen weightsYesLicenseApache 2.0

Models similar to Mistral Small 3.1 24B

Recommendations prioritize the same model type and family, then the closest LLMBoard score.

#256-1.06
MA

Mistral Small 3 24B

Mistral AI

5.49 LLMBoard

Details
#246+2.44
MA

Mistral Large 2

Mistral AI

8.99 LLMBoard

Details
#270-5.91
MA

Codestral 22B

Mistral AI

0.64 LLMBoard

Details
#282-6.55
MA

Ministral 8B

Mistral AI

0.00 LLMBoard

Details
#283-6.55
MA

Mistral Nemo

Mistral AI

0.00 LLMBoard

Details
#289-6.55
MA

Pixtral 12B

Mistral AI

0.00 LLMBoard

Details

What is Mistral Small 3.1 24B?

Key information about Mistral Small 3.1 24B and its available data.

1 24B is a large language model from Mistral AI with 24 billion parameters. It is designed for text and vision tasks and extends context capabilities up to 128k tokens.

Data as of 2026-09-08.

FAQ

Common questions about Mistral Small 3.1 24B.

When was Mistral Small 3.1 24B released?

Mistral Small 3.1 24B's default version was released on Mar 17, 2025.

How much does Mistral Small 3.1 24B cost?

No official standard PAYG price is currently available for Mistral Small 3.1 24B. The lowest tracked third-party offer starts at $0.10 input and $0.30 output via NanoGPT.

Who created Mistral Small 3.1 24B?

Mistral Small 3.1 24B was created by Mistral AI.

What is the context window for Mistral Small 3.1 24B?

A context window is not available for the default version.

Is Mistral Small 3.1 24B open weight?

Yes. The default version is marked as open weight under Apache 2.0.

How many API providers offer Mistral Small 3.1 24B?

2 provider offerings are linked to the default version.

Browse runtime rankings