LLM Reference

Voxtral Models by MistralAI

4 models2025–2026Up to 33k ctxFrom $0.04/1M input

Last refreshed 2026-05-22. Next refresh: weekly.

Details

ResearcherMistralAI
Models4
Released2025–2026
Max context33k

Capabilities

Multimodal2 of 4 models

About

Voxtral is a family of 4 AI models by MistralAI, released between 2025 and 2026.

Decision facts

Best fit
text to speechspeech recognitionaudio
Capability starting point
Voxtral Mini Transcribe 2 with 33k context and multimodal inputs
Lowest tracked input
Mistral Voxtral Mini 3B 2507 · $0.04/1M · AWS Bedrock
Closest related family
Ministral

Current Variants

Use-when guidance is based on each model's tracked capabilities, context window, release date, and replacement status.

4 in view

Use when the workload needs text to speech, multimodal inputs, and audio.

2026-03text to speechmultimodal inputsaudio

Use when the workload needs speech recognition, 33k context, and multimodal inputs.

2026-02speech recognition33k contextmultimodal inputs

Use when the workload needs audio and 3B parameters.

2025-07audio3B parameters

Use when the workload needs audio and 24B parameters.

2025-07audio24B parameters

Release Timeline

3 release groups
2026-03
1 current
Voxtral TTS
text to speechmultimodal inputsaudio
Current
2026-02
1 current
Voxtral Mini Transcribe 2
speech recognition33k contextmultimodal inputs
Current
2025-07
2 current
Current
Current

Specifications(4 models)

Voxtral model specifications comparison
ModelReleasedContextParametersMultimodal
Voxtral TTS2026-03Yes
Voxtral Mini Transcribe 22026-0233kYes
Mistral Voxtral Mini 3B 25072025-073BNo
Mistral Voxtral Small 24B 25072025-0724BNo

Available From(2 providers)

Pricing

Voxtral model pricing by provider
ModelProviderInput / 1MOutput / 1MType
Mistral Voxtral Mini 3B 2507AWS Bedrock$0.04$0.04Serverless
Mistral Voxtral Small 24B 2507AWS Bedrock$0.1$0.3Serverless
Mistral Voxtral Small 24B 2507Mistral AI Studio$0.1$0.4Serverless