LLM Reference

OpenAI Whisper Models by OpenAI

OpenAIProprietaryAudio
4 models2022–2024

Last refreshed 2026-06-07. Next refresh: weekly.

Details

ResearcherOpenAI
LicenseProprietary
Commercial useCommercial use: conditional
Models4
Released2022–2024

Capabilities

MultimodalAll models

Links

Website

About

OpenAI's Whisper family provides multilingual automatic speech recognition and translation models exposed through the OpenAI Audio API.

Decision facts

Best fit
audiospeech recognitionvision and multimodal work
Capability starting point
Whisper large-v3-turbo with multimodal inputs
Lowest tracked input
Not tracked
Closest related family
GPT Realtime 2

Current Variants

Use-when guidance is based on each model's tracked capabilities, context window, release date, and replacement status.

4 in view

Use when the workload needs speech recognition, multimodal inputs, and audio.

2024-01speech recognitionmultimodal inputsaudio

Use when the workload needs speech recognition, 74M parameters, and multimodal inputs.

2022-12speech recognition74M parametersmultimodal inputs

Use when the workload needs speech recognition, 39M parameters, and multimodal inputs.

2022-12speech recognition39M parametersmultimodal inputs
WhisperCurrent

Use when the workload needs speech recognition, multimodal inputs, and audio.

2022-09speech recognitionmultimodal inputsaudio

Release Timeline

3 release groups
2024-01
1 current
Whisper large-v3-turbo
speech recognitionmultimodal inputsaudio
Current
2022-12
2 current
Whisper Base
speech recognition74M parametersmultimodal inputs
Current
Whisper Tiny EN
speech recognition39M parametersmultimodal inputs
Current
2022-09
1 current
Whisper
speech recognitionmultimodal inputsaudio
Current

Specifications(4 models)

OpenAI Whisper model specifications comparison
ModelReleasedParametersMultimodal
Whisper large-v3-turbo2024-01Yes
Whisper Base2022-1274MYes
Whisper Tiny EN2022-1239MYes
Whisper2022-09Yes