LLM Reference

GPT Audio Models by OpenAI

OpenAIProprietary
2 models2024Up to 128k ctxFrom $0.6/1M input

Last refreshed 2026-05-19. Next refresh: weekly.

Details

ResearcherOpenAI
LicenseProprietary
Commercial useCommercial use: conditional
Models2
Released2024
Max context128k

Capabilities

MultimodalAll models

Links

Website

About

OpenAI's audio models for Chat Completions API audio in/out. Includes gpt-audio-1.5 (flagship), gpt-audio, and gpt-audio-mini. Replaced the gpt-4o-audio-preview series.

Decision facts

Best fit
audiovision and multimodal work
Capability starting point
GPT Audio with 128k context and multimodal inputs
Lowest tracked input
GPT Audio Mini · $0.6/1M · OpenRouter
Closest related family
GPT-5

Current Variants

Use-when guidance is based on each model's tracked capabilities, context window, release date, and replacement status.

2 in view
GPT AudioCurrent

Use when the workload needs audio, 128k context, and multimodal inputs.

2024-10audio128k contextmultimodal inputs

Use when the workload needs audio, 128k context, and multimodal inputs.

2024-10audio128k contextmultimodal inputs

Release Timeline

1 release group
2024-10
2 current
GPT Audio
audio128k contextmultimodal inputs
Current
GPT Audio Mini
audio128k contextmultimodal inputs
Current

Specifications(2 models)

GPT Audio model specifications comparison
ModelReleasedContextMultimodal
GPT Audio2024-10128kYes
GPT Audio Mini2024-10128kYes

Available From(2 providers)

Pricing

GPT Audio model pricing by provider
ModelProviderInput / 1MOutput / 1MType
GPT Audio MiniOpenRouter$0.6$2.4Serverless
GPT Audio MiniOpenAI API$0.6$2.4Serverless
GPT AudioOpenRouter$2.5$10Serverless
GPT AudioOpenAI API$2.5$10Serverless