LLM Reference

GLM-ASR Models by Zhipu AI

Zhipu AIProprietaryAudio
1 model

Last refreshed 2026-07-11. Next refresh: weekly.

Details

ResearcherZhipu AI
LicenseProprietary
Commercial useCommercial use: conditional
Models1

Capabilities

MultimodalAll models

Links

Website

About

GLM-ASR is Zhipu AI's speech-recognition family for reusable audio transcription models, including real-time and multilingual speech-to-text API access.

Decision facts

Best fit
audiospeech recognitionvision and multimodal work
Capability starting point
GLM-ASR-2512 with multimodal inputs
Lowest tracked input
Not tracked
Closest related family
GLM-5

Current Variants

Use-when guidance is based on each model's tracked capabilities, context window, release date, and replacement status.

1 in view

Use when the workload needs speech recognition, multimodal inputs, and audio.

Unknown releasespeech recognitionmultimodal inputsaudio

Release Timeline

1 release group
Unknown release
1 current
GLM-ASR-2512
speech recognitionmultimodal inputsaudio
Current

Specifications(1 models)

GLM-ASR model specifications comparison
ModelReleasedMultimodal
GLM-ASR-2512Yes

Available From(1 provider)