LLM Reference

GLM-OCR Models by Zhipu AI

Zhipu AIProprietaryVision
1 model

Last refreshed 2026-07-11. Next refresh: weekly.

Details

ResearcherZhipu AI
LicenseProprietary
Commercial useCommercial use: conditional
Models1

Capabilities

VisionAll models
MultimodalAll models
Structured OutputsAll models

Links

Website

About

GLM-OCR is Zhipu AI's vision family for optical character recognition, document understanding, and layout-aware parsing through the BigModel API.

Decision facts

Best fit
visionextractionvision and multimodal work
Capability starting point
GLM-OCR with structured outputs and multimodal inputs
Lowest tracked input
Not tracked
Closest related family
GLM-5

Current Variants

Use-when guidance is based on each model's tracked capabilities, context window, release date, and replacement status.

1 in view
GLM-OCRCurrent

Use when the workload needs vision, structured outputs, and multimodal inputs.

Unknown releasevisionstructured outputsmultimodal inputs

Release Timeline

1 release group
Unknown release
1 current
GLM-OCR
visionstructured outputsmultimodal inputs
Current

Specifications(1 models)

GLM-OCR model specifications comparison
ModelReleasedVisionMultimodalStructured Outputs
GLM-OCRYesYesYes

Available From(1 provider)