Youtu-Parsing Models by Tencent AI Lab

Tencent AI LabYoutu-Parsing LicenseOpen weights
Tencent AI Lab releases · 5 in the last 12 months · this family litChangelog →
1 model2026

Last refreshed 2026-10-09. Next refresh: weekly.

Details

ResearcherTencent AI Lab
Commercial useCommercial use: conditional
Models1
Released2026

Capabilities

VisionAll models
MultimodalAll models
Structured OutputsAll models

About

Youtu-Parsing is Tencent Youtu Lab's family of open-weight parsing models that turn documents and other media into structured output. Youtu-Parsing-Omni (October 2026) is a 5B omni-modal model that reads document pages, natural images, charts, flowcharts, geometry figures, audio and video and returns one structured JSON format covering layout, text, tables, formulas, timestamps, speech and captions.

Decision facts

Best fit
vision and multimodal workstructured outputscoding
Capability starting point
Youtu-Parsing-Omni with structured outputs and multimodal inputs
Lowest tracked input
Not tracked
Closest related family
Hunyuan Image

Current Variants

Use-when guidance is based on each model's tracked capabilities, context window, release date, and replacement status.

1 in view

Use when the workload needs multimodal, 5B parameters, and structured outputs.

2026-10multimodal5B parametersstructured outputs

Release Timeline

1 release group
2026-10
1 current
Youtu-Parsing-Omni
multimodal5B parametersstructured outputs
Current

Specifications(1 models)

Youtu-Parsing model specifications comparison
ModelReleasedParametersVisionMultimodalStructured Outputs
Youtu-Parsing-Omni2026-105BYesYesYes