Doubao Embedding Vision Models by ByteDance

ByteDanceProprietary
ByteDance releases · 19 in the last 12 months · this family litChangelog →
1 model2025

Last refreshed 2026-07-10. Next refresh: weekly.

Details

ResearcherByteDance
LicenseProprietary
Commercial useCommercial use: conditional
Models1
Released2025

Capabilities

VisionAll models
MultimodalAll models

Links

Website

About

ByteDance's multimodal embedding family for representing text and images in a shared vector space for retrieval, semantic search and RAG applications.

Decision facts

Best fit
embeddingvision and multimodal work
Capability starting point
Doubao Embedding Vision with multimodal inputs
Lowest tracked input
Not tracked
Closest related family
BAGEL

Current Variants

Use-when guidance is based on each model's tracked capabilities, context window, release date, and replacement status.

1 in view

Use when the workload needs embedding and multimodal inputs.

2025-12embeddingmultimodal inputs

Release Timeline

1 release group
2025-12
1 current
Doubao Embedding Vision
embeddingmultimodal inputs
Current

Specifications(1 models)

Doubao Embedding Vision model specifications comparison
ModelReleasedVisionMultimodal
Doubao Embedding Vision2025-12YesYes

Available From(1 provider)