Q

Qwen3 VL 235B A22B Instruct

Multimodalpor Qwen·Página del modelo

Modelo de visión y lenguaje MoE de 235B parámetros de Qwen para comprensión multimodal de texto e imagen.

Salida máxima

Máximo de tokens que el modelo puede devolver en una sola respuesta.

33Ktokens
Share:

Precios

por 1M tokens
Entrada$0.21 /1M
Salida$1.9 /1M
Lectura de caché$0.1 /1M

Descripción del Modelo

Qwen3-VL-235B-A22B Instruct is an open-weight multimodal model that unifies strong text generation with visual understanding across images and video. The Instruct model targets general vision-language use (VQA, document parsing, chart/table...

Autor
Q
Qwen
Organización
Qwen
Detalles
Descargas
Me gusta
AccesoCódigo Abierto
Contexto131K tokens
Precio entrada$0.21 /1M
Precio salida$1.9 /1M
Conocimiento hasta31 mar 2025
Creado23 sept 2025
Actualizado
Ver en Hugging Face
Entiende todo el contexto.

Regístrate para leer casos de estudio completos, acceder a métricas detalladas y recibir todos los reportes.