ML

Llama-3.2-11B-Vision-Instruct

Multimodalpor Meta Llama·Página del modelo

Modelo de visión Llama 3.2 de 10.7B parámetros de Meta ajustado para instrucciones, con comprensión y generación multilingüe de imagen y texto.

Salida máxima

Máximo de tokens que el modelo puede devolver en una sola respuesta.

16Ktokens
Share:
Autor
ML
Meta Llama
Organización · ✓
meta-llama
Detalles
Descargas101.7K
Me gusta1.6K
AccesoCódigo Abierto
Contexto131K tokens
Precio entrada$0.345 /1M
Precio salida$0.345 /1M
Tareaimage-text-to-text
Parámetros10.7B
Licenciallama3.2
Libreríatransformers
Conocimiento hasta31 dic 2023
Creado18 sept 2024
Actualizado4 dic 2024
Ver en Hugging Face
Idiomas
endefritpthiesth
Entiende todo el contexto.

Regístrate para leer casos de estudio completos, acceder a métricas detalladas y recibir todos los reportes.