B
UI-TARS 7B
Modelo multimodal de 7B parámetros de ByteDance para comprensión de interfaces gráficas e interacción automática con UI.
Tarjeta del Modelo
UI-TARS-1.5 is a multimodal vision-language agent optimized for GUI-based environments, including desktop interfaces, web browsers, mobile systems, and games. Built by ByteDance, it builds upon the UI-TARS framework with reinforcement...
Entiende todo el contexto.
Regístrate para leer casos de estudio completos, acceder a métricas detalladas y recibir todos los reportes.
Entiende todo el contexto.
Regístrate para leer casos de estudio completos, acceder a métricas detalladas y recibir todos los reportes.