TecnologíaIngeniería de Software

Cómo Trillion Labs Reduce el Tiempo de Entrenamiento de LLM 7 Veces con NVIDIA NeMo Curator

Trillion Labs, una startup coreana de IA que construye LLMs soberanos para el idioma coreano, desplegó NVIDIA NeMo Curator para acelerar la curación de datos en más de 2 billones de tokens. El procesamiento acelerado por GPU en 8x H100 redujo el tiempo de procesamiento de 24 horas a 3,4 horas — una mejora de 7 veces — y redujo los costes de computación hasta 10 veces en comparación con los pipelines basados en CPU, logrando además una mejora del 5% en precisión para los modelos de lenguaje coreano.

Resultados

7xAceleración del procesamiento de datos
up to 10xReducción de costes de computación frente a CPU
5%Mejora de precisión para el coreano

Herramientas y tecnologías

1NN
NVIDIA NeMo
Open-source framework for training, fine-tuning, and deploying large language models at scale.
2NN
NVIDIA NeMo Curator
GPU-accelerated data curation library for deduplication, filtering, and preprocessing LLM training datasets.

Categorías de IA

Desafío

El pipeline de curación de datos basado en CPU de Trillion Labs para el entrenamiento de LLMs coreanos tardaba 24 horas por ejecución en conjuntos de datos que superaban los 2 billones de tokens, creando cuellos de botella en la iteración que ralentizaban el desarrollo de modelos y hacían prácticamente imposible la experimentación rápida con datos de alta calidad en coreano.

Solución

Trillion Labs desplegó NVIDIA NeMo Curator en 8x H100 con DASK para el procesamiento paralelo, acelerando por GPU la deduplicación, el filtrado de calidad y la mezcla de datos en 100.000 millones de tokens coreanos curados, reduciendo el tiempo de procesamiento de 24 horas a 3,4 horas y los costes de computación hasta 10 veces.

Historia completa

Trillion Labs es una startup coreana de IA dedicada a construir grandes modelos de lenguaje soberanos para el idioma coreano. Su misión es cerrar la brecha entre los modelos fundacionales dominantes en inglés y las necesidades de las organizaciones del sector público coreano y las empresas, que requieren LLMs que entiendan los matices lingüísticos coreanos, la terminología gubernamental y el contexto cultural. Construir LLMs de alta calidad para el coreano a gran escala exige pipelines de curación capaces de procesar conjuntos de datos que superan los 2 billones de tokens, volúmenes que exponen cualquier ineficiencia en los flujos de trabajo tradicionales basados en CPU.

Accede a 455+ casos de uso de IA, 427+ herramientas y rankings de señales de adopción.

Fuente

Casos similares

1S
How Bolt Generates On-Brand Prototypes in 5 Minutes with Claude Agent SDK
StackBlitz
~53 minutesDesign system generation time (one-time autonomous run)
2V
How Vivint Uses Agentforce to Autonomously Resolve 20% of Customer Issues
Vivint
20%Autonomous resolution rate with Agentforce
3B
How BambooHR Uses Cohere to Answer Thousands of HR Questions Automatically
BambooHR
tens of thousandsEmployee questions answered
4Q
How Qualcomm Uses Writer to Save 2,400 Hours Monthly Across Marketing and Legal
Qualcomm
2,400Hours saved per month across all users
5Z
How Zapier’s Teams Condensed Days of Work into Minutes with Claude Cowork
Zapier
~15 minutesTime to produce shareable homepage concept draft
6P
How Postman Saves Developers 1,150 Hours/Year with Claude-Powered Agent Mode
Postman
Up to 1,150/yearDeveloper Hours Saved
7C
How Confluent Saves 15,000+ Hours a Month with Glean
Confluent
15,000+Hours saved monthly
8N
How Notion Powers Precise AI Search for Millions with Cohere Rerank
Notion
MillionsNotion AI users reached
Ver todos los casos →