AirLLM: Inferencia de LLM de 70 Billones de Parámetros en GPU de 4GB - Español
The Machine Learning Engineer via YouTube
Get 20% off all career paths from fullstack to AI
Google, IBM & Microsoft Certificates — All in One Plan
Overview
Google, IBM & Meta Certificates — All 10,000+ Courses at 40% Off
One annual plan covers every course and certificate on Coursera. 40% off for a limited time.
Get Full Access
Aprende a realizar inferencia utilizando un modelo de lenguaje grande (LLM) de 70 billones de parámetros en una GPU doméstica con solo 4GB de memoria. Este tutorial en español de 23 minutos, presentado por The Machine Learning Engineer, explora técnicas avanzadas de cuantización y optimización para ejecutar modelos de inteligencia artificial de gran escala en hardware de consumo. Accede al notebook proporcionado en GitHub para seguir paso a paso el proceso y descubre cómo aprovechar al máximo los recursos limitados de GPU para tareas de procesamiento de lenguaje natural y aprendizaje automático.
Syllabus
AirLLM Como hacer Inferencia en una GPU de 4G LLM 70billones Español #datascience #machinelearning
Taught by
The Machine Learning Engineer