🧑‍🎓 GPT Week de Yandex: cómo entrenan y ajustan GPT #MLSTART

Si quieres entender qué sucede realmente bajo el capó de los grandes modelos de lenguaje, desde el pretrain hasta el fine-tuning, Yandex tuvo un intensivo genial: GPT Week.

Yo mismo vi aproximadamente la mitad. Sinceramente, en algunos momentos es bastante complejo. Pero hay mucho contenido realmente útil, especialmente si ya tienes una base en ML y redes neuronales.

💡¿Qué analizan allí?
- Cómo se entrenan los grandes modelos de lenguaje
- Etapas de pretrain y fine-tuning
- Con qué limitaciones y compromisos se enfrentan en la práctica

📺 Las grabaciones de todas las sesiones se pueden encontrar en la lista de reproducción.

Y si no solo quieres mirar, sino también practicar, hay cuadernos para los seminarios:
- Seminario 1
- Seminario 2
- Seminario 4

También hay un resumen del intensivo - breve y al grano.

⚡️ GPT Week es el siguiente nivel después de la "inmersión". Cuando quieres entender no solo cómo usar los modelos, sino qué sucede realmente en su interior, desde el entrenamiento hasta el ajuste.

Si algunas conferencias te parecen difíciles, es normal. Incluso una visualización selectiva da una buena idea de cuán complejos son los LLM desde el punto de vista ingenieril.

Con esto, la serie sobre el inicio en ML y LLM concluye lógicamente. Espero que te ayude a construir tu camino más rápido y evitar confusiones innecesarias 🙂

Volver al índice

👩‍💻 Data Flow