Ejecutar LLM locales en tu propio hardware ya no es solo para los elegidos con clústeres de H100. ¿O sí? 😁

🗓 1 de mayo a las 18:00 hora de Moscú se realizará una transmisión en vivo en «Punto de Ensamblaje». Analizaremos la instalación y uso de modelos locales.

De qué hablaremos:
▪️ Cómo elegir el modelo adecuado para tu hardware, para que no consuma toda la memoria del sistema y funcione con un TPS (tokens por segundo) adecuado.
▪️ Levantar el modelo en modo chat para tareas cotidianas.
▪️ Conectar el LLM local a un IDE agente (como ejemplo usaremos Kilo Code).
▪️ Enrutamiento de solicitudes al modelo local a través de LangChain.
▪️ ¿Realmente vale la pena?

La transmisión y la grabación estarán disponibles para los participantes de «Punto de Ensamblaje». El acceso se gestiona a través del bot: https://t.me/TScompiler_bot