Qué es la inferencia en Inteligencia Artificial y por qué importa
Cada vez que le escribes a ChatGPT o a Claude y te responde, estás viendo inferencia: el modelo, ya entrenado, aplicándose sobre tu pregunta para generar una respuesta. Entrenar un modelo y usarlo son dos fases completamente distintas, con costes, hardware y problemas distintos, y entender la diferencia te explica un montón de cosas que vives a diario: por qué a veces el modelo va lento, por qué la velocidad se mide en tokens por segundo, por qué unos chips valen para entrenar y otros para responder, y por qué cada vez tiene más sentido ejecutar Inteligencia Artificial en tu propio equipo. Te lo cuento sin tecnicismos, con la diferencia entre entrenamiento e inferencia bien clara.