Marcos Ramírez BETA

#llm

Chip de procesador iluminado sobre una placa, con flujos de datos representando la fase de inferencia de un modelo de Inteligencia Artificial

Qué es la inferencia en Inteligencia Artificial y por qué importa

Cada vez que le escribes a ChatGPT o a Claude y te responde, estás viendo inferencia: el modelo, ya entrenado, aplicándose sobre tu pregunta para generar una respuesta. Entrenar un modelo y usarlo son dos fases completamente distintas, con costes, hardware y problemas distintos, y entender la diferencia te explica un montón de cosas que vives a diario: por qué a veces el modelo va lento, por qué la velocidad se mide en tokens por segundo, por qué unos chips valen para entrenar y otros para responder, y por qué cada vez tiene más sentido ejecutar Inteligencia Artificial en tu propio equipo. Te lo cuento sin tecnicismos, con la diferencia entre entrenamiento e inferencia bien clara.

08:30 8 min Marcos Ramírez Lucía
Terminal de línea de comandos con OpenClaude conectado a múltiples modelos de Inteligencia Artificial

🔧 OpenClaude: usa Claude Code gratis con cualquier modelo

OpenClaude es el fork open source de Claude Code que nació tras la filtración accidental del código fuente en npm el 31 de marzo de 2026. Funciona con más de 200 modelos: GPT-4o, DeepSeek, Gemini o Llama a través de cualquier API compatible con OpenAI, y se instala con un solo comando. Te explico qué es exactamente, cómo instalarlo y si merece la pena cambiarlo por el original de Anthropic.

08:30 9 min Marcos Ramírez Lucía
Modelo Gemini 3.5 Flash de Google sobre interfaz de agentes de voz

Gemini 3.5 Flash en el I/O 2026: ¿merece la pena el cambio?

Google acaba de anunciar Gemini 3.5 Flash en el Google I/O 2026. Lo he estado mirando con lupa porque llevo meses usando Gemini 3.0 Flash como modelo base en mis agentes de voz: es barato, rapidísimo y sigue instrucciones como nadie. La pregunta es si 3.5 mejora lo suficiente como para justificar el cambio, o si es uno de esos saltos de versión que solo cambia el número.

03:05 8 min Marcos Ramírez Lucía
Interfaz de ChatLLM mostrando múltiples modelos de Inteligencia Artificial conectados, representando el asistente unificado de Abacus.AI

ChatLLM de Abacus.AI: Inteligencia Artificial todo en uno

ChatLLM de Abacus.AI es un asistente profesional que te da acceso a más de 100 modelos de Inteligencia Artificial en una sola plataforma. Desde GPT-5.4 hasta Claude Opus 4.6, Gemini 3.1 Pro y Llama 4, todo en un mismo sitio por 10 $ al mes. Incluye generación de imágenes con Nano Banana Pro, vídeo con Sora 2, y DeepAgent para automatizar tareas complejas. Ideal para profesionales y equipos que necesitan acceso a la mejor Inteligencia Artificial sin pagar múltiples suscripciones por separado.

Logo de OpenRouter con múltiples modelos de Inteligencia Artificial conectados

OpenRouter: 500 modelos de Inteligencia Artificial en una API

OpenRouter es un gateway unificado con más de 500 modelos de Inteligencia Artificial de docenas de proveedores mediante una sola API key y endpoint. Incluye casi 30 modelos gratuitos ideales para desarrollo, sin tarjeta de crédito. Su sistema de fallback automático cambia de modelo si uno falla, y su compatibilidad con OpenAI permite integrarlo fácilmente en herramientas como OpenCode y OpenClaw.