Harness engineering: por qué el entorno importa más que el modelo
Por qué a veces brilla y a veces falla en lo tonto
Si has usado ChatGPT, Claude o Copilot, te habrá pasado: un día te resuelven algo que parece imposible, y al siguiente se atascan en una tontería. Misma herramienta, mismo modelo, resultados de otro planeta. ¿Por qué?
La respuesta tiene que ver con un concepto que casi nadie nombra fuera del mundillo, y que explica buena parte de los avances recientes: el arnés (harness). Porque resulta que muchas de las grandes mejoras de los últimos tiempos no han venido de modelos más listos, sino de mejores entornos en los que esos modelos trabajan. Y a construir bien esos entornos se le ha empezado a llamar harness engineering. Vamos a verlo.
Qué es un arnés (harness)
Imagina el modelo de Inteligencia Artificial como un motor potentísimo. Un motor solo, suelto, no te lleva a ningún sitio: necesita un coche alrededor (ruedas, dirección, frenos, salpicadero) para que esa potencia sirva de algo. El arnés es ese coche: todo lo que rodea al modelo para que pueda hacer trabajo de verdad.
En concreto, un arnés le da al modelo:
- Herramientas para actuar: leer y escribir archivos, ejecutar comandos, buscar en internet, llamar a otras aplicaciones.
- Contexto adecuado: qué información ve y cuándo, para que no se pierda ni alucine.
- Un bucle de trabajo: que pueda probar algo, ver el resultado, corregir y volver a intentarlo, en lugar de soltar una respuesta a ciegas.
- Límites y comprobaciones: que valide lo que hace antes de seguir.
Claude Code, sin ir más lejos, es un arnés: coge un modelo y le da terminal, acceso a tus archivos, capacidad de ejecutar tests y un bucle para iterar. El modelo es el mismo; lo que cambia es el coche que le has puesto alrededor.
Por qué el entorno importa más que el modelo
Aquí está la idea fuerte, la que le da nombre a todo esto. Coge el mejor modelo del mundo y úsalo como un chatbot pelado, copiando y pegando: rendirá regular. Coge un modelo más modesto y mételo en un buen arnés, con herramientas y un bucle bien diseñado: te sorprenderá.
Por eso se dice que el arnés importa tanto o más que el modelo. La inteligencia bruta ya está; lo que marca la diferencia es cómo la encauzas. Es la diferencia entre tener un genio encerrado en una habitación sin ventanas y darle un despacho, herramientas y la capacidad de comprobar su propio trabajo.
Y esto cambia del todo la forma de mirar la Inteligencia Artificial. Deja de ser “una caja a la que le pido cosas” y pasa a ser “una pieza que monto dentro de un sistema que diseño yo”. Ahí está el salto mental.
Del chatbot al sistema: el caballo desbocado
Hay un motivo de fondo por el que esto se ha vuelto tan importante justo ahora. Durante años, lo difícil era escribir código, y se leía mucho más de lo que se escribía. Esa tendencia se ha dado la vuelta.
Hoy, generar código es fácil y rapidísimo. Le pides a la máquina y te escupe miles de líneas en segundos. El problema ya no es producirlo, es controlarlo: leerlo, validarlo, asegurarte de que hace lo que debe y no mete un desastre. Tenemos una máquina capaz de generar código a chorro, y nuestra responsabilidad es domar ese caballo desbocado.
El harness engineering es justo eso: construir el entorno que mantiene a raya a esa máquina. Tests que se ejecutan solos, comprobaciones que frenan al modelo si se desvía, contexto que le impide perderse, pasos que validan antes de avanzar. No se trata de pedirle cosas más bonitas, se trata de montar la estructura que convierte un generador caótico en un sistema fiable.
Qué significa esto para ti
Si trabajas con Inteligencia Artificial, aunque sea para programar, la lección es práctica: deja de optimizar solo el prompt y empieza a pensar en el entorno. Qué herramientas le das al modelo, qué contexto ve, cómo compruebas lo que produce, qué bucle de mejora le montas. Ahí es donde están hoy las grandes diferencias de resultado, mucho más que en elegir el modelo de moda.
Para una empresa, esto es directamente donde está el valor: no en “usar Inteligencia Artificial”, sino en construir el arnés a medida que la convierte en algo fiable para su caso concreto. Es justo el tipo de sistema que monto para quien lo necesita, porque un buen arnés es la diferencia entre un juguete y una herramienta de trabajo.
Lo que me llevo de todo esto
Llevamos meses obsesionados con qué modelo es mejor, y resulta que la pregunta más interesante es otra: ¿qué le has puesto alrededor?. El harness engineering pone nombre a algo que los que trabajamos con esto veníamos notando: que el entorno, las herramientas y el bucle de control mandan tanto como el cerebro que hay en el centro.
Así que la próxima vez que una Inteligencia Artificial te falle en lo tonto, no pienses solo “qué modelo más malo”. Pregúntate qué coche le has puesto a ese motor. Muchas veces, el problema no es el genio: es la habitación sin ventanas.
Preguntas frecuentes
¿Qué es un arnés (harness) en Inteligencia Artificial?
Es todo el entorno que rodea a un modelo para que pueda hacer trabajo real: las herramientas que le dan capacidad de actuar (leer archivos, ejecutar comandos, buscar información), el contexto que ve, el bucle que le permite probar y corregir, y las comprobaciones que validan su trabajo. El modelo es el motor; el arnés es el coche que convierte esa potencia en algo útil.
¿Qué es el harness engineering?
Es la disciplina de diseñar y construir bien esos entornos (arneses) alrededor de los modelos de Inteligencia Artificial. En lugar de centrarse solo en el modelo o en el prompt, se centra en las herramientas, el contexto, el bucle de trabajo y las validaciones que hacen que el modelo sea fiable y útil para una tarea concreta.
¿Por qué importa más el entorno que el modelo?
Porque un modelo muy potente usado como chatbot pelado rinde regular, mientras que un modelo más modesto dentro de un buen arnés puede dar resultados excelentes. La inteligencia bruta ya está disponible; lo que marca la diferencia es cómo la encauzas con herramientas, contexto y bucles de control. Por eso el entorno importa tanto o más que el propio modelo.
¿Claude Code es un arnés?
Sí, es un buen ejemplo. Claude Code coge un modelo y le da terminal, acceso a tus archivos, capacidad de ejecutar tests y un bucle para iterar sobre el resultado. El modelo por sí solo no haría todo eso; es el arnés que lo rodea el que lo convierte en una herramienta capaz de trabajar sobre tu código de verdad.
Fuentes
Compártelo si te ha resultado útil, sobre todo con quien siga tratando la Inteligencia Artificial como un chatbot.
¿Habías oído lo de los arneses? ¿Montas sistemas o aún copias y pegas del chat? Cuéntame.
Y… el motor ya lo tenemos todos. La gracia está en el coche que le pongas.
Artículos relacionados
Las 6 estrategias del creador de Claude Code para tus proyectos
Llevamos meses optimizando prompts, creando reglas y ajustando cada parámetro de Claude Code, y resulta que Boris Cherney, el hombre que creó la herramienta, lo hace de una forma muy distinta a la mayoría. En una entrevista reveló las seis estrategias que usa él, y al leerlas te das cuenta de que casi todos lo estábamos haciendo regular. Van desde empezar siempre en modo plan y mantener un CLAUDE.md minimalista, hasta darle a Claude una forma de verificar su propio trabajo, trabajar con varias sesiones en paralelo, encapsular tus tareas repetidas y, la más filosófica de todas, no apostar nunca contra el modelo. Aquí te las cuento una a una, con ejemplos prácticos de cómo aplicarlas hoy mismo para sacarle de verdad el jugo a Claude Code.
Por qué un ingeniero veterano vive creando skills para agentes
Lo dice un ingeniero con casi una década de experiencia, y suscribo cada palabra: nunca, en todo ese tiempo, el proceso ha sido tan importante como ahora. Tienes a tu disposición una flota de programadores de nivel medio-bueno que puedes desplegar cuando quieras, pero con una pega rarísima: no tienen memoria, no recuerdan lo que hicieron antes, así que necesitas procesos extremadamente claros y bien definidos para que hagan algo útil. Y ahí es donde entran las skills: documentar cómo se hace cada cosa para guiar a esos agentes y mantenerlos en el carril. Aquí te cuento por qué, en la era de los agentes, el proceso manda más que nunca, y por qué crear skills para tus tareas del día a día se ha vuelto la habilidad clave del desarrollador.
Routines de Claude Code: automatiza sin el ordenador encendido
Anthropic acaba de soltar una función en Claude Code que cambia las reglas de la automatización: las Routines. Hasta ahora, para que un agente hiciera tareas solo y en bucle (revisar correos, montar un resumen diario, vigilar algo) necesitabas una herramienta como n8n y, muchas veces, un ordenador o un servidor encendido. Con las Routines puedes lanzar automatizaciones agénticas programadas o por eventos que corren en la infraestructura de Anthropic, sin tu equipo encendido, con la misma suscripción de Claude que ya pagas. Aquí te cuento qué son, qué puedes hacer con ellas, en qué se diferencian de n8n y por qué esto acerca a Claude Code a competir de tú a tú con las plataformas de automatización de toda la vida.