Las cuatro capas: prompt, contexto, arnés y bucle
12 conceptos · unos 50 minutos · sin instalar nada · el curso breve al que volverás una y otra vez
Un agente funciona durante cuarenta minutos. Gasta cincuenta dólares. No produce nada que puedas usar. Después lees el registro y ves lo ocurrido: probó las mismas tres cosas una y otra vez, cambiando solo unas pocas palabras en cada intento.
¿Qué cambias?
Casi todo el mundo cambia el prompt. Es lo primero que mira y lo único que puede editar en diez segundos. Así que lo reescribe, inicia la ejecución de nuevo y observa cómo gasta otros cuarenta minutos haciendo lo mismo.
El prompt estaba bien. Nada en ese sistema iba a detectar que la ejecución había dejado de avanzar, por lo que nada la detuvo. La solución constaba de unas once palabras, estaba en otro archivo y pertenecía a una capa que la mayoría no sabe nombrar.
Este curso te da los nombres. Son cuatro: prompt, contexto, arnés y bucle. No son cuatro habilidades entre las que eliges ni cuatro peldaños que subes. Son cuatro contenedores, cada uno dentro del siguiente, y cada uno se encarga de una parte distinta del trabajo. Cuando puedes verlos, «mi agente está averiado» se convierte en una pregunta con dirección: ¿qué capa falló?
Este es el curso más breve de la sección a propósito. Es un mapa, y un mapa que no puedes recordar no cumple su función.
Debes haber manejado un agente general al menos una vez, por cualquiera de las dos puertas: Claude Code y OpenCode si trabajas con código, o Cowork y OpenWork si no lo haces. El desarrollo guiado por especificaciones ayuda, pero no es obligatorio. Aquí no necesitas un repositorio, una base de datos ni instalar nada. Basta con una pestaña de chat y un agente que ya hayas utilizado.
📚 Recurso didáctico
Ver la presentación completa: Las cuatro capas: prompt, contexto, arnés y bucle
Por qué estas palabras resultan confusas ahora
Si estas palabras te parecen escurridizas cuando lees sobre ellas en línea, el problema no eres tú. Este es un campo joven y recibió su vocabulario en el orden equivocado.
No hace mucho, solo había una capa que cualquiera pudiera tocar. Escribías un mensaje y leías la respuesta. La «ingeniería de prompts» nombraba toda la habilidad porque el prompt era toda la superficie.
Después las herramientas crecieron hacia fuera, y lo hicieron rápido. Un agente de programación te dio un archivo de permisos, un archivo de reglas y hooks. Esa es una capa alrededor del modelo y puedes configurarla. Luego llegaron las programaciones y las rutinas. Esa es otra capa alrededor de la primera y también puedes configurarla. Aparecieron dos superficies nuevas en poco tiempo.
El vocabulario no siguió el ritmo. Cada superficie recibió el nombre de quien escribió primero sobre ella y los nombres chocaron. «Ingeniería de contexto» a veces significa la ventana y otras veces todo lo que hiciste antes de ejecutar el modelo. «Grafo» se usa para tres cosas distintas, que el Concepto 11 separa. La palabra arnés es la que más problemas causa. La mayoría de los textos en línea la usa para el arnés y el bucle juntos, como si fueran una sola capa. Algunos la usan para una tercera cosa: la plataforma que proporciona tus herramientas, tus credenciales y tu límite de seguridad.
Esto sería una discusión inofensiva sobre palabras de no ser por algo. Una regla de permisos ausente y una programación ausente son errores distintos. Viven en superficies distintas y los corrigen personas distintas. Una sola palabra para ambos te envía a buscar en el lugar equivocado, que es justo lo que ocurrió en la historia anterior.
Por eso este curso hace dos cosas. Te da las cuatro capas como contenedores y te da una prueba que seguirá funcionando cuando las palabras vuelvan a cambiar, porque lo harán.
Palabras clave en lenguaje sencillo
Lee esto una vez ahora. Vuelve cuando un término pierda claridad. Cada uno recibirá una explicación completa más adelante.
| Término | Significado en lenguaje sencillo |
|---|---|
| Prompt | El mensaje que envías: la petición, los ejemplos, el formato y el rol. |
| Ventana de contexto | Todo lo que el modelo puede ver mientras escribe una respuesta. Lo que no está en ella no está disponible como dato. |
| Curador | Lo que decide qué entra en la ventana, en qué orden y qué queda fuera. |
| Latido | Un turno completo del agente: tu instrucción y cada llamada a herramienta que realiza hasta quedar en silencio. |
| Arnés | El código alrededor del modelo que ejecuta un latido. |
| Bucle | El sistema alrededor del arnés que inicia los latidos, los evalúa y recuerda entre ellos. |
| Marcapasos | Lo que inicia un latido: una programación, un evento o una condición. |
| Columna vertebral | El estado guardado fuera del modelo para que el siguiente latido sepa qué hizo el anterior. |
| Condición de parada | Una regla comprobable que indica que el trabajo terminó. Algo distinto del creador la elige y la hace cumplir. |
| Creador-verificador | Un agente hace el trabajo. Otro agente o comando lo comprueba. |
| Puerta humana | Un punto en el que una persona decide antes de que continúe la ejecución. |
| Subagente | Un ayudante con su propia ventana que realiza un trabajo y devuelve un resumen. |
| Grafo | Varias de estas pilas conectadas en una topología: qué se ejecuta después, qué estado viaja por cada arista y quién verifica a quién. |
Volverás a encontrar varias de estas palabras en Ingeniería de bucles e Ingeniería de arneses, y es deliberado. Este curso es el mapa. Aquellos cursos son el territorio: construyen lo que este solo nombra.
La imagen: cuatro contenedores, cada uno dentro del siguiente

Contenedores, no pasos. Cada latido sigue construyendo un prompt. El verificador y la puerta humana están en el bucle, no dentro del latido, porque aquello que hizo el trabajo no puede decidir qué significa haber terminado.
Esta es la frase que realmente expresa la imagen. Volverá tres veces más antes de que termines:
Un buen prompt falla dentro de un mal contexto. Un buen contexto falla dentro de un arnés vacío. Un buen arnés permanece inactivo sin un bucle.
Eso significa en la práctica «cada uno dentro del siguiente». Nada en una capa interior puede rescatarte si falta una exterior, y nada en una capa exterior puede rescatar una interior averiada.
Noventa segundos que demuestran la afirmación más importante
La única frase que este curso pretende enseñar resulta más fácil de creer cuando la ves ocurrir. Abre el agente que ya utilizas. Asígnale una pequeña tarea real con un resultado que puedas comprobar: un script que deba funcionar, un total de hoja de cálculo que deba cuadrar o un enlace que deba abrirse.
Pídele el trabajo y lee la respuesta.
Corrige esto para que funcione y avísame cuando termines.
Ahora, antes de confiar en la respuesta, comprueba el resultado. Ejecuta el script. Suma la columna. Abre el enlace.
Con suficiente frecuencia como para molestarte, en cualquier tarea que implique trabajo real, encontrarás un «listo, todo corregido» seguro de sí mismo unido a trabajo que nunca se verificó. No es porque el modelo haya mentido ni porque tu prompt fuera débil. Es porque nada en esa configuración estaba obligado a comprobar y nada salvo el propio modelo decidió qué significaba «terminado». Recuerda esa sensación. El Concepto 6 la explica y el resto del curso depende de ella.
Quince minutos: la imagen anterior, el Concepto 2 (las cuatro unidades de trabajo) y la tabla del Concepto 9. Guarda esa tabla en un lugar visible durante tu próxima mala sesión de depuración.
Cincuenta minutos: de principio a fin, realizando los dos breves ejercicios de observación y el ejercicio de diagnóstico final.
Más adelante: vuelve por el ejercicio, no por la prosa. Estas recetas están hechas para consultarse, no para memorizarse. Solo hay una frase en este curso que debes recordar y está al final.
Parte 1: La forma
Concepto 1: Contenedores, no pasos
La forma más común de dibujar estas cuatro palabras es una escalera. El prompt está abajo para principiantes y el bucle arriba para expertos. La imagen promete en silencio que, cuando seas lo bastante competente, dejarás atrás los peldaños inferiores.
Esa imagen es errónea, y lo es de una forma que cuesta dinero.
Cada latido sigue construyendo un prompt. Un bucle que lleva seis meses funcionando sin supervisión, según una programación, con un verificador y una columna vertebral, sigue enviando mensajes a un modelo muchas veces al día. Si el mensaje es impreciso, el bucle produce trabajo impreciso más rápido y con temporizador. Nunca dejas atrás las capas interiores. Las envuelves.
La relación, por tanto, es de contención. El prompt está dentro de la ventana. La ventana se construye para un latido. La ejecución inicia el latido, lo evalúa y lo recuerda.
Una imagen así facilita tres creencias equivocadas. Conviene eliminarlas ahora:
- Exterior no significa posterior. No construyes estas capas en orden. La mayoría de las veces alquilas tres y posees una, como explica el Concepto 10.
- Exterior no significa más importante. Un prompt descuidado dentro de un bucle magníficamente diseñado produce mal trabajo según una programación y con recibo. Las capas no están clasificadas. Están anidadas.
- No son cuatro tamaños del mismo cuadro. Una imagen anidada puede sugerir cuatro versiones de un objeto. Son cuatro objetos realmente distintos, y el siguiente concepto permite distinguirlos.
Concepto 2: La prueba de la unidad de trabajo
Cada capa se define por la parte del trabajo de la que es responsable. Entiende bien estas cuatro y podrás reconocerlas en cualquier lugar, sin importar el nombre que alguien haya decidido darles.
| Capa | Unidad de trabajo | En palabras sencillas |
|---|---|---|
| Prompt | Una llamada al modelo | Lo que escribiste antes de pulsar Enter. Si cambias las palabras, es otro prompt. |
| Contexto | La ventana | Todo lo que el modelo puede ver mientras responde esa vez: tu mensaje, los archivos, los turnos anteriores, el archivo de reglas y los resultados de las herramientas. |
| Arnés | Un latido | El agente rara vez responde una vez y se detiene. Llama a una herramienta, lee el resultado, vuelve a pensar y llama a otra. Todo eso, desde tu instrucción hasta que queda en silencio, es un latido. El arnés es el código que lo ejecuta. |
| Bucle | Toda la ejecución | Lo que ocurre cuando nadie escribe. Algo inicia un latido. Algo decide si su trabajo fue bueno. Algo recuerda entre latidos. |
Ahora la prueba. Esta es la parte que conviene conservar cuando el vocabulario vuelva a cambiar:
Cuando una publicación, una empresa o una oferta de empleo diga «arnés», «ingeniería de contexto» o «bucle de agente», no discutas la palabra. Pregunta: ¿de qué unidad de trabajo hablan? ¿Una llamada al modelo, la ventana, un latido o toda la ejecución?
Si su «arnés» incluye la programación, han dibujado dos capas de este libro como una. Si su «arnés» es la plataforma que proporciona herramientas y credenciales, se refieren a algo todavía más amplio. Ninguna interpretación es incorrecta. Son mapas distintos. Ahora puedes traducirlos en vez de confundirte.
Parte 2: Las cuatro capas, una por una
Concepto 3: Prompt, la unidad es una llamada al modelo
El prompt es el mensaje que redactas: quién debe ser el modelo, qué quieres, qué aspecto tiene un buen trabajo, ejemplos y la forma que debe adoptar la respuesta. Todo ello es una sola entrada y produce una sola respuesta.
El oficio aquí es más estrecho de lo que cree la mayoría. Buscas el ingrediente más débil y corriges solo ese. Si la forma del resultado es incorrecta, añade un ejemplo con la forma adecuada. Si el tono es incorrecto, especifica el público. Reescribir los cinco ingredientes de una vez no te dice cuál causó el problema. Prompts para IA en 2026 trata esta capa a fondo.
Esta es la capa en la que las personas invierten demasiado, y hay dos motivos legítimos. Es la única que puedes practicar sin escribir código y la única que puedes editar en diez segundos. Ambas son ventajas. Ambas se convierten en una trampa en cuanto algo falla en producción, porque bajo presión se recurre a lo fácil de cambiar en vez de a lo que falló.
Cómo se ve cuando el prompt es realmente la capa averiada: el modelo entendió claramente la tarea e hizo más o menos el trabajo adecuado, pero la respuesta llega con la forma, la extensión o la voz equivocadas, o sin una sección que diste por obvia. No hay errores de datos. Simplemente no es lo que pediste y, al releer tus palabras, entiendes por qué.
Concepto 4: Contexto, la unidad es la ventana
La ventana es todo lo que el modelo puede ver mientras escribe una respuesta. Tómalo literalmente en una dirección: un archivo que no adjuntaste no está disponible para el modelo como dato. Una conversación de ayer no está disponible salvo que algo la vuelva a introducir.
Pero no lo tomes literalmente en la otra dirección. El modelo no está vacío cuando la ventana contiene poco. Conserva todo lo aprendido durante el entrenamiento, y eso llena el hueco. Este es el mecanismo que provoca el patrón de fallo al final del concepto. Un modelo al que le falta tu documento no se queda en blanco. Recurre a lo más probable que ya conoce y lo dice en su lugar, con la misma confianza que habría usado para la verdad.
Esto crea el problema que define la capa. Siempre hay más material del que cabe, así que algo tiene que elegir qué entra y en qué orden. Ese algo es el curador. Existe aunque nunca escribas uno. La ventana le asigna tres trabajos.
El orden va primero. La posición cambia la fuerza con la que llega el material. En un estudio conocido, la precisión fue mayor cuando el pasaje importante estaba al principio o al final de una entrada larga y cayó cuando estaba en medio. El resultado está tan documentado que tiene nombre propio: «perdido en el medio».1 Ese estudio midió modelos disponibles en 2023, por lo que debes probar la intensidad del efecto en el modelo que uses hoy, no darla por sentada. La lección no ha cambiado: enterrar tu única restricción importante en el noveno párrafo de un adjunto es una decisión real, aunque no pensaras que estabas decidiendo.
La compresión viene después y no es gratuita. Resumir cuarenta páginas en cuatro permite que quepan. Pero un resumen que eliminó la excepción no puede recuperarla después. Esa información ya no está en la ejecución. Este es el costo oculto de la capa: cada compresión es una apuesta sobre lo que no importará.
El descarte viene al final y es una política. Algo debe decidir qué sale cuando la ventana se llena. Si no estableces esa política, tu arnés lo hará por ti, en el peor momento posible y con una regla que nunca leíste.
Esta prueba se puede ejecutar en cualquier configuración en un minuto:
Señala cualquier documento de la ventana y di qué regla lo puso allí. Si la respuesta sincera es «lo devolvió el recuperador», tienes un buscador, no un curador. Eso es adecuado para algunos trabajos y peligroso para otros. Da a tu IA un contexto consultable es donde se construye la recuperación. Las Partes 2 a 4 de Programación con agentes enseñan a gestionar una ventana a mano.
Cómo se ve cuando el contexto es la capa averiada: la respuesta es fluida, segura y objetivamente incorrecta. A menudo es correcta sobre otra cosa: una versión anterior del archivo, otro cliente o el ejemplo de la documentación en vez de tu caso. Segura, incorrecta y cercana a algo verdadero. Las tres juntas casi forman una firma, un patrón lo bastante fiable para identificar la capa. Ahora ya sabes de dónde sale esa «otra cosa».
Obsérvalo tú mismo (dos minutos). Toma una pregunta sobre un documento que conozcas bien. Hazla dos veces en dos chats nuevos. En el primero, pega todo el documento. En el segundo, pega solo el primer tercio y formula la misma pregunta.
Este es el documento. Basándote solo en lo que te he dado, ¿qué dice sobre [lo que aparece en el último tercio]?
El segundo chat suele responder en vez de decir que no sabe, y a menudo responde con seguridad. El modelo no se está comportando mal. El conocimiento de entrenamiento está llenando el hueco que dejó la ventana. Acabas de cambiar la respuesta sin modificar una sola palabra del prompt.
Concepto 5: Arnés, la unidad es un latido
Das una instrucción. El agente lee tres archivos, ejecuta un comando, lee el error, edita algo, vuelve a ejecutarlo y después queda en silencio. Escribiste una vez. Ocurrieron alrededor de doce cosas. Todo ese tramo es un latido, y el arnés es el código que lo ejecuta.
La lista de funciones es breve y corriente. Reúne el contexto. Llama al modelo. Ejecuta las herramientas que solicite. Devuelve los resultados. Gestiona los errores. Exige aquello que el latido deba demostrar antes de permitirle terminar. Repite hasta que el modelo deje de pedir.
Ya estás usando uno. Claude Code incluye un arnés. OpenCode y Cowork también. Cada solicitud de permiso que has aprobado, cada archivo de reglas leído al inicio y cada comprobación automática ejecutada antes de un commit forman parte del arnés. Ingeniería de arneses te enseña a construir uno a propósito en vez de heredar uno por defecto.
Hay algo que sorprende aquí y es más importante de lo que parece.
Los subagentes se invocan como herramientas y se comportan como algo mucho mayor. En la mayoría de los sistemas inicias un subagente mediante una llamada a herramienta, y justo por eso es fácil pasar por alto la diferencia. Una llamada sale y vuelve con un resultado: el contenido de un archivo, una respuesta de API o un error. Un subagente abre su propia ventana y ejecuta su propio latido. Lo que regresa por esa abertura con forma de herramienta es el resultado de una copia anidada de toda esta pila.
Eso aporta algo real. El subagente puede leer cuarenta documentos y mantenerlos por completo fuera de tu ventana; recibes tres párrafos en vez de cuarenta páginas. También tiene un costo real que resulta fácil pasar por alto. Lo que vuelve es un resumen escrito con total seguridad, incluidas las partes que el subagente entendió mal. No viste los cuarenta documentos. Nada posterior los verá. La seguridad del resumen no dice nada sobre la calidad de la lectura.
Concepto 6: El límite que define el arnés
Este es el punto de inflexión del curso. Todo lo anterior era descripción. Todo lo posterior es consecuencia.
Un latido puede terminar por muchas razones. Se agota un tiempo de espera. Se alcanza un límite de tokens. Se lanza un error. Se deniega un permiso. El modelo decide que terminó. Nada de eso demuestra que el trabajo haya tenido éxito. Solo demuestra que el latido terminó.
Un buen arnés puede imponer comprobaciones reales dentro del latido. Puede ejecutar una suite de pruebas después de una edición, validar un esquema o comparar un resultado con un total conocido. Puede negarse a terminar a menos que el comando tenga éxito. Eso es verificación, no la opinión del modelo, y debes construirla siempre que puedas.
Pero el límite importa:
Un latido puede demostrar que una comprobación concreta pasó. No puede decidir que pasarla fuera suficiente.
Una prueba que pasa demuestra que esa prueba pasó. No demuestra que cubriera el caso importante ni que la prueba elegida defina toda la tarea. Alguien debe decidir qué significa «terminado» antes de iniciar la ejecución.
Piensa en un agente de conciliación bancaria. Propone cuarenta coincidencias e informa que el extracto cuadra, pero nunca compara los dos totales. El contexto se reunió, las herramientas funcionaron y no apareció ningún error. Todas las señales internas parecen sanas. La afirmación sigue siendo falsa.
Un verificador dentro del latido solo lo detectaría si alguien ya hubiera exigido que ambos totales coincidieran. Ese requisito es la parte importante. El creador no puede inventar su propia meta y después certificar que la cruzó.
Escribir «verifica tu trabajo» en el prompt no resuelve el problema. El modelo puede escribir «verificado» con la misma facilidad que «terminado». La definición final del éxito debe venir de fuera del trabajo evaluado. Por eso pertenece a la siguiente capa exterior.
Concepto 7: Bucle, la unidad es toda la ejecución
El bucle aporta lo que un latido no puede proporcionarse.
Un marcapasos inicia cada latido: una programación, un evento o una condición que sigue activándose hasta que algo se vuelve cierto. Sin él, tú eres el marcapasos. Cuando dejas de escribir, el trabajo se detiene.
Una columna vertebral guarda estado fuera del modelo para que el siguiente latido sepa qué hizo el anterior. Puede ser tan sencilla como un archivo que se reescribe después de cada latido:
run: nightly reconciliation, 2026-03-14
done: pulled 412 payments and 388 open invoices
in progress: matching pass 3 of 5, 341 matched so far
needs a person: invoice 4471, two candidates both at 0.52
budget: 3 beats used of 12
Nada en este archivo es ingenioso, y por eso funciona. El siguiente latido lo lee antes de actuar y reanuda desde la pasada 3 en vez de volver a empezar. La cuarta línea registra una decisión que el agente no pudo tomar. El Concepto 8 convierte esa línea en una puerta humana.
Las paradas externas deciden si toda la ejecución debe continuar:
- Una condición de éxito elegida de antemano y demostrada por un comando. El criterio viene de fuera del creador.
- Límites de latidos, gasto y tiempo transcurrido. Al tope no le importa lo prometedor que parezca el siguiente intento.
- Una comprobación de falta de progreso. Detecta intentos repetidos sin cambios significativos.
- Un verificador independiente. El componente que evalúa el trabajo no lo creó.
Ninguna pregunta al creador si ha terminado. Cada una se apoya en un hecho establecido fuera del criterio del propio creador. Esa es la regla creador-verificador en una frase.
Vuelve al fallo inicial: cuarenta minutos, cincuenta dólares y los mismos tres intentos. Faltaba una comprobación de falta de progreso, no un prompt mejor. Reescribir el prompt podía cambiar las palabras de cada intento, pero no hacer que la ejecución detectara que estaba atascada.
Ingeniería de bucles construye el marcapasos, la columna vertebral, las paradas, el verificador y la puerta. Confiar en el verificador pregunta si el propio verificador merece confianza.
Concepto 8: La puerta humana es una salida, no una parada
Hay otra salida de una ejecución y es distinta de las cuatro anteriores.
Las paradas permiten que una ejecución falle de forma segura. La puerta permite que tenga éxito con ayuda.

Esto importa por una idea fácil de decir y difícil de retener: la ambigüedad no es un error.
Un agente que encuentra una decisión auténticamente dudosa no ha fallado. La factura 4471 coincide con dos pagos y ambos obtienen 0,52. No es un bug del comparador. Así son los datos. Sin una puerta, el agente solo tiene dos opciones y ambas son malas. Puede fallar y descartar nueve pasadas de trabajo válido, o puede adivinar.
Adivinar es lo peligroso. Merece la pena aprenderlo bien porque contradice la intuición. Un fallo es ruidoso. Una suposición es silenciosa y parece exactamente una respuesta correcta: el mismo formato, la misma seguridad y el mismo lugar del informe. Nadie después puede distinguirla. Una ejecución fallida se corrige. Una ejecución que adivinó deja en una hoja de cálculo un número discretamente incorrecto.
La puerta se escribe de antemano, no se decide en el momento. Los activadores son los de la izquierda de la imagen: confianza por debajo de un umbral que fijaste, valor por encima de un límite que fijaste o cualquier acción difícil de deshacer. Cuando se activa la puerta, el caso llega a una persona identificada. Ayesha, del equipo de cuentas por pagar, lo abre, ve la factura 4471 con ambos pagos candidatos y elige el correcto en unos veinte segundos porque recuerda que el cliente pagó dos veces en marzo.
Su respuesta no termina la ejecución. Vuelve a entrar como nueva evidencia y la ejecución continúa desde donde se pausó.
Parte 3: Uso del mapa
Concepto 9: ¿Qué capa falló?
Esto te aporta el mapa. Cada capa falla de una forma reconocible, por lo que el síntoma señala la superficie.
| Lo que ves | Dónde mirar primero | Qué cambiar |
|---|---|---|
| La forma o el tono del resultado son incorrectos, pero entendió la tarea | Prompt | El ingrediente más débil: ejemplos, instrucciones o forma del resultado |
| La respuesta es segura, fluida y objetivamente incorrecta | Contexto | El curador: qué entró, en qué orden y qué se descartó |
| Informa de un éxito que nunca demostró o pasa por alto una llamada fallida | Arnés | Las herramientas, la gestión de errores y lo que el latido debe demostrar |
| Respuestas incorrectas llegan a una persona o sistema sin comprobarse | Bucle | El verificador, quién eligió sus criterios y si alguna vez rechazó algo |
| Nunca se detiene, se detiene demasiado pronto o adivina cuando debe preguntar | Bucle | Las paradas y la puerta |
Dos notas sinceras sobre esta tabla.
Es un orden de búsqueda, no un veredicto. Los fallos cruzan límites continuamente. Lee cada fila como «mira aquí primero», no como «aquí recae la culpa». El Concepto 12 cubre los casos realmente confusos.
El hábito que esta tabla pretende romper. La mayoría de los equipos depura la capa equivocada por un motivo totalmente predecible que no es falta de inteligencia. Un agente gasta cincuenta dólares repitiéndose y la respuesta es reescribir el prompt del sistema. El prompt estaba bien. Faltaba una comprobación de falta de progreso. Pero el prompt puede editarse en diez segundos y, bajo presión, se recurre a lo fácil de cambiar en vez de a lo que falló. Nombrar la capa en voz alta antes de tocar nada es toda la disciplina. Cuesta cinco segundos y marca la diferencia entre una corrección y seis.
Concepto 10: ¿Qué capas posees realmente?
No construyes las cuatro capas en cada proyecto. Buena parte del tiempo alquilas tres. Saber cuáles cambia incluso los consejos que se aplican a ti.
| Capa | Mode 1: resolver un problema con un agente general | Mode 2: fabricar un trabajador |
|---|---|---|
| Prompt | En su mayor parte es tuyo. La plataforma posee sus propias instrucciones del sistema y descripciones de herramientas. | Tuyo, escrito una vez y reutilizado. |
| Contexto | En parte es tuyo: qué adjuntas y cuándo borras. La compactación y la recuperación pertenecen al arnés. | Tuyo. Tú escribes el curador. |
| Arnés | Alquilado y configurable en parte mediante herramientas, habilidades, hooks e instrucciones del proyecto. | Tuyo. |
| Bucle | Casi siempre alquilado. La plataforma establece el bucle, aunque puede exponer topes y opciones de aprobación. | Tuyo. Cada parada es algo que escribiste. |
En Mode 1, «añade una comprobación de falta de progreso» no es una instrucción que puedas ejecutar. No existe un archivo para ello. Tu trabajo en las dos capas exteriores es distinto: conocer el comportamiento alquilado. ¿Dónde compacta tu arnés la ventana y qué descarta? ¿Qué reintenta en silencio? ¿Qué ocurre si se queda sin espacio en mitad de una tarea? Son preguntas con respuesta sobre un producto que ya utilizas, y esas respuestas cambian tu forma de trabajar.
En Mode 2, las cuatro capas son tuyas y nadie limitará tus latidos por ti.
Leer una página así en Mode 1 y concluir: «Ya hago todo esto porque mi herramienta lo hace».
Tu herramienta lo hace para su propio trabajo. El trabajador que vas a construir no tiene una herramienta que lo haga para el suyo. Claude Code limita sus propios latidos. No limita el bucle que escribes. Esa brecha es justo donde una demostración se convierte en un incidente de producción.
Descubre qué alquilaste (cuatro minutos). Elige el agente que más utilizas. Antes de buscar nada, escribe tu estimación para estas tres preguntas. Adivinar primero importa, porque la distancia entre tu respuesta y la real es la parte en la que confiabas sin saberlo.
- Cuando se llena la ventana, ¿qué elimina tu arnés y te avisa?
- Cuando falla una llamada a herramienta, ¿la reintenta, cuántas veces y puedes verlo?
- Cuando una ejecución alcanza su límite en mitad de una tarea, ¿qué ocurre con el trabajo ya realizado?
Ahora averígualo. La documentación responde parte. También puedes probar directamente la primera pregunta. Ejecuta una sesión larga, acuerda tres decisiones concretas al principio, continúa hasta que la herramienta compacte la conversación y pide al agente que repita las decisiones. Lo que no pueda repetir es lo que tu arnés decidió que no necesitabas.
Escribe las respuestas donde pueda leerlas el equipo. En Mode 1, ese documento breve es tu trabajo de contexto y de bucle. No es una versión reducida de la tarea. Es otra tarea.
Concepto 11: Dónde encajan los grafos
La ingeniería de grafos se discute mucho, pero un grafo no es una quinta capa.
Las cuatro capas describen una ruta de ejecución: un mensaje, una ventana, un latido y una ejecución. Un grafo describe una topología: qué se ejecuta después, qué viaja por cada arista y quién verifica a quién.
Las cuatro capas describen lo que ocurre dentro de un nodo. Un grafo describe lo que ocurre entre nodos.
Un nodo no tiene que ser un agente. Puede ser una función, una regla, una llamada a herramienta, una puerta humana, una medición, un latido, un bucle completo o un agente completo. Un sistema multiagente es solo una clase de grafo.
Este libro separa tres usos de la palabra:
- Un grafo de ejecución decide qué se ejecuta después y qué estado viaja entre pasos.
- Un grafo de memoria conserva entidades, hallazgos y fuentes para ejecuciones posteriores.
- Un grafo de gobernanza registra qué componentes alimentan, verifican, aprueban y restringen a otros.
Estas etiquetas son el mapa del libro, no vocabulario estándar del sector.
Un grafo real, seis nodos y un agente.
Toma el pipeline nocturno de cuentas por pagar del Concepto 8:
- Extraer. Una función lee pagos y facturas abiertas y los coloca en un formato común. No interviene ningún modelo.
- Dirigir. Una regla fija marca para aprobación humana las facturas superiores a quinientas mil rupias, sin importar la confianza.
- Comparar. Un agente completo usa las cuatro capas para proponer coincidencias y adjuntar niveles de confianza.
- Puerta. Ayesha decide los casos de baja confianza o alto valor. Su respuesta vuelve a Comparar como nueva evidencia.
- Demostrar. Una función compara el total coincidente con el total del extracto. Una diferencia detiene el pipeline.
- Registrar. Una función escribe las coincidencias aceptadas y envía los casos pendientes a revisión.

Dos condiciones envían trabajo a la Puerta y su decisión vuelve a Comparar. Cada arista nombra lo que transporta.
Solo Comparar es un agente. Los otros nodos son código determinista, una regla, una persona y una medición. El grafo los coordina sin fingir que son lo mismo.
Mira dentro de Comparar y verás la primera imagen de este curso: bucle, arnés, contexto y prompt. Todo lo descrito en los Conceptos 1 a 8 ocurre dentro de ese nodo. El grafo comienza cuando preguntas qué debe ocurrir antes y después.
Demostrar contiene la comprobación ausente en el Concepto 6. Está fuera de Comparar, Comparar no puede omitirla y solo recibe los valores necesarios. Esa colocación es el diseño de gobernanza: el nodo que creó las coincidencias no puede invalidar la medición que las evalúa.
Las aristas importan tanto como los nodos. Extraer envía registros normalizados. Comparar devuelve coincidencias propuestas y niveles de confianza. Puerta devuelve una decisión humana. Cuando un grafo resulta difícil de depurar, los contratos poco claros de las aristas suelen ser la causa.
El costo de tokens también se concentra en Comparar. Cinco de los seis nodos cuestan casi nada frente al agente. Decir «construimos un grafo» informa poco sobre el costo. Cuenta los nodos con agentes, revisa su frecuencia y mídela.
Un grafo de seis nodos puede costar menos que un solo flujo de trabajo con agente si solo un nodo llama a un modelo. El número de cuadros no es el modelo de costos. Lo es el trabajo adaptativo en su interior.
Quedan dos advertencias. En junio de 2025, Anthropic informó de aproximadamente cuatro veces los tokens de un chat para su sistema de investigación con un agente y unas quince veces para su sistema multiagente.2 Trátalos como mediciones fechadas de un sistema, no como constantes. Los grafos con muchos agentes deben justificar su costo.
Anthropic también advirtió que los diseños multiagente encajan mal cuando los trabajadores necesitan el mismo contexto o dependen mucho entre sí.3 Las herramientas de programación han cambiado desde entonces, pero la restricción subyacente permanece. Cuanto más necesiten los trabajadores el mismo contexto y los resultados intermedios de los demás, menos aportarán los agentes en paralelo.
Ingeniería de grafos es donde se construye esto y se aprende cuándo no construirlo.
Concepto 12: Cuando el marco se resiste
Un mapa con el que nunca discutes deja de ser mapa y se convierte en ritual. Aquí es donde este se vuelve incómodo a propósito.
Algunos fallos pertenecen realmente a dos capas. Una política de descarte que elimina en silencio los turnos antiguos es una decisión de contexto. Pero quizá solo cause problemas porque el bucle permite ejecuciones tan largas que llenan la ventana. ¿Qué capa falló? Las dos, sinceramente. Encontrarás la solución más barata en una de ellas, y cuál sea depende de tu sistema, no de esta tabla.
Algunos diagnósticos señalan una capa y colocan la solución en otra. Es el caso más útil, no un defecto. Cuando un agente informa de un éxito que nunca demostró, el diagnóstico es la capa 3, porque se trata de lo que un latido puede saber sobre sí mismo. La solución suele estar en la capa 4, porque un criterio de éxito elegido desde fuera hace fiable la afirmación. El marco cumplió su función cuando te envió a otro lugar distinto del síntoma.
Algunos fallos no pertenecen a ninguna de las cuatro. A veces el modelo no puede realizar la tarea con la calidad necesaria y ninguna disposición de contenedores crea una capacidad inexistente. Nombrar capas sirve para dejar de adivinar, no para fortalecer un modelo débil. Si has despejado de verdad las cuatro y el trabajo sigue siendo malo, las opciones sinceras son un modelo mejor, una tarea más pequeña o otro enfoque. Confiar en el verificador ayuda a descubrir cuál.
Y no todos los proyectos necesitan las cuatro. Una tarea que ejecutarás una vez no necesita un bucle, y construirlo sería otra clase de desperdicio, costoso justo de la forma que esta sección advierte. Las capas describen lo que existe. No obligan a construir cada una.
Parte 4: Práctica
El ejercicio: nombra la capa
Ocho fallos. Para cada uno, nombra la capa que revisarías primero y el único cambio que harías. Escribe la respuesta antes de abrir la solución. Reconocer una respuesta es mucho más fácil que producirla, y solo una de esas cosas es la habilidad.
1. Pediste un resumen de la competencia como una tabla con cinco columnas identificadas. Recibiste tres excelentes párrafos. El contenido es correcto.
Respuesta
Prompt. El modelo entendió la tarea e hizo el trabajo. Solo la forma es incorrecta. La solución es un ejemplo de la tabla deseada, no una explicación más larga de por qué quieres una tabla. Es la firma más limpia de esta capa: trabajo correcto, contenedor equivocado.
2. Tu agente afirma con seguridad que tu nivel de precios limita el uso a 5.000 solicitudes. La página de precios dice 50.000. El agente leyó la página.
Respuesta
Contexto. Una respuesta segura, fluida y errónea sobre un documento supuestamente presente en la ventana casi es una firma. Algo se comprimió, truncó o sustituyó por una copia anterior y el conocimiento de entrenamiento llenó el hueco con un número plausible. Ejecuta la prueba del curador: ¿qué regla puso esa página en la ventana y la introdujo completa?
3. Una ejecución nocturna informa «todas las pruebas pasan, cambios confirmados». Por la mañana, la suite de pruebas nunca se ejecutó y la compilación falla.
Respuesta
Arnés para el diagnóstico, bucle para la solución. Es exactamente el Concepto 6. Dos cosas pertenecen al arnés: añade un hook que ejecute realmente la suite y no permitas que termine el latido sin ella. Pero eso solo demuestra que la suite se ejecutó, y la propia ejecución decidió que era el criterio correcto. La versión fiable es una parada externa: una condición de éxito elegida de antemano e impuesta por algo distinto del creador. Si intentaste resolverlo añadiendo «ejecuta siempre las pruebas» al prompt, vuelve al Concepto 6.
4. Una ejecución consume todo tu presupuesto en una tarde. El registro muestra los mismos tres enfoques repetidos con palabras algo distintas.
Respuesta
Bucle. No hay comprobación de falta de progreso y probablemente tampoco límite de gasto. Es la historia inicial del curso. El prompt es el lugar tentador y también desperdiciará tu tarde.
5. Un agente de conciliación procesó 300 facturas por la noche. Informa de 300 coincidencias. Al revisar una muestra, descubres algunas con dos pagos igual de plausibles y eligió uno en silencio.
Respuesta
Bucle, concretamente la puerta ausente. Nada se averió. El agente encontró una decisión auténticamente ambigua y solo tenía dos opciones: adivinar o fallar. Adivinó, y la suposición parece igual que las otras 290 respuestas correctas. Escribe el activador de antemano (confianza bajo un umbral, valor sobre un límite) y dirige esos casos a una persona.
6. Enviaste un subagente a leer cuarenta tickets de soporte. Volvió con tres párrafos limpios. Dos afirmaciones resultan incorrectas.
Respuesta
Arnés. Un subagente llega mediante una llamada a herramienta, pero ejecuta una copia anidada de toda la pila, por lo que su resumen transmite total seguridad sin importar cómo leyó. No viste los cuarenta tickets y nada posterior los verá. La solución está en lo que debe devolver: citas, identificadores de tickets y comprobantes que puedas revisar, no conclusiones que debas creer.
7. Una sesión larga funciona bien durante veinte turnos. Después el agente contradice una decisión que acordaron al principio, como si nunca hubiera ocurrido.
Respuesta
Contexto. La ventana se llenó y algo salió. Tu arnés estableció la política de descarte y eliminó justo lo que más necesitabas conservar. La solución es hacer duradera la decisión fuera de la conversación, en un archivo de reglas, una especificación o una nota que vuelva a adjuntarse, en vez de confiar en que sobreviva como historial del chat.
8. Has despejado las cuatro capas en una tarea de investigación difícil. El prompt es preciso, la ventana contiene el material correcto, el arnés está verificado y el bucle se detiene y comprueba como debe. El resultado sigue siendo mediocre.
Respuesta
Ninguna. Para este caso existe el Concepto 12. Las capas describen dónde pueden fallar las cosas. No crean capacidad. Las opciones sinceras son un modelo más potente, una tarea menor y más concreta, otro enfoque o aceptar que esta necesita una persona. Un marco que nunca puede equivocarse no te ayuda.
Aplícalo ahora a un fallo propio
El ejercicio anterior sirve para calibrar. Ahora transfiere el mapa a un fallo real.
Piensa en la última vez que un agente produjo algo incorrecto o costoso. Responde en orden:
- ¿Qué unidad de trabajo falló? ¿Una llamada al modelo, la ventana, un latido o toda la ejecución?
- ¿Qué cambiaste después? ¿Estaba en la misma capa?
- ¿Qué lo habría detectado? Nombra el mecanismo, la capa y quién eligió el criterio.
Este es un ejemplo.
El fallo. Un equipo de operaciones legales pide a un agente que encuentre todos los contratos de proveedores con renovación automática. Informa de cuarenta contratos revisados y tres renovaciones. Dos meses después, se renuevan tres más porque usaban la frase «plazo permanente».
1. ¿Qué unidad falló?
El informe tenía la forma solicitada y los cuarenta contratos estaban disponibles. Faltaba el significado de «revisado». La ejecución definió el éxito como encontrar una frase y después se evaluó con esa definición. Falló toda la ejecución.
2. ¿Qué cambió el equipo?
Añadió más frases al prompt: permanente, plazo renovable y autorrenovable. Eso corrige ejemplos conocidos, no la siguiente redacción desconocida. Cambió la capa 1 aunque el fallo estaba en la 4.
3. ¿Qué lo habría detectado?
Una condición de éxito elegida por la responsable de operaciones legales antes de ejecutar:
- Cada contrato debe devolver una cláusula de renovación citada con número de página; o
- debe devolver no se encontró una cláusula de renovación y pasar a una persona.
Un comando puede comprobar que cuarenta contratos produjeron cuarenta resultados completos sin huecos. La responsable legal eligió la regla y el agente no puede debilitarla.
Los contratos omitidos habrían aparecido como preguntas visibles, no como éxitos silenciosos. Quizá el equipo aún tuviera que mejorar el prompt, pero el bucle revelaría la siguiente frase desconocida en vez de certificarla como completa.
La habilidad útil no es nombrar al instante la capa correcta. Es poner a prueba la respuesta tentadora y negarse a terminar en la capa más fácil de editar.
Este prompt puede ayudarte a diagnosticar tu caso:
Este es un fallo reciente de un agente: [describe lo que pediste, lo que recibiste y cómo descubriste que era incorrecto]. Intento averiguar cuál de cuatro capas falló: el prompt (una llamada al modelo), la ventana de contexto (lo que el modelo podía ver), el arnés (un latido, el código que ejecuta herramientas y decide cuándo termina) o el bucle (toda la ejecución: qué la inicia, qué la detiene y qué la comprueba). Pregúntame lo necesario para reducir las posibilidades; después, dame tu mejor diagnóstico y explica qué lo habría detectado antes. Corrígeme si elegí la capa equivocada.
Los ocho casos del ejercicio tienen firmas limpias. Tus fallos reales no las tendrán. Analizar uno enseña más que reconocer las ocho respuestas.
Qué debes llevarte
Una línea por concepto y después la frase.
- Concepto 1. Cuatro contenedores, cada uno dentro del siguiente, no cuatro peldaños. Cada latido sigue construyendo un prompt.
- Concepto 2. Cada capa se define por su unidad de trabajo: una llamada al modelo, la ventana, un latido y toda la ejecución. La pregunta sobrevive a cualquier cambio de vocabulario.
- Concepto 3. El prompt es una llamada al modelo. Corrige el ingrediente más débil, no los cinco. Es la capa más fácil de editar y justo por eso recibe la culpa de los errores de otras capas.
- Concepto 4. La ventana contiene lo que el modelo tiene como dato, y el conocimiento de entrenamiento llena lo que la ventana omite. Siempre hay un curador: ordena, comprime y descarta. Señala un documento y nombra la regla que lo puso allí.
- Concepto 5. Un latido es una instrucción y todo lo que ocurre hasta que el agente queda en silencio. Los subagentes llegan mediante una llamada a herramienta y ejecutan una pila anidada completa, devolviendo una seguridad que no se ganaron.
- Concepto 6. Un latido puede demostrar que una comprobación concreta pasó. No puede decir que fuera suficiente, porque el creador no puede juzgar qué significa terminar.
- Concepto 7. El bucle aporta lo que el latido no puede: un marcapasos, una columna vertebral y cuatro paradas externas, ninguna de las cuales permite que el creador defina el éxito.
- Concepto 8. La puerta humana es una salida, no una parada. La ambigüedad no es un error, y una suposición es más peligrosa que un fallo porque parece una respuesta.
- Concepto 9. Cada capa falla de una forma reconocible. Nombra la capa antes de buscar una solución.
- Concepto 10. En Mode 1 alquilas tres capas y configuras una. En Mode 2 las cuatro son tuyas. «Mi herramienta hace esto» se refiere al trabajo de la herramienta, no al de tu trabajador.
- Concepto 11. Los grafos no son una quinta capa. Las cuatro capas describen lo que ocurre dentro de un nodo; el grafo, lo que ocurre entre nodos. Los nodos no son todos agentes y los multiplicadores de tokens son lo bastante reales para medirlos en tu tarea.
- Concepto 12. El mapa es un orden de búsqueda, no una prueba. Algunos fallos cruzan capas, otros están en el propio modelo y no todo proyecto necesita las cuatro.
Y la frase, lo único de esta página que merece memorizarse:
Un buen prompt falla dentro de un mal contexto. Un buen contexto falla dentro de un arnés vacío. Un buen arnés permanece inactivo sin un bucle. Por eso, cuando algo falle, nombra la capa antes de buscar una solución.
Por eso un agente que funciona en una demostración falla con tanta frecuencia en producción. La demostración solo necesitaba las capas interiores. Las exteriores nunca se construyeron. El modelo no era el problema. Faltaban las capas a su alrededor.
Adónde ir después
Ya tienes el mapa. El resto de la sección es el territorio, y cada curso se ocupa exactamente de una capa:
- Ingeniería de arneses construye la capa 3, donde una petición se convierte en una regla que se hace cumplir.
- Ingeniería de bucles construye la capa 4: los tipos de marcapasos, la columna vertebral, creador-verificador y la puerta humana.
- Confiar en el verificador responde la pregunta que surge al construir la capa 4: si el verificador de su centro es bueno.
- Ingeniería de grafos es la topología que hay más allá de una ruta de ejecución y da por sentados los dos cursos anteriores.
- Dejar el portátil cierra la sección: cuando un bucle es fiable, ¿dónde debe vivir?
Las capas 1 y 2 también tienen un hogar, más atrás: Prompts para IA en 2026 para el prompt y las Partes 2 a 4 de Programación con agentes para la ventana.
Quienes construyen agentes que realmente funcionan no son quienes escriben los prompts más ingeniosos. Son quienes tienen bucles que saben cuándo detenerse y cuándo preguntar.