Skip to main content

Agentes generales

Las herramientas que no solo hablan: hacen. Aprende a dirigir una; todo lo demás del libro se apoya en eso.

Fundamentos te enseñó qué es la IA y cómo conservar tu propio criterio mientras la usas. Esta sección es donde tomas la herramienta que usarás durante el resto del libro: un agente general, una IA que no solo responde, sino que actúa. Abre tus archivos, los lee, escribe y ejecuta código, y usa otras aplicaciones para terminar una tarea.

No necesitas instalar nada para empezar. El primer paso de esta sección ocurre en la misma pestaña del navegador donde cursaste Fundamentos:

  • Agentes generales en la web: la puerta principal de toda la sección. Dirige tu primer agente real desde una pestaña del navegador sin instalar nada: qué es una sesión remota, dónde viven realmente tus archivos, cómo llega una aprobación a tu teléfono y cómo interpretar cualquier producto de agentes nuevo mediante una forma compartida. Todo el mundo empieza aquí desde el primer día, sepa programar o no.

Cuando quieras llevar un agente a tu propio equipo, hay dos puertas para el resto de la sección, y cuál tomes depende solo de quién eres:

  • Claude Code y OpenCode: para quienes trabajan con código.
  • Cowork y OpenWork: para todos los demás, la misma potencia en una app de escritorio orientada al trabajo profesional y de conocimiento.

La misma idea, para públicos distintos: una IA a la que diriges para hacer trabajo real, no una con la que solo conversas.

Esta es la bisagra de todo el libro. Casi todo lo que viene después presupone que sabes dirigir un agente general. Modo 1 (resolver un problema una vez) y Modo 2 (fabricar un worker permanente) son, en el fondo, "tú y un agente general". Incluso el puente opcional de Personal Agent Harnesses instala y ejecuta su harness a través de una de estas herramientas. Así que esta es la habilidad que más reutilizarás. Más adelante, el mismo agente general que diriges aquí se convierte en la herramienta que usas para construir workers. La misma herramienta, un trabajo más grande.

La sección en tres etapas

Los cursos te llevan por una sola línea: de sostener la herramienta a cada segundo, a dirigirla con precisión, diseñar el bucle que la ejecuta por ti, endurecer el harness donde se ejecuta, dar memoria compartida a muchos bucles y, por último, medir si puedes confiar en el verificador que ocupa el centro.

Diagrama de la ruta de Agentes generales como tres etapas, de izquierda a derecha. Una nota a la izquierda muestra que llegas desde Fundamentos. Etapa 1, "Dirigir", es aprender a operar un agente general: Claude Code y OpenCode, o Cowork y OpenWork. Etapa 2, "Orientar", es Spec-Driven Development. Etapa 3, "Delegar el bucle", es Loop Engineering. Una flecha hacia adelante conduce a los Modos 1 y 2. El pie dice: Dirige, luego orienta, luego delega el bucle.

Etapa 1: dirige

Aprende a operar bien un agente general. Todo el mundo empieza en la web sin instalar nada; después toma el curso de la herramienta instalada que te corresponde y deja los demás para más adelante.

  • Agentes generales en la web: empieza aquí, en un navegador y sin instalar nada. Dirige tu primer agente en las superficies de trabajo web de julio de 2026 (Claude Cowork en la web y ChatGPT Work): sesiones remotas, dónde viven tus archivos, la aprobación que llega a tu teléfono y el marco de seis partes para interpretar cualquier producto de agentes. Todo el mundo toma primero este curso, sepa programar o no; después elige una herramienta instalada.
  • Cowork y OpenWork para profesionales: para todos los demás. El mismo tipo de agente en una app de escritorio creada para trabajo profesional (documentos, hojas de cálculo, diapositivas, investigación), para que no tengas que tocar una terminal para ponerlo a trabajar.
  • LLM de código abierto: tu portátil, tu servidor o clúster y la nube: la primera parada de la ruta de programación. Los modelos abiertos se descargan gratis, así que la pregunta real es dónde ejecutarlos. Este curso responde en tres escalas: en tu portátil con Ollama, en un equipo con GPU bajo tu control mediante vLLM para atender a cincuenta personas a la vez, y en la nube con OpenRouter, donde viven los modelos abiertos de frontera que nadie puede autoalojar. Una idea lo une todo: tu agente es un harness con un cerebro intercambiable, y el cerebro es solo una dirección. La Parte 1 funciona por sí sola y no exige más que una instalación gratuita. Ayuda haber dirigido ya un agente de programación, pero si no lo has hecho, su instalación con un comando prepara uno por ti. Los trabajadores del conocimiento que ya hayan cursado Cowork pueden cursar igualmente la Parte 1 para tener una IA privada.
  • Agentic Coding: Claude Code y OpenCode: para quienes trabajan con código. Modo plan, gestión de contexto, el archivo de reglas, skills, subagentes y conectores (MCP): cómo dirigir un agente de código para que lea tus archivos, proponga un plan, haga los cambios y te permita comprobar el resultado.
  • Diseño de sitios web: el curso donde dejas de aprender sobre la máquina y la orientas hacia algo real. Un sitio para un cliente, desde una carpeta vacía hasta una dirección en vivo que otra persona puede abrir en su teléfono: una historia planificada antes de dibujar píxeles, la marca del cliente tratada como una regla y no como un estado de ánimo, fotos y video reales, una versión móvil que no sea una ocurrencia tardía y capturas usadas como pruebas para que "¿se ve bien?" se convierta en algo comprobable. Su gran idea es la que las etapas 2 y 3 siguen aprovechando: el gusto ahora es un archivo. El criterio que separa una página hecha de una generada puede escribirse y cualquier modelo puede cargarlo. Tómalo cuando ya puedas dirigir cualquiera de las herramientas anteriores; es mucho más fácil valorar las specs y los bucles después de entregar algo y sentir dónde falla el trabajo.

Etapa 2: orienta

Dirigir te da resultados; orientar te da el resultado correcto, cada vez.

  • Spec-Driven Development: deja de dar instrucciones vagas al agente y empieza a entregarle una spec escrita: qué hacer exactamente, sobre qué, y qué significa "terminado". Una spec clara es la diferencia entre un agente que adivina y uno que acierta el objetivo, y es lo primero que llevas contigo al cruzar al Modo 2.

Etapa 3: delega el bucle

Esta etapa comienza con un mapa y luego construye lo que el mapa nombra: diseña el bucle, endurece el harness donde se ejecuta, da memoria compartida a muchos bucles y demuestra con evals que el verificador de su centro es confiable. Un último curso responde la pregunta que todos plantean: cuando ya confías en un bucle, ¿dónde debe vivir?

  • Las cuatro capas: lee este curso primero y en menos de una hora. Es el mapa de todo lo que sigue: prompt, contexto, harness y bucle no son cuatro habilidades entre las que debas elegir, sino cuatro contenedores, cada uno dentro del siguiente y cada uno con su propia unidad de trabajo. El resultado es un hábito, no una técnica. Cuando un agente desperdicia cuarenta minutos y cincuenta dólares repitiéndose, dejas de reescribir el prompt (la capa que puedes editar en diez segundos) y empiezas a preguntar qué capa falló en realidad. También aclara dónde encajan los grafos, que no es como una quinta capa. No hay nada que instalar; basta con una pestaña de chat y un agente que ya hayas dirigido.
  • Loop Engineering: el salto de sostener la herramienta a diseñar un sistema que pregunta al agente por ti. Construyes un pequeño bucle que despierta, mira qué cambió, decide qué vale la pena hacer, entrega cada trabajo a un agente, revisa el resultado y te llama solo para las decisiones que de verdad necesitan a una persona. La habilidad valiosa pasa del prompt que escribes al bucle que diseñas. Es la puerta natural a todo lo que viene después.
  • Harness Engineering: el lado de la confianza del mismo salto. Un bucle que se ejecuta mientras duermes necesita una capa que decida qué puede hacer el agente, qué debe saber, cómo se prueba su trabajo y qué pasa cuando algo sale mal. Esa capa es el harness (Claude Code y OpenCode incluyen uno cada uno), y este curso te enseña a construirlo de forma deliberada: muros de permisos, sandboxes, comprobaciones automáticas y el hábito de convertir cada error detectado en una regla que hace imposible repetirlo.
  • Graph Engineering: el lado de la memoria y el curso que debes tomar cuando un bucle ya no basta. Distribuye veinte agentes y cada uno empieza vacío, redescubriendo lo que otro encontró hace una hora: el trabajo se multiplicó, la memoria no. La solución consiste en dejar de abandonar los hallazgos en transcripciones y empezar a escribirlos como registros tipados y conectados que cualquier agente posterior pueda consultar: el agente olvida; el grafo no. Conservas dos grafos sin mezclarlos, uno para el trabajo intentado y otro para los hechos establecidos; adjuntas un comprobante a cada afirmación; entregas a cada worker un fragmento pequeño en lugar de un volcado; y haces que el revisor cite una arista en vez de opinar. Una última parte conecta los propios bucles: quién verifica a quién, quién es responsable del objetivo de quién y qué mediciones ningún bucle puede discutir. Léelo cuando construyas el segundo bucle; también explica con honestidad cuándo no debes construir un grafo.
  • Confiar en el verificador: el bucle se ejecuta, el harness prueba el trabajo y en el centro hay un verificador que dice PASS o FAIL. ¿Cómo sabes si es bueno? Este curso enseña evals: construyes una pequeña carpeta de casos de prueba a partir de fallos reales, calificas al revisor varias veces en lugar de una, lo calibras contra tu propio criterio y bloqueas cada cambio según el resultado. Convierte "el verificador dijo PASS" en un número que puedes defender usando solo archivos, shell y jq.
  • Dejar el portátil: la decisión sobre el runtime. Un bucle probado en tu portátil está atrapado en un solo equipo; este curso lo traslada al lugar donde funcionará de verdad (una programación en la nube, un runtime gestionado o tu propio proceso) sin perder el historial que se ganó. Cierra la etapa 3: el bucle se ejecuta, el harness lo protege, el verificador es confiable y ahora vive en un lugar que no duerme cuando tú duermes.

Cuatro palabras, una dentro de la otra

Las tres etapas anteriores usan cuatro palabras que la industria confunde constantemente: prompt, contexto, harness y bucle. Esta es la relación entre ellas y el curso que se ocupa de cada una. Las cuatro capas es el curso que enseña este modelo en profundidad, en unos cincuenta minutos, y es lo primero que conviene leer en la etapa 3.

Diagrama titulado "Cuatro palabras, una dentro de la otra", con cuatro cajas redondeadas anidadas. La caja interior, de color pizarra, es la capa 1, el prompt: el mensaje que envías, con la petición, los ejemplos y el formato, a cargo de Prompting con IA en 2026. Alrededor, una caja dorada es la capa 2, el contexto: todo lo que el modelo ve para una respuesta, a cargo de las Partes 2 a 4 de Agentic Coding. Alrededor, una caja terracota es la capa 3, el harness: las reglas dentro de una ejecución, como permisos, comprobaciones y recuperación, a cargo de Harness Engineering. La caja exterior de color pizarra es la capa 4, el bucle: la programación alrededor de todo que inicia ejecuciones, las califica y recuerda entre ellas, a cargo de Loop Engineering. Una barra inferior dice: un buen prompt falla dentro de un mal contexto; un buen contexto falla dentro de un harness desnudo; un buen harness permanece inactivo sin un bucle. La mayoría de los textos en línea dibuja las capas 3 y 4 con el mismo trazo; este libro las separa porque fallan de formas distintas.

PalabraQué esUnidad de trabajoCurso responsable
PromptEl mensaje que envías: la petición, los ejemplos y el formato.Un mensajePrompting con IA en 2026
ContextoTodo lo que el modelo ve para una respuesta: archivos, historial, reglas y resultados de herramientas.Lo que permanece en la ventana paso a pasoAgentic Coding, Partes 2 a 4
HarnessLas reglas dentro de una ejecución: qué puede hacer el agente, cómo se prueba su trabajo y qué pasa si falla.Una ejecuciónHarness Engineering
BucleLa programación alrededor de todo: inicia ejecuciones, las califica y recuerda entre ellas.Muchas ejecuciones a lo largo de díasLoop Engineering

Las cuatro no son pasos de una línea. Son capas, una dentro de la siguiente. Un buen prompt falla dentro de un mal contexto. Un buen contexto falla dentro de un harness desnudo. Un buen harness permanece inactivo si no hay un bucle que lo ejecute. Por eso un agente que funciona en una demostración suele morir en producción: la demostración solo necesitó las capas internas y las externas nunca se construyeron. El problema no era el modelo. Faltaban las capas que lo rodean.

Un curso de esta sección no se ocupa de ninguna de las cuatro, y es deliberado. Graph Engineering no es una quinta capa, sino una topología: muchas de estas pilas conectadas que comparten una memoria. No aparece en la tabla porque la palabra no te aporta nada hasta que ejecutas más de un bucle, justo por eso viene después de las cuatro capas.

Un buen prompt te da una respuesta ingeniosa. Las cuatro capas juntas te dan algo que puedes entregar. Las cuatro capas descompone cada una, te muestra su firma de fallo y convierte «mi agente está roto» en una pregunta con dirección.

Lo que necesitas primero

Haz primero la sección Fundamentos, especialmente Cómo pensar en la era de la IA (conservar tu criterio) y Habilidades y conectores (los plugins que un agente general usa para llegar a tus herramientas y datos). No necesitas ser programador: si no lo eres, toma la puerta de Cowork y OpenWork, y estarás bien.

Hacia dónde lleva

Cuando puedes dirigir, orientar, poner en bucle y endurecer a un agente general, el resto del libro se abre. La sección opcional Personal Agent Harnesses queda justo adelante, si quieres poseer un worker que se ejecute en tu propia infraestructura. Luego llega la bifurcación sobre la que gira todo el libro: Modo 1: resolución de problemas, donde usas un agente general para resolver un problema una vez, y Modo 2: fabricación, donde construyes un worker permanente que lo resuelve para siempre.

El arco del libro en una línea: Fundamentos para entender, Agentes generales para dirigir, los dos modos para poner a trabajar.

Empieza en el navegador con Agentes generales en la web: cualquiera puede hacerlo desde el primer día y sin instalar nada. Después, cuando lleves un agente a tu propio equipo, elige la puerta que te corresponde: Claude Code y OpenCode si trabajas con código, Cowork y OpenWork si no.