Agentes generales en la web: curso intensivo
12 conceptos · Tu primer agente general, en la misma pestaña del navegador donde cursaste Fundamentos

Durante seis cursos trabajaste en una pestaña de chat. Preguntabas. Respondía. Volvías a preguntar. Cada turno comenzaba contigo. Fue una buena forma de aprender. Sin embargo, un chat sencillo tiene un límite: cuando dejas de escribir, la conversación se detiene.
Los agentes que siguen trabajando por su cuenta no son nuevos en la web. ChatGPT podía ejecutar tareas programadas desde principios de 2025. Podía investigar a fondo por su cuenta mientras te alejabas. Tenía un modo agente con equipo propio. Eran funciones reales y potentes, pero estaban dispersas: una tarea aquí, una herramienta de investigación allá, un modo agente dentro de un menú. No había un único lugar claro para el trabajo diario que reuniera tus archivos, sesiones y servicios en un mismo flujo.
Julio de 2026 resolvió esa carencia. Dos grandes empresas reunieron esas piezas en una interfaz de trabajo clara, junto al cuadro de chat y en la misma dirección web. En claude.ai, Claude Cowork funciona como una sesión remota en los servidores de Anthropic. En chatgpt.com, ChatGPT Work es un nuevo modo dentro de ChatGPT, junto al modo Chat que ya conoces. Funciona con el modelo GPT-5.6 de OpenAI. (ChatGPT también tiene un modo Codex para programadores, pero en la web y el teléfono verás sobre todo Chat y Work.)
Por tanto, julio de 2026 no inventó los agentes en el navegador. Les dio un lugar de trabajo de primera clase. El cuadro de chat no cambió: todavía te espera y siempre lo hará. Lo que cambió fue la interfaz contigua. Inicia allí una sesión y se ejecutará en los servidores de la empresa. Puedes cerrar la pestaña o subir a un avión; el trabajo continúa. Cuando llegue a una decisión que solo tú puedes tomar, la pregunta aparecerá en tu teléfono.
Este curso recorre esa interfaz. También es tu primera lección de una habilidad que necesitan todos los cursos posteriores: dirigir un agente general. Aprenderás qué es una sesión remota, dónde terminan realmente tus archivos, cómo llega una aprobación a tu teléfono, cómo delegar trabajo que no observarás y cómo reconocer los mismos componentes dentro de un producto de agentes nuevo.
Dos empresas construyeron esta interfaz casi al mismo tiempo y llegaron al mismo conjunto de componentes. Es una prueba sólida de la idea principal del libro: la habilidad está en la estructura, no en la herramienta.
Hay otra historia más amplia que conviene nombrar al entrar. Las dos empresas ya no compiten solo con el modelo, sino también con todo lo que lo rodea: el horario, los conectores, la memoria y la puerta. Este libro llama arnés a esa envoltura y guerra de arneses a la competencia. Antes se libraba mediante código y entre ingenieros. Ahora llegó a la web. Tu papel es sencillo: aquí no construyes el arnés. Eliges el que mejor encaja y lo diriges bien. El concepto 3 muestra los dos arneses lado a lado.
No instalarás nada. Fundamentos se ejecutó en una pestaña del navegador. Este curso también.
A quién se dirige este curso. A cualquiera que venga de Fundamentos y quiera dirigir un agente real sin instalar nada. Primero, a trabajadores del conocimiento: personas cuyo día transcurre entre documentos, hojas de cálculo, correo electrónico y chat. Abogados, contadores, profesionales de marketing, analistas, fundadores y estudiantes. También se dirige a ingenieros que desean el primer paso más accesible antes de la terminal. Si sabes programar, no pierdes nada por comenzar aquí. Si no sabes, este es exactamente tu lugar. Por eso es el primer curso de la sección Agentes generales. Cualquiera puede tomarlo desde el primer día y en un navegador.
Haz esto primero: Fundamentos, sobre todo Diseño de indicaciones para IA en 2026 y Habilidades y conectores. Este curso espera tres cosas de ti: puedes presentar un encargo claro a un modelo, sabes qué es el contexto y conoces una habilidad y un conector. Si algo de esto es nuevo, completa antes esos dos cursos. En conjunto llevan unas dos horas.
Cuánto tiempo requiere. La ruta central, las partes 1–3, necesita unos 90 minutos de lectura. El curso completo con la parte 4 y los apéndices se acerca a dos horas. Los proyectos añaden práctica, incluida una semana para el ejercicio de programación, y ahí se consolida el aprendizaje. Después hay siete apéndices de consulta: seis relacionan este curso con uno posterior (lee cada uno cuando llegues a él) y el último traza un mapa de toda la industria. Úsalos como referencia, no los leas todos de una vez.
¿Es tu primera vez aquí? Repaso de 2 minutos sobre lo que ya deberías saber
- Presentar un encargo significa describir una tarea por completo: el resultado, los límites, el lector y la razón. Una indicación vaga produce un resultado vago. (Curso 2 de Fundamentos.)
- El contexto es todo lo que ve el modelo en un turno. Más no siempre es mejor. Es mejor el contexto correcto, elegido a propósito. (Curso 2 de Fundamentos.)
- Una habilidad es una tarea que enseñas una vez. Vive en un archivo
SKILL.md. La IA solo la carga cuando tu solicitud coincide. (Curso 5 de Fundamentos.) - Un conector ofrece a la IA acceso seguro y limitado a un servicio real como Drive, Gmail o Slack mediante el estándar MCP. Tú otorgas los permisos. La IA trabaja dentro de ellos. (Curso 5 de Fundamentos.)
- Un chatbot frente a un agente. Un chatbot responde. Un agente planifica, usa herramientas y completa pasos. En este curso dirigirás uno por primera vez.
Si alguno de estos conceptos es nuevo, lee primero los dos cursos de Fundamentos. Este curso los aplica a trabajo real.
📚 Ayuda didáctica
Ver la presentación completa — Agentes generales en la web
Para docentes y autodidactas. Este curso enseña una idea transferible: un producto de agentes se compone de seis partes (latido, conectores, bucle de ejecución hasta terminar, columna vertebral del estado, puerta humana y cuerpo). Cuando conoces las partes, un producto nuevo requiere un recorrido breve, no aprender una materia nueva. Enséñalo en tres pasadas. Primero, el cambio: el cuadro de chat espera y la interfaz de agente contigua no lo hace (conceptos 1–3). Segundo, la propia interfaz: dónde viven los archivos, cómo llegan los conectores al exterior y cómo llegan las aprobaciones a tu teléfono (conceptos 4–7). Tercero, el trabajo sin supervisión: el bucle de delegación y las tareas programadas (conceptos 8–9), seguido de la elección de una interfaz según lo que toca el trabajo (conceptos 10–12). Los seis proyectos son la evaluación. La principal costumbre que deben llevarse los estudiantes es esta: el trabajo terminado sale de la plataforma.
Palabras clave en lenguaje sencillo
Verás estas palabras en todo el curso. Lee la lista una vez y vuelve cuando un término no esté claro.
| Término | Significado sencillo |
|---|---|
| Cuadro de chat | La conversación que te espera en cada turno. No puede iniciar nada por su cuenta. |
| Interfaz de agente | El producto junto al cuadro de chat que planifica, actúa y ejecuta trabajo de varios pasos. |
| Sesión remota | Una sesión que se ejecuta en los servidores del proveedor. Tu pestaña es una ventana hacia ella, no el equipo que la ejecuta. |
| Sesión local | Una sesión que se ejecuta en tu propio equipo. Se detiene cuando el equipo entra en reposo. Las conocerás en los próximos cursos. |
| Sistema de archivos de la tarea | El espacio de trabajo temporal que usa una sesión remota. Trátalo como borrador, nunca como almacenamiento permanente: las reglas de retención y limpieza dependen del proveedor. |
| Almacenamiento de la plataforma | Archivos guardados de forma permanente en tu cuenta de la plataforma del proveedor. Sobreviven a la tarea y a la pestaña. |
| La salida (nivel 3) | Sacar un entregable de la plataforma y llevarlo a un lugar bajo tu control: guardarlo mediante un conector, descargarlo, escribirlo en local o hacer un commit en un repositorio. El archivo entra en tu sistema de registro. |
| Columna vertebral de la cuenta | Tus sesiones y archivos guardados y sincronizados entre dispositivos. Memoria que no tuviste que construir. |
| Puerta humana | El punto donde una persona debe aprobar antes de que continúe una acción arriesgada. En esta interfaz llega a tu teléfono. |
| Tarea programada | Trabajo que comienza según un reloj, en los servidores del proveedor y sin que ninguno de tus dispositivos esté conectado. |
| Uso medido | Un presupuesto de ejecuciones u horas por plan. El trabajo sin supervisión en servidores ajenos siempre tiene uno. |
| Custodia | Quién conserva tus datos: en qué equipos viven y quién puede acceder a ellos. |
De dónde viene esto
Las fechas importan porque esta interfaz tiene apenas semanas, aunque sus raíces son anteriores.
Los agentes en el navegador no comenzaron en 2026. ChatGPT lanzó tareas programadas en enero de 2025. En febrero de 2025 lanzó la investigación profunda, que navega por su cuenta durante muchos minutos. A mediados de 2025 lanzó un modo agente con equipo propio. La web ya podía ejecutar trabajo de forma autónoma mucho antes de este curso. Le faltaba un hogar claro: las piezas estaban repartidas entre menús y herramientas.
Claude siguió su propio camino hasta el mismo lugar. Anthropic ofrecía sesiones de programación en la nube que funcionaban en sus servidores con el portátil cerrado. Eran útiles, pero estaban dirigidas a programadores.
Después, en julio de 2026, ambas empresas reunieron las piezas en un solo lugar con pocos días de diferencia.
Cowork llegó a la web en claude.ai (beta, primero para el plan Max y luego para más planes). Las sesiones se ejecutan en los servidores de Anthropic. Tus sesiones y archivos se guardan en tu cuenta. Las tareas programadas se inician sin dispositivos conectados.
ChatGPT Work se lanzó el 9 de julio de 2026. No es un producto independiente, sino un nuevo modo agente dentro de ChatGPT, junto al modo Chat. Funciona con GPT-5.6. Crea archivos terminados: hojas de cálculo, presentaciones, documentos, paneles y pequeñas aplicaciones web. Accede a tus servicios mediante un Plugin Directory renombrado. Sus Scheduled Tasks pueden ejecutarse una vez, según un horario, ante un evento o mientras observan un cambio. No es un nivel de precio nuevo. En la web y el teléfono viene con los planes de pago elegibles, no con Free ni Go, y consume la cuota de agente de cada plan. (En la aplicación de escritorio de ChatGPT, Chat, Work y Codex están disponibles en todos los planes, incluido Free. Codex es una vista independiente dentro de esa aplicación y no se puede seleccionar en la web ni en el teléfono.) La disponibilidad cambia constantemente, así que confirma tu acceso en la página del producto.
Dos empresas, con pocos días de diferencia, colocaron un agente junto al cuadro de chat. Dos productos distintos. Una estructura. Este curso enseña la estructura.
Por qué ocurrió y qué permite hacer que antes no podías
Antes de aprender la interfaz conviene entender por qué existe. Hay dos caras. Una es lo que te ofrece; la otra, lo que reciben las empresas. Lee ambas. Cuando comprendes lo que quiere la empresa, utilizas la interfaz con criterio en lugar de confianza ciega. También explica una regla que el curso insistirá en aplicar más adelante.
La brecha que cerró. Antes de julio de 2026, la web podía ejecutar trabajo por su cuenta, pero las piezas estaban dispersas y eran desiguales. Una tarea programada vivía en un menú; una herramienta de investigación, en otro; un modo agente, en una lista desplegable. Cada uno era potente por separado, pero resultaba difícil encontrarlos y aún más combinarlos. No había un lugar único donde se reunieran tus archivos, sesiones, servicios y una ejecución sin supervisión. Por eso la mayoría nunca utilizó estas capacidades. Los lanzamientos reunieron las piezas en una interfaz clara, en la dirección que la gente ya abre a diario. La potencia ya existía. Lo nuevo fue que se volvió fácil de encontrar y combinar.
Cuatro capacidades que julio de 2026 reunió en una interfaz de trabajo más clara:
- Trabajo prolongado en la misma interfaz cotidiana. Una sesión remota se ejecuta en los servidores de la empresa, así que puedes cerrar la pestaña, apagar el portátil o subir a un avión y la tarea continúa. Las ejecuciones remotas de agentes ya existían. Work y Cowork las colocaron junto al chat normal dentro de un flujo general. (Concepto 2.)
- Programación integrada en la interfaz de trabajo. Una tarea programada comienza según un reloj o un activador sin dispositivos conectados. El informe del lunes está listo antes de que te sientes. Las tareas programadas también existían antes. Ahora están junto a tus proyectos, archivos, conectores y ejecuciones de agentes, no en una herramienta independiente. (Concepto 9.)
- Trabajo organizado en torno a sesiones y proyectos. Tus sesiones y archivos permanecen en la cuenta y te siguen entre dispositivos. Las nuevas interfaces reúnen archivos relacionados, instrucciones y trabajo continuo en un lugar visible, por lo que vuelves a pegar mucho menos contexto. (Concepto 4.)
- Muchos pasos entre tus archivos y servicios conectados. El agente se conecta a tus servicios, planifica, trabaja durante horas a través de muchos pasos y devuelve archivos terminados, no solo una respuesta de chat. Además, envía a tu teléfono las decisiones que te corresponden. Lo nuevo es que hace todo esto sin obligarte a atravesar varios modos de producto. (Conceptos 5–8.)
Ahora la otra cara, porque cambia cómo debes utilizar todo esto. El objetivo declarado es ayudarte a completar trabajo. El objetivo comercial es alcance y dependencia. Durante 2026, ambas empresas combatieron la idea de que vendían un producto de chat en un mercado que quería agentes. La solución más rápida fue colocar el agente donde ya estaban cientos de millones de personas. Sin instalación, otra aplicación ni una terminal que aprender. De una vez, los usuarios de chat se convierten en usuarios de agentes. Guardar sesiones, archivos y conectores en la cuenta de la empresa produce además otro efecto: marcharse resulta costoso. Esto se llama costo de cambio. La memoria de cuenta tan práctica es también lo que dificulta abandonarla.
No es un motivo para desconfiar, sino para adoptar una costumbre clara. La función que más te ayuda, una memoria gratuita y operativa, y la que más ayuda a la empresa, la acumulación de tu trabajo en sus servidores, son la misma. Por eso el concepto 5 te enseñará a sacar el trabajo terminado de la plataforma y llevarlo a tu propio almacenamiento. Conservas la comodidad y evitas la dependencia. Cuando entiendes el objetivo de la empresa, la costumbre parece evidente, no paranoica.
Y un límite sincero. Nada de esto mejora ni hace más seguro el trabajo en sí. Una instrucción débil ahora se ejecuta por su cuenta sin nadie que la detenga a mitad de camino. Además, reunir código, un navegador y conectores activos en una interfaz siempre disponible amplía el alcance de una mala ejecución. Los revisores de seguridad señalaron este problema durante la semana de lanzamiento de ChatGPT Work. La nueva potencia solo es apalancamiento. Que te ayude o perjudique sigue dependiendo de tu encargo, revisión y criterio. Por eso el curso coloca una disciplina junto a cada capacidad nueva, en vez de venderte la capacidad por sí sola.
La potencia de los agentes ya existía en la web, pero estaba distribuida entre herramientas y modos independientes. Ahora convive en la dirección web que ya utilizas, dentro de un espacio para el trabajo diario que continúa cuando te marchas. Ese es el regalo. La contrapartida es que tu trabajo se acumula en los servidores de la empresa: cómodo para ti y difícil de abandonar. Aprovecha la comodidad, pero envía todo lo terminado a tu propio almacenamiento. Y recuerda: esta interfaz hace que el trabajo se ejecute sin ti. No hace que sea bueno. Esa parte todavía te corresponde.
El cambio de mentalidad en una imagen

Datos comprobados el 21 de julio de 2026. Cowork en la web y ChatGPT Work tienen pocas semanas. Los lanzamientos se organizan por plan, el uso se mide y los nombres cambian. Esta es la página del libro que más rápido envejece. Consulta las páginas actuales de los productos antes de depender de un límite, un plan o una función.
Qué cubre este curso
| Parte | Tema | Qué aprenderás |
|---|---|---|
| 1 | El cambio | Qué cambió en julio de 2026, qué es una sesión remota y por qué dos proveedores llegaron a una estructura |
| 2 | La interfaz | Sesiones, columna vertebral de la cuenta, tres niveles de archivos, conectores sin carpetas y la puerta en tu bolsillo |
| 3 | Trabajo sin supervisión | El bucle de delegación, cómo presentar trabajo que no observarás y tareas programadas sin dispositivos conectados |
| 4 | La elección y el camino abierto | Web o escritorio según la tarea, el camino de código abierto sin nube del proveedor y dónde entrega el curso el relevo |
Dos formas de leer el curso. La primera vez, lee Por qué ocurrió, después las partes 1–3 en orden y luego los proyectos 1–3. Son unos 90 minutos de lectura y te convierten en usuario de agentes sin instalar nada. En una segunda lectura, aborda la parte 4, las notas detalladas y los proyectos 4–6 cuando ya tengas una semana de sesiones reales.
Qué recordar y qué consultar. Dos capas recorren el curso y envejecen de manera muy distinta. Recuerda la primera. Consulta la segunda. La capa duradera: el cuadro de chat espera y siempre lo hará. Una sesión remota vive en tu cuenta, no en la pestaña. Cada entregable termina en uno de tres niveles y el trabajo terminado sale de la plataforma. La puerta humana debe llegar a un lugar que realmente mires. Y todos los productos de agentes, de cualquier proveedor, tienen la misma estructura con nombres distintos. La capa mecánica: cada plan, límite de ejecución, etiqueta de botón y nombre de producto que aparece abajo. Tienen semanas y cambian cada mes. Trátalos como indicadores hacia la documentación actual, no como hechos para memorizar.
Un límite declarado desde el principio. Este curso enseña la interfaz y el bucle de delegación. No enseña la decisión sobre el tiempo de ejecución: dónde debe vivir a largo plazo el trabajo probado y sin supervisión, qué viaja durante una mudanza y cómo se vuelve a ganar la confianza. Ese es el tema de Dejar atrás el portátil, al final de la sección. Este curso es la puerta de entrada. Lee el otro antes de depender de lo que hay detrás.
Parte 1: El cambio
1. La misma dirección, dos cosas diferentes
Abre claude.ai o chatgpt.com hoy y encontrarás el cuadro de chat y el agente en la misma dirección. En ChatGPT, la separación está visible: los modos Chat y Work aparecen lado a lado en una aplicación. (La aplicación de escritorio también tiene una vista Codex independiente para programadores. En la web y el teléfono verás principalmente Chat y Work.) No son lo mismo, y distinguirlos es la primera habilidad del curso.
El cuadro de chat es la conversación que conoces de Fundamentos. Te espera en cada turno. Escribes, responde y vuelve a esperar. No puede iniciarse según un horario, reaccionar a un evento ni continuar después de cerrar la pestaña. No le faltan funciones: así funciona una conversación. El cuadro de chat nunca ejecutará trabajo sin ti y no necesita hacerlo. Es donde piensas, redactas y diseñas.
La interfaz de agente está a su lado. Le asignas una tarea, no un mensaje. Prepara un plan, usa herramientas, recorre pasos y produce un entregable. Solo se detiene cuando una decisión te necesita, y sigue trabajando cuando dejas de mirar.
Aquí tienes una prueba sencilla que conviene conservar durante toda tu carrera, porque todas las empresas difuminarán este límite en su marketing:
Si dejo de escribir, ¿se detiene el trabajo?
Cuadro de chat: sí. Interfaz de agente: no. Esa pregunta distingue ambos en cualquier dirección, empresa o año.
La versión más profunda, cuando la necesites, es esta: un turno de chat sencillo es sincrónico. Se ejecuta mientras esperas, termina y aguarda tu próximo turno. Una ejecución de agente está delegada. Una vez iniciada, avanza hacia un resultado. Puede ejecutarse después u observar un cambio. No necesita tu siguiente turno para continuar. Ese es el límite real y sobrevivirá a futuros cambios de botones y menús. La prueba de «dejar de escribir» es la forma cotidiana de percibirlo.
Una precaución para que la prueba no te engañe: a menudo inicias una ejecución delegada desde el cuadro de chat con palabras normales. «Cada lunes, resume estos correos». Las palabras entran en el chat, pero configuras una tarea delegada, no una respuesta normal. Observa lo que hace el trabajo, no solo dónde lo escribiste.
Algo más no cambió en julio de 2026: el cuadro de chat mantuvo su función. Diseñar una tarea, redactar un encargo y probar una idea manualmente son trabajos de chat, y allí comienza cada asignación del curso. La interfaz de agente no reemplazó el chat. Se instaló al lado.
Una ventana y dos habitaciones. En la primera no ocurre nada hasta que hablas. En la segunda, un trabajador sigue trabajando después de que te marchas. Este curso trata sobre la segunda. Seguirás utilizando la primera para preparar lo que delegas.
Comprueba tus conocimientos
Un colega dice: «Ya uso claude.ai todos los días, así que ya utilizo agentes». Corrige la idea en dos frases.
Mostrar respuesta
Utiliza el cuadro de chat: trabajo que se detiene en cuanto deja de escribir, lo que significa que todavía inicia cada turno de forma manual. La interfaz de agente es el producto contiguo: asígnale trabajo y planificará, actuará y continuará después de cerrar la pestaña. Utilizar el chat a diario es una habilidad real, pero no es utilizar agentes.
2. La sesión remota: la pestaña es una ventana, no el tiempo de ejecución
Este es el concepto arquitectónico central del curso. Todo lo demás se deriva de un hecho.
Un agente puede vivir en dos lugares. Puede vivir en tu equipo, como las aplicaciones de escritorio y terminales que conocerás en los tres próximos cursos. Allí, la aplicación es el tiempo de ejecución, es decir, lo que realmente ejecuta el trabajo. Cierra el portátil y el trabajo se detiene donde estaba porque el equipo entró en reposo. O puede vivir en los servidores del proveedor, como en este curso. En ese caso, la pestaña del navegador es una ventana hacia la sesión, no el equipo que la ejecuta.
Las consecuencias son sencillas y cada una cambia tu forma de trabajar:
- Cierra la pestaña: el trabajo continúa. La sesión nunca estuvo dentro de ella. Está en tu cuenta, sobre una infraestructura que no duerme cuando tú lo haces.
- Abre la sesión desde el teléfono: es la misma sesión. No es una copia ni un resumen, sino el mismo trabajo en ejecución visto a través de una ventana más pequeña.
- Una tarea programada se inicia desde una pestaña que cerraste la semana pasada. El horario también vive en los servidores del proveedor. Tus dispositivos no forman parte de la ruta crítica.
Inicia una sesión de Cowork en claude.ai, en la misma pestaña donde chateas. Funciona como una sesión remota en los servidores de Anthropic. Tus sesiones y archivos se guardan en tu cuenta: continuidad que no tuviste que configurar. Cuando el trabajo llega a una decisión que solo tú puedes tomar, la aprobación aparece en la aplicación Claude de tu teléfono.
Cowork en la web está en beta mientras se escribe el curso: primero el plan Max, después más planes, y el uso se mide. La capa mecánica cambia rápidamente. Confirma el acceso de tu plan en la página actual del producto antes de depender de él.
Cambia al modo Work de ChatGPT en chatgpt.com (lanzado el 9 de julio de 2026 y basado en GPT-5.6). No es una aplicación independiente: aparece junto al modo Chat en la misma interfaz y está diseñado para permanecer durante horas en un proyecto de varios pasos, dividir el objetivo y completar partes por sí mismo. Las sesiones se sincronizan en la nube entre la web, el escritorio y el teléfono: comienza en el portátil, revisa desde el teléfono y encontrarás la misma sesión. Scheduled Tasks se ejecuta desde la nube aunque ninguno de tus dispositivos esté conectado.
El acceso se habilita por plan. En la web y el teléfono, Work llegó a los planes de pago elegibles, no a Free ni Go. (En la aplicación de escritorio de ChatGPT, Chat, Work y Codex están disponibles en todos los planes, incluido Free. Codex es una vista independiente y no puede seleccionarse en la web ni el teléfono.) Está incluido en esos planes sin un precio adicional y consume la cuota de uso de agentes de cada plan. Por eso «medido» significa aquí la cuota incluida en el plan, no una factura independiente. La disponibilidad sigue cambiando y estos detalles son las afirmaciones que más rápido envejecen en el libro. Confirma tu acceso actual en la página de OpenAI antes de depender de él.

Un límite sincero evita exagerar este concepto. Una sesión remota se ejecuta en los equipos de la empresa. Por sí sola alcanza lo que esos equipos alcanzan: tus conectores, el sistema de archivos de la tarea y los archivos de la plataforma. No alcanza por sí sola tu disco duro, aplicaciones de escritorio ni el perfil del navegador donde iniciaste sesión en el banco. El trabajo que necesita esos elementos requiere un puente o agente local, y eso enseñan los próximos cursos. (Un matiz para después: una aplicación de escritorio puede servir como puente. Mientras está abierta, puede ofrecer a la sesión remota acceso limitado a archivos locales o al navegador. Al cerrarla, la sesión continúa pero pierde ese alcance local. Todavía no necesitas esto; basta saber que la barrera no es absoluta.) La parte 4 presenta la tabla de decisiones completa.
Un agente de escritorio es un trabajador dentro de tu casa: si la casa pierde electricidad, se detiene. Una sesión remota es un trabajador en la oficina del proveedor: la electricidad de tu casa no importa, y el portátil y el teléfono solo son ventanas para observarlo.
Para profundizar: volverás a encontrar esta idea dos veces
Conserva este concepto para el resto de la sección. Ingeniería de bucles te enseñará que el trabajo sin supervisión necesita algo que permanezca activo entre ejecuciones y preguntará dónde vive. Dejar atrás el portátil llamará al equipo de tu escritorio «el último punto único de fallo» y enseñará la decisión completa para eliminarlo. Aquí ves la versión para consumidores de ambas ideas: los servidores del proveedor permanecen activos para que los tuyos no tengan que hacerlo. La misma idea, sin archivos de configuración.
Comprueba tus conocimientos
Ayesha, en Lahore, inicia un informe de cliente en una sesión web a las 17:00. Un corte de electricidad apaga su equipo a las 18:00. A las 20:00 abre la sesión desde el teléfono. ¿Qué encuentra y por qué su electricidad nunca fue el problema?
Mostrar respuesta
Encuentra el trabajo terminado o esperando una aprobación que puede resolver desde el teléfono. La sesión funcionó todo el tiempo en los servidores del proveedor: su portátil solo era una ventana, y cerrarla no detiene lo que hay al otro lado. Un agente de escritorio, que conocerá en el curso de Cowork para escritorio, se habría detenido al perder electricidad porque allí el equipo es el tiempo de ejecución.
3. Dos proveedores, una estructura
Llegamos al concepto que justifica el curso. En julio de 2026, Anthropic y OpenAI llevaron sus interfaces de agentes al navegador con pocos días de diferencia. Ambos productos presentan un conjunto de componentes claramente similar. Llegaron con la misma anatomía.
Este libro enseña esa anatomía como seis componentes, y los cursos posteriores construyen cada uno en profundidad. No necesitas esos cursos para usar hoy los componentes como lente de lectura. Aquí aparece cada uno en una frase y su lugar en ChatGPT Work. Todos los nombres son los de OpenAI en el lanzamiento de julio de 2026:

| ChatGPT Work lo llama | Este libro lo llama | Significado en una frase |
|---|---|---|
| Scheduled Tasks | El latido | Lo que inicia el trabajo sin ti: una vez, según un horario, ante un evento o mientras observa cambios. |
| Plugin Directory (aplicaciones conectadas) | Conectores | Acceso limitado por permisos a tus servicios reales —Slack, Gmail, Drive y muchos más— para que el agente actúe, no solo sugiera. |
| Ejecución de tareas basada en resultados | Bucle de ejecución hasta terminar | Dale un resultado y trabajará hacia él a través de varios pasos: no una respuesta, sino una meta. |
| Sesiones sincronizadas en la nube y Projects | Columna vertebral del estado | Memoria que sobrevive entre dispositivos y ejecuciones, para que el trabajo continúe en vez de reiniciarse. |
| Solicitudes de aprobación (teléfono) | Puerta humana | Las decisiones arriesgadas o que exigen criterio llegan a una persona, en el teléfono, antes de continuar. |
| Entorno de ejecución en la nube de Work y herramientas de artefactos | Cuerpo | Donde ocurre realmente una ejecución y se producen artefactos terminados: documentos, hojas de cálculo, presentaciones, paneles y aplicaciones web pequeñas. |
Aplica la misma lente a Cowork en la web y aparecerá la misma tabla con los nombres de Anthropic: tareas programadas, conectores, sesiones guardadas en la cuenta y la aprobación en tu teléfono. Dos proveedores. Una estructura.
¿Por qué te importa tras tres semanas de carrera con agentes? Porque seguirán apareciendo productos y cambiando nombres, y no puedes volver a aprender desde cero cada vez. Cuando constructores independientes llegan a los mismos componentes, los componentes son la disciplina y los productos, el envoltorio. Aprende la estructura una vez y cada nuevo producto de agentes será una lectura de media hora, no una materia nueva. Esa es la afirmación central del libro, y julio de 2026 ofrece su mejor prueba: la habilidad está en la estructura, no en la herramienta.
Dos notas sinceras para mantener la lente en su sitio. Primero, una estructura igual no implica el mismo comportamiento. El orden de lanzamiento, los planes, los límites y los detalles difieren y cambian cada semana. La relación indica qué buscar, no promete que esté configurado igual. Segundo, aquí solo se presentan los seis componentes como vocabulario. Ingeniería de bucles enseña a diseñarlos, y no deberías programar nada serio antes de cursarla (el concepto 9 amplía la idea).
Una nota más que anticipa el concepto 6. El lanzamiento de ChatGPT Work reunió ejecución de código, acceso al navegador y conectores empresariales dentro de un espacio siempre activo. Una mala ejecución podía llegar más lejos, algo que los revisores de seguridad señalaron de inmediato. No es una crítica al producto: es el costo de la estructura y todos los proveedores lo pagan. Por eso los conectores reciben un concepto propio y la puerta de aprobación no es opcional.
Los automóviles de distintas empresas se ven diferentes, pero todos tienen motor, ruedas, frenos y volante. Cuando conoces las piezas, puedes conducir cualquiera después de observarlo un momento. Los productos de agentes son iguales. Esta tabla es la lista de piezas. El libro las enseña para que el envoltorio de un proveedor no vuelva a confundirte. Dos empresas compiten por construir un automóvil mejor alrededor de motores parecidos. Esa carrera es la «guerra de arneses». En la web eres quien elige y conduce el automóvil, no quien lo construye. Ambas funciones importan, pero son diferentes.
La misma estructura; entonces, ¿dónde difieren realmente? Los seis componentes son compartidos, pero el envoltorio no. Esta comparación sincera utiliza los lanzamientos de julio de 2026. Trata cada fila como una descripción de mediados de ese mes y verifícala en las páginas actuales: es la tabla que más rápido envejece en el libro.

| Cowork en la web (Anthropic) | ChatGPT Work (OpenAI) | |
|---|---|---|
| Qué es | Una sesión remota a la que accedes desde Cowork en claude.ai | Un modo dentro de ChatGPT, junto al modo Chat, en chatgpt.com |
| Dónde se ejecuta | En los servidores de Anthropic | En los servidores de OpenAI |
| Modelo | Claude (nivel Opus/Sonnet según la tarea) | Familia GPT-5.6 |
| Cómo se vende | Beta web habilitada por plan; uso medido | Incluido en planes de pago elegibles en la web y el teléfono, y en todos los planes de la nueva aplicación de escritorio; consume la cuota de agente del plan |
| Conectores | Catálogo de conectores de Anthropic mediante MCP | Plugin Directory (renombrado desde App Directory durante el lanzamiento), también basado en MCP |
| Ejecución hasta terminar | Condición de parada declarada en el encargo | Dale un resultado y trabajará hacia él a través de varios pasos |
| Espacio de trabajo persistente | Projects y un archivo de contexto guardado (Anthropic lo llama CLAUDE.md) | Projects y memoria (revisable y corregible) |
| Artefactos terminados | Documentos, hojas de cálculo, presentaciones y archivos | Documentos, hojas de cálculo, presentaciones, paneles y Sites (aplicaciones web publicables en una URL) |
| Herramienta hermana de programación | Claude Code (una interfaz independiente) | Codex (integrado como modo en la misma aplicación) |
| Puerta móvil | Aprobaciones en la aplicación Claude | Aprobaciones en la aplicación ChatGPT |
Al leer la tabla pensando en los componentes aparece un patrón: casi todas las diferencias están en la columna del envoltorio; los componentes centrales son compartidos. Cambian el modelo, las reglas de los planes y el nombre del catálogo de conectores. Uno ofrece una función para publicar URL y el otro no. Algunas diferencias son más profundas: hasta dónde llega una tarea en tus archivos locales, cómo funcionan las aprobaciones y si el agente de programación vive en la misma aplicación. Son reales y el concepto 10 las utiliza. Sin embargo, el latido sigue siendo un latido, la puerta una puerta y la columna una columna en ambos productos. Los componentes compartidos son la capa duradera. El resto es la capa mecánica que debes consultar, no memorizar. Ese es el propósito de la lente de seis componentes, mostrado en vez de afirmado. Si solo hubieras aprendido un producto, el otro seguiría siendo un recorrido breve porque comparten las piezas que sostienen el trabajo.
Una palabra sobre lo que observas. Fíjate en dónde compiten los productos, no solo en el modelo. Los modelos importan y ambos son potentes, pero los productos compiten en todo lo que los rodea: programador, capa de conectores, columna de la sesión, puerta del teléfono y salida de archivos. Este libro llama arnés a esa envoltura, e Ingeniería de arneses es el curso dedicado a ella. Durante la mayor parte de los dos últimos años, los ingenieros construían el arnés a mano mediante código y en la terminal. Los lanzamientos de julio de 2026 muestran que el arnés llegó a la web como producto terminado y que dos empresas compiten por ofrecer el mejor. Esa competencia te beneficia y explica la rápida mejora de la interfaz.
Mantén clara una frase. En la web, las empresas libran la guerra de arneses. Tú no. Aquí no construyes un arnés, sino que eliges entre dos ya terminados. El trabajo del ingeniero, conectar el bucle, las herramientas, el contexto y las comprobaciones, es el tema del curso posterior de Ingeniería de arneses. Es trabajo real y profundo. Tu función aquí es menor y distinta: elige el arnés prediseñado que encaje con la tarea y dirígelo bien. Saber que existe la guerra ayuda a elegir, pero no te convierte en ingeniero de arneses. Ese es otro curso y otro asiento.
¿Para quién es cada producto? Los componentes son compartidos, pero los proveedores apuntan a públicos diferentes que se solapan. Conocer la intención ayuda a elegir. Hay dos niveles:
A quién apuntaron las empresas. Ambos productos se dirigen al mismo usuario central: el trabajador del conocimiento. Es la persona que mueve información entre documentos, hojas de cálculo, correo electrónico y chat, y que no programa. Para ella se escribe «produce una hoja de cálculo, presentación o informe terminado». Sin embargo, la estructura que la rodea difiere. ChatGPT Work es un modo dentro de una aplicación que también contiene un agente de programación (Codex). OpenAI apunta a un lugar de trabajo donde una persona o equipo puede realizar trabajo de conocimiento y programación sin cambiar de aplicación. Además, viene con planes de pago existentes sin un precio nuevo, por lo que apunta a un público amplio. Cowork en la web se lanzó primero para Max y con uso medido: un grupo inicial más estrecho y decidido. Su agente de programación, Claude Code, sigue siendo una interfaz independiente, lo que separa mejor ambos tipos de usuario.
Quién debería elegir cada uno. Esta es la orientación del libro, no una afirmación del proveedor. Para la mayoría del trabajo con documentos y conectores, cualquiera sirve. Los desempates son normales: qué modelo prefieres, con qué empresa ya están conectados tus servicios y qué plan pagas. La decisión solo se vuelve clara en un caso. Si realizas trabajo de conocimiento y programas, y deseas reunirlo todo, la aplicación de escritorio de ChatGPT contiene Chat, Work y Codex, la configuración más ligera. Si prefieres mantener el agente de trabajo y el de programación como interfaces independientes y gobernadas por separado, la división entre Cowork y Claude Code es más limpia. En ambos casos se trata principalmente de envoltorio, no de capacidad, por eso es una nota secundaria y no el titular.
Hay un público que el curso excluye de ambos productos: quien maneja datos regulados. La información sanitaria protegida, el material sujeto a privilegio y los registros financieros regulados no deben utilizar ninguna interfaz web hasta que cumplimiento lo autorice por escrito, porque los archivos de trabajo y el almacenamiento de la plataforma están bajo custodia del proveedor. El concepto 10 lo explica por completo. Aquí basta recordar que «para quién es» tiene un límite firme que el marketing no dibuja.
Conviene señalar una diferencia real además del envoltorio porque cambia una decisión. El agente de programación de OpenAI, Codex, vive en la misma aplicación ChatGPT que Work, aunque aparece como una vista independiente en el escritorio y no puede seleccionarse en la web ni el teléfono. Anthropic mantiene Claude Code como una interfaz totalmente separada. Para un trabajador del conocimiento es invisible. Para alguien que trabaja con conocimiento y código importa. En el escritorio, ChatGPT reúne Chat, Work y Codex. Claude exige moverse entre Cowork y Claude Code. Ninguna opción es mejor. Es una diferencia estructural real y se vuelve útil en la tabla «elige según lo que toca el trabajo» del concepto 10.
Los dos productos están construidos de la misma forma y difieren principalmente en las etiquetas, el modelo y la manera en que cada plan los vende. La diferencia estructural real es que OpenAI colocó su herramienta de programación dentro de la misma aplicación que el agente de trabajo, mientras Anthropic las mantiene separadas. No lo notarás en trabajo con documentos. Si también programas, conviene saberlo.
Comprueba tus conocimientos
El próximo trimestre, un tercer proveedor lanza un producto de agentes llamado «Flows». La página enumera activadores, integraciones, modo piloto automático y memoria del espacio de trabajo. Relaciona los cuatro nombres con los componentes del libro antes de leer su documentación.
Mostrar respuesta
Activadores: el latido. Integraciones: conectores. Modo piloto automático: el bucle de ejecución hasta terminar (y tu primera pregunta para la documentación es: ¿cuál es la condición de parada y quién la comprueba?). Memoria del espacio de trabajo: la columna vertebral del estado. Acabas de leer un producto desconocido en menos de un minuto y llegaste con las preguntas correctas. Ese ejercicio es la habilidad que enseña el concepto.
Parte 2: La interfaz
El cambio quedó atrás. Ahora conocerás las piezas operativas de la interfaz: dónde viven las sesiones, dónde terminan los archivos, qué hace un conector cuando nadie mira y cómo te encuentra la única decisión que te necesita. Son cuatro conceptos. Uno, los tres niveles de archivos, es la disciplina más importante del curso. Detente al llegar.
4. La columna vertebral de la cuenta: sesiones y archivos que no tuviste que construir
En el flujo de Fundamentos, una conversación independiente comenzaba a menudo desde cero. Volvías a pegar el contexto, explicar el proyecto y subir el archivo. La continuidad era tu responsabilidad y solías mantenerla a mano.
La interfaz de agente ofrece continuidad como función. Las sesiones se guardan en tu cuenta. Los archivos que produce una sesión también. Abre cualquiera desde cualquier dispositivo y encontrarás el mismo trabajo en el mismo punto. Este curso lo llama columna vertebral de la cuenta, la versión de esta interfaz de la columna vertebral del estado del concepto 3: memoria que sobrevive entre sesiones y dispositivos, construida por el proveedor y sin personal que debas contratar para mantenerla.
Es un regalo real y deberías aprovecharlo. También tiene un precio que conviene conocer antes de apoyar en él tu trabajo. La columna vive bajo custodia del proveedor y en su formato. Tus sesiones, archivos e historial están en sus equipos, bajo su sistema de cuentas y con las formas que definió. No es siniestro. Sí es una dependencia: del plan que pagas, de la supervivencia del producto y de que las reglas del proveedor sigan siendo compatibles con las tuyas. El concepto 5 ofrece la disciplina para mantener segura esa dependencia. Por ahora conserva ambas ideas: es continuidad gratuita dentro de una casa ajena.
Cada sesión de Cowork se guarda en tu cuenta de claude.ai con los archivos producidos. Vuelve mañana desde cualquier dispositivo y el contexto, el plan y los archivos estarán donde los dejaste. La lista de sesiones funciona como registro de trabajo en esta interfaz.
Las sesiones de ChatGPT Work se sincronizan en la nube entre la web, el escritorio y el teléfono: comienza en el portátil, vuelve a abrirla en el teléfono y encontrarás la misma sesión, estado y archivos. Dos funciones amplían la columna. Projects agrupa chats, archivos e instrucciones relacionadas en un espacio persistente que comparte contexto entre sesiones, el hogar natural del trabajo recurrente (la idea de espacio persistente del concepto 6 ya incorporada). Y la memoria, donde está habilitada, conserva contexto relevante de chats anteriores mediante un resumen revisable y fuentes que puedes inspeccionar o corregir. La lista de sesiones, tus proyectos y la memoria son la columna. Los dispositivos son ventanas. Todo lo dicho por Cowork sobre la custodia se aplica aquí: la columna vive en los servidores de OpenAI y en su formato.
Tres hábitos pequeños hacen que la columna trabaje a tu favor. Nombra las sesiones como productos de trabajo, no como chats. «Informe de renovación de Acme. Ejecución de facturas de mayo» se encuentra dentro de tres meses; «Pregunta rápida» no. Un flujo de trabajo por sesión. Mezclar el informe del cliente y las vacaciones filtra contexto entre ambos, y Fundamentos ya mostró lo que hace el contexto obsoleto con la calidad. Elimina lo que ya no sirve. Una sesión larga lleva todo su historial a cada turno y el contexto sigue costando dinero igual que en el chat: menos contexto elegido a propósito supera a más contexto arrastrado por costumbre.
En el chat llevabas los papeles a casa cada tarde y los devolvías cada mañana. En la interfaz de agente tienes un escritorio con cajones: todo permanece donde lo dejaste y está disponible desde cualquier lugar. Es muy útil, pero recuerda que el escritorio está en el edificio del proveedor, no en el tuyo.
Comprueba tus conocimientos
Nombra el regalo y el precio de la columna vertebral de la cuenta, una frase para cada uno.
Mostrar respuesta
El regalo es continuidad que no tuviste que construir: sesiones y archivos que sobreviven a la pestaña, el día y el dispositivo. El precio es que vive bajo custodia del proveedor y en su formato, así que todo lo que existe solo allí depende de tu plan, su producto y sus reglas. El próximo concepto convierte ese precio en una disciplina práctica.
5. Los tres niveles de archivos: ¿dónde vive realmente el entregable?
Este es el concepto distintivo del curso. Imagina que cada archivo que toca tu agente vive en uno de tres niveles. Es un modelo, no una ley física, pero funciona en la práctica y convierte una pregunta difusa en otra precisa. Para cada entregable decides una cosa: ¿en qué nivel termina?
Nivel 1: el sistema de archivos de la tarea. Mientras trabaja una sesión remota, utiliza un espacio temporal en los servidores del proveedor para borradores, cálculos intermedios y archivos incompletos. Se limpia al terminar y las reglas exactas de retención dependen del proveedor, así que nunca lo trates como almacenamiento. El nivel 1 es transparente sobre su función. Nunca es el hogar de algo que necesitarás mañana.
Nivel 2: almacenamiento de la plataforma. Archivos guardados de forma permanente en tu cuenta de la plataforma. Sobreviven a la tarea, la pestaña y la semana. Es la columna vertebral del concepto 4 aplicada a archivos y constituye el destino natural: el trabajo termina aquí salvo que lo envíes a otro lugar. El nivel 2 es seguro, pero también está bajo custodia del proveedor, en su formato y detrás de su inicio de sesión.
Nivel 3: la salida. El archivo abandona la plataforma y llega a un lugar que tú controlas: se guarda mediante un conector en Drive, se envía por correo electrónico o Slack, se descarga al equipo, se escribe en una carpeta local o se confirma en un repositorio. Hay muchas puertas y no importa cuál uses. Importa el destino: el nivel 3 es el único donde el entregable entra en tu sistema de registro, el lugar donde tu empresa, cliente o yo futuro buscarán realmente.

La disciplina en una frase, la que debes memorizar del curso entero:
El trabajo terminado sale de la plataforma. Todo lo demás puede quedarse.
Lee los niveles como una escalera de riesgo y la frase se explica sola. Un entregable que solo existe en el nivel 1 ya está perdido: borrarlo no es un error, sino la definición del nivel. Uno que solo existe en el nivel 2 está seguro hoy y cautivo mañana: seguro porque persiste, cautivo porque persiste solo allí, bajo custodia ajena y accesible mediante un inicio de sesión ajeno. El entregable del nivel 3 es tuyo: está en el historial de Drive, la carpeta de asuntos de tu empresa o el repositorio, bajo tus reglas de retención, disponible para tus colegas y todavía allí si el producto cambia el próximo trimestre.
Una sesión web de Cowork trabaja en un sistema de archivos temporal (nivel 1), guarda resultados en tu cuenta junto a la sesión (nivel 2) y puede guardar o enviar archivos mediante servicios conectados como Drive, Gmail y Slack (nivel 3). La ruta al nivel 3 pasa por los conectores concedidos, por eso el próximo concepto trata su alcance con una seriedad nueva.
Los mismos tres niveles. El nivel 1 es el entorno aislado que utiliza una tarea Work durante la ejecución, con su propio sistema de archivos creado para ese trabajo. OpenAI gestiona la implementación exacta y no forma parte de la interfaz que controlas. El nivel 2 son los archivos terminados: documentos, hojas, presentaciones, paneles y Sites, guardados con la sesión sincronizada y Projects. El nivel 3 es la salida: el archivo abandona la plataforma y llega a un lugar bajo tu control. En el navegador, la salida automatizada principal es guardar mediante un conector de Plugin Directory en Drive, Gmail o Slack. La descarga es manual y un puente de escritorio puede añadir una escritura local. Un punto a favor de OpenAI: Sites publica una aplicación web o panel terminado en una URL compartible. Es útil, pero léelo mediante el concepto 5. Un Site alojado en la plataforma sigue siendo nivel 2 con puerta pública, no nivel 3 bajo tu custodia. Las reglas exactas de conservación y exportación tienen pocas semanas, así que compruébalas en la documentación actual. La estructura de tres niveles no cambiará y es lo que debes aprender.
Un ejemplo práctico. Ayesha ejecuta la facturación mensual de un cliente. Los números provisionales viven en el nivel 1: cálculos preliminares y un CSV temporal. Nacen y mueren allí, como corresponde; nadie audita papel de borrador. Reutilizará la plantilla de factura el próximo mes, por lo que la guarda en el nivel 2, vinculada a una sesión que reabrirá en 30 días. El PDF terminado va dos veces al nivel 3: se guarda en Drive de la empresa y se envía al cliente mediante el conector de correo. ¿Por qué dos veces y por qué al nivel 3? Porque algún día alguien preguntará «¿dónde está la factura de marzo?»: un auditor, un socio o Ayesha en noviembre. La respuesta debe ser en los registros de la empresa, no «en algún lugar de mi cuenta de Cowork». El sistema de registro pertenece a la empresa. Solo el nivel 3 llega a él.
Termina cada encargo que produzca un entregable con una instrucción y la decisión sobre el nivel se resolverá sola:
End by listing every file you created and where each one landed:
temporary working space, platform storage, or a system I control (connector save, download, local write, or repo commit).
La frase convierte una configuración invisible en una decisión visible, y el proyecto 2 te hace aplicarla a trabajo real.
Un papel puede estar en tres lugares. En el bloc de borradores del trabajador: se tira al final del día. En su cajón: seguro, pero en su escritorio, no el tuyo. En tu archivador: tuyo, bajo tus reglas y disponible para tu equipo. La regla es sencilla: todo lo terminado va a tu archivador. Los borradores pueden permanecer en el bloc o el cajón.
Para profundizar: esta disciplina tiene futuro
Dos cursos posteriores devolverán el concepto ya maduro. Ingeniería de bucles enseña la columna vertebral del estado, la memoria que conserva un bucle entre ejecuciones; decidir dónde vive esa memoria es exactamente elegir un nivel. Dejar atrás el portátil enseña la prueba de la maleta, qué viaja cuando cambias de hogar, cuya regla el repositorio contiene la verdad es el nivel 3 con ropa de ingeniería. El proyecto 6, el ejercicio de salida, es la versión para principiantes del ejercicio de hogar desaparecido. Aprende ahora la costumbre con facturas e informes; las versiones de ingeniería resultarán naturales después.
Comprueba tus conocimientos
Un abogado crea una nota comparativa en una sesión web y comparte con el cliente el enlace de la plataforma. Nombra los dos errores de detenerse allí.
Mostrar respuesta
Primero, la custodia: la nota solo existe en el nivel 2, fuera de la carpeta del asunto y del sistema de retención, por lo que el registro de la empresa tiene un vacío. Segundo, el acceso: el enlace comparte según las reglas de la plataforma, no las de la empresa, que no puede gobernar lo que no conserva. La solución es el nivel 3: guarda la nota en el sistema documental y compártela desde allí. El enlace era una ventana; el cliente recibió una ventana en lugar de un documento.
6. Conectores en la web: alcance y puerta de salida en uno
Conociste los conectores en Fundamentos: acceso limitado por permisos a un servicio real, como Drive, Gmail o Slack, mediante MCP. Tú otorgas los alcances y la IA trabaja dentro de ellos. La definición no cambia. Cambia el peso de un conector cuando lo sostiene un agente, no un chat.
En esta interfaz, los controles de confianza se reducen a dos palancas: alcance de los conectores y aprobaciones. Los agentes de escritorio añaden una tercera, las carpetas locales que pueden ver, y construyen una disciplina completa a su alrededor. Esa palanca no existe en una sesión solo de navegador porque no tiene un sistema local cuyo alcance pueda limitar. Su función se divide entre la decisión del nivel y los alcances concedidos.
Esto conduce al hecho que el concepto declara: los conectores tienen doble peso en la web. Siempre han sido el alcance del agente hacia tus servicios. En una sesión solo de navegador son también la principal puerta de salida automatizada para archivos: la ruta del nivel 3 pasa sobre todo por los conectores. La descarga es manual y un puente de escritorio puede añadir escritura local, pero para el trabajo sin intervención el conector es la puerta. La misma pantalla de permisos gobierna lo que puede leer el agente y dónde puede ir el trabajo terminado. La costumbre de Fundamentos se convierte en regla: lee los alcances antes de conectar y concede el más estrecho que complete la tarea.
Dos detalles que conviene conocer antes de la primera tarea real:
- El alcance de lectura no es el de envío. Conceder lectura al conector de correo permite resumir conversaciones. Escribir o enviar requiere otro permiso, mayor. Un mensaje enviado desde tu dirección no puede recuperarse y las personas actuarán sobre él. No supongas una configuración segura. Los conectores varían: algunos solo leen, otros crean borradores y otros pueden escribir o enviar según la aplicación, el plan y el espacio de trabajo. Inspecciona las acciones y permisos del conector específico. Exige aprobación para todo lo que tenga consecuencias y trata cualquier configuración que pueda enviar como una decisión independiente de mayor confianza.
- El contenido no confiable siempre exige el modo cuidadoso. Esta es la versión breve de una regla que el curso Cowork enseña completa. El texto escrito por otra persona puede contener instrucciones ocultas: un correo entrante, un PDF de un proveedor o una página desconocida. Para ti son frases normales; para el agente pueden parecer órdenes. Se llama inyección de indicaciones y es un ataque real. La defensa aquí es sencilla. Cuando una tarea toca contenido que no escribiste, mantén el modo de preguntar antes de actuar. Lee el plan en busca de pasos no solicitados. Si propone una acción de conector que no pediste, no la apruebes. Redirige o comienza de nuevo.
La disciplina para conceder permisos no cambia desde Fundamentos, pero conviene repetirla al aumentar el riesgo: conecta un servicio cuando un flujo específico lo necesite, no por si acaso. Cada conector es alcance y ahora también una puerta.
Un conector es una llave que entregas al trabajador. En esta interfaz abre dos cosas: las habitaciones donde puede buscar información y el buzón por el que salen tus documentos terminados. Una llave que abre más de lo necesario no es comodidad, sino riesgo elegido. Lee qué abre antes de entregarla.
Comprueba tus conocimientos
En el escritorio, las palancas de confianza son carpetas, conectores y aprobaciones. En la web son dos. ¿Qué ocurrió con la tercera y qué asumió su función?
Mostrar respuesta
La palanca de carpetas desapareció porque una sesión remota solo de navegador no tiene un sistema de archivos local cuyo alcance pueda limitar. (Un puente de escritorio puede ofrecer acceso local limitado mientras la aplicación está abierta, pero esa es la palanca del escritorio, no de la pestaña.) Heredaron su función la decisión del nivel, que gobierna dónde viven los archivos, y el alcance del conector, que determina qué puede alcanzar el agente y por dónde salen los archivos. Por eso los conectores tienen doble peso.
7. La puerta en tu bolsillo
Todos los productos de agentes del libro mantienen una promesa: las decisiones que necesitan a una persona llegan a una persona. El libro lo llama puerta humana. Esta interfaz no cambia la puerta, sino dónde te encuentra.
Con un agente de escritorio sueles estar ante la pantalla cuando aparece la tarjeta de aprobación: la puerta y tus ojos coinciden por accidente. Aquí esa coincidencia desaparece. El trabajo se ejecuta mientras almuerzas, estás en una reunión o duermes; esa es la finalidad, así que la aprobación no puede esperar en la pestaña. Llega a tu teléfono como notificación y tarjeta que puedes leer y resolver en 30 segundos desde cualquier lugar.
Entiende exactamente la función del teléfono porque dos errores son comunes. El teléfono es la puerta, no la mesa de trabajo. Desde allí revisas un plan, apruebas un paso, rediriges con una frase o detienes la tarea. No redactas el encargo ni revisas 40 páginas. El diseño corresponde a una pantalla grande. El teléfono evita que una sesión espere seis horas por una decisión de 10 segundos.
Ahora la advertencia que justifica el concepto, prestada de un curso posterior porque no puede esperar: la puerta no se movió; el timbre tuvo que hacerlo. Cuando trabajabas ante la pantalla, una escalada aparecía frente a tus ojos. Ahora el trabajo ocurre donde no miras. Una aprobación puede quedar sin verse, y una escalada invisible es una decisión retrasada, a veces una decisión por omisión. Una sesión detenida tres días ante una aprobación que nunca viste no falló con ruido. Falló en silencio, algo peor.
La costumbre es obligatoria antes de confiar en cualquier trabajo sin supervisión: haz sonar la puerta a propósito una vez. Diseña una tarea pequeña que requiera una aprobación, por ejemplo guardar un archivo de prueba inofensivo en una carpeta de prueba conectada. Iníciala y aléjate del equipo. Confirma que la notificación llega al teléfono, con la aplicación instalada, las notificaciones activadas y sin que un modo de concentración las bloquee. Resuelve la aprobación desde el teléfono. Una alarma que nunca escuchaste es un rumor. El proyecto 3 te guía.
Las aprobaciones de una sesión remota de Cowork llegan a la aplicación Claude del teléfono. Antes de la primera tarea sin supervisión: instala la aplicación, inicia sesión con la misma cuenta y activa las notificaciones. Después ejecuta una vez de principio a fin la prueba deliberada de aprobación.
OpenAI construyó directamente la puerta móvil. La aplicación ChatGPT te mantiene conectado al trabajo en ejecución. Puedes responder preguntas, revisar resultados y aprobar acciones importantes lejos del escritorio. OpenAI describe Work como un sistema que divide un objetivo en pasos mientras observas, respondes, cambias de dirección y apruebas acciones. La puerta llega al teléfono por diseño. Realiza la misma comprobación previa: aplicación instalada, misma cuenta y notificaciones activadas. Ejecuta la prueba deliberada una vez antes de confiar en algo no observado. (Parte de la documentación móvil más detallada trata del trabajo de Codex en un Mac anfitrión. Confirma el comportamiento exacto de Work en las páginas actuales, aunque la puerta móvil es una idea de primera fuente.)
El trabajador continúa mientras estás lejos y a veces debe hacerte una pregunta. En esta interfaz llega al teléfono. Dos reglas: responde desde el teléfono, pero diseña de verdad en el escritorio. Antes de confiar en el acuerdo, haz que formule una pregunta a propósito y comprueba que llega. Un timbre que nunca has oído puede estar roto sin que lo sepas.
Comprueba tus conocimientos
Tu informe programado del lunes no ha producido nada en dos semanas. Nunca recibiste un error. ¿Qué compruebas primero y qué después?
Mostrar respuesta
Primero, si la puerta te alcanza: ¿hay una sesión detenida ante una aprobación que nunca llegó al teléfono? La entrega silenciosa fallida produce exactamente este síntoma: sin resultado ni error. Segundo, si la tarea llegó a ejecutarse, porque el uso medido y los límites del plan (concepto 9) pueden detenerla o exigir intervención al agotar el presupuesto. No confíes en recibir un error. Ambos controles comparten algo: el silencio es ambiguo hasta que haces que signifique algo. Esta idea regresa con consecuencias de ingeniería en Dejar atrás el portátil.
Parte 3: Trabajo sin supervisión
Ya conoces la interfaz. Ahora aprenderás la habilidad que la vuelve útil: delegar trabajo que no observarás. Esta parte enseña el bucle de delegación, los cuatro pasos que todos los cursos posteriores suponen conocidos. Después aborda la capacidad para la que se construyó la interfaz: trabajo que comienza según un reloj sin dispositivos conectados.
8. El bucle de delegación: encargo, plan, aprobación y revisión
Esta es tu primera lección de delegación en el libro y quizá la primera de tu vida. En Fundamentos todo era conversación: preguntabas, leías, volvías a preguntar y no ocurría nada sin que lo observaras. Delegar es diferente. Describes un resultado, el agente realiza trabajo de varios pasos y ves el producto. La calidad se decide casi por completo en cuatro momentos, y solo uno es la indicación.
Paso 1: encargo. Describe la tarea como lo harías para un colega nuevo, inteligente y motivado que desconoce tu contexto: resultado, restricciones, público y razón. Es la disciplina del curso 2 de Fundamentos con más riesgo, porque el modelo ya no solo responde según los vacíos del encargo: actúa según ellos.
La diferencia en un par:
- Una consulta: «Resume este PDF».
- Una asignación: «Lee estos tres archivos. Señala cada plazo y compromiso pendiente. Produce un informe de una página para mi gerente: tono directo, plazos primero y sin introducción».
La consulta funciona en el chat. La asignación es para esta interfaz. Contiene lo que la consulta omite: qué producir, de qué fuentes, para quién, con qué forma y reglas. Cada punto sería una decisión que el agente tomaría por ti en silencio, a mitad de la tarea y sin que lo observaras.
Paso 2: plan. Termina cada encargo no trivial con una línea:
Lay out your plan first, and pause for my approval before doing anything.
La línea importa más aquí que en cualquier otra interfaz. Con un agente de escritorio a menudo observas el trabajo e interrumpes a mitad de un paso. Aquí te marcharás; esa es la finalidad. Por tanto, el plan suele ser tu único punto de intervención entre la intención y el trabajo terminado. Si lo omites, detectarás el error demasiado tarde, después de que haya recorrido todos los archivos.
Paso 3: aprobar o redirigir. Lee el plan antes de aprobarlo. Hay cuatro cosas que comprobar, y solo llevan dos minutos:
- Alcance: ¿toca únicamente lo que nombraste o el trabajo ha crecido sin que nadie lo diga?
- Orden: ¿alguna acción ocurre antes de que otra cosa la verifique?
- Acceso: ¿propone un conector o un envío que no pediste? (Si es así y la tarea incluye contenido escrito por otra persona, detente y vuelve a leer el Concepto 6.)
- Suposiciones: ¿qué da por hecho sobre el formato, la audiencia o las reglas que nunca indicaste?
Si algo está mal, no empieces de nuevo. Redirígelo con una frase: «En el paso 2, usa los encabezados de la plantilla existente en lugar de inventar otros». El agente reescribe el plan y vuelve a preguntar. Una corrección de una frase durante la planificación no cuesta nada. Limpiar una ejecución equivocada llevada a cabo con seguridad consume una tarde.
Paso 4: revisar. El entregable llega mientras estás en otra parte, así que incorpora la revisión al propio encargo. Añade estas líneas al final de cada asignación que produzca un entregable:
Before you start: ask me 1–2 clarifying questions.
If any sources contradict each other on a material point, flag the
contradiction in the deliverable. Do not silently pick one.
When done: list every file you created and where each one landed —
temporary working space, platform storage, or a system I control (connector save, download, local write, or repo commit).
La primera línea revela la suposición que habría terminado convertida en un defecto. La segunda existe porque el entrenamiento de un modelo lo empuja a suavizar los conflictos hasta producir respuestas seguras y, para un abogado o un contable, elegir en silencio una de dos fuentes contradictorias es el fallo que más importa. La tercera automatiza la disciplina de niveles del Concepto 5. Después, cuando leas el resultado: si está bien en un 90 %, edita la última frase a mano. Si hay algo estructural que no encaja, dile al agente qué está mal y pide una revisión. Iterar con el agente le enseña tus preferencias. Reescribir a mano no le enseña nada.

Ejecuta ahora tu primera asignación (diez minutos, sin conectar nada). Toma cualquier material real y desordenado que tengas: notas de una reunión, un plan de proyecto o tres correos relacionados pegados en archivos. Abre la interfaz de agente, adjúntalos o pégalos y envía una asignación completa de cuatro pasos: un resultado con restricciones y audiencia, la línea que pide primero el plan y las tres líneas de revisión. Lee el plan. Redirige una cosa a propósito, aunque sea pequeña, para experimentar cómo funciona. Aprueba. Aléjate durante el tiempo que tardas en tomar un té. Vuelve y compara el entregable con tu encargo. Esa única ejecución te enseña más que el resto de este concepto y es exactamente el bucle que repetirás, sin cambios, en todos los cursos posteriores.
El antipatrón, por su nombre. El fallo más habitual en esta interfaz es tratarla como un cuadro de chat con superpoderes: lanzar una instrucción de una línea a un trabajo desatendido de varios pasos. La cuenta es implacable: cuanto más impreciso sea el encargo, más decisiones tomará el agente en solitario. Cuanto más dure la ejecución sin supervisión, más se acumularán esas decisiones antes de que veas alguna. Una consulta imprecisa en un chat desperdicia una respuesta. Una asignación imprecisa en esta interfaz desperdicia una tarde tuya en tareas de limpieza.
Cuatro pasos, siempre. Di por completo lo que quieres: el resultado, las reglas y el lector. Pide ver el plan antes de que empiece cualquier trabajo. Lee el plan y corrígelo con una frase si está mal. Después compara el resultado con lo que pediste. El plan es el paso importante. Corregir un plan lleva un minuto. Corregir un trabajo equivocado ya terminado consume una tarde.
Para profundizar: este bucle es toda la sección en miniatura
Cada curso que encontrarás más adelante profundiza en uno de los pasos de este bucle. El curso de Cowork profundiza en los pasos 2 y 3 para el trabajo de escritorio: tarjetas de aprobación por paso, vista de ejecución y modelo de confianza completo. Desarrollo guiado por especificaciones profundiza en el paso 1 hasta que un encargo se convierte en una especificación lo bastante precisa para comprobar el trabajo. Ingeniería de bucles automatiza el paso 3: un agente verificador lee el trabajo para que tú no tengas que leer cada ejecución. Confiar en el verificador profundiza en el paso 4 hasta convertir la revisión en medición. Nada de lo que aprendas después sustituye este bucle. Todo perfecciona uno de sus pasos.
Comprueba lo que has aprendido
Presentas un encargo con varias fuentes, omites la línea que pide primero el plan y te marchas a una reunión. Cuando vuelves, encuentras un entregable terminado que se basa en una interpretación equivocada de una fuente. Con un agente de escritorio quizá lo habrías detectado durante la ejecución. ¿Por qué esa red de seguridad nunca estuvo disponible aquí y qué única línea la sustituye?
Mostrar respuesta
La red eran tus ojos sobre la pantalla, y en esta interfaz nunca iban a estar ahí porque trabajar sin supervisión es precisamente la finalidad. No tienes un punto de intervención durante la ejecución, así que el único que queda está antes de ella: «Lay out your plan first, and pause for my approval». En esta interfaz, esa línea no es solo una buena práctica. Es la red de seguridad.
9. Tareas programadas sin ningún dispositivo conectado
Hasta ahora todo seguía empezando cuando tú pulsabas el botón de inicio. Este concepto también elimina ese paso y presenta la capacidad que hizo que julio de 2026 mereciera un curso.
Una tarea programada es una asignación que describes una vez, con una frecuencia, y que después se ejecuta según su propio reloj en los servidores del proveedor: con el portátil cerrado, el teléfono en el bolsillo y sin ninguno de tus dispositivos conectado. Cada lunes a las 8, el informe de la semana te espera antes de que te sientes. Esa es la promesa y, en esta interfaz, es real. Lo que este concepto añade es la disciplina necesaria para impedir que se convierta poco a poco en un desastre.
Cada tarea programada consta de cuatro respuestas. Escríbelas antes de crearla y en este orden:
- ¿Qué debe hacer? El encargo permanente. Todo lo que enseñó el Concepto 8, con una adición: no habrá nadie para aclarar dudas, así que el encargo debe funcionar en tu ausencia, incluido el caso vacío. «Si esta semana no hay elementos nuevos, produce una nota de una línea que lo indique» marca la diferencia entre una semana tranquila y un fallo silencioso que no puedes distinguir.
- ¿Qué puede tocar? Los archivos y el almacenamiento de la plataforma que están dentro del alcance, por nombre. Una tarea programada con un alcance impreciso se amplía cada semana y nadie observa cómo lo hace.
- ¿Hasta dónde puede llegar? Los conectores, enumerados. Los conectores son permisos, no sugerencias: una tarea sin conector de correo no puede enviar mensajes por mucho que lo pida el encargo, y eso es una ventaja. Concédele el acceso más limitado que necesite su trabajo, tal como enseñó el Concepto 6, y nada más, porque ese permiso se usará sin supervisión, según un horario y de manera indefinida.
- ¿Cuándo empieza? La frecuencia. Y un hecho sincero sobre todos los programadores de tareas que han existido: «el lunes a las 8» significa aproximadamente el lunes a las 8. Los programadores escalonan las ejecuciones y, en ocasiones, se retrasan. Si el resultado está sujeto a un plazo estricto, la programación por sí sola no es una garantía, un tema que Dejar el portátil trata como corresponde.

Tres reglas antes de tu primera programación, cada una aprendida por otra persona de la forma más difícil:
- Nunca programes algo que todavía no confiarías en dejar trabajando solo. La programación es el último peldaño de una escalera, no el primero. Ejecuta la tarea a mano y bajo supervisión al menos unas cuantas veces. Después ejecútala otras veces sin observarla. Solo lo que ha superado la prueba de trabajar solo merece un horario. Programar una tarea que has ejecutado una vez no es automatización. Es una sorpresa semanal a la que te has suscrito.
- Calcula por escrito el uso medido. El trabajo desatendido en servidores ajenos siempre tiene un presupuesto: ejecuciones al día u horas por plan, distribuidas por nivel y diferentes para cada empresa. Compara tus tareas programadas con el límite de tu plan antes de que coincidan en la misma semana. Cuando se alcanzan los límites de uso o de tareas, una tarea puede ponerse en pausa, no ejecutarse o necesitar tu intervención. No confíes en la ausencia de un mensaje de error. Comprueba la página de tareas programadas y tus notificaciones. Este es el fallo del que advirtió el Concepto 7: el silencio no significa nada hasta que tú le hayas dado un significado.
- Una ejecución terminada no equivale a una tarea lograda. El trabajo del programador termina cuando «se ejecutó». Determinar si el trabajo está bien no le corresponde. Por tanto, incorpora la señal de éxito al resultado de la propia tarea: el encargo debe terminar con una línea indicada, la cantidad de elementos procesados, los archivos producidos y sus niveles o la nota explícita para el caso vacío, y tú debes buscar esa línea. Verde significa «se ejecutó». Solo la línea significa «funcionó».
Las tareas programadas de Cowork se describen en lenguaje natural con una frecuencia y, en la web, se ejecutan de forma remota: se activan sin que ninguno de tus dispositivos esté conectado y los resultados te esperan en la sesión. Los límites de acceso y ejecución se distribuyen y miden según el plan; haz los cálculos usando los límites vigentes de tu plan, no algo impreso aquí. Conviene conocer pronto una salvedad que es justo lo contrario de una limitación: las tareas programadas de Cowork se ejecutan de forma remota incluso cuando tu equipo está suspendido o la aplicación de escritorio está cerrada. Funcionan con tus conectores, complementos y archivos guardados en tu cuenta de Claude, pero no se pueden vincular a una carpeta de tu equipo. Por tanto, si un flujo de trabajo recurrente depende de archivos locales o aplicaciones de escritorio, necesita una configuración diferente que dependa del escritorio. Mantén el trabajo programado en los conectores y el almacenamiento de la cuenta, y la promesa se cumple.
Las Tareas programadas de ChatGPT Work cubren los cuatro latidos que acabas de aprender, según las propias palabras de OpenAI: realizar una acción una vez, repetirla según un horario o cuando ocurre un acontecimiento, o supervisar cambios con el paso del tiempo. (En esta interfaz web, los desencadenantes basados en acontecimientos, como «aparece un archivo nuevo», se gestionan mediante supervisión periódica, no con una notificación instantánea, así que trata «desencadenante» y «supervisión» como una sola familia.) Sus ejemplos de lanzamiento incluyen ambos tipos. Algunos informan: comprueban paneles cada mañana y resumen qué ha cambiado. Otros actúan: actualizan una presentación cuando llegan comentarios nuevos o convierten temas recurrentes de esos comentarios en ideas de producto priorizadas. Por tanto, el producto hace algo más que informar. Aun así, este curso para principiantes se detiene deliberadamente en la línea del informe. Las programaciones que actúan tienen un radio de impacto mayor (pueden fallar más cosas y llegar más lejos) y deben esperar hasta que aprendas diseño de verificadores, estado, idempotencia y recuperación en cursos posteriores. Esa es una regla elegida por este curso, no una limitación del producto. Las cuatro respuestas (qué, tocar, llegar, cuándo) y las tres reglas se aplican aquí sin cambios. Las tareas se ejecutan en la nube sobre tu cuenta. El acceso se concede mediante el Directorio de complementos. El uso consume la asignación de agentes de tu plan, por lo que el cálculo del uso medido también es real aquí. Confirma la asignación actual en las páginas vigentes.
Una salvedad firme: una Tarea programada creada dentro de un Proyecto que contiene archivos subidos no puede acceder a esos archivos del Proyecto. Por tanto, usa un conector compatible u otra fuente a la que pueda llegar la tarea y no diseñes el flujo de trabajo programado alrededor de archivos subidos al Proyecto. Este es el Concepto 3 en la práctica: la misma forma de seis partes, con los botones de otra empresa.
Y el límite, expresado con franqueza. Lo que puedes construir solo con este concepto es una programación que informa: lee fuentes, sintetiza, produce un informe y lo deposita en el nivel correcto. Es realmente valioso, exactamente el primer año de valor de la mayoría de las personas en esta interfaz, y constituye deliberadamente el techo de este curso. Lo que todavía no puedes construir de forma segura es una programación que actúa: una que envía, archiva, actualiza y decide según un horario. Actuar sin supervisión requiere componentes que aún no tienes: un verificador que evalúe el trabajo, una condición de parada que una máquina pueda comprobar y un archivo de estado que recuerde entre ejecuciones. Ingeniería de bucles te enseña a diseñarlos todos y Dejar el portátil te enseña dónde debe residir el resultado probado. Este concepto abrió la puerta. Esos cursos son los que la atraviesan.
Una tarea programada es una instrucción permanente: el trabajador realiza el trabajo cada lunes sin que se lo pidas, incluso cuando tu portátil está apagado. Anota cuatro cosas: el trabajo, qué puede tocar, hasta dónde puede llegar y cuándo se ejecuta. Tres reglas: programa solo trabajos que el trabajador ya haya hecho bien mientras estabas ausente. Calcula el presupuesto de tu plan antes de alcanzar el límite y comprueba la página de tareas programadas en lugar de confiar en el silencio. Además, haz que el trabajo informe de su propio resultado, porque «se ejecutó» y «funcionó» son hechos diferentes.
Comprueba lo que has aprendido
Ayesha quiere programar dos cosas: un resumen de las facturas impagadas de sus clientes cada lunes por la mañana (leído desde Drive y guardado como informe en su cuenta) y una tarea automática los viernes que envíe por correo recordatorios de pago a cada cliente moroso. ¿Cuál pertenece a este curso, cuál debe esperar y qué palabra distingue a las dos?
Mostrar respuesta
El resumen del lunes pertenece aquí: es una programación que informa, lee, sintetiza y deposita el resultado en un nivel, y una semana equivocada solo le cuesta reescribirlo. Los recordatorios del viernes deben esperar: esa tarea actúa sobre el mundo exterior, sin supervisión y según un horario; una ejecución equivocada envía mensajes a clientes reales y nada de este curso comprueba el trabajo antes de que salga. La diferencia en una palabra: actuar (frente a informar). Las programaciones que informan son el techo de este curso. Las que actúan necesitan el verificador, la condición de parada y el estado que enseña Ingeniería de bucles e, incluso entonces, el correo recordatorio es exactamente aquello para lo que existe la puerta humana.
Parte 4: Elegir y el camino abierto
Ahora puedes dirigir a un agente en esta interfaz, depositar sus archivos en el nivel correcto y poner una tarea de informes en un horario. Quedan tres preguntas, las verdaderamente sinceras. ¿Cuándo es esta interfaz una elección equivocada? ¿Cómo es el camino del código abierto, sin ninguna nube de proveedor? ¿Y qué es lo que esta interfaz nunca podrá hacer por ti, por mucho que mejoren los productos? Esta parte responde las tres y después te entrega al resto de la sección.
10. Web, escritorio o terminal: elige según lo que toque el trabajo
La interfaz que acabas de aprender es una opción entre varias, y el hábito maduro consiste en elegir para cada tarea, no en jurar fidelidad a una sola. La regla que ordena todos los casos es breve: elige según lo que toque el trabajo.
| El trabajo necesita... | La interfaz | Dónde lo enseña este libro |
|---|---|---|
| Trabajo con conectores y documentos, continuidad entre dispositivos, nada instalado | Web | Este curso |
| Trabajo que debe continuar con tu equipo apagado | Web (para el trabajo con repositorios, una Rutina en la nube, un tema posterior) | Este curso; Ingeniería de bucles |
| Tus archivos locales, tus aplicaciones de escritorio, el navegador donde has iniciado sesión | Escritorio | Cowork y OpenWork, el siguiente para profesionales del conocimiento |
| Código, repositorios, la línea de comandos | Agentes de programación | Programación agéntica, el siguiente para ingenieros |
| Datos regulados con requisitos de custodia (información médica protegida, asuntos sujetos a privilegio o datos financieros regulados) | Ninguna de las anteriores, todavía. Obtén primero la respuesta del equipo de cumplimiento por escrito | El curso de Cowork contiene toda la orientación sobre cargas de trabajo reguladas |

Lee la tabla dos veces porque cumple dos funciones. Como enrutador de tareas, responde la pregunta de hoy: este informe, esta interfaz. Como enrutador de cursos, responde la pregunta de la sección: qué curso sobre compañeros de trabajo debes tomar después. Los profesionales del conocimiento cuya jornada transcurre entre documentos y conectores continúan con el curso de Cowork, que añade todo aquello a lo que la web no puede acceder. Los ingenieros continúan con Programación agéntica. Nadie tiene que abandonar esta interfaz: una configuración saludable mezcla permanentemente distintas interfaces según la tarea.
Una fila merece su propio párrafo porque concentra el mayor riesgo: los datos regulados. Recuerda lo que enseñó el Concepto 5: los niveles 1 y 2 están bajo la custodia del proveedor por definición. Los archivos de trabajo de una sesión remota y el almacenamiento de tu plataforma residen en las máquinas del proveedor. Eso es lo que hace funcionar esta interfaz. También es justo lo que preocupa a un régimen de cumplimiento. Por tanto, para información médica protegida, documentos sujetos al privilegio de un cliente o datos financieros regulados, la pregunta no es «¿tiene cuidado esta interfaz?». La pregunta real es «¿se permite que estos datos residan bajo esta custodia, con este plan y esta documentación?». Solo tu equipo de cumplimiento puede responderla, y debe hacerlo por escrito. El curso de Cowork ofrece el tratamiento completo. Hasta que tengas esa respuesta escrita, los datos regulados no deben tocar esta interfaz.
Y una regla impide que la mezcla de interfaces se convierta en un desastre, y ya la conoces: saber en qué nivel ha quedado cada entregable. A un entregable del nivel 3, tu Drive, tu repositorio o los registros de tu empresa, no le importa qué interfaz lo produjo. Esa es precisamente la finalidad del nivel 3.
Trabajos diferentes, lugares de trabajo diferentes. Para documentos y servicios conectados, o para trabajo que debe ejecutarse con tu equipo apagado: la web. Para tus propios archivos y programas de escritorio: las aplicaciones de escritorio, en el próximo curso. Para el código: los agentes de programación. Para datos regulados sensibles: detente y obtén primero una aprobación escrita del equipo de cumplimiento. Usa varios lugares de trabajo a la vez, pero asegúrate de que cada documento terminado acabe en tu propio archivador, sin importar qué lugar de trabajo lo haya producido.
Comprueba lo que has aprendido
Tres tareas llegan a tu escritorio: (a) un resumen semanal elaborado a partir de Slack y Notion que necesitas incluso mientras viajas; (b) ordenar 200 archivos de una carpeta de tu portátil; (c) un memorando que sintetiza documentos confidenciales de un cliente. Asigna una interfaz a cada una y nombra el hecho decisivo.
Mostrar respuesta
(a) Web: solo toca conectores y debe funcionar con tu equipo apagado; ambos hechos apuntan en la misma dirección. (b) Escritorio: el trabajo toca tu sistema de archivos local, al que una sesión remota disponible únicamente en el navegador no puede acceder directamente por sí sola. Este es el curso de Cowork. (c) Ninguna, todavía: los asuntos sujetos a privilegio plantean una cuestión de custodia, y los niveles 1 y 2 están bajo la custodia del proveedor por definición; el equipo de cumplimiento debe responder por escrito antes de que ninguna interfaz vea esos datos. Tres tareas, tres respuestas y una regla: lo que toca el trabajo decide.
11. El camino abierto: sin nube de proveedor
Primero, una confesión sobre la estructura de este curso; después, la franqueza que exige.
Cada curso sobre compañeros de trabajo de este libro empareja una herramienta comercial con su gemela de código abierto: Claude Code con OpenCode, Cowork con OpenWork. Este curso rompió ese patrón. Sus pestañas emparejan dos productos cerrados: Cowork en la web y ChatGPT Work. Fue intencional. Dos rivales lanzaron la misma forma con pocos días de diferencia. Uno lo hizo como sesión remota y el otro como un modo dentro de su aplicación de chat. Esa es la evidencia que respalda la tesis de este libro y necesitabas verla lado a lado. Pero un patrón roto en silencio se convierte en sesgo. Por tanto, esta es la pregunta a la que habría respondido la pestaña de código abierto que falta: ¿puedes disponer de esta interfaz sin ninguna nube de proveedor?
Sí, con trabajo. Hoy existen dos caminos abiertos. Algunas de sus palabras (self-hosted, cron, GitHub Actions) pertenecen al vocabulario del ingeniero; todavía no necesitas entenderlas, solo saber que estos caminos existen.
OpenWork, espacios de trabajo remotos y compartidos. OpenWork es el compañero de escritorio de código abierto que conocerás debidamente en el curso siguiente. Puede conectarse con un trabajador que se ejecute en otro lugar, no en tu portátil. Puede ser un trabajador de OpenWork alojado por ti al que accedes mediante una URL y un token de acceso. También puede tratarse de los trabajadores compartidos en la nube de tu organización, conectados en un solo paso. Esta es la idea central del curso: la máquina que realiza el trabajo no es la máquina que estás mirando. Sin embargo, aquí se ejecuta en una infraestructura que controláis tú o tu organización. La ventana es tuya. El edificio también.
OpenCode, con un programador que controlas. Para el trabajo vinculado a repositorios, la respuesta abierta al Concepto 9 es un agente de programación activado por tu propio reloj: cron en una máquina que administras o una tarea programada de GitHub Actions. Sin nube de proveedor, niveles de plan ni despliegue escalonado. El patrón completo corresponde a Ingeniería de bucles. Por ahora, basta con saber que existe y no tiene nada de exótico.
Ahora, el intercambio, expresado una sola vez y con claridad. Es el mismo intercambio al que se reduce cada elección entre abierto y gestionado en este libro. Las empresas te venden una columna vertebral. El camino abierto te obliga a construirla. En la interfaz del proveedor recibes todo listo y en funcionamiento desde el primer día: sesiones, archivos, sincronización, puerta del teléfono y programador. Sin embargo, vive bajo su custodia, en su formato, a su precio y según sus reglas. En el camino abierto, debes configurar, ejecutar y reparar cada una de esas piezas. A cambio obtienes las dos cosas que ningún proveedor vende. Primero, custodia: tus datos en máquinas que controlas. Segundo, elección: qué modelo ve tus instrucciones y la libertad de cambiarlo. Ningún lado del intercambio es el noble. La fila sobre datos regulados del Concepto 10 es un caso en el que la custodia gana de forma absoluta. Un consultor independiente que debe entregar informes el viernes es un caso en el que la columna vertebral funcional gana con la misma claridad. La mayoría de los lectores conservarán ambas respuestas a la vez, una para cada tarea. A estas alturas debería resultarte familiar.
La interfaz del proveedor es una oficina amueblada: escritorio, cajones y timbre, todo en funcionamiento desde el primer día, dentro de su edificio. El camino abierto es una habitación vacía que amueblas por tu cuenta: más trabajo, pero tu edificio, tus reglas y tu elección sobre quién ve cada cosa. Ninguna opción es simplemente mejor. El trabajo sensible suele necesitar tu edificio. El trabajo rápido suele necesitar la oficina amueblada. Puedes alquilar una y poseer otra al mismo tiempo.
Comprueba lo que has aprendido
Una ONG te pide que configures una automatización semanal de informes de donantes. Su política de datos prohíbe que los registros de donantes estén en plataformas comerciales de consumo de terceros, pero el equipo no cuenta con ningún ingeniero. ¿Qué camino impone la política, qué pierde el equipo y qué frase sincera debes decir antes de que se comprometan?
Mostrar respuesta
La política impone el camino abierto: los registros de donantes no pueden residir en los niveles 1 y 2 de la plataforma comercial de un proveedor, y esos niveles son los cimientos de su interfaz. Lo que pierden es la columna vertebral gratuita, la sincronización, la puerta del teléfono y el programador gestionado, que alguien tendrá que construir y mantener en funcionamiento. La frase sincera: «Este camino cambia una cuota de suscripción por un operador. Alguien de aquí debe hacerse cargo de la configuración, las actualizaciones y la mañana en que deje de funcionar. Y, sin un ingeniero en plantilla, ese coste, no el software, es la verdadera decisión». La custodia no es gratuita. Se paga con operaciones.
12. Lo que esta interfaz no puede hacer y hacia dónde conduce
Termina el curso en el límite sincero, como terminan todos los cursos de este libro.
La interfaz no mejora el trabajo. Una sesión remota hace que un encargo deficiente quede desatendido, no que mejore. Todas las palancas de calidad que has conocido están de tu lado de la pantalla: el encargo (Concepto 8), la revisión del plan (tu único punto de intervención), la decisión del nivel (Concepto 5), la prueba deliberada de la puerta (Concepto 7) y la regla de probar caminando antes de programar (Concepto 9). Julio de 2026 trasladó el agente al navegador. No trasladó ninguna de tus responsabilidades.
La interfaz tiene pocas semanas, usa medición, se despliega por etapas y adopta la forma del proveedor. Cada dato mecánico de esta página, niveles de plan, límites de ejecución, nombres de botones e incluso nombres de productos, es el material que más rápido envejece en este libro. Debes marcharte con la capa duradera: la prueba de dejar de escribir, la arquitectura de ventana y no entorno de ejecución, los tres niveles y su disciplina de una línea, la lente de lectura de seis partes, el bucle de cuatro pasos y las cuatro respuestas de una programación. Todo eso sobrevive a cada cambio de nombre. Y una disciplina te protege de todos los cambios a la vez, así que escúchala una última vez: nada importante reside únicamente en la plataforma. Siempre el nivel 3 para cualquier cosa que no quieras perder.
Y esta interfaz es un comienzo, no un destino. Esta es la sección que ya estás preparado para recorrer y lo que cada curso añade a lo que acabas de aprender:
- Cowork y OpenWork, el siguiente para profesionales del conocimiento, extiende tu bucle de delegación a tus archivos reales y al escritorio, con el modelo de confianza completo que la web no necesitaba: carpetas como palanca, escala de autonomía y disciplina de cargas de trabajo reguladas.
- Programación agéntica, el siguiente para ingenieros, presenta el mismo bucle en el terminal y aplicado al código.
- Desarrollo guiado por especificaciones perfecciona tu paso 1 hasta convertir un encargo en una especificación lo bastante precisa para comprobar el trabajo, y también se ejecuta en esta interfaz.
- Ingeniería de bucles construye lo que el Concepto 9 dejó fuera: programaciones que actúan, con el verificador, la condición de parada y la columna vertebral del estado que permiten actuar con seguridad.
- Ingeniería de arneses y Confiar en el verificador hacen que el bucle sea seguro y después medible.
- Dejar el portátil cierra la sección con la decisión sobre el entorno de ejecución, dónde debe residir el trabajo probado, y la interfaz que acabas de aprender es una de las puertas principales de sus hogares.
La reflexión final, que resume el curso en tres frases. El cuadro de chat es donde diseñas. La interfaz de agente es donde se ejecuta. En julio de 2026 ambas se trasladaron a la misma dirección y la división del trabajo se hizo más nítida, no más débil. Aprende la forma. La dirección volverá a cambiar.
Esta interfaz cambia dónde y cuándo se ejecuta el trabajo. No cambia su calidad: eso todavía depende de tu encargo, la revisión del plan y tus comprobaciones. Los productos de esta página cambiarán de nombre y de límites muchas veces. Sus ideas no lo harán. Conserva el trabajo terminado en tu propio almacenamiento y lleva las ideas al siguiente curso.
Comprueba lo que has aprendido
Un lector termina este curso y dice: «Ahora que los agentes se ejecutan en la web, los cursos sobre escritorio y terminal son un legado del pasado». Aplica la regla del Concepto 10 y el límite de este concepto para escribir una corrección de dos frases.
Mostrar respuesta
Las interfaces se dividen según lo que toca el trabajo, no según cuál fue la última en lanzarse. Los archivos locales, las aplicaciones de escritorio y los repositorios son trabajo real al que una sesión remota disponible únicamente en el navegador no puede acceder directamente por sí sola. Por tanto, los cursos sobre escritorio y terminal enseñan un territorio que esta interfaz no cubre. Además, ninguna interfaz, nueva o antigua, mejora el trabajo en sí: la habilidad está en el encargo, la revisión del plan y las comprobaciones, y el resto de la sección es donde esa habilidad adquiere profundidad.
Dónde usa este libro esta interfaz (uso interno)
La respuesta sincera, a mediados de julio de 2026, es que los propios bucles desatendidos de este libro no se ejecutan en esta interfaz, y la razón es que el Concepto 10 cumple su cometido. El libro es un repositorio, sus bucles están vinculados a él y su puerta de revisión reside junto a la puerta de integración en CI, exactamente como explica la sección de uso interno de Dejar el portátil. Lo que toca el trabajo, un repositorio, lo dirigió a otra interfaz.
Esta interfaz sí se gana su lugar en la producción del libro de dos maneras. Primero, el trabajo de diseño en el chat antes de cada bucle: redactar encargos, probar instrucciones de revisión y ejecutar un latido a mano. Segundo, las tareas con conectores y documentos alrededor del libro. Ese segundo tipo es el trabajo de informes que el Concepto 9 definió como el techo de este curso. Esta división no es una concesión. Es la división del trabajo que enseñó el curso: diseña en el cuadro de chat y ejecuta en la interfaz que toca el trabajo. Ahora mismo estás leyendo el resultado de esa organización.
🚀 Proyectos
Seis proyectos, de fácil a difícil. Usa trabajo real pero de bajo riesgo, como notas, planes y borradores, y nunca datos regulados (la regla del Concepto 10 también se aplica a la práctica).
📱 Proyecto 1 · 15 min · La prueba de la tapa cerrada. Dificultad: fácil · Usa: Concepto 2. Hazlo. Inicia una sesión pequeña de varios pasos (resume tres documentos pegados en un solo informe). Durante la ejecución, cierra la pestaña. Vuelve a abrir la sesión desde tu teléfono. Terminas cuando hayas observado que la misma sesión continúa en un segundo dispositivo y puedas decir en una frase dónde está realmente el entorno de ejecución.
🗂️ Proyecto 2 · 30 min · La auditoría de los tres niveles. Dificultad: fácil · Usa: Conceptos 5 y 8. Hazlo. Ejecuta una tarea real que produzca un entregable. Usa el encargo completo del Concepto 8, incluida la línea final que enumera cada archivo y su nivel. Terminas cuando puedas nombrar el nivel de cada archivo que creó la tarea y el propio entregable exista en el nivel 3: tu Drive, tu bandeja de entrada o tus registros, no solo en la plataforma.
🔔 Proyecto 3 · 20 min · Haz sonar la puerta a propósito. Dificultad: fácil-media · Usa: Concepto 7. Hazlo. Diseña una tarea que requiera una aprobación y después aléjate por completo del equipo. El comportamiento de aprobación varía según el producto, el conector y el espacio de trabajo, así que usa un desencadenante seguro y de bajo riesgo: pide al agente que guarde un archivo de prueba inofensivo en una carpeta de prueba conectada o que prepare un borrador de una acción que necesite tu confirmación. No uses envíos, eliminaciones, compras ni cambios de cuenta en este ejercicio. Si no se activa ninguna aprobación, eso también es un hallazgo: comprueba el modo de aprobación y la configuración del conector, y anota qué fue necesario para hacer sonar la puerta. Terminas cuando la aprobación haya llegado a tu teléfono, la hayas autorizado desde él y el trabajo terminado te espere al volver. Una alarma que nunca has oído es un rumor. Este proyecto te permite oírla una vez.
⏰ Proyecto 4 · 30 min más una semana · La primera programación de informes. Dificultad: media · Usa: Concepto 9. Hazlo. Crea un informe para el lunes por la mañana a partir de un conector y una fuente de archivos. Escribe primero las cuatro respuestas (qué, tocar, llegar, cuándo), incluye en el encargo la línea del caso vacío y la señal de éxito, y calcula por escrito el uso medido de tu plan. Una nota sobre el proveedor: en ChatGPT, una Tarea programada creada dentro de un Proyecto que contiene archivos subidos no puede acceder a esos archivos del Proyecto. Usa un conector compatible u otra fuente a la que pueda llegar la tarea y no construyas el flujo de trabajo programado alrededor de un archivo subido al Proyecto. Terminas cuando se haya activado dos veces sin ninguno de tus dispositivos conectado y cada resultado contenga la señal de éxito, no solo una ejecución terminada.
🔁 Proyecto 5 · 45 min · Una tarea, dos proveedores. Dificultad: media · Opcional: requiere acceso a ambos productos · Usa: Concepto 3. Hazlo. Ejecuta la misma asignación en Cowork en la web y en el modo Work de ChatGPT. Necesitas un plan de pago en ambos lados y es posible que el despliegue por etapas todavía te impida acceder a uno de ellos. Si ocurre, trabaja con alguien que tenga el otro producto y comparad los resultados, o ejecútala en el que tengas y predice el otro usando la tabla del Concepto 3. Mantén abierta a tu lado la tabla comparativa del Concepto 3 y ponla a prueba: ¿sigue siendo válida cada fila o un despliegue o cambio de nombre ha modificado algo desde mediados de julio de 2026? Terminas cuando tengas una nota de una página guardada en el nivel 3. Debe indicar qué filas de la comparación confirmaste, cuáles han cambiado (la capa mecánica envejeciendo en tiempo real) y si las seis partes compartidas aparecieron en ambos. Ese último hallazgo, no las diferencias, es lo importante.
🧳 Proyecto 6 · 45 min · El simulacro de salida. Dificultad: proyecto final · Usa: Conceptos 5 y 11. Hazlo. Imagina que la plataforma desaparece este trimestre. Reconstruye tu estado de trabajo usando únicamente el nivel 3, tu Drive, tu correo y tus registros: las plantillas, los encargos permanentes y los entregables. Terminas cuando hayas escrito la lista de lo que no pudiste reconstruir. Esa lista es tu exposición al nivel 2 y la disciplina de guardado para la semana siguiente. (Cuando llegues a Dejar el portátil, volverás a encontrar este ejercicio, con exigencia de ingeniería.)
Apéndices: los cursos posteriores, en la web
El resto de la sección de Agentes generales enseña su oficio con Claude Code y OpenCode: herramientas locales que se ejecutan desde el terminal y trabajan con archivos de tu propia máquina. Este curso enseñó la interfaz web: Cowork en la web y ChatGPT Work, ambos remotos y dentro de una pestaña del navegador.
Estos apéndices son el puente. Para cada curso posterior plantean una pregunta: ¿qué parte de ese curso puedes completar desde la interfaz web, sin instalar nada? La respuesta nunca es «todo» ni «nada». Algunas ideas se transfieren sin problemas, con otros nombres. Algunas se transfieren de una forma más débil. Otras no pueden cruzar porque necesitan una máquina local o una ejecución de código real que la interfaz web no ofrece. Un último apéndice se aleja por completo del curso para trazar la guerra de los arneses en toda la industria.
Ese último grupo no representa una carencia de la interfaz web. Es la línea exacta en la que esta sección te indica que abandones el navegador. Por tanto, lee estos apéndices de dos maneras: como mapa de lo que ya puedes hacer hoy y como anticipo de por qué existen los cursos siguientes.
Una regla se mantiene en todos ellos. En la web alquilas un arnés terminado. En los cursos posteriores construyes uno. Por tanto, un tema «se transfiere» cuando el arnés del proveedor ya lo hace por ti y «no se transfiere» cuando tendrías que conectarlo por tu cuenta. Mantén esa línea a la vista y todos los apéndices se leen de la misma manera.

Una última nota de contexto para mantener honestos los límites siguientes. Cuando un apéndice dice que la web «no accede a tus archivos locales» o «no tiene repositorio local», se refiere a una sesión disponible únicamente en el navegador: una pestaña, sin instalar nada. Esa es la interfaz que enseñó este curso. Hay dos elementos justo después de ella. Un puente de escritorio (Concepto 2) puede prestar a una sesión remota un acceso local limitado mientras la aplicación de escritorio está abierta. Y un agente local (los cursos sobre escritorio y programación) se ejecuta en tu máquina desde el principio. Por tanto, interpreta las filas «no se transfiere» como solo navegador: marcan dónde termina la pestaña, exactamente el lugar donde empiezan los próximos cursos.
Apéndice A · Programación agéntica, en la web
El curso de Programación agéntica enseña Claude Code y OpenCode mediante quince conceptos. También es el curso de ingeniería de contexto de este libro. La mayoría de sus ideas tratan de gestionar lo que ve el modelo y hacer que su trabajo se pueda comprobar. Una parte sorprendentemente grande se transfiere a la web porque las seis partes son las mismas. Lo que no se transfiere es todo aquello que supone un terminal, un sistema de archivos local y código que tú ejecutas.
Se transfiere sin problemas:
| Ese curso enseña | En la web es |
|---|---|
| Modo de planificación (leer primero, actuar después de la aprobación) | El bucle de delegación que aprendiste en el Concepto 8. Pide el plan antes de la ejecución. La misma idea, sin atajo de teclado. |
| El archivo de reglas (CLAUDE.md / AGENTS.md), instrucciones permanentes del proyecto | Las instrucciones guardadas de un Proyecto, además de la idea de espacio de trabajo persistente del Concepto 6. Reglas permanentes que el agente lee en cada sesión. |
| Gestión del contexto (mantener la ventana ligera, empezar de nuevo o continuar) | Elegir entre una sesión nueva o continuar otra. La columna vertebral del estado del Concepto 4 es la misma pila, gestionada por ti. |
| Ajustar el modelo a la tarea | Más limitado en la web: recibes el modelo de la interfaz, no un menú. El hábito sobrevive como «saber qué modelo ejecuta esta interfaz». |
| MCP, conectar un sistema de registro | Conectores, exactamente. Concepto 6. El mismo estándar subyacente, un catálogo diferente en cada lado. |
| Skills (conocimiento práctico empaquetado y reutilizable) | En los planes compatibles, ambas familias permiten crear una Skill desde el chat, construirla en un editor o subir un paquete con instrucciones, recursos y código. El formato se transfiere. |
| El bucle de verificación (intentar, comprobar, corregir, repetir) | Un informe programado que comprueba una condición y te dice qué cambió. El techo del Concepto 9. Obtienes la comprobación, ejecutada por ti. Todavía no obtienes la corrección automática. |
| Inyección de instrucciones, el contexto es la puerta | La regla sobre contenido no fiable del Concepto 6, palabra por palabra. El riesgo y el hábito son idénticos en cualquier interfaz. |
Se transfiere de una forma más débil:
| Ese curso enseña | En la web, la versión limitada |
|---|---|
| Comandos con barra y el entorno de ejecución de una Skill | Las propias Skills se transfieren (consulta la sección anterior). Lo que sigue siendo más débil es el resto de la configuración del agente de programación: comandos con barra creados por ti y tu control sobre el entorno donde se ejecuta una Skill, sus puntos de enganche del ciclo de vida, enrutamiento de modelos, sistema de archivos y capa de aplicación de reglas. Obtienes la Skill, no la máquina donde se ejecuta. |
| Subagentes (un trabajador separado con su propia ventana de contexto) | La interfaz web puede dividir por sí sola una tarea grande en pasos secundarios, pero tú no creas un subagente con un modelo elegido y un conjunto de herramientas restringido. Obtienes la orquestación del proveedor, no la tuya. |
| Reanudar, deshacer, retroceder | Las sesiones se reanudan. Sin embargo, no existe /rewind para volver a un paso anterior ni /undo respaldado por git para deshacer las ediciones del agente, porque el trabajo no ocurrió en tu repositorio. Tu forma de deshacer es «conservar el archivo anterior en el nivel 3». |
No se transfiere, y esa es precisamente la cuestión:
| Ese curso enseña | Por qué la web no puede hacerlo |
|---|---|
| Puntos de enganche y complementos (una regla que el código aplica siempre) | Un punto de enganche es código que se ejecuta en tu máquina para bloquear o comprobar una acción. La interfaz web no ejecuta tu código ni expone estos acontecimientos del ciclo de vida. Esta es la línea más clara de todo el curso para «salir del navegador». Cuando necesitas una garantía que el modelo no pueda eludir con palabras, necesitas un arnés construido por ti. Eso es Ingeniería de arneses. |
| Trabajar en un repositorio local, comandos del terminal | Una sesión disponible únicamente en el navegador se ejecuta en los servidores de la empresa, no en tu disco. Por sí sola no abre tu terminal ni edita tu proyecto local. Un puente de escritorio puede prestar acceso local limitado, pero el flujo de trabajo de terminal y repositorio pertenece a las herramientas locales. Este es el Concepto 2 reformulado: el entorno de ejecución es remoto. |
| Control de costes mediante enrutamiento de modelos (planificar con un modelo avanzado, ejecutar con uno barato) | La división entre planificar con uno potente y ejecutar con otro barato requiere dos modelos elegidos por ti y una herramienta que permita cambiarlos a mitad de la tarea. La interfaz web elige el modelo por ti. |
El resumen sincero. Si tu trabajo consiste en documentos, conectores e informes programados, la interfaz web cubre gran parte de lo que ofrecería el curso de Programación agéntica, con nombres distintos. En cuanto el trabajo toca tu propio código, tus archivos o una regla que debe aplicarse mediante código, has encontrado el borde de la interfaz web. Ese borde no es un defecto. Es la entrada a los cursos siguientes, y ahora sabes exactamente dónde está.
Apéndice B · Cowork y OpenWork, en la web
Este es diferente de los demás. El curso de Cowork y OpenWork es el pariente más cercano de este curso. Enseña la misma clase de compañero de trabajo de agente general, dirigido a los mismos profesionales del conocimiento y construido sobre el mismo bucle de delegación. La diferencia es el entorno de ejecución. Ese curso enseña los dos productos en tu escritorio: Cowork dentro de Claude Desktop y OpenWork, su gemelo de código abierto. Este curso enseñó Cowork en la web. La misma familia, un hogar diferente. Por tanto, el mapa no pregunta «cuánto se transfiere». Casi todo se transfiere. Pregunta «qué te ofrece el escritorio que la web no tiene y por qué».
Se transfiere sin problemas porque es la misma familia de productos:
| Ese curso enseña | En la web es |
|---|---|
| Delega, no consultes (un compañero al que asignas trabajo) | Los Conceptos 1 y 8, palabra por palabra. El hábito más importante y exactamente igual en cualquier interfaz. |
| El bucle de tareas (encargo, plan, aprobación, ejecución, revisión) | Tu bucle de delegación del Concepto 8. Los mismos seis pasos, el mismo punto de intervención en el plan. |
| El plan es la palanca | La idea central del Concepto 8 y la razón por la que la figura del bucle de delegación resalta el paso del plan. |
| Los conectores como palanca de confianza (alcance mínimo, leer no es enviar) | El Concepto 6, exactamente. Los mismos conectores, la misma disciplina de alcance, la misma regla de que «el alcance de lectura no es alcance de envío». |
| Modos de aprobación (preguntar antes de actuar, actuar sin preguntar) | La puerta del teléfono del Concepto 7. La web dirige la misma aprobación a tu teléfono en lugar de mostrar una tarjeta dentro de la aplicación. |
| Skills (un procedimiento guardado que el agente elige por su descripción) | Cowork en la web incorpora el mismo sistema de Skills: el catálogo, /skill-creator y el formato SKILL.md pertenecen al producto, no al escritorio. Este es el único lugar en el que la interfaz web es más potente de lo que sugieren los apéndices anteriores. |
| La escala de autonomía (subir un peldaño por cada tipo de tarea) | La disciplina de los Conceptos 8 y 9: nunca programes algo que no confiarías en dejar trabajando solo. La escala trata sobre confianza, no sobre la interfaz que utilizas. |
| Inyección de instrucciones, contenido no fiable | La regla sobre contenido no fiable del Concepto 6. La historia del PDF de un proveedor con una instrucción oculta se aplica de la misma forma en la web. |
| Tareas programadas (la frecuencia incorporada de Cowork) | El Concepto 9. El comando /schedule de Cowork y la vista de tareas programadas funcionan igual desde la web. |
| La pila de instrucciones por capas (global, carpeta, sesión) | Los Conceptos 4 y 6: configuración global, instrucciones de un Proyecto y la instrucción de la sesión. La capa de «carpeta» se convierte en la capa del Proyecto. |
Se transfiere, pero la web cambia la forma:
| Ese curso enseña | En la web, la diferencia |
|---|---|
| Las tres palancas de confianza: carpetas, conectores, aprobaciones | Dos de las tres son iguales. La primera cambia. En el escritorio concedes acceso a una carpeta local. En una sesión disponible únicamente en el navegador no hay ninguna carpeta local que conceder. Tu zona de trabajo es el sistema de archivos de la tarea y el almacenamiento de la plataforma del Concepto 5. La disciplina de alcance sobrevive, pero «crea una carpeta de trabajo dedicada en tu disco» se convierte en «mantén el trabajo en su propio Proyecto». (Un puente de escritorio puede acceder a carpetas locales, pero esa es la función de la aplicación de escritorio, no de la pestaña.) |
| Subagentes (trabajadores paralelos para un lote) | Cowork en la web todavía puede dividir por sí solo un lote entre trabajadores paralelos. Lo que pierdes es la visibilidad más completa del escritorio sobre cada trabajador y cualquier control que dependa de archivos locales. El patrón sobrevive; su versión con archivos locales, no. |
Espacios de trabajo persistentes (una carpeta más un archivo CLAUDE.md) | Se convierte en un Proyecto más sus instrucciones guardadas, como explica el Concepto 6. La misma idea, sin carpeta en tu disco. El archivo de contexto se convierte en el campo de instrucciones del Proyecto. |
| Enrutamiento de modelos (un modelo potente para pensar, uno barato para el trabajo mecánico) | Más limitado en la web, exactamente como en el Apéndice A. Obtienes el selector de modelo de la interfaz para cada tarea, no la elección completa de proveedor de OpenWork. |
No se transfiere, y esta es toda la razón de ser del escritorio:
| Ese curso enseña | Por qué la web no puede hacerlo |
|---|---|
| Archivos locales como interfaz de ejecución | Este es el corazón del curso de escritorio. El agente lee y escribe archivos en una carpeta de tu máquina: la carpeta de tu asunto, la del ciclo de cierre o la de tu campaña. Una sesión web remota se ejecuta en los servidores de la empresa y no accede por sí sola a tu disco local. Este es el Concepto 2 y la principal razón por la que el curso de Cowork existe como un curso de escritorio independiente. |
| OpenWork en su totalidad (el gemelo de código abierto en el que aportas tu propio modelo) | OpenWork es una aplicación de escritorio que instalas, diriges a un proveedor de modelos elegido por ti y mantiene tus archivos en tu máquina. No existe una versión web de ese intercambio. El camino abierto es un tema posterior; el Concepto 11 lo nombra, pero no es una interfaz de navegador. |
| Privacidad «local primero» (tus archivos nunca abandonan tu máquina) | En la web, el contenido de los archivos que lee el agente está en los servidores de la empresa por definición. La propuesta de privacidad esencial del escritorio, que tus archivos se queden en local, no puede existir en una interfaz remota. Esto es decisivo para los datos regulados y el Concepto 10 ya trazó esa línea. |
| Complementos de Cowork como paquetes para funciones profesionales (Legal, Finance, Sales) | Los complementos del curso de escritorio agrupan Skills, conectores, comandos con barra y subagentes para una función profesional. Si el sistema completo de complementos está disponible desde la web es justo el tipo de detalle de pocas semanas que debes comprobar en las páginas vigentes, pero se diseñó para ejecutarse en el escritorio. |
| Recuperación mediante copias de seguridad (Time Machine, git, historial de Drive) | La estrategia de recuperación del curso de escritorio es «tu copia de seguridad local restaura el archivo». En la web no hay ningún archivo local que restaurar. Tu recuperación es la disciplina del Concepto 5: conservar la versión anterior en el nivel 3. |
El resumen sincero. El curso de Cowork y este curso son dos puertas que dan a la misma habitación. Si trabajas con documentos y conectores y quieres empezar con la menor fricción, la interfaz web ya te ofrece la mayor parte de ese curso, incluido su sistema de Skills. En cuanto el trabajo deba tocar archivos de tu propia máquina, mantener tus datos fuera de los servidores de un proveedor o recorrer el camino de modelo propio de OpenWork, necesitas el escritorio. Eso no es una limitación de la web. Es la razón por la que el curso de escritorio es el siguiente: allí vas cuando el trabajo vuelve a casa, a tu máquina.
Apéndice C · Ingeniería de bucles, en la web
El curso de Ingeniería de bucles te enseña a construir un sistema que da instrucciones a tus agentes por ti: empieza por sí solo, hace el trabajo, comprueba el resultado, recuerda lo que hizo y solo te llama para las decisiones que necesitan una persona. Lo enseña con Claude Code y OpenCode. También utiliza exactamente la forma de seis partes que este curso tomó como lente de lectura: un latido, cuatro partes de trabajo y una columna vertebral.
Esta es la división sincera. El propio curso traza esta línea. Contiene una sección completa titulada «¿Dónde puede ejecutarse un bucle?» y su respuesta es directa: el cuadro de chat normal no puede ejecutar un bucle, pero Claude Code, OpenCode y Cowork sí. Por tanto, la interfaz web ocupa el centro. Puede activar los latidos sencillos. No puede realizar la ingeniería que vuelve fiable un bucle cuando se ejecuta de verdad.
Se transfiere de forma sencilla:
| Ese curso enseña | En la web, la versión sencilla |
|---|---|
| El latido programado (se ejecuta cada mañana, con el portátil apagado) | El Concepto 9, tus tareas programadas. Este es el único latido que la web hace bien. Un informe que se activa según el reloj es exactamente lo que ofrecen /schedule de Cowork y las Tareas programadas de ChatGPT Work. |
| El latido de acontecimiento (reaccionar cuando llega algo) | En parte. Las Tareas programadas de ChatGPT Work pueden observar un cambio, una forma ligera de desencadenante basado en acontecimientos. Lo que no obtienes es la maquinaria de acontecimientos de GitHub y desencadenantes mediante API que presenta el curso. |
| La columna vertebral (memoria entre ejecuciones, para que hoy continúe lo de ayer) | Una forma débil. Tu cuenta conserva sesiones y Proyectos, por lo que cierta memoria continúa. Sin embargo, no obtienes la verdadera columna vertebral del curso: un archivo progress.md y un archivo de reglas en un repositorio que cada ejecución lee primero y actualiza al final. |
| Skills (conocimiento escrito una vez, leído en cada ejecución) | Ambas familias ofrecen Skills empaquetadas en los planes compatibles, como indicó el Apéndice A. Así que la parte de «ninguna ejecución empieza de cero» se transfiere a la web en ambos lados. |
| El menú de latidos (¿la tarea termina, se repite u ocurre una vez?) | La propia comprobación del Concepto 9. La disciplina de elegir el bucle más ligero no depende de la interfaz. Es una forma de pensar, no un comando. |
No se transfiere, y esto es de lo que trata realmente el curso:
| Ese curso enseña | Por qué la web no puede hacerlo |
|---|---|
| La separación creador-verificador (un agente escribe, un agente separado evalúa) | Esta es la idea más importante del curso y la web no puede ofrecer la versión real. En la web obtienes la ejecución hasta terminar de la propia interfaz, donde el proveedor decide qué significa «terminado». No creas un agente verificador separado con su propio modelo y una rúbrica escrita. El bucle de verificación del Apéndice A vuelve aquí y choca con el mismo muro. |
| Árboles de trabajo (aislamiento para que los agentes paralelos no colisionen) | Un árbol de trabajo es una copia de trabajo independiente de git en tu máquina. En la web no hay un repositorio local, así que no existe nada que aislar. Todo este concepto presupone el sistema de archivos local que la web no tiene. |
La columna vertebral en un repositorio (progress.md y un archivo de reglas que el bucle lee y escribe) | La columna vertebral real vive como archivos en tu propio repositorio, que se leen al principio de cada latido y se actualizan al final. La memoria de la sesión web pertenece al proveedor y usa su formato. La regla del curso, «sin columna vertebral no hay bucle», explica precisamente por qué los bucles serios necesitan una herramienta que controle un repositorio. |
/goal, /loop, bucles de shell con límite (ejecución hasta terminar bajo tu control) | Son comandos de Claude Code y patrones de shell de OpenCode. La interfaz web te ofrece la versión del proveedor de la ejecución hasta terminar, no la del curso, donde tú estableces la condición de parada, el límite de reintentos y la comprobación de falta de progreso. |
| Flujos de trabajo dinámicos (escribir toda la orquestación como un script que pueda volver a ejecutarse) | Esta es la forma más profunda del cuerpo del bucle: muchos subagentes, comprobados y limitados, reunidos en un solo script. Incluso entre las herramientas locales, solo existe en Claude Code. Está muy fuera del alcance de cualquier interfaz web. |
| Rutinas en la nube y GitHub Actions (el entorno de ejecución desatendido) | El verdadero latido desatendido del curso se ejecuta en las Rutinas de Anthropic o los ejecutores de GitHub, sobre un repositorio, con reglas de rama y límites de ejecución. La tarea programada de la web es un pariente más ligero: informa, no abre una solicitud de incorporación revisada en una rama claude/. |
El resumen sincero. La interfaz web puede ejecutar la forma del latido más sencillo de un bucle: un informe programado que se activa mientras duermes. Es real y, para muchas personas, suficiente. Sin embargo, Ingeniería de bucles no trata principalmente del latido. Trata de los componentes que hacen seguro un bucle desatendido: un verificador separado, aislamiento, una columna vertebral de tu propiedad y condiciones de parada que controlas. Todos necesitan una herramienta que sea propietaria de un repositorio y ejecute tu código. Por tanto, este apéndice marca el ascenso más claro de toda la sección. Cuando tu informe programado deba convertirse en un bucle al que confíes cambios mientras duermes, habrás superado la interfaz web, e Ingeniería de bucles es el curso que te espera allí.
Apéndice D · Ingeniería de arneses, en la web
Este es el apéndice hacia el que ha señalado todo el curso. En el Concepto 3 y en la nota sobre la guerra de los arneses, el curso ya explicó la división. En la web alquilas un arnés terminado. Los cursos posteriores te enseñan a construir uno. El curso de Ingeniería de arneses es donde ocurre esa construcción. Enseña la capa alrededor del modelo que convierte inteligencia sin procesar en un agente en el que puedes confiar: todo lo que decide qué puede hacer el agente, qué sabe, cómo se demuestra su trabajo y qué ocurre cuando algo sale mal.
Por tanto, este apéndice contiene la línea más tajante. Casi nada de la construcción se transfiere a la web. Sin embargo, la forma de pensar del curso, sus cinco verbos, se transfiere por completo. Es la mejor lente que tiene un usuario web para una tarea: ver lo que el arnés alquilado hace por él y lo que no.
Los cinco verbos como lente (esto se transfiere como forma de pensar):
El curso organiza todo lo que hace un arnés en cinco verbos. En la web no construyes ninguno de ellos. No obstante, puedes ver los cinco, y conocerlos te indica qué estás confiando al proveedor.
| El verbo | Qué significa | En la web, quién lo hace |
|---|---|---|
| Restringir (limitar lo que puede hacer el agente) | Reglas de permisos, listas de denegación, entornos aislados | El proveedor, por ti. Los alcances de tus conectores y el modo de aprobación (Conceptos 6 y 7) son la pequeña parte que controlas. |
| Informar (darle lo que necesita) | Archivo de reglas, Skills, diseño de herramientas | Tú, en parte. Las instrucciones de un Proyecto y las Skills empaquetadas (tanto en Cowork como en ChatGPT, en planes compatibles) son tu interfaz para informar. El resto pertenece al proveedor. |
| Verificar (demostrar el trabajo antes de aceptarlo) | Puntos de enganche, pruebas, salida tipada | La ejecución hasta terminar incorporada por el proveedor. No puedes añadir tu propio punto de enganche ni comprobación. |
| Corregir (recuperarse y después arreglar el sistema) | Puntos de control, trinquete | El proveedor. Tu única «vuelta atrás» es la copia del nivel 3 del Concepto 5. |
| Escalar (enviarlo a una persona) | La puerta humana, registros visibles | Compartido. La puerta del teléfono del Concepto 7 es tu interfaz de escalado. Los registros pertenecen al proveedor. |
Esa tabla ofrece la imagen sincera. Dos de los cinco verbos te dan una participación real en la web: informas mediante Proyectos y Skills empaquetadas, y ocupas la puerta de escalado a través del teléfono. Los otros tres, los que hacen seguro a un agente desatendido, los realiza el proveedor de maneras que no puedes ver ni cambiar.
No se transfiere porque construir el arnés es todo el curso:
| Ese curso enseña | Por qué la web no puede hacerlo |
|---|---|
| Reglas de permisos (permitir, preguntar, denegar, según el radio de impacto) | Una regla de denegación es una línea de settings.json u opencode.json que la herramienta aplica. La web te ofrece un modo de aprobación, no un lenguaje de reglas. No puedes escribir «denegar la lectura de .env» en una interfaz web. |
| La regla central: una barrera de seguridad reside en el arnés, nunca en la instrucción | Esta es la frase más importante del curso y exactamente aquello sobre lo que no puedes actuar desde la web. Para trasladar una regla de la instrucción a una capa que la aplique, necesitas acceder a esa capa. La interfaz web no la expone. En la web, tus «barreras de seguridad» son las del proveedor más lo que puedas decir en las instrucciones de un Proyecto, algo que el curso llamaría petición, no barrera. |
| Entornos aislados (barreras para el sistema de archivos, la red y las ramas) | Un entorno aislado es un muro del sistema operativo alrededor de aquello a lo que puede acceder el agente. Presupone una máquina que controlas y un entorno de ejecución que puedes cercar. La sesión web se ejecuta en los servidores del proveedor, dentro de su entorno aislado y según condiciones que no puedes definir. |
| Puntos de enganche (código que se ejecuta automáticamente antes o después de una acción) | Un punto de enganche es tu código, ejecutado por el arnés en un momento fijo, que puede bloquear o comprobar una acción. La interfaz web no ejecuta tu código. Es el mismo muro que encontró el Apéndice A, visto desde el lado del arnés: la razón individual más clara por la que un control serio necesita una herramienta local. |
| Salida tipada (un veredicto comprobable por una máquina que tú validas) | Aquí escribes un validador que el bucle ejecuta antes de confiar en un resultado. Necesita un entorno de ejecución bajo tu control. La web te ofrece la verificación del proveedor, no un lugar donde añadir la tuya. |
| El trinquete y las cuatro clases de fallo (convertir cada error en una corrección permanente) | El trinquete escribe cada lección en una parte del arnés que posees: una regla, un punto de enganche o una barrera. En la web no existe esa parte donde escribir. Puedes aprender el hábito de clasificar fallos, pero no instalar la corrección donde la instala el curso. |
| La división interna/externa, observabilidad, acoplamiento del arnés | Son disciplinas de un ingeniero que construye y ajusta un arnés con el tiempo. Presuponen que eres propietario del arnés. Por diseño, el usuario web no posee nada de él. Ese es el intercambio que ya nombró la nota sobre la guerra de los arneses: alquilas, así que no ajustas. |
El resumen sincero. Ingeniería de arneses es el curso que con mayor claridad te pide «salir del navegador» en esta sección, y aquel hacia el que este curso ha señalado desde el Concepto 3. Su tema completo es la capa que alquilas en la web y construyes en el escritorio. Hoy puedes cruzar la línea con una cosa: los cinco verbos como lente para ver qué hace por ti el arnés alquilado y la regla de que una barrera de seguridad real se aplica, no se solicita. Sin embargo, en cuanto necesites establecer una barrera, escribir una regla de denegación, añadir un punto de enganche, cercar un entorno aislado o fijar una corrección mediante el trinquete, habrás alcanzado el borde exacto que todo el curso ha trazado. En la web confías en el arnés. En este curso lo construyes. Esa es la diferencia entre alquilar la caja e ingeniarla.
Apéndice E · Confiar en el verificador, en la web
El curso Confiar en el verificador plantea la pregunta que los cursos sobre bucles y arneses seguían aplazando: ¿cómo sabes si el verificador es bueno? Cuando un agente evalúa su propio trabajo o un agente revisor devuelve PASS, ese veredicto es la opinión de un modelo. Este curso enseña evaluaciones: la disciplina de probar al evaluador para convertir «el verificador dijo PASS» en un número que puedas defender. Construye un conjunto dorado de expedientes, los ejecuta sin interfaz, calibra al juez con respecto a tu propia evaluación y condiciona cada cambio al resultado.
Este es el curso de toda la sección que más necesita «un repositorio y un shell». Su método completo consiste en una carpeta de archivos, un script ejecutor y jq. Nada de esa maquinaria existe en la web. Sin embargo, el curso también enseña una forma de entender la medición. Esa perspectiva cambia cómo lees el resultado de cualquier agente, incluido un agente web, y se transfiere por completo.
Se transfiere como criterio (este es el verdadero valor en la web):
| Ese curso enseña | En la web se convierte en un hábito mental |
|---|---|
| Un agente es una distribución, no una función (evalúa la tasa, no la ejecución) | La idea más útil que puedes conservar. Cuando un informe programado funciona bien una vez, eso es una ejecución, no una prueba. Si hace algo importante, compruébalo a lo largo de varias ejecuciones antes de confiar. No requiere herramientas, solo la disciplina de no confiar en un único resultado verde. |
| El juez también es un modelo (un PASS es una opinión que necesita calibración) | Cuando un agente web dice «terminado» o «lo he comprobado», recuerda que es una afirmación, no una prueba. La web te ofrece el verificador del proveedor y no puedes calibrarlo. Por tanto, tú sigues siendo la calibración humana: revisa por muestreo sus veredictos, sobre todo al principio. |
| Lee qué falló antes de cuántos (una tasa oculta la gravedad) | Cuando revises un lote de trabajo del agente, los tres elementos equivocados importan más que una cifra total elevada. Este hábito de lectura funciona con cualquier resultado y en cualquier interfaz. |
| El umbral es una decisión, no un descubrimiento | Decidir qué nivel es suficiente y para qué tareas te corresponde a ti como persona que dirige al agente. Ese criterio sigue contigo en cualquier interfaz. Es la disciplina de revisión del plan del Concepto 8 aplicada a los resultados. |
| Las demostraciones son la evidencia más débil | «Funcionó cuando lo probé» es una ejecución en una tarea elegida porque funciona y observada por alguien que desea que funcione. Esa cautela te protege cuando decides si debes confiar al agente web algo importante. |
No se transfiere porque construir una batería de evaluaciones necesita un repositorio y un shell:
| Ese curso enseña | Por qué la web no puede hacerlo |
|---|---|
| El conjunto dorado (una carpeta de expedientes bajo control de versiones) | Los casos son archivos JSON en un repositorio, revisados y fechados como código. En la web no existe un repositorio que los contenga ni un lugar donde versionarlos. |
El ejecutor (claude -p / opencode run en un bucle de shell con jq) | El ejecutor completo utiliza la línea de comandos sin interfaz y evaluación mediante shell. La interfaz web no ejecuta tu shell ni tus scripts. Es el mismo muro que todos los apéndices anteriores. |
| Calibrar al juez (el protocolo ciego de 20 elementos, la tabla de cuatro celdas) | Puedes realizar a mano el razonamiento, pero la versión del curso mide a un modelo juez que puedes inspeccionar y cambiar. En la web el juez está sellado y pertenece al proveedor. No puedes ejecutar el protocolo contra él. |
| La batería de regresión y la puerta de CI (volver a ejecutar con cada cambio, fallar por debajo de la referencia) | Es un trabajo de evaluación conectado a CI, con protección de ramas y una referencia confirmada. Todas sus piezas, CI, ramas y referencias, son herramientas de repositorio que la web no tiene. |
| Supervisión de la deriva según un horario (ejecuciones nocturnas, alerta ante un descenso) | El curso ejecuta la batería completa como un bucle programado contra una referencia. La web puede programar un informe, pero no ejecutar una batería contra una referencia confirmada porque no hay batería ni lugar donde conservar la referencia. |
| Defensas contra la ley de Goodhart (conjuntos reservados sellados que el agente nunca ve) | Los conjuntos reservados son casos guardados en una carpeta fuera del alcance del agente. Esto presupone un sistema de archivos que controles y puedas aislar. La web no te ofrece ni la carpeta ni el muro. |
El resumen sincero. Confiar en el verificador es el menos construible de todos estos cursos desde la web porque su método completo consiste en archivos, un shell y un repositorio. No puedes construir una batería de evaluaciones en una interfaz web. Sin embargo, puede ser el más valioso para leer pronto porque su forma de pensar no necesita herramientas. Cada vez que dependes de un agente web, confías en un verificador que no probaste. Ese curso te enseña a sentir el peso de esa decisión, evaluar una tasa en lugar de una ejecución, leer la gravedad antes que el volumen y seguir siendo la calibración humana que el verificador del proveedor nunca obtiene. Construirás la batería real cuando llegues a un repositorio. Hasta entonces, conserva la mentalidad: solo un historial observado con honradez merece confianza y, en la web, quien lleva ese registro eres tú.
Apéndice F · Dejar el portátil, en la web
Este es el último apéndice de correspondencia entre cursos y cierra el bucle con el límite en el que se ha apoyado todo este curso. Desde el principio, este curso se presentó como la puerta principal y Dejar el portátil como el plano de la planta. Ahora puedes ver por qué. Ese curso responde la última pregunta de la sección: no qué hace el agente, sino dónde vive y quién lo mantiene con vida. Ordena cada opción en cuatro hogares, y la interfaz web que aprendiste aquí no queda fuera de ese mapa. Está dentro, como un hogar específico con límites concretos.
Por eso este apéndice es diferente de los cinco anteriores. Los demás preguntaban una cosa: ¿qué parte de ese curso puedes hacer en la web? Este pregunta algo distinto: ¿dónde está la interfaz web en el mapa de ese curso? La respuesta aclara la posición de todo este curso dentro de la sección.
La interfaz web, situada en los cuatro hogares:
Dejar el portátil ordena los entornos de ejecución mediante una pregunta: ¿quién opera el bucle y dónde se ejecuta el trabajo? Aquí es donde encaja la interfaz web.
| El hogar de ese curso | Dónde encaja la interfaz web |
|---|---|
| Hogar 1: tu sesión (tú controlas todo; muere cuando cierras la tapa) | Es la correspondencia más cercana para una sesión web normal que diriges a mano. Tú la inicias, la observas y se detiene cuando terminas. La versión web incluso elimina la parte de «muere cuando cierras la tapa» porque la sesión se ejecuta en los servidores de la empresa, no en tu portátil. |
| Hogar 2: la programación en la nube (el reloj se traslada; el portátil puede estar apagado) | Aquí alcanza su techo la interfaz web y lo hace bien. Una Tarea programada de Cowork o ChatGPT Work es exactamente este hogar para el trabajo del conocimiento. El curso nombra las Tareas programadas de Cowork como ejemplo propio del hogar 2. Tu informe programado del Concepto 9 es un bucle del hogar 2. |
| Hogar 3: el entorno de ejecución gestionado (envías una definición; un proveedor opera el bucle) | Fuera del alcance de un autor desde la web. El hogar 3 significa que entregas a un proveedor una definición de agente mediante una API y operas el negocio a su alrededor. Es una acción de constructor que se realiza con el SDK y la documentación de la plataforma, no desde un chat en el navegador. |
| Hogar 4: tu propio proceso (el arnés como biblioteca en tus servidores) | Completamente fuera de alcance. Es el Modo 2, donde tú escribes y ejecutas el entorno de ejecución. Es lo más alejado de una interfaz web en todo el libro. |
Lo que se transfiere como criterio decisivo:
El verdadero regalo del curso no es su mecánica. Son las cuatro preguntas que eligen un hogar, y todas dependen del criterio. Funcionan en cualquier interfaz, incluida esta.
| Ese curso enseña | En la web, todavía lo preguntas |
|---|---|
| P1: ¿quién es el usuario? (¿solo tú u otras personas?) | La pregunta más importante, y te corresponde por completo. Si la respuesta es solo tú, una tarea web programada suele ser toda la solución y el curso lo afirma: el hogar 2 es el techo de la mayoría de las personas. En cuanto otras personas dependen del resultado, empiezas a notar los bordes de la web. |
| P4: ¿cuánto cuesta una mala noche? (el radio de impacto determina la velocidad) | Es la línea entre informar y actuar del Concepto 9 y la pregunta de presupuesto del curso sobre arneses, aplicada a los entornos de ejecución. Depende del criterio, y te corresponde en cualquier interfaz. |
| La ejecución sin interfaz es el puente | No puedes cruzar este puente desde la web, y eso lo revela todo. Cada traslado fuera de la web hacia un hogar más potente pasa por un comando sin interfaz (claude -p, opencode run) que la interfaz web no te ofrece. El puente es real y empieza donde termina el navegador. |
| La prueba de la maleta (la disciplina viaja, la mecánica se reconstruye) | Tus encargos permanentes, las instrucciones de tu Proyecto y tu idea de qué significa «terminado» son la disciplina, y viajan cuando cambias a una herramienta más potente. Los botones y ajustes propios de la interfaz web no. Mantener portátil tu conocimiento de trabajo, en tus propias notas, es la versión para el usuario web de «el repositorio contiene la verdad». |
No se transfiere porque dejar el portátil significa abandonar el navegador:
| Ese curso enseña | Por qué la web no puede hacerlo |
|---|---|
Invocación sin interfaz (claude -p, opencode run) | El puente que atraviesa cada traslado. La interfaz web no tiene ningún comando sin interfaz, justo por eso no puede alcanzar los hogares 3 y 4 y solo llega en parte al hogar 2. |
| El entorno de ejecución gestionado (definiciones de agentes, entornos y sesiones mediante una API) | Un entorno para constructores que controlas con código y documentación de la plataforma. No existe un camino desde el navegador. |
| El conjunto mínimo para trabajo desatendido (idempotencia, detección de ejecuciones omitidas, bloqueos de concurrencia) | Seis controles que conectas alrededor de un bucle operado por ti. En la web, el proveedor opera el bucle, así que no construyes el conjunto: heredas lo que ofrece el proveedor y no puedes ampliarlo. |
| El protocolo de llegada y el reajuste de referencia (demostrar el traslado con tu batería de evaluaciones) | Ejecuta tu conjunto dorado en el nuevo hogar, lo que necesita la batería del Apéndice E, que a su vez necesita un repositorio. Sin batería no hay protocolo de llegada. |
| Ser propietario del entorno de ejecución (hogares 3 y 4) | Toda la segunda mitad del curso. Ser propietario de cualquier parte del entorno significa operar infraestructura, justo lo contrario de alquilar una interfaz web. |
El resumen sincero y el cierre de los apéndices de correspondencia entre cursos. Dejar el portátil es el curso que te dice que la interfaz web tiene un lugar real y también un techo. La web es un buen hogar 1 para el trabajo que diriges a mano y un verdadero hogar 2 para los informes de trabajo del conocimiento que se ejecutan según un horario. Eso cubre una gran cantidad de trabajo real y, para muchas personas, es toda la historia. Sin embargo, en cuanto tu trabajo necesite cruzar el puente sin interfaz, ejecutarse sobre un repositorio, controlar su propio entorno aislado o servir a otras personas desde un entorno de ejecución bajo tu control, habrás llegado al borde que todo este curso ha trazado desde la primera página. Ese es el límite que este curso comparte con Dejar el portátil: este curso es la puerta principal y Dejar el portátil es el plano de toda la casa. Ahora sabes qué habitaciones se abren desde el navegador y cuáles requieren que recojas las llaves e instales una herramienta. Esa es la forma sincera de la interfaz web: un lugar real donde empezar, un punto claro donde termina y un mapa de todo lo que hay después.
Apéndice G · La guerra de los arneses en toda la industria
Los seis apéndices anteriores relacionan este curso con los posteriores, uno por uno. Este último mira hacia fuera. El Concepto 3 nombró la guerra de los arneses entre dos empresas. En 2026 ya no son dos empresas. Es toda la industria, y casi todos los laboratorios importantes han aceptado el mismo marco: la lucha se ha desplazado del modelo puro al arnés que lo rodea.
Esa es la observación más útil de esta sección. Cuando lees las noticias, los titulares hablan de modelos: uno logró una puntuación mayor, otro es más barato. Sin embargo, los productos compiten por la envoltura. La programación, los conectores, la memoria, la puerta, el entorno de ejecución. Este apéndice es una guía de campo sobre quién lucha y dónde. No pretende que lo memorices. Los productos envejecen en semanas, como repite este curso. Lo importante es que la forma de seis partes que aprendiste permite leerlos todos.
Panorama de la industria, datos comprobados el 21 de julio de 2026. Este apéndice envejece más rápido que el resto del curso y está pensado para actualizarse por separado. Muchos de los elementos siguientes han sido anunciados, no lanzados, y el panorama competitivo cambia cada mes. Trátalo como una instantánea fechada, no como un hecho permanente, y verifica cada fila con sus fuentes antes de depender de ella.
Los participantes se distribuyen en tres frentes. La misma línea entre alquilar y construir de los apéndices anteriores atraviesa toda la industria.
Frente 1: la interfaz de trabajo para consumidores (alquilar un arnés terminado). Esta es la lucha que aborda este curso: una interfaz de agente junto al cuadro de chat para el trabajo cotidiano del conocimiento.
| Participante | La interfaz | Situación actual |
|---|---|---|
| OpenAI · ChatGPT Work | Un modo dentro de ChatGPT | El tema de este curso. Lanzado en julio de 2026. |
| Anthropic · Claude Cowork | Una sesión remota en claude.ai | El tema de este curso. Ampliado a web y móvil en julio de 2026. |
| Google · Gemini Spark | Un agente en la nube disponible las 24 horas dentro de la aplicación Gemini | Anunciado en I/O 2026: un agente personal que se ejecuta en las máquinas en la nube de Google aunque tu dispositivo esté apagado, en Gmail, Docs y Workspace. La misma forma que enseña este curso y la misma disciplina: su principal barrera de seguridad es que pregunta antes de gastar dinero o enviar un correo. A mediados de 2026, solo con acceso temprano en Estados Unidos. Dispone de los bolsillos más profundos y la mayor distribución mediante Search, Workspace y Chrome. |
| Microsoft · Copilot Tasks | Una interfaz de tareas unificada en Microsoft 365 | Modos Auto, Researcher y Analyst, además de programación: las mismas partes, dirigidas de lleno al trabajo empresarial con Office. La ventaja de Microsoft es la distribución. Como afirmó un analista, la batalla ya no trata de quién tiene el mejor chatbot, sino de quién controla la interfaz de trabajo. |
| Meta · Meta AI | Agentes dentro de WhatsApp, Messenger e Instagram | Compite por alcance, no por capacidad: su arnés vive donde miles de millones de personas ya conversan y su renovada línea de modelos (Muse Spark) señala una reconstrucción importante. El intento de Meta de comprar la empresa emergente de agentes Manus por dos mil millones de dólares, según los informes, se deshizo después de que los reguladores chinos ordenaran revertir el acuerdo en 2026, un recordatorio de que esta guerra también tiene un frente geopolítico. |
Lee esa tabla teniendo presentes las seis partes del Concepto 3. Cada participante tiene un latido (programaciones), conectores, un bucle de ejecución hasta terminar, una columna vertebral del estado, una puerta humana y un cuerpo. Nombres diferentes, propietarios diferentes, la misma forma. Esa es toda la tesis de este curso desplegándose en cinco empresas a la vez.
Frente 2: el entorno de ejecución gestionado (alquilar el entorno, no la interfaz). Una capa por debajo de la interfaz para consumidores está la plataforma empresarial: entregas al proveedor una definición de agente y este opera el bucle. Es el hogar 3 del Apéndice F vendido como producto.
| Participante | La plataforma | Qué es |
|---|---|---|
| Google Cloud · Gemini Enterprise Agent Platform | Una evolución de Vertex AI | Construir, ejecutar y gobernar agentes, con primitivas de orquestación, entorno de ejecución, memoria y gobernanza como Agent Identity y Agent Gateway. Google dirige ahora toda su hoja de ruta empresarial de agentes mediante esta marca. |
| Microsoft · Copilot / Agent 365 | La capa empresarial de agentes en Microsoft 365 | El mismo impulso de gobernanza, vinculado a Office, Teams y Windows. |
| Alibaba Cloud · Wukong, Qwen Cloud | Una plataforma empresarial nativa de IA | Automatiza tareas empresariales mediante varios agentes, además de un portal de Skills que convierte más de 60 productos en la nube en Skills compatibles con MCP. |
El hilo conductor del Frente 2 es la gobernanza, no la capacidad. El problema difícil de esta capa no es crear un agente que funcione. Es crear uno en el que una empresa pueda confiar: identidad, políticas, auditoría. Una encuesta reveló que la mayoría de las empresas ya ejecutan agentes en producción, pero solo una pequeña parte puede gobernarlos de verdad. Esa diferencia es exactamente lo que abordan Ingeniería de arneses y Confiar en el verificador, vendido como producto empresarial.
Frente 3: el motor abierto (construir tu propio arnés). En el extremo opuesto a la interfaz alquilada para consumidores está el modelo de pesos abiertos: ninguna interfaz, solo un motor que colocas dentro de un arnés que construyes y ejecutas por tu cuenta. Es el extremo de construcción de la línea entre alquilar y construir.
| Participante | El motor | Por qué importa aquí |
|---|---|---|
| DeepSeek · V4 | Pesos abiertos, nativo para herramientas, API compatible con Anthropic | Se entrega preajustado para integrarse en Claude Code, OpenCode y otros agentes de programación. La adopción es real: menos de un mes después del lanzamiento, su modelo rápido constituía la mayoría del tráfico agéntico de DeepSeek, y los modelos abiertos chinos superaron a los estadounidenses en proporción total de tokens a mediados de 2026. |
| Alibaba · Qwen 3.6 / 3.7 | Línea de pesos abiertos (Apache 2.0), además de un modelo comercial insignia «Agent Frontier» | Compatibilidad nativa con MCP, un contexto de 1 millón de tokens y una ejecución autónoma demostrada de 35 horas con más de 1000 llamadas a herramientas (esa ejecución corresponde al modelo comercial insignia Agent Frontier, no a la línea abierta con licencia Apache). La línea abierta es la opción para el alojamiento propio. |
| Meta · Llama | Pesos abiertos | Sigue siendo la línea abierta más conocida, aunque la propia estrategia de Meta se está desplazando hacia comprar y lanzar agentes (Manus) en lugar de publicar únicamente modelos. |
El Frente 3 contiene la promesa más profunda de este libro. Un motor de pesos abiertos es la única opción que te permite poseer el arnés completo: modelo, entorno de ejecución, entorno aislado y datos. Las fuentes dejan clara la razón, y vuelve a ser el Concepto 10: la API alojada de DeepSeek se ejecuta en China, así que para datos regulados o sensibles el alojamiento propio de los pesos abiertos es el camino limpio. Controla el motor, controla la custodia. Esa es la pared más alejada de la casa cuya puerta principal abrió este curso.
El resumen sincero. Tres frentes, una guerra. En la interfaz para consumidores, cinco empresas compiten por alquilarte el mejor arnés terminado. En el entorno de ejecución gestionado, los mismos gigantes alquilan el arnés a empresas y compiten en gobernanza. En el motor abierto, los laboratorios de pesos abiertos te entregan las piezas para construir el tuyo. Los modelos difieren. Los precios difieren. La distribución difiere. La forma no. Cada producto de los tres frentes es un latido, conectores, un bucle, una columna vertebral, una puerta y un cuerpo. Aprende una vez la forma, en este curso y con la interfaz más amable, y podrás leer toda la industria, en cualquier frente y cualquier año. Por eso este libro enseña la forma y no la herramienta. Las herramientas están en guerra. La forma es el tratado de paz que llevas contigo.
Fuentes y lecturas adicionales
Dentro de este libro
- Skills y conectores, las dos mejoras que este curso ejecuta desde un navegador. Curso de Fundamentos 5.
- Cowork y OpenWork, la profundización de escritorio del bucle de delegación de este curso: carpetas, palancas de confianza, escala de autonomía y cargas de trabajo reguladas.
- Ingeniería de bucles, las seis partes que este curso utilizó como lente de lectura, enseñadas como elementos que tú diseñas. También presenta la versión segura de las programaciones que actúan.
- Dejar el portátil, la decisión sobre el entorno de ejecución detrás de esta interfaz. Este curso es la puerta principal; aquel, el plano de la planta.
Los productos (páginas vigentes, las únicas cifras actuales)
ChatGPT Work (OpenAI):
- Anuncio del lanzamiento, disponibilidad y ejemplos: ChatGPT ahora es un socio para tu trabajo más ambicioso (9 de julio de 2026).
- ChatGPT Work y Codex, cómo se relacionan Work y Codex, estructura de uso, escritorio frente a web y móvil.
- Tareas programadas en ChatGPT, tipos de frecuencia (una vez, horario, acontecimiento, supervisión) y la salvedad sobre archivos de Proyecto.
- Complementos en ChatGPT y Codex, la capa que este curso llama conectores.
- Skills en ChatGPT, Skills empaquetadas, creación y planes compatibles.
Cowork (Anthropic):
- Usar Claude Cowork en la web, el escritorio y el móvil, sesiones remotas, funciones por interfaz y reglas del puente de escritorio para archivos locales.
- Descripción general de la arquitectura de Claude Cowork, cómo se aíslan las sesiones remotas y locales y a qué puede acceder cada una.
- Programar tareas recurrentes en Claude Cowork, frecuencia y ejecución remota sin ningún dispositivo conectado.
- Usar Claude Cowork de forma segura, el modelo de confianza detrás de los Conceptos 6 y 7.
- Claude Code (la interfaz de programación independiente) y las ejecuciones en la nube vinculadas a repositorios: code.claude.com/docs.
OpenWork (gemelo de Cowork de código abierto):
- OpenWork, la alternativa de código abierto a Cowork (basada en OpenCode) y su documentación.
La industria en general (Apéndice G), fuentes primarias y de lanzamiento:
- Google: Gemini Enterprise Agent Platform (Google Cloud, I/O 2026); el agente para consumidores lanzado en I/O 2026 es Gemini Spark, un agente en la nube disponible las 24 horas (acceso temprano en Estados Unidos a mediados de 2026).
- Microsoft: Copilot Tasks con los modos Auto, Researcher y Analyst (Microsoft 365 Copilot); el agente Researcher para el modelo de permisos «solo ve aquello a lo que tú puedes acceder».
- Meta: los reguladores chinos ordenaron deshacer la adquisición de Manus y Meta inició el proceso para revertirla en 2026; trata como incierta cualquier afirmación estratégica basada en Manus.
- DeepSeek: adopción agéntica de V4 (OpenRouter) y guías de integración de V4 con agentes de programación.
- Alibaba: Qwen3.7, la frontera de los agentes y el entorno Qwen-Agent (abierto, nativo para MCP).
Comprueba estas páginas antes de depender de cualquier cifra. Esta es la página del libro que envejece más rápido: ambas interfaces web de trabajo se lanzaron o ampliaron de forma importante en julio de 2026 (la interfaz web y móvil de Cowork amplió un producto existente, y ChatGPT Work se lanzó como un modo nuevo), los despliegues se realizan por etapas según el plan, las asignaciones se miden y los nombres cambian. Todo lo expuesto aquí se comprobó el 21 de julio de 2026. Los datos volátiles (niveles de despliegue, asignaciones, acciones de los conectores y la salvedad sobre archivos de Proyecto) también llevan un marcador de fuente donde aparecen.
El resumen en una línea
El cuadro de chat espera y siempre lo hará. Lo que cambió es la interfaz contigua: trabajo que se ejecuta en los servidores de la empresa después de que te marches y acude a tu teléfono cuando te necesita.
Todos los hábitos en un solo lugar
Presenta el encargo completo. Detecta los problemas en el plan, no después. Envía el trabajo terminado a la salida (nivel 3). Programa solo trabajo que informa y únicamente cuando ya lo hayas dejado trabajando solo. Lee cada producto nuevo mediante las seis partes. Y lleva la pregunta sobre el entorno de ejecución a Dejar el portátil antes de depender de todo esto.