L'Era dei Subagenti: Quando un Agente Non Basta Più
Hasta hace seis meses, un coding agent era un único proceso: un modelo que leía tu prompt, iteraba sobre el código, y devolvía un resultado. Funcionaba. Pero los repositorios reales no son problemas individuales — son ecosistemas. Y un ecosistema requiere una orquesta, no un solista.
Claude Opus 4.8, lanzado el 1° de junio, rompió el paradigma del solista. Con Dynamic Workflows in Claude Code, puedes spawnar hasta 1000 subagentes paralelos en una sola sesión. Cada subagente es una instancia independiente con su propio contexto, sus propias herramientas y su propio ciclo de reasoning. El modelo orquestador no ejecuta — coordina. Y lo hace con tres niveles de esfuerzo: high (por defecto), extra, y max.
El Cambio Arquitectónico que Muchos Subestiman
La novedad más importante de Opus 4.8 no es el número de subagentes. Es la Messages API reformulada: ahora acepta system entries directamente en el array messages. Esto significa que puedes cambiar las instrucciones de sistema mid-task sin invalidar la prompt cache. En términos prácticos: un agente orquestador puede reescribir las reglas de sus subprocesos mientras están en ejecución, adaptando la estrategia en tiempo real sin la penalización de costo que antes habría hecho la operación prohibitiva.
Traducido: ya no estás lanzando un ejército con órdenes fijas. Estás comandando un ejército al que puedes cambiarle las reglas de enfrentamiento durante la batalla.
La Alternativa Multimodal: Qwen3.7-Plus
Mientras Anthropic va en horizontal (más agentes, mismo tipo), Alibaba ha apostado en vertical con Qwen3.7-Plus: un único agente multimodal que integra visión (imágenes + video), deep reasoning, tool invocation e iteración autónoma en la misma instancia. No spawnea subagentes — hace más cosas por sí mismo.
Qwen3 Coder Next, la variante open-weight optimizada para coding agents, ofrece 1M token de contexto a $0.65/1M input. Para workflows locales donde la latencia de red entre subagentes sería un cuello de botella, este enfoque "todo en uno" tiene una ventaja real: cero overhead de coordinación.
¿Cuál Usar? Depende de la Topología del Problema
La respuesta no es "uno u otro". Es: ¿qué forma tiene tu problema?
- Problemas de estructura jerárquica (monorepo con módulos independientes, pipeline CI/CD multi-step, codebase scan en 100+ archivos) → subagentes paralelos. Claude Opus 4.8.
- Problemas de estructura densa (un único archivo complejo que requiere razonamiento visual sobre diagramas, debugging donde mirar la captura de pantalla del error es más rápido que leer el log) → único agente multimodal. Qwen3.7-Plus.
En la práctica, un Watchdog puede usar subagentes para monitorear microservicios independientes (cada uno con su scope), mientras la instancia de razonamiento profundo para las decisiones arquitectónicas es única y de alto contexto. No es ideología — es geometría del problema.
Insight Práctico: Empieza con un Subagente, No con Mil
Antes de rehacer tu arquitectura a golpes de `spawn_agent`, hazte esta pregunta: ¿tu subagente debe comunicarse con los otros para completar la tarea? Si la respuesta es sí, el costo de coordinación supera rápidamente el beneficio del paralelismo. Empieza con 2-3 subagentes con scope disjunto, mide el throughput real, y escala desde ahí. Claude Opus 4.8 lo permite — el default es "high effort", no "max". Usa la escala con conocimiento de causa.
Los subagentes no son un hype — son un cambio de paradigma arquitectónico. Si estás diseñando tu próximo sistema agéntico y quieres entender cuándo paralelizar y cuándo consolidar, la topología del problema es tu brújula.