Radar · 03/08/2026 · ocurrido el 02/08/2026 · negocio

Cloudflare pone el runtime de agentes en el centro del cloud: @cloudflare/computer y la Agents Week

Cloudflare ha lanzado @cloudflare/computer, un runtime para agentes que elige dinámicamente entre aislados rápidos y contenedores Linux completos, e inauguró la “Agents Week”: una serie de posts sobre cómo la infraestructura cloud debe transformarse cuando los clientes son agentes autónomos, no navegadores humanos.

Por qué te importa. Si estás desplegando agentes en producción, dónde y cómo se ejecutan importa tanto como el modelo que eliges. Un agente que debe navegar la web necesita un navegador en un contenedor Linux completo. Uno que procesa texto rápidamente funciona mejor en un aislado, un entorno de ejecución ligero que inicia en milisegundos. Hoy tomas esta decisión manualmente, construyendo la infraestructura alrededor. @cloudflare/computer interpone un runtime: declaras qué necesitas y él encamina al entorno correcto.

Esto se conecta con una tendencia que estamos siguiendo. Como contábamos en julio, el protocolo MCP se volvió sin estado para escalar mejor. Ahora Cloudflare hace lo mismo a nivel de ejecución: el entorno de runtime se vuelve orquestable, no fijo.

El segundo post de la semana trata sobre inferencia: cómo servir Kimi y GLM en GPU sin agotar memoria, con cuantización de KV cache (la memoria donde el modelo mantiene el contexto de la conversación) y compresión de pesos. Detalles que impactan el costo para quien ejecuta agentes a escala.

Si quieres seguir. Los posts de la Agents Week y la documentación de @cloudflare/computer están en el blog de Cloudflare.

En profundidad

Cloudflare Workers existe desde 2017 como plataforma para ejecutar código en los bordes de la red. El modelo es el aislado: un entorno de ejecución sandboxed que inicia en milisegundos y consume poca memoria, porque no arranca un sistema operativo completo. Es perfecto para responder una solicitud HTTP, transformar un JSON, servir una página.

Los agentes tienen un problema diferente. Un agente que navega la web necesita un navegador, y un navegador necesita un sistema operativo. Un agente que escribe archivos y los procesa necesita un filesystem real. Los aislados no son suficientes. Los contenedores Linux completos lo resuelven, pero inician en segundos en lugar de milisegundos y consumen más recursos. Hasta ahora, quien desplegaba agentes en Cloudflare debía elegir uno de los dos caminos y construir todo alrededor de esa elección.

@cloudflare/computer interpone un runtime que decide automáticamente. El agente declara qué necesita (un navegador, un filesystem, acceso a la red) y el runtime lo encamina al entorno correcto. Si la tarea es ligera, va a aislado. Si necesita un navegador, va a contenedor. La transición es transparente para el agente, que siempre ve “una computadora” como entorno de ejecución.

La Agents Week amplía el alcance. Cloudflare argumenta que la infraestructura cloud fue diseñada para un mundo donde humanos con navegadores hacen solicitudes: rate limiting calibrado para tráfico humano, storage pensado para sesiones de usuario, seguridad basada en cookies y CORS. Los agentes rompen estos supuestos. Hacen solicitudes a velocidades altas, mantienen estado durante horas, acceden a recursos de formas que los patrones de seguridad actuales no cubren. Se necesita un nuevo conjunto de primitivas.

El segundo post de la semana desciende a un nivel más bajo: cómo servir modelos frontier como Kimi y GLM en GPU sin agotar memoria. Cloudflare aplica cuantización al KV cache (donde el modelo mantiene el contexto de la conversación) y compresión a los pesos del modelo, con verificaciones de integridad para confirmar que la compresión no corrompió los resultados. Para quien ejecuta agentes que consumen muchos tokens, el costo de inferencia se decide también aquí, no solo en el precio de lista del modelo.

Límites de lo que sabemos. Los posts del blog describen la arquitectura, pero detalles sobre pricing, SLA y disponibilidad general de @cloudflare/computer aún no son claros del material publicado. La Agents Week está en curso: otros posts podrían añadir información operativa en los próximos días. Para quien evalúa la plataforma para agentes en producción, el runtime es interesante conceptualmente pero debe probarse con tu carga real antes de tomar una decisión.

Escribe para buscar en curso, playbooks, skills, papers…