Mindwalk: reproducción de sesiones de agentes en mapa 3D de la codebase
Qué pasó. Mindwalk es un visualizador local que lee los logs de sesión de Claude Code y Codex y los reproduce en un mapa 3D del repositorio: cada archivo se convierte en un punto en el espacio, y la actividad del agente (búsqueda, lectura, modificación) ilumina esa zona del mapa. Un binario Go descargable, totalmente local, sin datos enviados fuera de la máquina. El proyecto está en GitHub bajo licencia MIT.
Por qué te importa. Cuando delegas una tarea a un agente de coding, el log JSONL te dice qué hizo, no cómo comprendió el problema: qué partes del repo exploró, dónde se concentró, si su recorrido coincide con lo que tenías en mente. Mindwalk transforma esa secuencia en una forma que puedes ver de un vistazo: la comprensión de la tarea del agente se convierte en un mapa de calor en la codebase. Si el agente tocó archivos irrelevantes, o si omitió los centrales, lo ves inmediatamente. Es útil para depurar agentes que fallan (¿dónde se perdió?) y para mejorar los prompts (¿le di suficiente contexto sobre la estructura?).
Si quieres probarlo. El repo contiene un script de instalación que verifica la firma e instala el binario en ~/.local/bin. Una vez instalado, mindwalk sin argumentos lee las carpetas de Claude Code y Codex y abre la interfaz web localmente. La UI tiene una timeline con histograma (acciones de observación vs mutación), controles de play/pausa y scrub, e inspector que muestra el historial de visitas de cada archivo seleccionado.
En detalle
El contexto
Los agentes de coding — Claude Code, Codex, Cursor en modo agente — producen logs detallados de cada acción (archivos abiertos, búsquedas, modificaciones, ejecuciones). Pero leer un JSONL línea por línea no responde la pregunta más importante: ¿el agente comprendió el problema como tú te lo imaginabas? ¿Exploró las partes correctas del repo, o se concentró en zonas irrelevantes?
Mindwalk parte de la idea de que la comprensión de una tarea por parte del agente tiene una forma espacial: se puede representar como un mapa de luz y sombra en la codebase. Donde el agente buscó, leyó y modificó, el mapa se ilumina; todo lo demás permanece oscuro.
Cómo funciona
La herramienta tiene dos modos principales:
- Modo servidor (
mindwalksin argumentos): escanea las carpetas de Claude Code (~/.claude/projects) y Codex (~/.codex/sessions), genera los mapas de los repositorios involucrados, inicia un servidor local en un puerto aleatorio y abre el navegador. Desde allí puedes seleccionar una sesión de la lista y ver su reproducción. - Modo abrir (
mindwalk open <session.jsonl>): abre una sesión específica sin escanear todo.
La representación visual ofrece dos vistas: Tree (árbol radial de la estructura de carpetas) y Terrain (treemap plano, cada archivo es un rectángulo dimensionado por número de visitas). Cada archivo lleva un estado de contacto que evoluciona con la sesión: seen (verde musgo, archivo encontrado en una búsqueda), read (blanco lunar, archivo abierto), edited (ámbar cálido, archivo modificado), unvisited (oscuro). El estado mantiene un registro del nivel más profundo alcanzado.
El histograma de la timeline bajo el mapa muestra la actividad de la sesión en buckets temporales en un espectro frío/cálido: las acciones de observación (search, read, exec) permanecen frías, las mutaciones (edit, verify) se calientan. Las fases de edición destacan visualmente. En la timeline aparecen marcadores seleccionables: compactaciones de contexto (◇), lanzamientos de subagentes (○), turnos de usuario (›).
El HUD en la parte superior resume señales de fricción: tasa de error, archivos modificados varias veces (churn), modificaciones después de la última verificación. El inspector al lado se abre al hacer clic en un archivo y muestra su historial de visitas con timestamps; cada fila es un salto de playhead a ese momento.
Las limitaciones
Mindwalk funciona solo con los logs que producen las herramientas. Si un agente mantiene conversaciones internas o hace razonamientos que no terminan en el log estructurado, estos permanecen invisibles. El mapa muestra dónde fue el agente, no por qué: para reconstruir el razonamiento debes releer los mensajes de la sesión.
La herramienta por ahora soporta solo Claude Code y Codex. Otros agentes de coding (Cursor, Windsurf, Zed AI) producen logs en formatos diferentes: necesitará un parser para cada uno, o un estándar compartido (no existe aún).
Finalmente, la visualización 3D es útil para repositorios de tamaño medio-pequeño. En monorepos enormes (miles de archivos) el mapa se vuelve difícil de navegar: la herramienta aún no escala bien más allá de cierto umbral.
Qué hacer con esto
Mindwalk no te dice si el agente hizo un buen trabajo: te dice si comprendió el problema como tú. Si una tarea de refactoring tocó solo la mitad de los archivos que sabías que estaban involucrados, descubriste un problema en el brief o en el contexto pasado. Si el agente modificó archivos de config que eran irrelevantes, descubriste una herramienta llamada en el momento equivocado o un prompt ambiguo.
Es una herramienta de debugging del prompt, no del código producido. Después de ver el mapa, vuelves al brief del agente y lo reescribes con el contexto faltante, o delimitas mejor los límites de las herramientas.
Para quien construye agentes custom o experimenta con orquestaciones multi-agente, Mindwalk puede convertirse en parte del ciclo de desarrollo: ejecutas la tarea, miras el mapa, corriges, relanzas. Es el mismo loop que haces con un profiler de rendimiento, pero aplicado a la comprensión de la tarea en lugar del tiempo de ejecución.