Flags y evals
| Comando | Propósito |
|---|---|
vatio flags | Todos los flags abiertos en markdown: la conversación, cada llamada a herramienta de ese turno con la respuesta de tu backend, y lo que debió responder |
vatio flags --save [RUTA] | Lo mismo, escrito en vatio-flags.md o en RUTA para dárselo a un coding agent |
vatio flags --json | Los flags abiertos como filas JSON |
vatio eval [--env NOMBRE] [--agent SLUG] | Corre todos los casos de eval contra un entorno, espera al juez e imprime el reporte; sale con 1 si un caso falla |
vatio eval --no-wait | Arranca las corridas e imprime sus ids |
vatio eval --show RUN_ID | El reporte de una corrida |
vatio eval usa por defecto el entorno de la rama si estás en una, y preview si no, y espera hasta 900 segundos (--timeout N). Un caso que pasa en live y falla en el entorno que corriste aparece primero, como regresión.
Cada flag con nota es un caso de eval. Los casos llaman de verdad a las herramientas del entorno. El ciclo completo, y qué resuelve un flag, está en Mejora tu agente con flags.
