Cómo saber si tu IA terminó de verdad.
Por el equipo de Olomni · Actualizado
Mira si hay una prueba (tests, build o lint) ejecutada después del último cambio y que haya pasado. Si no se probó, no está terminado aunque la IA diga «listo»; si la prueba falla, tampoco. Olo lo automatiza en tu equipo: verde si una prueba pasó después del último cambio, ámbar si no se probó, rojo si falla o tocó una ruta que no debía.
Paso a paso
- Revisa qué cambió de verdad con
git statusygit diff, no con el resumen de la IA. - Corre los tests y el build del proyecto después del último cambio (o pídele a la IA que lo haga y mira el resultado).
- Comprueba que no tocó rutas delicadas: migraciones, configuración, despliegue, archivos de claves.
- Desconfía si repite el mismo error varias veces: pídele otro enfoque o pasa el trabajo a otra IA.
- Con Olo, escribe una vez en el contrato del proyecto qué comandos comprueban que está listo; Olo los corre en tu equipo y marca el turno en verde, ámbar o rojo.
Por qué el «listo» de una IA no basta
Un agente describe lo que cree haber hecho. Puede haber editado archivos sin correr las pruebas, o haber corrido una prueba antes de su último cambio. La evidencia útil es la que se observó en tu equipo después del último cambio.
Qué significa cada color en Olo
- Verde: una prueba observada pasó después del último cambio.
- Ámbar: no se probó después del último cambio.
- Rojo: la prueba falla, tocó una ruta intocable o la IA está en un bucle repitiendo el mismo fallo.
Qué no hace
No sustituye la revisión de código ni garantiza que no haya errores: solo comprueba lo que tus pruebas cubren. Olo corre únicamente los comandos que tú escribiste en el contrato del proyecto.
Preguntas frecuentes
¿Funciona con cualquier IA?
El veredicto se calcula con lo que Olo observa en tu equipo, con la integración de cada IA. Claude Code es la más probada; las demás funcionan con límites.
¿Olo ejecuta código de la IA?
No. Solo corre los comandos que tú escribiste en el contrato, con una lista cerrada de tipos de comando (tests, build, lint).
¿Qué pasa si no tengo pruebas?
El turno queda en ámbar: sin pruebas, no hay evidencia. Es una buena razón para añadir al menos una.