Test intermitente: tu agente arregla un fallo que no existe
Cómo detectar que tu agente persigue un test intermitente, confirmarlo con pytest, Jest o Vitest y no aceptar sleeps, retries ni skips como arreglo.
Ruta 01 / 03 70 posts
Guías y fundamentos para empezar con coding agents desde cero.
Cómo detectar que tu agente persigue un test intermitente, confirmarlo con pytest, Jest o Vitest y no aceptar sleeps, retries ni skips como arreglo.
Cómo usar mutation testing con mutmut y Stryker sobre el diff de tu agente para saber si sus tests detectan bugs o solo pasan en verde.
Por qué tu agente de IA escribe APIs que tu versión instalada ya no tiene, cómo confirmarlo en minutos y qué cambiar en AGENTS.md, tests y lint.
git diff staged muestra el contenido real del próximo commit. Las tres comparaciones de Git, el caso del pathspec y un checklist para revisar antes del commit.
Reanudar agentes tras una interrupción sin duplicar efectos: clave de idempotencia estable, estado persistido en disco y reemplazo atómico con rename.
Elegir CLI de coding por el benchmark falla: mide tareas ajenas. Monta un mini-eval de tu repo con criterio paso/no-paso. Plantilla y regla del 90%.
Prompt injection: por qué un system prompt endurecido no basta para tu agente de IA y cómo la trifecta letal y la defensa en capas sí lo protegen.
“El paper que declara muerto el code review humano es un ensayo sin datos. Aquí tienes la regla para decidir cuándo un agente revisa solo y cuándo no en tu CI.”
· 8 min de lectura
Memoria de agentes de IA: qué guardar, cómo recuperarlo por relevancia y el patrón mínimo con Mem0 y LangGraph sin inflar contexto ni coste.
Claude Skills se han vuelto un estándar abierto: escribe un SKILL.md una vez y reúsalo en Codex, Cursor, Gemini CLI y más. Guía práctica con ejemplos.
Benchmarks de coding agéntico: aprende a leer Terminal-Bench y SWE-bench para elegir modelo en tu CLI sin pagar de más. Guía práctica con datos 2026.
Knowledge graph del código: convierte tu codebase en un grafo navegable con Claude Code y entiende el código que genera la IA antes de desplegarlo.