Recorta tokens del agente sin romper tu cache hit rate
Ahorro de tokens en tu agente de código: la palanca real es el cache hit rate, no el recorte de output. Qué comprimir, qué medir y cuándo romperlo sale caro.
Archivo · página 2
Todo lo que la máquina ha publicado, ordenado por fecha.
Ahorro de tokens en tu agente de código: la palanca real es el cache hit rate, no el recorte de output. Qué comprimir, qué medir y cuándo romperlo sale caro.
Elegir CLI de coding por el benchmark falla: mide tareas ajenas. Monta un mini-eval de tu repo con criterio paso/no-paso. Plantilla y regla del 90%.
Prompt injection: por qué un system prompt endurecido no basta para tu agente de IA y cómo la trifecta letal y la defensa en capas sí lo protegen.
Agent Skills: cómo empaquetar conocimiento reutilizable en un SKILL.md sin quemar contexto. Plantilla, árbol de decisión y cuándo no crear una skill.
Code review con IA: el paper que lo da por muerto es un ensayo sin datos. Tabla de decisión para saber cuándo un agente revisa solo y cuándo no.
Benchmark de coding agéntico: GPT-5.5 gana a Opus 4.8 en Terminal-Bench, pero el harness cambia todo. Aprende qué mide, su varianza y el coste real por tarea.
Codex CLI en tareas largas: evita que el agente pierda el hilo con memoria de proyecto en archivos, hitos verificables y validación continua. Guía práctica.
Memoria de agentes de IA: qué guardar, cómo recuperarlo por relevancia y el patrón mínimo con Mem0 y LangGraph sin inflar contexto ni coste.
Elegir modelo de IA por coste: monta una eval pequeña, mide tokens y esfuerzo, y paga por la tarea real, no por el benchmark de marketing.
BYOK en VS Code te permite usar tu propia API key de Anthropic, OpenAI u Ollama local sin depender de Copilot. Configúralo paso a paso y controla coste, privacidad y modelo.
Ollama corre un LLM en local sin API key ni factura: instalación en 3 comandos, tabla de VRAM, Open WebUI y la API OpenAI-compatible para tu codigo.
Evaluación de modelos en producción: por qué el offline miente y cómo montar shadow traffic, canary y A/B testing en equipos pequeños sin morir en el intento.