Tu CLI de coding se elige con tu repo, no con Terminal-Bench
Elegir CLI de coding por el benchmark falla: mide tareas ajenas. Monta un mini-eval de tu repo con criterio paso/no-paso. Plantilla y regla del 90%.
Ruta 01 / 03 64 posts
Guías y fundamentos para empezar con coding agents desde cero.
Elegir CLI de coding por el benchmark falla: mide tareas ajenas. Monta un mini-eval de tu repo con criterio paso/no-paso. Plantilla y regla del 90%.
Prompt injection: por qué un system prompt endurecido no basta para tu agente de IA y cómo la trifecta letal y la defensa en capas sí lo protegen.
Code review con IA: el paper que lo da por muerto es un ensayo sin datos. Tabla de decisión para saber cuándo un agente revisa solo y cuándo no.
Memoria de agentes de IA: qué guardar, cómo recuperarlo por relevancia y el patrón mínimo con Mem0 y LangGraph sin inflar contexto ni coste.
Claude Skills se han vuelto un estándar abierto: escribe un SKILL.md una vez y reúsalo en Codex, Cursor, Gemini CLI y más. Guía práctica con ejemplos.
Benchmarks de coding agéntico: aprende a leer Terminal-Bench y SWE-bench para elegir modelo en tu CLI sin pagar de más. Guía práctica con datos 2026.
Knowledge graph del código: convierte tu codebase en un grafo navegable con Claude Code y entiende el código que genera la IA antes de desplegarlo.
“Claude Skills ahora son estándar abierto: aprende a escribir un SKILL.md portable que funciona en Codex, Cursor y Gemini CLI con ejemplos reales.”
Claude Skills ya son estándar: úsalas en Codex y Cursor →
Claude Skill para generar Word con tu plantilla de marca: estructura SKILL.md, scripts y docxtpl. Guía práctica para automatizar documentos .docx sin copiar.
Agent harness: la capa que envuelve a Claude Code y Codex para que tu agente planifique, ejecute y verifique sin descarrilarse. Qué es y cómo crearlo.
Cursor vs Claude Code: descubre qué cambia con subagents y skills, si las skills son portables, cuánto cuesta cada uno y cuál elegir según tu flujo de trabajo.
CLAUDE.md y Opus 4.8: por qué tus instrucciones se interpretan distinto y el checklist para auditar tono, verbosidad y reglas duras en Claude Code sin rehacerlo.
Opus 4.8 ya está en GitHub Copilot. Compara cuándo usarlo y cuándo Claude Code CLI para no duplicar facturas. Tabla de decisión incluida.
Google retira Gemini CLI el 18/06/2026. Plan de migración a Claude Code o Antigravity CLI con checklist, comparativa real y errores comunes.
CLAUDE.md y Opus 4.8: por qué tus instrucciones se interpretan distinto y el checklist para auditar tono, verbosidad y reglas duras en Claude Code sin rehacerlo.
Las 5 acciones que rompen el prompt cache de Claude Code y disparan tu factura hasta 12,5x. Causas, mitigación y cómo medir tu hit rate.
Claude se ha vuelto más tonto para muchos developers en 2026. Aprende a medir la degradación del modelo con un eval propio y deja de discutir por intuición.
Vibe coding desde el móvil con Claude Code: 7 reglas para delegar proyectos completos al agente sin leer el código y mantener el control en producción.
Por qué la config de Claude Code, Cline o Gemini CLI pesa más que el modelo en 2026. Tabla comparativa y 4 ajustes con impacto inmediato en tu flujo.
Aplica research-first en Claude Code para explorar repos grandes, planificar cambios y evitar errores. Guía con fases y checklist práctico.
Skills reutilizables para agentes de IA: anatomía, diferencia con subagentes y cómo llevarlas a producción sin romper tu flujo.
“Por qué la configuración, los plugins y la cadencia de releases de Claude Code o Cline impactan más que cambiar de modelo. Guía práctica con 4 ajustes.”
Coding agents 2026: la config pesa más que el modelo elegido →
Hooks en Claude Code: ejecuta linters, formateo y validaciones automáticas antes y después de cada acción. Tutorial con settings.json paso a paso.
System prompts de Claude Code, Codex y otros coding agents: cómo leerlos, compararlos y ajustar tu CLAUDE.md para depurar mejor en 2026.
Qué ocurre realmente con tu contexto cuando cambias de modelo a mitad de sesión en Claude Code: ventana, caché de prompt, /compact y reglas prácticas.
Convierte tus Claude Skills en una librería mantenible: convenciones de nombrado, estructura de carpetas y versionado real para reutilizar entre proyectos.
WebSocket Mode en la Responses API de OpenAI baja un 40% la latencia en agentes con muchas tool calls. Guía técnica con Python para usarlo en producción.
Claude Skills 2026: criterios prácticos para decidir si una tarea merece skill propia, repos curados y mantenimiento real en producción.
Convierte tus Claude Skills en una librería mantenible: convenciones de nombrado, estructura de carpetas y versionado real para reutilizar entre proyectos.
Workspace Agents de OpenAI: agentes compartidos sobre Codex para automatizar flujos de equipo en ChatGPT y Slack. Cuándo usarlos y cuándo elegir n8n.
Guía práctica para montar Claude Code con memoria persistente, MCPs y un mapa del repo que reduce tokens y alucinaciones en proyectos reales.
Harness unificado para coding agents: 4 patrones clave que puedes copiar en Claude Code hoy. Contexto, skills, sandbox y memoria con ejemplos reales.
Guía práctica sobre Claude Opus 4.7: cuándo usarlo frente a Sonnet, cómo ajustar control y coste en tu flujo diario con Claude Code.
Memoria en Claude Code: tres enfoques (archivos, MCP, plugins) para conservar contexto entre sesiones sin inflar el prompt. Guía práctica 2026.
gh skill, el nuevo comando del GitHub CLI, instala y versiona skills de Claude Code desde cualquier repo. Guía práctica con pinning y flujo reproducible.
“Claude Opus 4.7 ya está generalmente disponible. Analizamos cuándo elegirlo frente a Sonnet, cómo ajustar control y coste en tu flujo diario con Claude Code.”
Claude Opus 4.7: qué cambia de verdad en tu flujo diario →
Everything Claude Code: el harness con 140K stars que unifica skills, instincts y memoria en Claude Code, Cursor, Codex y OpenCode.
Subagentes en Cursor permiten dividir tareas entre IAs en paralelo con contexto aislado. Guía con SKILL.md, configuración paso a paso y errores comunes para tu workflow.
VS Code Agents app y Cursor 3 Agents Window: compara los nuevos agent workspaces que reemplazan al IDE clásico. Tabla, setup y costes reales, abril 2026.
Vibe coding con Rust y WebAssembly: cómo docfind logra búsquedas en 0,4ms sin servidor. Guía práctica con GitHub Copilot para enviar WASM sin dominar Rust.
Vibe coding tiene un muro real al mes 3: 19% más lento según METR, 1.7x más bugs según CodeRabbit. Estrategia híbrida para no estrellarte contra el techo.
GPT-5.4 vs Claude Opus 4.6: compara benchmarks reales, SWE-bench Pro y SWE-CI para decidir qué modelo usar en cada tarea de coding. Guía con model routing.
Vibe coding con Rust y WebAssembly: cómo docfind logra búsquedas en 0,4ms sin servidor. Guía práctica con GitHub Copilot para enviar WASM sin dominar Rust.
El mapa de alternativas a Cursor cambió en 2026: Windsurf pasó a ser Devin Desktop, los precios se movieron y Aider bajó su ritmo de releases. Esta comparativa recoge el estado real con fuentes (Cursor, Cline, Aider, Devin Desktop y Copilot), más una...
Cursor Rules: configura archivos .mdc en .cursor/rules/ para que el agente entienda tu codebase. Los 4 tipos de reglas con ejemplos para Python y TypeScript.
Aprende cómo el equipo de VS Code usa Copilot Agent Mode en su día a día. Desglosamos su workflow para refactorizar, generar tests y revisar PRs con IA.
Descubre OmniCoder-9B, un LLM de 9B parámetros que puedes ejecutar en una GPU de 12GB. Aprende cómo su entrenamiento en trayectorias agénticas le permite superar a modelos más grandes.
Descubre SkillsGate, el marketplace con 45.000 skills para agentes IA como Claude Code y Cursor. Aprende cómo su búsqueda semántica te ayuda a encontrar herramientas por intención y no por nombre.
Guía práctica para elegir entre Claude Code, Cursor, GitHub Copilot y Codex en 2026. Comparativa por tipo de tarea, coste real y cuándo la combinación de dos herramientas supera a cualquiera por separado.
“Un LLM de 9B afinado para programación agéntica que explica por qué puede ganar a modelos mayores en una RTX 3060 y qué limita.”
OmniCoder-9B: El LLM para Programar en tu GPU de 12GB →
¿Confundido con el término 'agente de IA'? Descubre la diferencia técnica real entre un prompt con instrucciones y un agente autónomo con memoria y acción. Aprende los 3 criterios clave (percepción, planificación, acción) que definen a un agente real...
Claude Code con modelos locales como Qwen3-Coder reduce el coste de API hasta un 80%. Guía para configurar claude-code-router o LiteLLM en 30 minutos.
Multi-CLI MCP conecta Claude, Codex y Gemini como herramientas en un solo agente: instala una vez, configura routing y enruta cada tarea al modelo idóneo.
RTK (Rust Token Killer) filtra el ruido de terminal antes de que llegue al agente IA. Guía de instalación y hook automático para Claude Code con ahorro del 60-89% de tokens.
OpenClaw setup: cómo evitar los errores más comunes en las primeras 72 horas, configurar AGENTS.md, SOUL.md y tu primer workflow real desde el día 1.
Equipo multi-agente Claude con 13 roles especializados: arquitectura boss agent, ciclo de crítica cruzada, tracking con SQLite y costes reales por pipeline.
RTK (Rust Token Killer) filtra el ruido de terminal antes de que llegue al agente IA. Guía de instalación y hook automático para Claude Code con ahorro del 60-89% de tokens.
VS Code 1.109 convierte el editor en hub multi-agente: Agent Skills pasa a GA, MCP Apps llega a VS Code y Claude Agent se integra junto a Copilot y Gemini CLI en un workspace unificado.
Claude Code Skills: transforma tutoriales de YouTube en SKILL.md con OCR y Skill Seekers. Contexto persistente para el agente sin copiar código manualmente.
VS Code Agent Mode convierte el editor en un hub multiagente: Claude, Codex y Gemini conviven mediante Agent Sessions con acceso al workspace. Cómo configurarlo, cuándo elegir cada agente y cómo gestionar la cuota de Copilot.
LSP en Claude Code transforma la navegación de código: de búsquedas grep lentas e imprecisas a respuestas semánticas en 50ms. Aprende a configurarlo para Python, TypeScript y Go.
Claude Code statusline con ccusage: monitoriza coste, burn rate y ventana de contexto en tiempo real. Configura hooks PreToolUse y Stop para datos siempre frescos.
Guía paso a paso para crear un skill de auditoría en OpenClaw que revisa providers, cron jobs y bootstrap, y guarda los hallazgos en memoria persistente. Incluye el skill.md completo, persistencia con Mem0 y un cron semanal.
“Cuando grep tarda 30-60 segundos, LSP devuelve referencias reales en 50 ms y puedes activarlo con una variable de entorno y un plugin por lenguaje.”
LSP en Claude Code: navegación semántica de 45s a 50ms →
Orquestación multi-agente con Claude: patrones builder-validator con código Python real, costes y lecciones de producción para sistemas de agentes autónomos.
Browser-Use convierte cualquier LLM en un agente que navega la web: 79K estrellas en GitHub, 89% de tasa de éxito. Guía práctica con código en Python.
Claude Code Auto-Memory: el sistema donde el agente escribe sus propias notas entre sesiones. Guía práctica de configuración, límites y casos de uso reales.
Hooks, Skills y MCPs para Claude Code: configuraciones battle-tested que automatizan workflows, bloquean errores y reducen costes en entornos reales.
Gemini CLI: agente open-source de Google con MCP nativo y 1M tokens de contexto. Tier gratuito, configuración paso a paso y comparativa con Claude Code y Codex CLI.
Grafo de dependencias + MCP en Claude Code: reduce tokens entre 40% y 50x indexando tu codebase con Tree-sitter y SQLite. Tutorial paso a paso.
Hooks, Skills y MCPs para Claude Code: configuraciones battle-tested que automatizan workflows, bloquean errores y reducen costes en entornos reales.
Programmatic Tool Calling en Claude reduce hasta un 37% los tokens en workflows multi-herramienta. Guía práctica con código Python, benchmarks reales y consejos de producción.
OpenAI ficha al creador de OpenClaw, agente personal IA con 196K estrellas GitHub. Análisis técnico: seguridad, alternativas y futuro de agentes autónomos open source.
Este artículo técnico profundiza en las estrategias de Prompt Engineering avanzado, esenciales para desarrolladores que buscan ir más allá de las interacciones básicas con Modelos de Lenguaje Grandes (LLMs). Cubre en detalle el concepto de Chain-of-T...