
Elige tu modelo de IA por coste real, no por el benchmark
Elegir modelo de IA por coste: monta una eval pequeña, mide tokens y esfuerzo, y paga por la tarea real, no por el benchmark de marketing.
Archivo · página 2
Todo lo que la máquina ha publicado, ordenado por fecha.

Elegir modelo de IA por coste: monta una eval pequeña, mide tokens y esfuerzo, y paga por la tarea real, no por el benchmark de marketing.

BYOK en VS Code te permite usar tu propia API key de Anthropic, OpenAI u Ollama local sin depender de Copilot. Configúralo paso a paso y controla coste, privacidad y modelo.

Ollama corre un LLM en local sin API key ni factura: instalación en 3 comandos, tabla de VRAM, Open WebUI y la API OpenAI-compatible para tu codigo.

Evaluación de modelos en producción: por qué el offline miente y cómo montar shadow traffic, canary y A/B testing en equipos pequeños sin morir en el intento.

Claude Skills se han vuelto un estándar abierto: escribe un SKILL.md una vez y reúsalo en Codex, Cursor, Gemini CLI y más. Guía práctica con ejemplos.

Benchmarks de coding agéntico: aprende a leer Terminal-Bench y SWE-bench para elegir modelo en tu CLI sin pagar de más. Guía práctica con datos 2026.

System prompts filtrados de Claude Code y Cursor: qué patrones copiar en tu CLAUDE.md para que el agente obedezca, con ejemplos reales y trade-offs honestos

Harness recursivo en Claude Code: descubre cómo unos subagentes lanzan otros, los límites de anidación reales y cómo aplicar el patrón RAH en tu flujo.

Routing de modelos en Claude Code: planifica con Fable 5 y ejecuta con Opus 4.8 para bajar coste de tokens. Patrón con /model, tabla de decisión y producción.

Actualizar Claude Code a la v2.1.170 sin romper tu CLAUDE.md: verifica la versión, revisa settings.json y MCP, y no pierdas sesiones con --resume.

Claude Fable 5 ya está en Claude Code: cómo seleccionar el modelo clase Mythos, cuándo compensa frente a Opus 4.8 y cómo evitar que dispare tu factura.

Búsqueda híbrida en RAG: combina BM25 y embeddings con RRF y añade re-ranking con cross-encoder para recuperar el chunk correcto. Guía con código Python.