Reducir el uso de tokens de Claude Code: imponer, no sugerir
La respuesta corta
Una relación ampliamente difundida afirma reducir el uso de tokens de Claude Code en más del 90% usando una pila de 5 capas donde cada capa captura lo que la anterior dejó pasar — además de hooks que imponen la pila para que Claude no vuelva al camino perezoso.
La lección que vale la pena tomar no es la cifra exacta del 90% (es autoinformada y muy dependiente de la configuración) — es el encuadre: "No le digas a Claude que sea eficiente. Impónlo. Un hook que bloquee un patrón desperdiciador vence a 1.000 palabras en CLAUDE.md."
Las cinco capas
Cada capa se sitúa en un punto diferente del flujo:
- Codebase Memory MCP (grafo de conocimiento) — cambia lecturas de archivos por consultas estructuradas. Reporta ~99% de reducción en tokens para exploración de código.
- Context-mode (virtualización de salida) — aísla salidas grandes, las indexa en una tienda buscable y devuelve solo un resumen. Reporta ~98% de reducción en salidas voluminosas.
- RTK (compresión de shell) — un binario que comprime la salida de la CLI in situ antes de que entre al contexto. Reporta 60–90% de reducción en salida de shell.
- Headroom (proxy a nivel de API) — comprime todo el prompt antes de que salga de la máquina, incluyendo el historial de conversación y prompts de sistema. Reporta 47–92% de reducción.
- Caveman (estilo de salida) — hace que Claude mismo hable menos: sin relleno, sin cortesías. Reporta 50–75% de reducción en las respuestas de Claude.
La idea de la imposición
La parte distintiva es la imposición mediante hooks. El autor no solo sugiere usar primero el grafo de conocimiento — un hook PreToolUse bloquea la primera llamada Read/Grep/Glob/Search hasta que se haya usado una herramienta codebase-memory-mcp. Una vez que existe el marcador, la compuerta se desactiva para el resto de la sesión.
Un segundo hook (bash-ban-raw-tools) bloquea cat/grep/find/head/tail vía Bash — porque la salida de Bash evita todos los hooks de compresión y va directamente al contexto. También se rechazan tuberías de truncado bruto (| head), ya que inundan el contexto antes de la reducción.
Ese es el principio transferible: haz que el camino eficiente sea el único camino posible. Claude toma siempre la ruta de menor resistencia.
Ganancias rápidas antes de cualquier hook
Tres movimientos sin esfuerzo inmediato ayudan de inmediato:
/clearagresivamente — sesiones cortas y enfocadas superan a las largas.- Deshabilitar servidores MCP no usados por sesión — los servidores sin usar consumen contexto silenciosamente mediante las descripciones de las herramientas.
- Preferir Mermaid sobre prosa para arquitectura — un diagrama de 6 líneas transmite la forma de 3 párrafos por una fracción de los tokens.
Una nota sobre los números
Esta pila es una configuración de usuario avanzado y con opiniones que tiene advertencias reales de seguridad:
- Los porcentajes alegados son mediciones individuales en un proyecto específico — considérelos direccionales, no garantizados.
- El instalador obtiene código de terceros de PyPI, npm, mercados de plugins y releases de GitHub. Audite, fije versiones o verifique esas dependencias antes de usar en algo sensible.
- Varias capas (Headroom, context-mode, hooks, servidores MCP) pueden ver prompts, salidas de herramientas, código, logs y datos de sesión — trátelas como herramientas locales con acceso a secretos.
- La configuración omite solicitudes de permiso (
defaultMode: auto, flags skip-dangerous), lo que significa menos puntos de control humanos antes de ejecutar comandos. - Si algo de eso es inaceptable, haga una instalación manual, omita el wrapper de shell y mantenga las solicitudes de permiso activas.
Conclusión
La lección duradera no es "apila 5 plugins." Es la mentalidad de imposición: si quieres que Claude deje de desperdiciar tokens, no te limites a decírselo — haz que el camino desperdiciador sea imposible. Ya sea un hook que bloquee cat/grep crudos, una herramienta que virtualice salidas grandes antes de que lleguen al contexto, o un ajuste de esfuerzo por defecto agresivo, la ganancia viene de límites que Claude físicamente no puede cruzar — no de un prompt mejor redactado.
Este es un informe práctico (Abid Abdul Gafoor, abril de 2026) con el repositorio complementario sgaabdu4/claude-code-tips. Los porcentajes son mediciones propias del autor. La mecánica de Claude Code (MCP disable, /clear, hooks) se verificó contra la documentación oficial cuando corresponde; las afirmaciones sobre herramientas de terceros no fueron verificadas de forma independiente el 2026-08-07.