Saltar al contenido
Claude Code

Por qué tus límites de Claude no duran y cómo optimizar el contexto

Técnicas prácticas para no quemar tokens en Claude Code, evitar el límite de mensajes por hora y mantener respuestas precisas en repositorios grandes.

Alejandro de Blas, fundador de Aducti

Fundador de Aducti. Software e IA.

6 min de lectura
Ver vídeo original

Si usas Claude para programar a diario, seguro que te has topado con el temido aviso: "Has alcanzado el límite de mensajes. Vuelve a intentarlo en 3 horas".

Esto no suele ocurrir por hacer demasiadas preguntas, sino por cómo viaja el contexto en cada turno.

Cuando no optimizas tu entorno, Claude Code recarga archivos completos, logs de errores gigantescos y volcados de terminal que multiplican el consumo de tokens de entrada exponencialmente.

Aquí tienes las 4 optimizaciones indispensables para que tus límites duren todo el día.

1. El filtro .claudeignore

Por defecto, los agentes intentan indexar o leer todo lo que encuentran a su paso. Si tu proyecto tiene carpetas temporales, bundles o mapas de código fuente (.map), estás pagando miles de tokens invisibles.

Crea un archivo .claudeignore en la raíz de tu proyecto:

gitignore
# Dependencias y builds
node_modules/
dist/
.next/
build/
out/

# Logs y bases de datos locales
*.log
*.sqlite
*.db
.turbo/

# Archivos de empaquetado y sourcemaps
*.map
*.lock
package-lock.json
pnpm-lock.yaml

2. Reemplazo de bloques específicos en vez de archivos completos

Un mal hábito común es pedirle a la IA: "Reescribe este archivo con el nuevo cambio".

Eso obliga al modelo a generar 400 líneas de código que ya estaban bien, consumiendo tiempo y tokens de salida (que son hasta 5 veces más caros que los de entrada).

En su lugar, instruye al agente a emitir diffs o usar herramientas de reemplazo quirúrgico (replace_file_content):

markdown
 Modifica únicamente la función `calculatePricing` dentro de `lib/billing.ts` (líneas 45-60) para aplicar el nuevo descuento del 20%. No toques el resto del archivo.

3. Limpieza de memoria intermedia (/compact y /clear)

En sesiones interactivas, la conversación acumula trazas de terminal, comandos fallidos y mensajes antiguos que ya no son relevantes para la tarea actual.

  • Usa /compact para comprimir el historial en un resumen estructurado.
  • Usa /clear cuando comiences una tarea completamente independiente. No arrastres el contexto del backend cuando vayas a maquetar el frontend.

4. Reparto de tareas por Subagentes

En lugar de mantener un único hilo monolítico de 150.000 tokens, divide el trabajo en subagentes con scopes limitados:

| Rol de Subagente | Contexto Asignado | Beneficio | |---|---|---| | Investigador (Read-only) | Solo lectura de docs y tipos | No ensucia el historial de cambios | | Editor (Write-only) | Solo el archivo objetivo | Máxima velocidad de escritura | | Tester | Solo comandos de terminal y logs de test | Si falla, no contamina el prompt principal |

Resumen

Trata el contexto como memoria RAM cara: cuanto más limpio y específico sea el contexto que le entregas a Claude en cada turno, más rápido responderá, menos alucinaciones tendrá y nunca más te quedarás bloqueado por límites de uso.

Etiquetas:#claude#claude-code#context-window#optimizacion#tokens

Recursos relacionados