Saltar al contenido
Curso Claude Code
13/57 Modelos, effort y coste Ventana de contexto y compactación en Claude Code
Tu lectura Quedan 14 min
Lección 13 de 57 · Modelos, effort y coste

Ventana de contexto y compactación en Claude Code

14 min de lectura Claude Code 2.1.283

Hola, bienvenido. En la lección anterior vimos cómo funcionan los límites de cada plan y cómo consultar lo que llevas gastado, y en esta lección vamos a ver lo que más influye en lo rápido que se gastan: la ventana de contexto. Veremos qué ocupa el contexto en cada petición, qué significa que hoy tengas 1 millón de tokens en todos los planes, cómo revisarlo con /context, cuándo y cómo compactar con /compact y /autocompact, qué sobrevive a una compactación y qué acciones rompen la caché de prompts, que es lo que decide si una petición sale barata o cara.

La propia documentación de Claude Code lo dice sin rodeos: casi todas las buenas prácticas salen de una sola limitación, que la ventana de contexto se llena rápido y que el rendimiento del modelo empeora a medida que se llena. Cuando el contexto va lleno, Claude puede empezar a olvidar instrucciones que le diste al principio o a cometer más errores, y la documentación considera la ventana de contexto el recurso más importante que tienes que gestionar. Así que esta lección va de calidad tanto como de dinero.

Qué ocupa la ventana de contexto

La ventana de contexto es todo lo que Claude tiene delante en cada petición, y hay que entender un detalle de cómo funciona para que el resto tenga sentido: el modelo no recuerda nada entre una petición y la siguiente. Cada vez que envías un mensaje, Claude Code vuelve a enviar el contexto completo, con las instrucciones del sistema, el contexto del proyecto, todos los mensajes y resultados de herramientas anteriores y tu mensaje nuevo al final. Por eso una pregunta de una línea en una sesión que lleva abierta todo el día consume uso por toda la conversación que arrastra.

Antes de que escribas nada, en el contexto ya hay bastantes cosas:

  • Las instrucciones del sistema y las definiciones de las herramientas.
  • Tu CLAUDE.md y la auto memory, que veremos en la sección de memoria, y el AGENTS.md si tu proyecto lo tiene.
  • Los nombres de las herramientas de los servidores MCP y sus instrucciones, porque las definiciones completas se cargan bajo demanda.
  • Las descripciones de las skills disponibles.

Y a medida que Claude trabaja, se va sumando todo lo demás: cada archivo que lee, cada salida de un comando, las rules que se cargan al tocar ciertas carpetas, lo que añaden los hooks, tus mensajes y sus respuestas. Una sesión de depuración o una exploración del código puede generar decenas de miles de tokens. La excepción son los subagentes, que trabajan en su propia ventana de contexto: las lecturas grandes se quedan en la suya y a la tuya solo vuelve un resumen, que es una de las razones por las que tienen su propia sección en el curso.

Lo que queda de esta lección
  1. 02Un millón de tokens en todos los planes
  2. 03Revisar el contexto con /context
  3. 04Compactar la conversación
  4. 05Qué sobrevive a una compactación
  5. 06Empezar de cero con /clear
  6. 07No romper la caché de prompts
Sigue leyendo con tu suscripción El curso completo, con el certificado y el foro con los planes trimestral y anual, está incluido en la suscripción. Ver los planes