AI and Automation26 de julio de 20267 min de lectura

Ventana de contexto de Claude Code: gestiónala como un presupuesto

Una sesión nueva de Claude Code ya gasta unos 20.000 tokens antes de que escribas. Así usamos /context, /compact y /clear para mantener ágil la ventana de 200K.

white and blue analog tachometer gauge

La gestión de la ventana de contexto en Claude Code es la práctica de controlar qué ocupa la ventana de 200.000 tokens del modelo para que el agente siga siendo preciso a medida que la sesión crece. Una ventana de contexto no es almacenamiento gratis. Es un presupuesto de trabajo, y se degrada según se llena.

Casi todos chocan con este límite igual. La sesión se alarga, Claude empieza a olvidar el archivo que editó hace diez minutos, y la solución parece magia cuando alguien por fin escribe /clear. No hay nada mágico en ello. Es cuestión de presupuesto. Aquí tienes cómo se llena la ventana, por qué una ventana llena hace daño y los pocos comandos que la mantienen en orden.

La versión en 30 segundos

  • La ventana admite 200.000 tokens por defecto. Una sesión nueva ya gasta unos 20.000 en el arranque, y otros 33.000 aproximadamente quedan reservados para la autocompactación.
  • La precisión baja según se llena la ventana. Es el context rot, y empieza mucho antes del tope.
  • /context muestra el desglose, /compact resume el hilo, /clear lo pone a cero.
  • Compacta al 50-70% de llenado, no esperes al disparo automático del 95%. Abre una sesión nueva por cada tarea.
  • Lleva las lecturas grandes a los subagentes, así gastan su presupuesto y no el tuyo.

¿Qué es la ventana de contexto de Claude Code?

La ventana de contexto es cada token que Claude ve a la vez: el system prompt, las definiciones de las herramientas, tu CLAUDE.md, las skills cargadas y todo el ida y vuelta de la conversación. El valor por defecto es 200.000 tokens. Opus 4.6 y posteriores, y Sonnet 4.6, llegan a una ventana de un millón de tokens cuando la activas.

Arranca ya cargada. Una sesión nueva gasta unos 20.000 tokens en el system prompt, las definiciones de herramientas y el CLAUDE.md antes de que escribas una palabra. Claude Code también aparta un búfer para la autocompactación, unos 33.000 tokens a principios de 2026, frente a los 45.000 de antes. Así que en una ventana de 200K empiezas con unos 147K de espacio útil, no con los 200K completos.

Por qué una ventana llena empeora a Claude

La ventana tiene un techo rígido, pero el problema real aparece mucho antes de tocarlo. Los investigadores lo llamaron context rot: la precisión del modelo cae a medida que la entrada se alarga, en muchos tipos de tarea, no solo en buscar una aguja en un pajar.

La caída tiene forma. Cuando la ventana está a menos de la mitad, el modelo atiende sobre todo al principio y al final y pasa rápido por el centro. Pasada la mitad, la atención se desplaza hacia los tokens más recientes y los primeros se desvanecen. En una sesión de código eso significa que la condición que fijaste en el tercer mensaje es lo primero que se escapa. Anthropic llama a la respuesta context engineering: tratar los tokens que das al modelo como un recurso escaso y elegirlos a propósito.

Así que el objetivo no es aguantar hasta el techo de los 200K. Es mantener la ventana lo bastante pequeña para que el modelo siga razonando bien sobre lo que contiene.

Los cinco comandos que gobiernan el presupuesto

Claude Code te da pocas herramientas. Cuatro comandos leen o remodelan la ventana. Uno informa del coste.

  • /context muestra adónde va cada token: system prompt, herramientas, archivos de memoria, skills y conversación, con el búfer de autocompactación reservado a la vista. Lánzalo el primero cuando la sesión se sienta pesada.
  • /status informa de las métricas de la sesión sin cambiar nada.
  • /compact resume la conversación hasta ese punto y cambia el historial en bruto por ese resumen, conserva el razonamiento y suelta el peso en tokens. /compact focus on X guía qué conserva el resumen.
  • /clear borra la conversación y devuelve el contexto a cero. Es el reinicio para pasar a un trabajo sin relación.
  • /usage (también /cost) informa del gasto frente a los límites de tu plan.

A su aire, Claude Code autocompacta cuando la ventana toca el 95% de la capacidad. Ese valor por defecto llega tarde. Al 95% el modelo ya ha razonado un rato sobre una ventana hinchada, y el resumen que escribe bajo presión es más flojo que uno que dispares a propósito.

Cómo gastamos el presupuesto

Tres hábitos mantienen viva la ventana. Ninguno es ingenioso. Todos son baratos.

Abre una sesión nueva por cada tarea. La regla práctica de Anthropic es tarea nueva, sesión nueva. Una refactorización, la caza de un bug y un repaso a la documentación apenas comparten contexto. Arrastrar una hasta la siguiente paga alquiler por tokens que el modelo luego tiene que ignorar. Termina, /clear, empieza limpio.

Compacta pronto, no al 95%. Cuando sigues en la misma tarea pero el hilo se alarga, lanza /compact tú mismo, en algún punto entre el 50 y el 70% de llenado. Conservas las decisiones y la lista de archivos; sueltas la salida en bruto de las herramientas que se comió el espacio. Añade una línea al CLAUDE.md que le diga a Claude qué debe conservar una compactación, por ejemplo la lista completa de archivos modificados y el comando de test, para que el resumen no tire justo lo que necesitabas.

Lee /context antes de culpar al modelo. Cuando Claude se vuelve olvidadizo, la ventana suele estar al 80% de un solo volcado enorme o de una herramienta que devolvió 40.000 tokens de JSON. /context te lo muestra en una pantalla. El arreglo casi siempre es estructural, un cambio en lo que le das a leer más que un prompt más listo.

Un ejemplo real. Abres una sesión para arreglar un test que falla y, a mitad de camino, le pides a Claude también refactorizar el módulo y actualizar la documentación. En el tercer trabajo el modelo relanza el test mal, porque el error original quedó enterrado bajo dos tareas posteriores. La respuesta del presupuesto: termina el arreglo del test, /clear, y abre la refactorización como sesión propia, con su ventana limpia.

¿La ventana de un millón de tokens lo arregla?

Opus y Sonnet ya llegan a una ventana de un millón de tokens, y la pregunta obvia es si eso cierra el asunto. No. Una ventana más grande sube el techo; no deroga el context rot. Sigues perdiendo precisión según se llena la ventana, solo que más tarde y a mayor coste, porque pagas por cada token de entrada y de salida. Algunos desarrolladores mantienen a propósito la ventana de 200K en vez de la de un millón, porque el presupuesto más pequeño impone la disciplina que mantiene afilada la salida. El tamaño de la ventana es un techo. El presupuesto sigue siendo cosa tuya.

Saca trabajo de tu ventana: subagentes y CLAUDE.md

El mejor token es el que nunca entra en tu ventana. Dos mecanismos mueven el trabajo a otro sitio.

Los subagentes corren en su propia ventana de contexto, aparte. Encarga a un subagente la lectura de una carpeta grande o una investigación larga: gasta su presupuesto y devuelve a la sesión principal un resumen corto. La lectura de 40.000 tokens se queda en la ventana del subagente, no en la tuya. Para todo lo exploratorio, es la jugada de mayor rendimiento.

El CLAUDE.md se carga en cada sesión, así que es presupuesto permanente. Trátalo así. Un CLAUDE.md hinchado es un impuesto sobre el recuento de tokens, en cada sesión, antes incluso de que escribas. Mantenlo corto y siempre activo, lleva las reglas de obligado cumplimiento a los hooks y el conocimiento contextual a las skills. La versión larga de ese reparto la escribimos en un artículo dedicado al CLAUDE.md, y los hábitos a nivel de sesión están en nuestro flujo de trabajo diario con Claude Code.

Toda la disciplina se reduce a una idea. La ventana es un presupuesto con un saldo fijo y un coste que corre, y el agente se atonta según baja el saldo. Vigílala con /context, gástala en una sola tarea, recárgala con /clear.

Foto de Chris Liverani en Unsplash

Preguntas frecuentes

¿/clear borra mi código o solo la conversación?

/clear solo borra el historial de la conversación de la sesión actual. Los archivos en disco, el historial de git y todo lo que ya guardaste quedan intactos. Lo que pierdes es la memoria de Claude sobre la discusión: el razonamiento, las instrucciones previas, los archivos que había leído. Si ese contexto todavía importa, usa /compact, que guarda un resumen. Usa /clear cuando la siguiente tarea empieza de verdad desde cero.

¿Cada cuánto conviene lanzar /clear en Claude Code?

Usa los límites entre tareas, no un temporizador. Cada vez que pasas a un trabajo sin relación, una función nueva, un bug distinto, un repaso a la documentación, lanza /clear y empieza limpio. Dentro de una sola tarea larga, usa /compact para conservar el razonamiento del hilo. Una señal aproximada: si te costaría explicar cómo se conecta la petición actual con la anterior, la ventana lleva peso muerto y un reinicio ayuda.

¿Por qué Claude olvida mis instrucciones en una sesión larga?

Porque la atención no es uniforme en una ventana llena. Pasada más o menos la mitad, el modelo se inclina hacia los tokens más recientes y los primeros se desvanecen. Una instrucción que diste al principio de una sesión larga es justo el tipo de token inicial que se escapa. Es el context rot, y por eso compactar pronto o repetir una condición clave a media sesión funciona mejor que seguir sin más.

¿La ventana de un millón de tokens cuesta más que la de 200K?

Sí. Pagas por cada token de entrada y de salida, así que una ventana más grande que llenas de verdad cuesta más por turno que una sesión ligera de 200K. La ventana más amplia tampoco elimina el context rot, solo lo retrasa. Para la mayoría del trabajo de código, una ventana más pequeña y ordenada con /compact y /clear es más barata y más afilada que una ventana enorme dejada a llenarse.

Artículos relacionados

Studio

Empieza un proyecto.

Un partner único para el producto digital que necesitas construir. Producción más rápida, tecnología moderna, costes reducidos. Un equipo, una factura.