Escrito por Denys Havryliak
Por qué Claude Max se agota tan rápido y cómo hacer que dure
Claude cuenta tokens, no mensajes — y cada mensaje reenvía toda tu conversación. Por qué eso encarece las charlas largas, y los hábitos que hacen durar una suscripción Max, en lenguaje claro.

En resumen
- Claude cuenta tokens, no mensajes. Dos personas pueden enviar el mismo número de mensajes y a una se le acaba mucho antes
- Cada mensaje vuelve a enviar toda la conversación. Claude no recuerda nada entre un mensaje y otro, así que recibe la conversación entera cada vez. En el mensaje cincuenta, Claude vuelve a leer los cuarenta y nueve anteriores
- Empezar una conversación nueva es gratis. Es el hábito más eficaz de todos, y no te cuesta nada
- Volver después de un descanso largo sale caro. Claude guarda una copia barata de tu conversación durante una hora. Pasado ese tiempo, tu siguiente mensaje paga el precio completo por todo
- Anthropic no publica cuánto te da Max. No hay una cifra oficial de tokens ni de mensajes, en ningún plan. Quien te dé una, se la ha inventado
Creamos productos con Claude a diario, con suscripciones Max, y chocamos con estos límites antes de entenderlos. Todo lo que sigue sale de la documentación de la propia Anthropic, enlazada al final. Los hábitos son nuestros.
¿Por qué Claude Max se agota tan rápido?
Imagina que respondes a un correo y, detrás de cada respuesta, grapas una fotocopia del hilo completo. El taco de papel engorda cada vez. Y te cobran por página, aunque tu mensaje nuevo sea de una sola línea.
Así funciona Claude. No recuerda tu conversación entre mensajes, así que se la vuelven a enviar entera cada vez que escribes. Tu consumo depende de lo larga que sea la conversación, no de cuánto hayas pedido.
Cada hábito de este artículo es solo una forma distinta de mantener fino ese taco de papel.
Lo que Anthropic te dice de verdad sobre los límites
Empieza aquí, porque casi todos los consejos sobre este tema se basan en cifras que nadie ha publicado nunca. Este es todo el panorama público.
Lo que está documentado sobre el plan Max, y lo que sencillamente no aparece en ningún sitio. Las filas vacías son lo importante, no algo que se nos olvidara buscar.
| Lo que la gente quiere saber | Lo que dice Anthropic | Dónde |
|---|---|---|
| Publicado | ||
| Precio | $100/mes por Max 5x, $200/mes por Max 20x | What is the Max plan? — precios web; en las tiendas de apps cambian |
| Cada cuánto se reinicia | Un límite que “se reinicia cada cinco horas”, más un límite semanal “que se aplica a todos los modelos” | La misma página. Tu reinicio semanal ocurre a una hora fija asociada a tu cuenta |
| Cuánto te dan | Max 5x ofrece “cinco veces más uso por sesión que el plan Pro”. Max 20x, “20 veces” | La misma página, y esa es toda la respuesta que dan |
| Un cambio que conviene conocer | Los límites de cinco horas de Claude Code se duplicaron. Además, Pro y Max ya no tienen límites más bajos en horas punta | Anthropic, 6 de mayo de 2026. Si has leído que tu límite se agota antes en horas de mucho uso, esa información está desfasada |
| No publicado en ningún sitio | ||
| Cuántos tokens tienes en cinco horas | ninguna cifra publicada | Pro tampoco tiene una cifra publicada, así que “cinco veces Pro” no se traduce en nada que puedas contar |
| Cuántos tienes a la semana | ninguna cifra publicada | Por el mismo motivo |
| Cuánto consume cada modelo | ninguna cifra publicada | Los límites existen, y Claude te avisa cuando llegas a uno, pero los umbrales no están documentados |
Algo útil cuando chocas con el límite. Si el aviso dice que has llegado a tu límite de sesión o semanal, cambiar de modelo no sirve: ese límite los cubre a todos. Si nombra un modelo concreto, cambiar a otro sí te deja seguir trabajando. El propio aviso te dice cuál es.
Las cuatro cosas que consumen tu uso
Anthropic las publicó por orden de impacto en agosto de 2026, y el orden sorprende a casi todo el mundo:
1. Lo larga que es tu conversación. 2. Cuántas idas y vueltas hacen falta. 3. Qué modelo has elegido. 4. Cuánto se esfuerza pensando.
Casi todo el mundo intenta arreglar primero la número tres, cambiando a un modelo más barato. Por algo está en tercer lugar.
El modelo importa. Opus cuesta varias veces más por mensaje que Sonnet, y Sonnet más que Haiku. Pero un modelo barato que arrastra una conversación enorme te costará más que un modelo caro en una conversación recién empezada. La longitud manda.
Cuándo empezar de cero y cuándo resumir
Es la decisión que más a menudo tomas, y tiene una respuesta clara. Claude te da dos formas de liberar espacio, y su coste es muy distinto.
Escríbelos en Claude Code. Los dos liberan espacio. Solo uno es gratis.
/clear | /compact | |
|---|---|---|
| Qué hace | Tira la conversación y empieza de cero | Sustituye la conversación por un resumen breve y sigue |
| Qué cuesta | Nada | Claude tiene que leerse toda la conversación para resumirla, así que ya es un mensaje grande en sí |
| Úsalo cuando | Has terminado y lo siguiente no tiene nada que ver | Estás a mitad de algo y necesitas el hilo, pero no cada detalle |
La mayoría recurre a /compact cuando en realidad ha terminado y lo que quiere es /clear: paga por resumir un trabajo al que nadie va a volver.
Si quieres resumir, hazlo antes de irte, no después. Dentro de esa hora, resumir cuesta una fracción de lo que esperarías. Si lo haces a la mañana siguiente, Claude primero relee todo a precio completo.
Los hábitos que más ahorran
Por orden de cuánto se nota. El primer grupo pesa más que los otros dos juntos.
Todo lo que aparece aquí está documentado por Anthropic. Cuando no publican cuánto ahorra, lo decimos en lugar de adivinar.
| Hábito | Por qué funciona | Qué se sabe |
|---|---|---|
| Mantén la conversación corta: con diferencia, lo que más cuenta | ||
| Empieza una conversación nueva entre tareas | Si dejas una abierta todo el día, cada mensaje arrastra el día entero | No cuesta nada. Escribe /rename antes si quieres encontrarla después, y /resume para volver a ella |
| Manda las búsquedas grandes a otro sitio | Di “usa un subagente para encontrar X”. La búsqueda ocurre en su propio espacio y solo vuelve la respuesta | En el ejemplo de Anthropic, la búsqueda lee varios archivos y devuelve un resumen breve; el resto nunca entra en tu conversación |
| Señala el archivo exacto | Escribe @ y el nombre del archivo para señalarlo directamente, así Claude abre ese en lugar de buscarlo | Te ahorra la búsqueda, y los archivos que Claude abriría por el camino |
| Mantén cortas las instrucciones del proyecto | El archivo CLAUDE.md de tu proyecto se carga en cada conversación, aunque no tenga nada que ver con la tarea | Anthropic recomienda que no pase de 200 líneas |
| Menos idas y vueltas: lo segundo que más cuenta | ||
| Haz que planifique antes de construir | Pulsa Shift+Tab hasta que el indicador diga plan: va rotando por los modos de permisos. Claude piensa un enfoque y te lo enseña antes de escribir nada | El motivo de Anthropic: evita “rehacer trabajo caro cuando la dirección inicial es la equivocada” |
| Pide algo concreto | “Mejora este código” pone a Claude a leerlo todo. “Arregla el botón de inicio de sesión de la página de registro”, no | No hay cifra publicada, pero es la diferencia entre leer cuatro archivos y leer cuarenta |
| Páralo pronto en lugar de discutir | Escape lo detiene en seco. /rewind te devuelve a antes de que se torciera | Cada paso por el camino equivocado es otro mensaje que arrastra toda la conversación, y arreglarlo cuesta todavía más |
| Dile cómo comprobar su trabajo | Dale el resultado que esperas, o pega una captura de lo que ha salido mal | Detecta sus propios errores “antes de que tengas que pedir correcciones” |
| Modelo y esfuerzo: importan, pero van al final | ||
| Elige el modelo al principio | Opus cuesta varias veces más por mensaje que Sonnet, y Sonnet más que Haiku | Cambiar a mitad de tarea obliga a Claude a releer toda la conversación: cada modelo guarda su propia copia |
| Baja el esfuerzo para tareas sencillas | Pensar más cuesta más, y no todo lo necesita | La misma trampa en la mayoría de modelos: cambiarlo a mitad de tarea reinicia la conversación. Ajústalo una vez |
Cómo ver en qué se va de verdad
No hace falta adivinar. Escribe esto en Claude Code:
/usage— muestra cuánto has gastado de tu plan y qué se lo ha comido. Señala lo que se lleva una parte grande, como una conversación que ha crecido demasiado. Pulsadowpara cambiar entre el último día y la última semana/context— muestra qué ocupa espacio ahora mismo en tu conversación. Ejecútalo en una conversación nueva para detectar herramientas e instrucciones que arrastras sin motivo/insights— analiza cómo has trabajado últimamente y te escribe un informe sobre dónde está la fricción. Merece la pena ejecutarlo una vez. Consume parte de tu uso
Algo que confunde a mucha gente. /usage muestra una cifra en dólares y, con Max, eso no es una factura. Anthropic lo dice claramente: los suscriptores “tienen el uso incluido en su suscripción, así que la cifra de coste de la sesión no es relevante a efectos de facturación”. Tómalo como un velocímetro, no como una factura: sirve para ver qué hábitos salen caros, no dinero que debas.
Lo que cambiamos en nuestra forma de trabajar
Cuatro cosas, en el orden en que notamos la diferencia:
- Empezar de cero pasó a ser lo normal. Antes resumíamos al final de cada tarea terminada: pagábamos por comprimir trabajo que nadie iba a volver a mirar. Ahora, terminar algo significa abrir una conversación nueva
- Las búsquedas grandes se hacen en otro sitio. Cualquier cosa del tipo “revísalo todo y dime dónde pasa esto” se delega, así que cuarenta archivos nunca acaban en la conversación principal. Recibimos la respuesta y la conversación sigue corta
- El modelo y el esfuerzo se eligen una vez, al principio. Fue lo menos evidente. Cambiar a un modelo más potente “solo para esta parte difícil” hacía que Claude releyera, sin avisar, toda la conversación
- Todo lo largo se va escribiendo en un archivo. Un resumen que solo existe en la conversación muere con ella, y reconstruirlo sale caro. Volver a abrir un archivo no cuesta casi nada
Nada de esto consiste en usar menos Claude. Consiste en no pagar cincuenta veces por la misma conversación. Si prefieres tener a ingenieros con experiencia haciendo esto contigo en un producto real, eso es nuestro desarrollo de MVPs asistido por IA.
¿Merece la pena pagar Max 20x?
Corrige primero los hábitos. No cuestan nada y se acumulan. Alguien que empieza conversaciones nuevas y mantiene cortas sus instrucciones puede sacarle fácilmente más partido a Max 5x que alguien con 20x que deja una misma conversación abierta desde el desayuno hasta la cena.
Sube de plan si ya lo has hecho y sigues chocando con el límite: normalmente, si llevas varias conversaciones a la vez o trabajas jornadas largas en las que cinco horas es de verdad lo que te frena. También hay una opción intermedia: los créditos de uso te dejan seguir por encima del límite pagando el exceso, con un tope mensual que fijas tú. Los encontrarás en la configuración de tu cuenta de Claude, en la sección de uso.
Hay una trampa que conviene conocer. En cuanto funcionas con créditos, esa copia barata de una hora baja a cinco minutos, porque ahora te están cobrando por ella. No se rompe nada; simplemente, los descansos salen más caros.
Y si llegas al límite a mitad de una tarea, las versiones recientes de Claude Code pueden esperar al reinicio y seguir donde lo dejaste. Compruébalo antes de ponerte a rehacer trabajo a mano.
Si quieres ir más allá, hemos escrito sobre lo que cuesta de verdad el vibe coding frente a contratar ingenieros y, porque es la parte que la gente se salta, sobre los riesgos de seguridad de las apps hechas con vibe coding. Si construyes para iPhone o Android en concreto, tienes Claude Code con Xcode y Claude Code con Android Studio.
Fuentes
Cada cifra de arriba sale de una de estas fuentes, todas consultadas el 15 de septiembre de 2026. Cada nota indica qué demuestra y qué no.
Documentación de Anthropic
- Claude Code — “Manage costs effectively”Fuente de los hábitos, de los motivos por los que el uso sube en una conversación larga, de lo que muestra
/usagey del consejo de mantener las instrucciones del proyecto por debajo de 200 líneas. Sus cifras en dólares son medias de grandes empresas que pagan por token, no cifras de suscripción, así que aquí no citamos ninguna. - Claude Code — “How Claude Code uses prompt caching”Fuente de la tarifa reducida de relectura, de la duración de una hora, de qué hace que Claude reinicie tu conversación y de por qué resumir cuesta menos dentro de esa hora.
- Claude Code — “Subagents”Fuente de la idea de delegar las búsquedas grandes para que a tu conversación solo vuelva la respuesta.
- Claude Code — “Explore the context window”Un recorrido interactivo de una conversación que se va llenando. De aquí sale el ejemplo de la búsqueda que devuelve un resumen breve. Son cifras ilustrativas de Anthropic para una sesión de ejemplo, no mediciones de tu equipo.
Las páginas de los planes
- Claude Help Center — “What is the Max plan?”Los precios, el reinicio de cinco horas, el límite semanal y la comparación 5x/20x con Pro. No contiene ninguna cifra de tokens ni de mensajes, y por eso este artículo no publica ninguna.
- Claude Help Center — “What is the Pro plan?”Consultada expresamente para ver si existe una cifra real más abajo en la cadena. Pro se describe como “al menos cinco veces el uso por sesión de nuestro servicio gratuito”: otro múltiplo, sin nada debajo. De gratis a Pro y de Pro a Max, todo es relativo.
- Anthropic — “Higher usage limits” (6 de mayo de 2026)La duplicación de los límites de cinco horas de Claude Code y el fin de la reducción en horas punta para Pro y Max. Conviene tenerlo en cuenta porque muchos artículos siguen describiendo el funcionamiento anterior.
Escrito por el equipo que desarrolla Claude Code
- “Maximizing the value of your Claude Code sessions” (14 de agosto de 2026)Fuente del orden de las cuatro cosas que consumen tu uso, y de resumir antes de un descanso en lugar de después.
- “Lessons from building Claude Code: prompt caching is everything” (30 de abril de 2026)Por qué esto le importa a Anthropic tanto como a ti: vigilan con qué frecuencia se reutiliza esa copia barata, y dicen que una tasa alta “nos ayuda a ofrecer límites más generosos en nuestros planes de suscripción”.
Lo que este artículo no afirma
- Ninguna cifra de tokens ni de mensajes para ningún plan. Anthropic no publica ninguna, en ningún nivel.
- Ningún porcentaje de ahorro para ningún hábito salvo que Anthropic lo haya publicado. No hicimos una prueba controlada a lo largo de un periodo del plan, y la variación de una persona de una semana a otra taparía el resultado de todos modos.
- Ninguna afirmación de que esto sea permanente. Claude Code cambia a menudo y los límites ya cambiaron una vez en 2026. Las páginas enlazadas son la referencia actual; este artículo es una foto de septiembre de 2026.
Artículos relacionados
- Por qué los iPhone cierran primero las aplicaciones pesadasDesarrollo
- Claude Code con Xcode: guía de flujo de trabajo 2026 para ingenieros iOSIA y herramientas
- Claude Code con Android Studio: guía de flujo de trabajo 2026 para ingenieros KotlinIA y herramientas
