Saltar al contenido
← Blog
Desarrollo

Escrito por Denys Havryliak

Por qué Claude Max se agota tan rápido y cómo hacer que dure

Claude cuenta tokens, no mensajes — y cada mensaje reenvía toda tu conversación. Por qué eso encarece las charlas largas, y los hábitos que hacen durar una suscripción Max, en lenguaje claro.

Por qué Claude Max se agota tan rápido y cómo hacer que dure

En resumen

  • Claude cuenta tokens, no mensajes. Dos personas pueden enviar el mismo número de mensajes y a una se le acaba mucho antes
  • Cada mensaje vuelve a enviar toda la conversación. Claude no recuerda nada entre un mensaje y otro, así que recibe la conversación entera cada vez. En el mensaje cincuenta, Claude vuelve a leer los cuarenta y nueve anteriores
  • Empezar una conversación nueva es gratis. Es el hábito más eficaz de todos, y no te cuesta nada
  • Volver después de un descanso largo sale caro. Claude guarda una copia barata de tu conversación durante una hora. Pasado ese tiempo, tu siguiente mensaje paga el precio completo por todo
  • Anthropic no publica cuánto te da Max. No hay una cifra oficial de tokens ni de mensajes, en ningún plan. Quien te dé una, se la ha inventado

Creamos productos con Claude a diario, con suscripciones Max, y chocamos con estos límites antes de entenderlos. Todo lo que sigue sale de la documentación de la propia Anthropic, enlazada al final. Los hábitos son nuestros.

¿Por qué Claude Max se agota tan rápido?

Imagina que respondes a un correo y, detrás de cada respuesta, grapas una fotocopia del hilo completo. El taco de papel engorda cada vez. Y te cobran por página, aunque tu mensaje nuevo sea de una sola línea.

Así funciona Claude. No recuerda tu conversación entre mensajes, así que se la vuelven a enviar entera cada vez que escribes. Tu consumo depende de lo larga que sea la conversación, no de cuánto hayas pedido.

Cada hábito de este artículo es solo una forma distinta de mantener fino ese taco de papel.

NadaLo que te cuesta empezar una conversación nuevaDocumentación de Claude Code, consultada el 15 sept. 2026: “Cuando quieres empezar de cero en lugar de continuar, /clear no cuesta nada.”
~10%Lo que cuesta releer tu conversación, dentro de esa horaDocumentación de caché de prompts de Claude Code. El historial releído se “factura aproximadamente al 10% de la tarifa estándar de entrada”. Mucho más barato, pero no gratis, y se aplica a toda la conversación cada vez.
1 horaCuánto puedes ausentarte antes de que salga caroDocumentación de caché de prompts de Claude Code. La copia barata dura una hora con una suscripción. Después, tu siguiente mensaje lo relee todo a precio completo.
Ninguna cifraLo que publica Anthropic sobre cuánto te da MaxComprobado en las páginas de los planes Max y Pro, 15 sept. 2026. Cada plan de pago se describe solo como un múltiplo del inferior.

Lo que Anthropic te dice de verdad sobre los límites

Empieza aquí, porque casi todos los consejos sobre este tema se basan en cifras que nadie ha publicado nunca. Este es todo el panorama público.

Lo que está documentado sobre el plan Max, y lo que sencillamente no aparece en ningún sitio. Las filas vacías son lo importante, no algo que se nos olvidara buscar.

Lo que la gente quiere saberLo que dice AnthropicDónde
Publicado
Precio$100/mes por Max 5x, $200/mes por Max 20xWhat is the Max plan? — precios web; en las tiendas de apps cambian
Cada cuánto se reiniciaUn límite que “se reinicia cada cinco horas”, más un límite semanal “que se aplica a todos los modelos”La misma página. Tu reinicio semanal ocurre a una hora fija asociada a tu cuenta
Cuánto te danMax 5x ofrece “cinco veces más uso por sesión que el plan Pro”. Max 20x, “20 veces”La misma página, y esa es toda la respuesta que dan
Un cambio que conviene conocerLos límites de cinco horas de Claude Code se duplicaron. Además, Pro y Max ya no tienen límites más bajos en horas puntaAnthropic, 6 de mayo de 2026. Si has leído que tu límite se agota antes en horas de mucho uso, esa información está desfasada
No publicado en ningún sitio
Cuántos tokens tienes en cinco horasninguna cifra publicadaPro tampoco tiene una cifra publicada, así que “cinco veces Pro” no se traduce en nada que puedas contar
Cuántos tienes a la semananinguna cifra publicadaPor el mismo motivo
Cuánto consume cada modeloninguna cifra publicadaLos límites existen, y Claude te avisa cuando llegas a uno, pero los umbrales no están documentados

Algo útil cuando chocas con el límite. Si el aviso dice que has llegado a tu límite de sesión o semanal, cambiar de modelo no sirve: ese límite los cubre a todos. Si nombra un modelo concreto, cambiar a otro sí te deja seguir trabajando. El propio aviso te dice cuál es.

Las cuatro cosas que consumen tu uso

Anthropic las publicó por orden de impacto en agosto de 2026, y el orden sorprende a casi todo el mundo:

1. Lo larga que es tu conversación. 2. Cuántas idas y vueltas hacen falta. 3. Qué modelo has elegido. 4. Cuánto se esfuerza pensando.

Casi todo el mundo intenta arreglar primero la número tres, cambiando a un modelo más barato. Por algo está en tercer lugar.

El modelo importa. Opus cuesta varias veces más por mensaje que Sonnet, y Sonnet más que Haiku. Pero un modelo barato que arrastra una conversación enorme te costará más que un modelo caro en una conversación recién empezada. La longitud manda.

Cuándo empezar de cero y cuándo resumir

Es la decisión que más a menudo tomas, y tiene una respuesta clara. Claude te da dos formas de liberar espacio, y su coste es muy distinto.

Escríbelos en Claude Code. Los dos liberan espacio. Solo uno es gratis.

/clear/compact
Qué haceTira la conversación y empieza de ceroSustituye la conversación por un resumen breve y sigue
Qué cuestaNadaClaude tiene que leerse toda la conversación para resumirla, así que ya es un mensaje grande en sí
Úsalo cuandoHas terminado y lo siguiente no tiene nada que verEstás a mitad de algo y necesitas el hilo, pero no cada detalle

La mayoría recurre a /compact cuando en realidad ha terminado y lo que quiere es /clear: paga por resumir un trabajo al que nadie va a volver.

Si quieres resumir, hazlo antes de irte, no después. Dentro de esa hora, resumir cuesta una fracción de lo que esperarías. Si lo haces a la mañana siguiente, Claude primero relee todo a precio completo.

Los hábitos que más ahorran

Por orden de cuánto se nota. El primer grupo pesa más que los otros dos juntos.

Todo lo que aparece aquí está documentado por Anthropic. Cuando no publican cuánto ahorra, lo decimos en lugar de adivinar.

HábitoPor qué funcionaQué se sabe
Mantén la conversación corta: con diferencia, lo que más cuenta
Empieza una conversación nueva entre tareasSi dejas una abierta todo el día, cada mensaje arrastra el día enteroNo cuesta nada. Escribe /rename antes si quieres encontrarla después, y /resume para volver a ella
Manda las búsquedas grandes a otro sitioDi “usa un subagente para encontrar X”. La búsqueda ocurre en su propio espacio y solo vuelve la respuestaEn el ejemplo de Anthropic, la búsqueda lee varios archivos y devuelve un resumen breve; el resto nunca entra en tu conversación
Señala el archivo exactoEscribe @ y el nombre del archivo para señalarlo directamente, así Claude abre ese en lugar de buscarloTe ahorra la búsqueda, y los archivos que Claude abriría por el camino
Mantén cortas las instrucciones del proyectoEl archivo CLAUDE.md de tu proyecto se carga en cada conversación, aunque no tenga nada que ver con la tareaAnthropic recomienda que no pase de 200 líneas
Menos idas y vueltas: lo segundo que más cuenta
Haz que planifique antes de construirPulsa Shift+Tab hasta que el indicador diga plan: va rotando por los modos de permisos. Claude piensa un enfoque y te lo enseña antes de escribir nadaEl motivo de Anthropic: evita “rehacer trabajo caro cuando la dirección inicial es la equivocada”
Pide algo concreto“Mejora este código” pone a Claude a leerlo todo. “Arregla el botón de inicio de sesión de la página de registro”, noNo hay cifra publicada, pero es la diferencia entre leer cuatro archivos y leer cuarenta
Páralo pronto en lugar de discutirEscape lo detiene en seco. /rewind te devuelve a antes de que se torcieraCada paso por el camino equivocado es otro mensaje que arrastra toda la conversación, y arreglarlo cuesta todavía más
Dile cómo comprobar su trabajoDale el resultado que esperas, o pega una captura de lo que ha salido malDetecta sus propios errores “antes de que tengas que pedir correcciones”
Modelo y esfuerzo: importan, pero van al final
Elige el modelo al principioOpus cuesta varias veces más por mensaje que Sonnet, y Sonnet más que HaikuCambiar a mitad de tarea obliga a Claude a releer toda la conversación: cada modelo guarda su propia copia
Baja el esfuerzo para tareas sencillasPensar más cuesta más, y no todo lo necesitaLa misma trampa en la mayoría de modelos: cambiarlo a mitad de tarea reinicia la conversación. Ajústalo una vez

Cómo ver en qué se va de verdad

No hace falta adivinar. Escribe esto en Claude Code:

  • /usage — muestra cuánto has gastado de tu plan y qué se lo ha comido. Señala lo que se lleva una parte grande, como una conversación que ha crecido demasiado. Pulsa d o w para cambiar entre el último día y la última semana
  • /context — muestra qué ocupa espacio ahora mismo en tu conversación. Ejecútalo en una conversación nueva para detectar herramientas e instrucciones que arrastras sin motivo
  • /insights — analiza cómo has trabajado últimamente y te escribe un informe sobre dónde está la fricción. Merece la pena ejecutarlo una vez. Consume parte de tu uso

Algo que confunde a mucha gente. /usage muestra una cifra en dólares y, con Max, eso no es una factura. Anthropic lo dice claramente: los suscriptores “tienen el uso incluido en su suscripción, así que la cifra de coste de la sesión no es relevante a efectos de facturación”. Tómalo como un velocímetro, no como una factura: sirve para ver qué hábitos salen caros, no dinero que debas.

Lo que cambiamos en nuestra forma de trabajar

Cuatro cosas, en el orden en que notamos la diferencia:

  1. Empezar de cero pasó a ser lo normal. Antes resumíamos al final de cada tarea terminada: pagábamos por comprimir trabajo que nadie iba a volver a mirar. Ahora, terminar algo significa abrir una conversación nueva
  2. Las búsquedas grandes se hacen en otro sitio. Cualquier cosa del tipo “revísalo todo y dime dónde pasa esto” se delega, así que cuarenta archivos nunca acaban en la conversación principal. Recibimos la respuesta y la conversación sigue corta
  3. El modelo y el esfuerzo se eligen una vez, al principio. Fue lo menos evidente. Cambiar a un modelo más potente “solo para esta parte difícil” hacía que Claude releyera, sin avisar, toda la conversación
  4. Todo lo largo se va escribiendo en un archivo. Un resumen que solo existe en la conversación muere con ella, y reconstruirlo sale caro. Volver a abrir un archivo no cuesta casi nada

Nada de esto consiste en usar menos Claude. Consiste en no pagar cincuenta veces por la misma conversación. Si prefieres tener a ingenieros con experiencia haciendo esto contigo en un producto real, eso es nuestro desarrollo de MVPs asistido por IA.

¿Merece la pena pagar Max 20x?

Corrige primero los hábitos. No cuestan nada y se acumulan. Alguien que empieza conversaciones nuevas y mantiene cortas sus instrucciones puede sacarle fácilmente más partido a Max 5x que alguien con 20x que deja una misma conversación abierta desde el desayuno hasta la cena.

Sube de plan si ya lo has hecho y sigues chocando con el límite: normalmente, si llevas varias conversaciones a la vez o trabajas jornadas largas en las que cinco horas es de verdad lo que te frena. También hay una opción intermedia: los créditos de uso te dejan seguir por encima del límite pagando el exceso, con un tope mensual que fijas tú. Los encontrarás en la configuración de tu cuenta de Claude, en la sección de uso.

Hay una trampa que conviene conocer. En cuanto funcionas con créditos, esa copia barata de una hora baja a cinco minutos, porque ahora te están cobrando por ella. No se rompe nada; simplemente, los descansos salen más caros.

Y si llegas al límite a mitad de una tarea, las versiones recientes de Claude Code pueden esperar al reinicio y seguir donde lo dejaste. Compruébalo antes de ponerte a rehacer trabajo a mano.

Si quieres ir más allá, hemos escrito sobre lo que cuesta de verdad el vibe coding frente a contratar ingenieros y, porque es la parte que la gente se salta, sobre los riesgos de seguridad de las apps hechas con vibe coding. Si construyes para iPhone o Android en concreto, tienes Claude Code con Xcode y Claude Code con Android Studio.

Fuentes

Cada cifra de arriba sale de una de estas fuentes, todas consultadas el 15 de septiembre de 2026. Cada nota indica qué demuestra y qué no.

Documentación de Anthropic

  1. Claude Code — “Manage costs effectively”Fuente de los hábitos, de los motivos por los que el uso sube en una conversación larga, de lo que muestra /usage y del consejo de mantener las instrucciones del proyecto por debajo de 200 líneas. Sus cifras en dólares son medias de grandes empresas que pagan por token, no cifras de suscripción, así que aquí no citamos ninguna.
  2. Claude Code — “How Claude Code uses prompt caching”Fuente de la tarifa reducida de relectura, de la duración de una hora, de qué hace que Claude reinicie tu conversación y de por qué resumir cuesta menos dentro de esa hora.
  3. Claude Code — “Subagents”Fuente de la idea de delegar las búsquedas grandes para que a tu conversación solo vuelva la respuesta.
  4. Claude Code — “Explore the context window”Un recorrido interactivo de una conversación que se va llenando. De aquí sale el ejemplo de la búsqueda que devuelve un resumen breve. Son cifras ilustrativas de Anthropic para una sesión de ejemplo, no mediciones de tu equipo.

Las páginas de los planes

  1. Claude Help Center — “What is the Max plan?”Los precios, el reinicio de cinco horas, el límite semanal y la comparación 5x/20x con Pro. No contiene ninguna cifra de tokens ni de mensajes, y por eso este artículo no publica ninguna.
  2. Claude Help Center — “What is the Pro plan?”Consultada expresamente para ver si existe una cifra real más abajo en la cadena. Pro se describe como “al menos cinco veces el uso por sesión de nuestro servicio gratuito”: otro múltiplo, sin nada debajo. De gratis a Pro y de Pro a Max, todo es relativo.
  3. Anthropic — “Higher usage limits” (6 de mayo de 2026)La duplicación de los límites de cinco horas de Claude Code y el fin de la reducción en horas punta para Pro y Max. Conviene tenerlo en cuenta porque muchos artículos siguen describiendo el funcionamiento anterior.

Escrito por el equipo que desarrolla Claude Code

  1. “Maximizing the value of your Claude Code sessions” (14 de agosto de 2026)Fuente del orden de las cuatro cosas que consumen tu uso, y de resumir antes de un descanso en lugar de después.
  2. “Lessons from building Claude Code: prompt caching is everything” (30 de abril de 2026)Por qué esto le importa a Anthropic tanto como a ti: vigilan con qué frecuencia se reutiliza esa copia barata, y dicen que una tasa alta “nos ayuda a ofrecer límites más generosos en nuestros planes de suscripción”.

Lo que este artículo no afirma

  1. Ninguna cifra de tokens ni de mensajes para ningún plan. Anthropic no publica ninguna, en ningún nivel.
  2. Ningún porcentaje de ahorro para ningún hábito salvo que Anthropic lo haya publicado. No hicimos una prueba controlada a lo largo de un periodo del plan, y la variación de una persona de una semana a otra taparía el resultado de todos modos.
  3. Ninguna afirmación de que esto sea permanente. Claude Code cambia a menudo y los límites ya cambiaron una vez en 2026. Las páginas enlazadas son la referencia actual; este artículo es una foto de septiembre de 2026.

Artículos relacionados

Trabaja con Applefy
Hablemos

Reserva una llamada con nuestro CEO

Retrato de Denys Havryliak, fundador y CEO de Applefy

Denys Havryliak

Fundador y CEO

  • Más de 10 años en ingeniería de software
  • Máster en ciberseguridad
  • Conocimiento profundo y actual de las herramientas de IA

Hablarás con quien construye. Denys trabaja de forma práctica en producto, arquitectura y entrega, y sigue de cerca lo que las herramientas de IA de hoy pueden hacer de verdad en producción, no solo en una demo.