← voltar Arte em linha de um blueprint com dois medidores de calibre aninhados conectados por tubos, representando janelas de limite de uso sobrepostas.

Limites de Uso do Claude Code: Caps de Sessão, Limites Semanais e Opções

O Claude Code executa dois medidores de uso simultaneamente, e a maioria das pessoas que são interrompidas no meio da tarefa conhece apenas um deles. Há uma janela de sessão móvel de cinco horas para rajadas curtas, e um cap semanal separado que se aplica em todos os modelos e todas as superfícies. Os dois podem disparar independentemente, o que é por que o comportamento parece imprevisível. Este post cobre como identificar qual limite você atingiu, o que consome uso mais rápido do que você esperaria, e quais são suas opções realistas quando o trabalho para.

Qual Limite Você Realmente Atingiu?

Esta é a primeira pergunta a responder, porque a solução é completamente diferente dependendo da resposta.

Quando a janela de sessão de cinco horas se esgota, o Claude Code dirá para você esperar e fornecerá um tempo aproximado até a janela avançar. Quando o cap semanal dispara, a mensagem é diferente: você atingiu seu limite de uso para o período, e esperar algumas horas não vai resolver.

A maneira mais confiável de distingui-los é verificar Configurações → Uso no aplicativo web. Essa visualização mostra barras de progresso para a janela de sessão e o limite semanal, e é a única que obtém uso de todos os seus dispositivos. O comando /status dentro do Claude Code também exibe avisos conforme você se aproxima de qualquer um dos limites, e /usage fornece um detalhamento mais detalhado (com d / w para alternar entre visualizações de 24 horas e 7 dias). Uma ressalva importante do detalhamento do bestagent.dev: as figuras na CLI são "calculadas a partir do histórico de sessão local nesta máquina", portanto não refletirão o que você fez em uma máquina diferente ou via claude.ai.

Triagem rápida:

  • Mensagem diz para esperar algumas horas: quase certamente a janela de sessão de 5 horas
  • Mensagem referencia seu limite de uso sem oferta de espera curta: provavelmente o cap semanal
  • Você está no Max 5x ou Max 20x e atingindo limites rapidamente: verifique se o sub-cap semanal apenas Sonnet é o culpado (os planos Max têm dois caps semanais, não um)

Janelas de Sessão e Semanais: Como Funcionam Realmente

A janela de cinco horas é móvel, não fixa em um relógio. Ela começa com sua primeira mensagem e reinicia cinco horas depois, independentemente da hora em que começou. Portanto, se você enviar sua primeira mensagem às 14h47, sua janela reinicia às 19h47, não às 20h.

O cap semanal funciona com a mesma lógica móvel, de acordo com o guia 2026 do Tokens for Good: ele reinicia aproximadamente sete dias após a primeira mensagem de seu ciclo atual, não em um dia de calendário fixo. Seu dia de reset pessoal depende de quando você começou, não de um midnight segunda-feira compartilhado.

Nenhum limite se acumula. O espaço não utilizado desaparece na reinicialização. Não se acumula.

Aqui está a comparação de planos, baseada em multiplicadores documentados e no posicionamento da própria Anthropic:

PlanoPreçoAllowance de sessãoCaps semanais
Gratuito$0Baseline1 (todos os modelos)
Pro$20/mês~5x Free1 (todos os modelos)
Máx 5x$100/mês5x Pro2 (todos os modelos + apenas Sonnet)
Máx 20x$200/mês20x Pro2 (todos os modelos + apenas Sonnet)
Team Premium$100/assento/mês (anual)~6,25x Pro2 (todos os modelos + apenas Sonnet)

O número de Team Premium é a figura menos discutida da linha. Pelo mesmo preço de Max 5x, um assento Team Premium na verdade fica acima de Max 5x no uso de sessões, com o excedente gerenciado pelo seu administrador em vez de self-serve. Vale a pena saber se você está comprando assentos para um time mesmo assim.

Um mito que vale a pena esclarecer: a pesquisa de abril de 2026 do TokenMix flagra explicitamente que "Max 5x e Max 20x são simplesmente Claude ilimitado" é falso. Max expande o uso, mas limites de sessão, semanal e de modelo ainda se aplicam a critério da Anthropic. É um pool maior, não um sem fundo.

O Que Muda Seu Consumo de Uso

O uso não é contado em mensagens brutas. O verdadeiro motor é o peso computacional por requisição.

Coisas que queimam mais rápido do que você esperaria:

  • Modo de pensamento estendido. Quando Claude raciocina sobre um problema passo a passo antes de responder, esse raciocínio custa tokens mesmo que você nunca veja tudo.
  • Conectores MCP. Múltiplos conectores ativos multiplicam chamadas de ferramentas. Cada chamada de ferramenta se soma à conta computacional para essa sessão.
  • Leituras pesadas de arquivos. Um prompt curto que dispara a leitura de uma grande base de código pode consumir muito mais do que um prompt conversacional longo.
  • Escolha de modelo. Modelos classe Opus consomem o orçamento de sessão muito mais rápido que Sonnet. Se você está rodando Opus para tarefas que Sonnet faz bem, você está queimando orçamento de sessão desnecessariamente.
  • Subagentes e sessões paralelas. Executar múltiplas sessões Claude Code simultaneamente aumenta a taxa de consumo em ambas as janelas.

E o detalhe que pega as pessoas desprevenidas: tudo isso é contado em um mesmo pool compartilhado. Conversas no Claude.ai, Claude Desktop e a CLI extraem do mesmo limite do plano. O breakdown do Felloai deixa claro: Anthropic não publica mais contagens de mensagens para nenhum plano, por isso os números que circulam pela internet raramente coincidem com o que você realmente experimenta.

Os horários de pico adicionam outra camada. Assinantes Free, Pro e Max consomem a janela de cinco horas mais rápido nos dias úteis entre 5 a.m. e 11 a.m. PT (1 p.m. a 7 p.m. GMT). Mesma tarefa, mesmo modelo, drenagem mais rápida. Se você está em Londres fazendo trabalho pesado com Claude Code à tarde, está atingindo essa janela no seu pior momento.

O Que Fazer Quando o Trabalho É Bloqueado

Aqui está uma árvore de decisão para quando você bate um limite no meio da tarefa.

Diagrama em arte linear de uma árvore de decisão com nós e tubulações com símbolos de válvula, representando um fluxo de solução de problemas para tipos de limite.
  1. Verifique qual limite foi acionado. Settings → Usage no app web. Não adivinhe.
  2. Se for a janela de sessão de 5 horas: aguarde o reset contínuo, ou mude para um modelo mais leve para tarefas de menor prioridade enquanto aguarda.
  3. Se for o limite semanal: você tem quatro opções reais: aguardar seu reset semanal pessoal, habilitar créditos de uso extra se seu plano suportar, atualizar para um plano superior, ou rotear o trabalho diretamente para a API Claude.
  4. Se você estiver no Max e atingindo limites frequentemente: revise se fluxos de trabalho pesados com Sonnet também estão ultrapassando o sub-limite somente de Sonnet. O limite de todos os modelos e o limite somente de Sonnet são independentes.
  5. Se você está executando um fluxo de trabalho de agência com volume sustentado: o modelo de assinatura pode simplesmente ser a ferramenta errada. A API não tem janela de sessão de cinco horas.

Para fluxos de trabalho em escala de agência onde atingir esses limites é um problema operacional recorrente e não apenas um incômodo ocasional, vale a pena ler como outros times estruturam seu uso de Claude Code em larga escala: nosso guia de agência Claude Code cobre as decisões arquitetônicas que mudam quando você está rodando isso para clientes em vez de para si mesmo.

No lado do batching: Anthropic dobrou os limites de sessão contínua de cinco horas para planos pagos no início deste ano, de acordo com a cobertura do Geeky Gadgets da atualização. Os limites semanais não foram alterados naquela época. Um aumento temporário de 50% no uso semanal que rodou junto com o lançamento terminou em 19 de julho. Então o estado atual é: sessões mais longas, mesmo teto semanal.

Limites de Assinatura Versus Limites de Taxa da API

Esses são sistemas genuinamente diferentes e vale a pena esclarecer o que cada um controla.

Os limites de assinatura (Pro, Max, Team) são os limites de cinco horas e semanais descritos acima. Eles se aplicam a tudo que você faz via claude.ai, Claude Desktop e Claude Code CLI em uma conta de assinatura. Eles são baseados em uso de forma ponderada: modelo, contexto, features e chamadas de ferramentas afetam a velocidade com que você os consome. Anthropic ajusta essas permissões conforme a demanda cresce e não publica contagens exatas de tokens.

Os limites de taxa da API são diferentes em estrutura. São limites de tokens por minuto e limites de requisições simultâneas configurados no nível da conta. Não há janela contínua de cinco horas. Você pode atingir um limite de taxa por minuto e estar bem novamente 60 segundos depois. Os limites de gastos adicionam um teto financeiro por cima. A API foi projetada para roteamento em produção onde você precisa de controle programático sobre quando limitar versus quando pagar por mais.

A implicação prática: se você está construindo uma ferramenta ou rodando tarefas automatizadas, a API é a superfície correta. Não porque necessariamente seja mais barata (a decomposição de custo do Claude Code é uma questão separada), mas porque o comportamento da cota é previsível e recuperável programaticamente. Os limites de assinatura foram projetados para uso interativo no ritmo humano.

Opções de Reset e Disponibilidade

A resposta honesta é que as opções de reset são limitadas.

O que definitivamente funciona:

  1. Aguarde a janela de sessão de 5 horas avançar
  2. Aguarde sua semana pessoal individual se reiniciar (sete dias após a primeira mensagem do ciclo)
  3. Ative créditos de uso extra se disponíveis no seu plano (isso amplia a margem, mas não reinicia a janela)
  4. Atualize seu nível de plano (multiplicador maior na mesma estrutura de janela)
  5. Redirecione trabalho em excesso para a API (sem janela de sessão, limites de taxa separados)

Uma coisa que vale a pena destacar diretamente: os comandos de Claude Code referenciados verificados em 4 de setembro não listavam um comando /limit-reset. A ausência da referência não é prova de que o recurso não existe, mas também não há nota de lançamento oficial ou documentação de suporte confirmando sua disponibilidade. Até que haja, não planeje seu fluxo de trabalho em torno disso.

A opção de créditos de uso extra é a alavanca mais rápida de autoatendimento se você estiver no meio da semana e bloqueado. Ela não reinicia sua janela, expande quanto você pode usar dentro dela. Pense nisso como comprar um pouco mais de margem em vez de começar do zero.

O que não ajuda: alternar modelos na mesma sessão depois de já ter atingido o limite semanal. O limite cobre todos os modelos. Mudar de Opus para Sonnet quando você já esgotou o limite semanal de todos os modelos não vai te desbloquear; você precisaria verificar se o limite apenas de Sonnet tem margem restante separada nos planos Max.

FAQ

O uso de claude.ai conta contra os limites de Claude Code?

Sim. Os dois funcionam com a mesma permissão de plano. Uma sessão longa de pesquisa em claude.ai pela manhã reduzirá o que está disponível para Claude Code à tarde. A visualização de Configurações → Uso na web é o único lugar para ver o quadro combinado entre dispositivos e plataformas.

Posso ter orçamentos de uso separados para Claude Code e claude.ai?

Não em planos de assinatura. Pro e Max oferecem um pool compartilhado. A única forma de separá-los operacionalmente é rotear tarefas de Claude Code através da API em uma conta diferente, que tem seus próprios limites de taxa e faturamento.

O que acontece com a cota semanal não utilizada?

Nada útil. Ela não acumula, rola ou é transportada. O limite semanal se recarrega ao mesmo nível no reinício, independentemente de quanto você usou. Queimar parcialmente uma semana não garante margem extra na semana seguinte.

Existe uma forma de monitorar o uso antes de bater no limite?

Sim. /status na CLI mostra a alocação restante e exibe avisos conforme você se aproxima dos limites. /usage oferece uma análise mais completa por skill, subagente e servidor MCP. Nenhum deles reflete o uso de outros dispositivos ou claude.ai; para isso você precisa de Configurações → Uso no aplicativo web.

A atualização no meio do ciclo me dá um reinício completo?

A Anthropic não documenta isso explicitamente nas fontes analisadas para este post. A expectativa prática é que a atualização o mova para o multiplicador maior a partir desse ponto, mas se ela reinicia retroativamente a janela atual no meio do ciclo não está confirmado. Se você está comprando uma atualização especificamente para desbloquear uma sessão ativa, verifique a documentação de suporte atual ou contate o suporte da Anthropic antes de assumir que terá margem imediata.

A ressalva mais aguda em tudo isso: a Anthropic não publica contagens exatas de tokens para limites de sessão ou semanais, e a empresa ajustou as permissões mais de uma vez conforme a demanda cresceu. Qualquer número específico de contagem de mensagens que você encontre online (incluindo "~45 mensagens por 5 horas" para Pro) é uma aproximação em condições típicas, não uma garantia absoluta.

← voltar