Como gerenciar limites com várias assinaturas de AI coding
Formas práticas de acompanhar uso, definir ferramenta principal e não queimar a cota errada quando você paga Cursor, Claude, Codex, Copilot e créditos de API ao mesmo tempo.
No mês passado eu tinha três superfícies pagas de AI coding abertas na mesma máquina: plano de IDE, assinatura de agente no terminal e um produto de chat que também limita “agente de código”. Nenhum mostrava limites nas mesmas unidades. Um resetava à meia-noite UTC, outro em janela semanal rolante, e o terceiro misturava pools “rápido” vs “lento” — só descobri depois que um refactor parou no meio do diff.
A lição foi simples e cara: assinaturas sobrepostas não são redundância. São três medidores de cobrança se você não der papel para cada ferramenta.
Este texto é como eu organizo isso sem fingir que os vendors publicam cotas estáveis e comparáveis para sempre. Limites mudam; trate números como sinal, não contrato. Para escolher ferramentas, comece por Como escolher uma ferramenta de AI coding e Cursor vs Claude Code vs Codex.
O que você está medindo de fato
Antes de planilha ou app de menu, anote o que é consumido quando você “usa IA para codar”:
| Tipo de medidor | O que costuma significar | Onde dói |
|---|---|---|
| Mensagens / requisições | Cada turno de chat, passo do agente ou completion inline | Loops longos de agente em um ticket |
| Acesso a modelo premium | Modelo “rápido” ou flagship vs fallback | Refactors pesados com pool rápido vazio |
| Janela de tempo | Limites diários, semanais ou estilo 5 h rolantes | Correria no fim da semana |
| Concorrência / assento | Planos de time, pools compartilhados | Dois devs no mesmo login “Pro” |
| Saldo API em $ | Pay-per-token fora da assinatura consumer | Chave API no caminho do agente sem perceber |
Assinatura consumer e API são produtos diferentes. Pagar os dois faz sentido; usar os dois na mesma tarefa sem notar é receita de fatura surpresa.
Papéis: principal, overflow e API
Eu não ranqueio por hype, e sim por qual cota aceito queimar:
Principal → trabalho diário no repo (reviews, diffs pequenos)
Overflow → quando o principal está limitado OU a tarefa encaixa melhor em outro
API → jobs em lote, scripts, experimentos perto de CI (teto em $ explícito)
O principal deve bater com o fluxo real do checklist de workflow de AI coding: se você vive no editor, o plano de IDE é principal; se entrega pelo shell, o agente de terminal é principal.
Overflow não é “backup porque gosto de duas UIs”. É vazão intencional quando o medidor principal está baixo ou a tarefa combina mais com a outra ferramenta.
API recebe um teto mensal em dólares que eu escrevo antes do mês começar. Produtos que mudam silenciosamente para chave API são o principal vazamento.
Setup de uma semana (sem cerimônia)
No dia 1 não precisa telemetria perfeita:
- Escolha um principal por duas semanas — não teste tudo em todo ticket.
- Registre três campos ao bater no limite: data, ferramenta, sintoma (
pool lento,hard stop,nudge de upgrade). - Anote o fuso do reset na UI do vendor — “diário” depende de timezone.
- Separe contas trabalho vs projetos pessoais se o limite for pessoal.
Depois de sete dias aparecem padrões: talvez o IDE cubra 80% das edições, mas todo run multi-arquivo do agente caia no terminal — ou o contrário.
Limite honesto: não confio em um número de terceiros sem reconciliar uma vez com o dashboard do vendor. Tiers mudam de nome; “ilimitado” raramente é o que o IC imagina.
Dashboards, CLI e helpers na barra de menu
As superfícies variam:
- Uso in-product — em geral fonte da verdade, às vezes escondido em Settings ou Billing.
- Sessões CLI — alguns agentes de terminal expõem status no shell; vale checar antes de um loop longo.
- Agregadores desktop — com três ou mais assinaturas, veja CodexBar abaixo.
O diretório de extensões da DevCove lista extensões de agente (skills, plugins, MCP) — não utilitários de menu bar. CodexBar entra na caixa “como acompanho cotas”, não no mesmo balde de uma skill do Cursor.
CodexBar: muitos provedores, uma barra de menu
CodexBar (MIT, codexbar.app) é um app de barra de menu macOS 14+ de Peter Steinberger (steipete), com codexbar CLI opcional no macOS e Linux. Não é agente: mantém limites de provedores de AI coding visíveis — janelas de sessão, semana e mês quando a fonte expõe — e contagem regressiva até o próximo reset, para você decidir se começa um run longo de agente.
Isso encaixa na pilha de assinaturas deste artigo. Cursor, Claude Code, Codex, Copilot, Gemini CLI, Grok, Zed, Windsurf, OpenRouter e dezenas de outros têm UIs de uso diferentes. CodexBar não substitui os dashboards oficiais; agrega em itens por provedor (ou modo Merge Icons com seletor) para não alternar abas de billing antes de cada refactor.
O que aparece na barra
- Medidores por provedor no ícone (erro ou dado stale pode escurecer o ícone).
- Countdown de reset por janela — útil quando um produto reseta à meia-noite UTC e outro em relógio rolante de 5 h.
- Visões opcionais de spend/crédito para fontes API (OpenAI Admin API, Claude Admin API, OpenRouter, LiteLLM, AWS Bedrock, etc.; lista completa na documentação de providers).
- Polling de status com badges de incidente — às vezes o “limite” é cookie de auth quebrado.
- Settings → Usage & Spend para estimativas locais 7/30 dias;
codexbar costem scripts para scans de custo Codex/Claude.
Widgets, notificações de cota e confete no reset semanal são opcionais; o valor para ICs é headroom de relance.
Como ele obtém os limites (privacidade e permissões)
CodexBar é privacy-first: não armazena senhas. Por provedor, reutiliza o que você já tem — OAuth, device flow, API keys, CLIs instalados (Codex, Claude, Gemini, etc.) e cookies de browser opt-in para dashboards web como uso do plano Cursor. Lê caminhos de config e logs conhecidos, não varredura de disco inteiro; o macOS pode pedir Keychain (descriptografia de cookies) ou Full Disk Access para provedores Safari — veja a nota de privacidade do README e issue #12.
É trade-off: conveniência vs conceder acesso a material de sessão a um app de terceiros. Só CLIs habilitados evitam a maior parte dos caminhos de cookie.
Instalação e CLI (snapshot 2026-07-29)
| Superfície | Como obter |
|---|---|
| App macOS | GitHub Releases ou brew install --cask codexbar |
| Só CLI | brew install steipete/tap/codexbar (Linux suportado); Arch via AUR codexbar-cli |
| Primeiro uso | Settings → Providers → habilite o que usa; login pelo caminho suportado (CLI, OAuth, API key, cookies) |
Exemplo de CLI (docs upstream):
codexbar config providers
codexbar config enable --provider cursor
codexbar config disable --provider grok
Windows: sem app estilo macOS oficial; existe Win-CodexBar da comunidade. Desktop Linux: CLI bundled alimenta Waybar, extensões GNOME e widgets Plasma — seção “Linux desktop integration” do README.
Uso no fluxo multi-assinatura
- Antes de loop longo de agente — veja medidor e relógio de reset; se a janela acaba em vinte minutos, estreite escopo ou mude para overflow de propósito.
- Uma vez por semana — reconcilie CodexBar com a página de billing de um provedor; atualize memo interno se tiers mudaram.
- Não roteie tarefas automaticamente pela barra — CodexBar informa; papéis principal / overflow / API ainda decidem onde o trabalho roda.
Números podem atrasar ou quebrar quando o vendor muda dashboard. CodexBar é sinal, como as tabelas acima — não sistema de registro de cobrança.
Por que não está no diretório de plugins ou Skills da DevCove
CodexBar não instala em Cursor, Claude Code ou Codex como skill, plugin ou servidor MCP. É companheiro desktop para visibilidade de cotas. Linkamos aqui porque gerenciar várias assinaturas é exatamente o problema que ele ataca — não porque estenda contexto ou ferramentas do agente.
Roteamento de tarefa para casar limite e trabalho
| Forma da tarefa | Prefira queimar… | Por quê |
|---|---|---|
| Fix inline em um arquivo | IDE principal / estilo Copilot | Turnos baratos, contexto curto |
| Loop de agente com testes + shell | Agente de terminal principal | Permissões alinhadas |
| “Só explica este stack trace” | Quem tiver headroom não premium | Guarde pools rápidos para edits |
| Refactor grande + muitos arquivos | Principal até limitar; overflow com prompt menor | Loops multiplicam medidores |
| Checklist de release + diff | Humano + ferramentas de checklist | Modelo não substitui gates de ship |
Se o limite bater no meio de uma sessão de agente, pare e estreite o escopo antes de trocar de ferramenta. Colar o repo inteiro em um segundo produto costuma queimar duas cotas pelo mesmo patch pela metade.
Quando adicionar, cancelar ou consolidar
Adicione um segundo plano quando:
- throttling no principal custa tempo mergeável mais de uma vez por semana, e
- overflow já está definido (não “talvez eu use Gemini”).
Cancele quando:
- duas ferramentas ocupam o mesmo papel principal e a segunda foi FOMO, ou
- gasto API duplica um plano consumer que você nunca esgota.
Consolide quando:
- o time padronizou review e permissões em um caminho de agente — veja Cursor vs Claude Code vs Codex.
Não estamos dizendo “só uma assinatura”. Muitos ICs seniores mantêm duas de propósito. Estamos dizendo: dois principais = pagar duas vezes e bater no muro duas vezes.
Modos de falha que ainda observo
- Hard stop no meio do PR — commit ou stash antes do run longo; patch sem teste piora que esperar o reset.
- Tier errado para a tarefa — flagship num typo; pool lento num refactor sensível.
- Login compartilhado — limites “aleatórios” porque o colega esgotou o pool.
- Chave API no agente — rápido até o e-mail de saldo.
Se limite começar a mandar na arquitetura (“só shipamos quando o Claude reseta”), arrume roteamento e workflow primeiro; trocar marca sem papéis raramente ajuda.
Disciplina de snapshot
Para memo interno de time, inclua:
- Data em que checou cada página do vendor
- Nome do plano exatamente na fatura
- Link para pricing ou docs oficiais de uso — não só screenshot eterno
O diretório de ferramentas AI Coding da DevCove segue a mesma lógica dated; seus rótulos de plano mudam mais rápido que nossas tabelas.
Resumo: trate várias assinaturas de AI coding como várias contas de cloud — rótulos parecidos, medidores diferentes. Defina principal, overflow e teto de API, registre uma semana de tickets reais, e só então decida se a segunda fatura compra capacidade ou duplicação.