Ir para o conteúdo principal

Contexto, tokens e custos

Ferramentas para controlar o uso de contexto, reduzir desperdícios de tokens e acompanhar consumo e custos — da compressão manual de prompts a estratégias nativas como prompt caching.

17 recursos

Compressão e saúde do contexto

8 recursos

Context Mode

MCP que isola o contexto de cada sessão de agente, evitando vazamento de informações entre tarefas e reduzindo tokens desnecessários em conversas longas.
Tipo Servidor MCPFerramenta
Temas ContextoMemória de sessãoOtimização de tokensAgentes

Headroom

Comprime saída de ferramentas, logs e chunks de RAG antes de chegar no LLM (60-95% menos tokens, mesma resposta).
Tipo Ferramenta
Temas Compressão de contextoEconomia de TokensRAGLogs

RTK

Proxy CLI em Rust que comprime outputs de comandos antes de chegarem ao contexto do AI assistant — 60–90% de redução por operação.
Tipo CLI
Temas Economia de TokensContextoProdutividadeClaude CodeRust

Token Optimizer

Skill para Claude Code que elimina ghost tokens e redundâncias do contexto: compacta mensagens, remove repetições e mantém só o que o LLM precisa para raciocinar.
Tipo Skill
Temas Otimização de tokensContextoSessõesAgentes

Claude Context

MCP da Zilliz que indexa o codebase inteiro com busca vetorial híbrida, entregando ao Claude só os trechos relevantes em vez de carregar arquivos inteiros — cerca de 40% de redução de custo em tarefas que cobrem o repositório todo.
Tipo Servidor MCP
Temas Busca semânticaIndexação de códigoEconomia de TokensCodebaseAgentes

Token Optimizer MCP

Servidor MCP que armazena conteúdo comprimido (Brotli) em SQLite fora do contexto e substitui ferramentas padrão (Read, Grep, Glob) por versões otimizadas — 60-90% menos tokens em uso real.
Tipo Servidor MCP
Temas Otimização de tokensCacheCompressãoMCPAgentes

Token Savior

MCP de navegação estrutural de código por símbolos, com memória persistente entre sessões: -80% de tokens ativos e -83% de tempo de execução em benchmark próprio contra o Claude Code puro.
Tipo Servidor MCP
Temas Navegação de códigoMemória persistenteEconomia de TokensAgentes

Claude Token Optimizer

Hooks e estrutura de CLAUDE.md que carregam documentação sob demanda por palavra-chave do prompt em vez de tudo de uma vez — projeto real caiu de 11K para 1,3K tokens no início de sessão.
Tipo Ferramenta
Temas DocumentaçãoContextoEconomia de TokensClaude CodeSessões

Eficiência e observabilidade de uso

7 recursos

Caveman

Comprime a comunicação ao extremo pra gastar menos tokens.
Tipo Skill
Temas Economia de TokensRedução de verbosidadeEficiênciaRespostas concisasAgentes

ccusage

Monitora em tempo real o consumo de tokens e custo de sessões do Claude Code no terminal, com breakdown por modelo, projeto e período configurável.
Tipo CLI
Temas Economia de TokensCustosObservabilidadeRelatórios

Honey for Devs

Skill para Claude Code que aplica YAGNI e usa stdlib/nativos antes de bibliotecas: escreve o mínimo de código necessário e responde com máxima concisão.
Tipo Skill
Temas EficiênciaQualidade de códigoRedução de verbosidadeAgentes

Claude Token Efficient

Um único CLAUDE.md universal que corta cerca de 63% dos tokens de saída do Claude, banindo abertura bajuladora, fechamento vazio, sugestão não pedida e over-engineering — sem mudar nada no código.
Tipo Template
Temas Economia de TokensRedução de verbosidadeRespostas concisasClaude Code

llmfit

Um comando para descobrir quais modelos, entre centenas de opções e provedores, realmente rodam no seu hardware — memória, GPU e quantização já considerados.
Tipo CLI
Temas Seleção de modeloHardwareLLM local

9Router

Gateway local que conecta Claude Code, Cursor, Codex e outros CLIs de IA a 40+ provedores (Claude, GPT, Gemini e alternativas gratuitas), com fallback automático e compressão de tokens via RTK.
Tipo CLI
Temas Roteamento de provedoresEconomia de tokensMulti-provedor

OmniRoute

Gateway de IA gratuito e open source: um único endpoint para 290+ provedores (90+ com tier gratuito) e 500+ modelos, com fallback automático por cota e compressão de tokens via RTK + Caveman.
Tipo CLI
Temas Roteamento de provedoresEconomia de tokensMulti-provedor

Memória entre sessões

2 recursos

claude-mem

Camada de memória persistente entre sessões: captura o que o agente fez durante o trabalho, comprime com IA e injeta de volta o contexto relevante nas sessões seguintes.
Tipo FerramentaCLI
Temas Memória de sessãoContextoMulti-harnessContinuidade

ai-memory

Memória de longo prazo para CLIs de código com foco em handoff entre ferramentas: abandone o Claude Code no meio da tarefa, abra o Codex no mesmo diretório e continue sem reexplicar a arquitetura.
Tipo FerramentaCLI
Temas Memória de sessãoHandoff entre agentesMulti-harnessMCP

Recebe os próximos posts por email

Data science, IA e agentes. Sem spam, cancela quando quiser.

Confirmar inscrição

Fellipe Gomes
Autor
Fellipe Gomes
Data Science Specialist @ Accenture | Kaggle Master

Sou formado em estatística e atuo como cientista de dados desde 2017. Compartilho meus estudos e evolução por meio de artigos, tutoriais e projetos de código aberto. Se quiser saber mais sobre meu trabalho, sinta-se à vontade para entrar em contato através das minhas redes sociais.

Recomendados