Biblioteca · Repositório

JuliusBrussee/caveman

Dev tools e coding agents · JavaScript · MIT

Skill gratuita para Claude Code (e 30+ agentes) que manda a IA responder em 'linguagem de caverna': frases curtas, zero enrolação, código intacto. Viralizou com o lema 'why use many token when few token do trick' e chegou a 95 mil estrelas em 4 meses, mas o número real é 65% de economia SÓ nos tokens de saída, não da conta toda.

O que é, em uma frase honesta

É uma instrução instalável (uma 'skill') que faz o agente de programação parar de escrever parágrafos educados e responder em telegrama: fragmentos de frase, sem preâmbulo, sem 'ótima pergunta!'. A regra de ouro é que código, comandos e mensagens de erro ficam byte a byte intactos, só o blá-blá-blá em volta é cortado. Instala com um comando, ativa sozinho no Claude Code desde a primeira mensagem, e traz comandos como /caveman-stats (mede quanto a sessão economizou) e /caveman-compress (encolhe arquivos de memória em ~46%).

Nasceu meio piada, meio protesto contra a verbosidade das IAs, e a piada tinha um fundo técnico real o bastante para virar ferramenta.

Para que serve na prática

Serve para quem paga a conta de token do Claude Code (ou Codex, Cursor, Gemini) e quer respostas mais baratas e mais rápidas de ler. Casos concretos: sessões longas de programação em que o agente repete explicações que ninguém lê; times que estouram limites de uso do plano; arquivos de memória (CLAUDE.md e afins) inchados, que o /caveman-compress reduz quase pela metade e essa economia aí é de entrada, que se repete toda sessão. Curiosidade útil: o autor cita um paper de março de 2026 sugerindo que forçar respostas curtas pode até melhorar a precisão em alguns benchmarks.

Instalação leva 30 segundos e desinstalar é igualmente trivial, risco de experimentar é quase zero.

Quando faz sentido pra você que lidera

Aqui a lente honesta importa: o burburinho fala em 'cortar 65-75% dos tokens', mas a medição do próprio projeto é 65% em média apenas nos tokens de SAÍDA, numa amostra de 10 prompts com variação de 22% a 87%. Tokens de entrada e de raciocínio, que costumam dominar a conta numa sessão de agente, não mudam nada, e a skill ainda adiciona 1 a 1,5 mil tokens de entrada por turno. Ou seja: a economia da fatura total é bem menor que o slogan, e em cargas curtas pode até sair negativa.

Vale como experimento de custo quase grátis no time de engenharia; não vale como linha de corte de orçamento de IA na planilha.

Por que está no mapa

Criado em abril de 2026, foi nº 1 do Hacker News e nº 1 do GitHub Trending na primeira semana (com ~5 mil estrelas) e não parou: hoje a API do GitHub marca 95.157 estrelas e 5,4 mil forks, o próprio site oficial ainda estampa 74 mil, sinal de que dezenas de milhares chegaram nas últimas semanas. O empurrão veio do humor (o meme do caverna), da dor real de custo de token e de cobertura de veículos como The New Stack, que também trouxe o contraponto: a economia real é menor que a manchete. Último push: 26/07/2026.

Ver no GitHub →
O que você achou desta página?
Recomendaria esta página para alguém do seu time?