A Rippling acaba de lançar o AI Spend Console, uma ferramenta desenhada para conter o fenômeno do tokenmaxxing — o hábito de gastar excessivamente em modelos de IA de ponta sem um controle claro de retorno.
O problema surgiu quando o gasto em IA escalou para níveis alarmantes. A empresa descobriu que estava prestes a queimar 40% do orçamento de P&D apenas com tokens, um valor equivalente a quase metade da remuneração da unidade. Para resolver isso, a nova ferramenta mapeia o consumo por funcionário e equipe, permitindo identificar quem está realmente produzindo e quem está apenas gerando slop (conteúdo de baixa qualidade).
A análise revelou disparidades gritantes no uso da tecnologia. Segundo a Rippling, cerca de 10–15% dos funcionários eram responsáveis por 60% do gasto total com IA. Em um caso extremo, um único engenheiro estava gastando US$ 50.000 por mês. O console agora permite aos gestores estabelecer limites máximos e alertas automáticos para ferramentas como Cursor, OpenAI e Anthropic.
A estratégia agora foca em eficiência de custos através de múltiplos modelos. A Rippling identificou que modelos como o GLM 5.2 da Z.ai podem ser 85% mais baratos que os modelos de fronteira, mantendo uma performance quase idêntica para tarefas de codificação. A ferramenta inclui um gateway de IA que direciona automaticamente as solicitações para o modelo mais econômico e adequado para cada tarefa específica.
Os resultados práticos já mostram uma mudança significativa na conta final. Após a implementação do console, a Rippling reduziu o gasto com tokens de 40% para 15% do orçamento de pessoal. Embora o volume de uso tenha permanecido alto — atingindo novamente a marca de 600 bilhões de tokens em julho —, o custo desse consumo foi 37% menor em comparação ao período de pico anterior.
Para gestores, o próximo passo é criar uma cultura de 'capitães de IA'. A empresa identificou usuários eficientes e os designou para treinar o restante da equipe. Se você gerencia um orçamento de tecnologia, a lição é clara: monitore a produtividade vinculada ao consumo de tokens para garantir que a automação esteja realmente economizando tempo, e não apenas aumentando a fatura mensal.







