TokenTamer: il proxy che dimezza i costi dell'AI (senza sacrificare nulla)
·2 min·Medio
“
Stai pagando l'API di OpenAI o Claude per inviare intere cartelle di codice che l'AI nemmeno tocca? Bene, TokenTamer è il vigilante che intercetta questi sprechi prima che partano. Un proxy drop-in che comprime il contesto al volo, tagliano i costi del 50-80% e lasciando intatto quello che serve davvero.
In 30 secondi
01TokenTamer è un proxy che intercetta richieste API e comprime il codice, tagliando costi del 50-80%.
→
💡
Cosa significa per te
Se usi Aider, Cursor o Claude Code, TokenTamer ti taglia il conto dell'API senza che l'AI perda niente di importante. È un tool invisibile che capisce cosa l'agente legge davvero e cosa è solo rumore.
Hai presente quando ti trovi davanti un file e non hai idea di chi l'abbia creato? Finalmente, un modo per smettere di fare il detective digitale.
·2 min·2·Medio
02
Mantiene solo firme, import e strutture essenziali, buttando via il resto senza perdere contesto.
03Setup in minuti, dashboard real-time mostra token risparmiati e denaro risparmiato istantaneamente.
Se hai mai usato Aider, Cursor o Claude Code per editare il tuo codebase, conosci il problema: l'agente legge lo stesso file tre volte nella stessa conversazione, e tu paghi per quello ogni volta. TokenTamer si mette in mezzo (letteralmente — è un proxy HTTP) e fa pulizia.
Come funziona? L'idea è elegante: quando l'AI richiede un file, TokenTamer lo parcela. Mantiene le firme delle funzioni, gli import, la struttura delle classi — tutto quello che l' ha bisogno di capire il codice. Poi si taglia via il corpo delle funzioni che non stai nemmeno toccando. Se rileggere lo stesso file una seconda volta, TokenTamer sa già cosa è vecchio e cosa è fresco, e comprime solo le letture ridondanti.
Non è magia, è parsing AST — cioè capire la struttura del codice e essere intelligente nel cosa buttar via. L'AI continua a vedere tutto quello che serve, ma il count scende come un sasso.
📬 Ti piace quello che leggi?
Ricevi le migliori notizie AI ogni settimana, direttamente in inbox.
L'installazione è ridicolmente semplice: clone il repo, pip install -e ., cambia la URL dell'API base del tuo tool in http://127.0.0.1:8000/v1, e fatto. Per Aider, Cursor o qualsiasi cosa usi un'API custom: niente certificati, niente configurazioni strane. Per Claude Code e Codex CLI (che hanno l'endpoint hardcodato), c'è un setup HTTPS leggermente più elaborato, ma comunque una roba di minuti.
E qui viene il bello: TokenTamer ha un dashboard in tempo reale che ti mostra quanti token stai risparmiando e quanto denaro sta rimanendo nel tuo wallet. Il feedback istantaneo è importante — quando vedi "250 token risparmiati" scorrere sullo schermo, capisci subito che il tool sta facendo il suo lavoro.
Ci sono limitazioni — è ancora alpha, i numeri di risparmio vengono da test sintetici (non da sessioni vere di Claude Code lunghe ore), e il supporto multi-turno cross-request per la cache non c'è ancora. Ma la roadmap è chiara: Tree-sitter per AST multilingua, dashboard con heatmap per file, cross-request caching. Lo sviluppatore sa dove sta andando.
Detto brutalmente: se usi agenti AI per codificare e leggi lo stesso file più volte in una sessione — spoiler: lo fai — questo ti farà risparmiare soldi reali subito.
Creare video parlati, quelli dove tu sei il protagonista che spiega qualcosa, può essere una noia pazzesca. Immagina se un'AI potesse fare il grosso del lavoro, direttamente nel tuo browser.