Arriva ancora quella notifica? ‘Limite di utilizzo raggiunto’. E ogni volta la stessa frustrazione. Paghi 200 dollari al mese per Claude, eppure ogni due per tre finisci contro il muro dei token.
La buona notizia: probabilmente non è colpa del piano. È colpa di come lo usi.
Miles Deutscher — influencer AI con 670.000 follower — ha appena condiviso un thread che ha fatto 3,35 milioni di like. Il suo claim? Stesso piano da $200/mese, zero limiti raggiunti nelle ultime tre settimane. Come? Cambiando il modo di lavorare con Claude, non il portafoglio.
Step 1: separare il cervello dall’esecuzione
Il primo errore che Miles identifica è brutale nella sua semplicità: ‘Non fare brainstorming con Opus’.
E qui molti si riconosceranno. Ti viene un’idea, apri Claude Opus, cominci a buttare giù pensieri, chiedi feedback, itteri. Mezz’ora dopo: limite raggiunto. Familiare?
Il punto chiave che Miles ha capito scavando nella documentazione: le chat di testo consumano relativamente poco. Quello che svuota il serbatoio sono coding, build, design — le operazioni di esecuzione.
La soluzione è quasi banale: separa la fase di pianificazione da quella di esecuzione. Due persone costruiscono la stessa app di tracking finanziario. Persona A pianifica 2 minuti e parte subito a buildare. Rifà tutto tre volte. Persona B pianifica 20 minuti e builda una volta sola. Risparmio di B: 67% di token. In soldoni, $1,50 per task. Moltiplicalo per tutti i task di una giornata, poi di un mese.
Se usi Claude Code, c’è un comando fatto apposta: Shift+Tab×2 attiva la Plan Mode. In questa modalità Claude non scrive codice — si concentra solo su architettura e strategia. Zero token di esecuzione bruciati.
E per la pianificazione? Haiku, non Opus. Haiku costa una frazione ed è più che sufficiente per brainstorming e design iniziale. Opus lo riservi per quando hai tutto chiaro e devi solo realizzare.
Step 2: i chat lunghi sono killer silenziosi
Questa molti non la sanno. Ogni volta che mandi un messaggio, Claude rilegge l’intera conversazione da capo. Non solo l’ultimo scambio — tutto.
Chat da 10 messaggi: rilegge 10 messaggi ogni volta. Chat da 100 messaggi: rilegge 100 messaggi ogni volta. Il costo cresce a valanga. E non è solo una questione di soldi: più il contesto è lungo e pieno di roba vecchia, più Claude perde precisione. Risponde basandosi su informazioni obsolete, fa confusione, ti dà output meno rilevanti.
La soluzione di Miles è doppia.
Primo: usa i Projects. Invece di un unico chat infinito, crei un Project (per esempio ‘Scrittura articoli X’) e dentro apri chat separati ogni volta. Le istruzioni del Project — chi sei, come vuoi che Claude si comporti — vengono ereditate automaticamente da tutti i chat, quindi non devi rispiegare nulla. Ma il contesto resta corto.
Trick bonus: nelle istruzioni del Project, Miles inserisce questa frase: ‘Be cognisant of the fact I’m trying to save account usage. Be concise in your answers, and when appropriate, advise me on when I should start a new chat or any other tips that may help me reduce token usage’. Risultato? Claude diventa il tuo consulente di risparmio. Ti dice lui quando è ora di aprire un nuovo chat.
Secondo: se devi portarti dietro il contesto, usa il megaprompt. Alla fine del chat vecchio, chiedi: ‘I’m moving to a new chat; give me a prompt I can use to restart this session without losing any of our context from this conversation’. Claude genera un prompt compresso con tutto il contesto essenziale. Lo copi, lo incolli nel chat nuovo, e riparti leggero.
Regola d’oro: tre chat corti consumano meno di uno lunghissimo. Nel dubbio, apri un chat nuovo.
Step 3: la memoria esterna cambia tutto
Claude non ricorda nulla di te tra una sessione e l’altra. Questo significa che ogni volta devi rispiegare le tue preferenze, i tuoi standard, le correzioni che hai già fatto mille volte. E ogni ripetizione consuma token.
La soluzione di Miles: una memoria esterna con due file Markdown.
Primo file: Instructions.MD. Qui metti le regole permanenti: chi sei, cosa fa Claude per te, come deve comportarsi. E soprattutto, aggiungi questa riga: ‘Update Memory.MD with my preferences over time’.
Secondo file: Memory.MD. È il secondo cervello di Claude. Struttura suggerita: sezione Preferences (stile, formati), Corrections (errori da non ripetere), Patterns (schemi ricorrenti).
Funziona così: dici una volta a Claude ‘non usare em-dash’ o ‘i titoli li voglio con ■ non con ##’. Claude lo scrive in Memory.MD. Da quel momento non lo dimentica più, neanche se apri un chat completamente nuovo.
Come si attiva? Crei una cartella sul desktop, ci metti questi due file, e la alleghi a Claude Code o Cowork. Claude leggerà sempre il contenuto di quella cartella, in ogni chat.
Miles dice che una volta provato non si torna più indietro. Ha senso: azzeri completamente i token spesi per rispiegare le stesse cose.
Step 4: l’escalation intelligente tra modelli
‘Usare Opus per tutto è uno spreco totale’ — parole di Miles, non mie.
L’analogia che usa: è come prendere la Ferrari per andare al supermercato sotto casa. Tecnicamente funziona, ma ha senso?
Il metodo escalation: parti da Haiku per i task leggeri. Se non basta, passi a Sonnet. Solo se serve davvero, sali a Opus. Miles stima che il 90% dei task si risolve senza mai toccare Opus. Opus è per quel 10% che richiede la massima potenza, e per le rifiniture finali.
Ma ci sono anche settaggi che quasi nessuno tocca.
Extended Thinking: tienilo spento di default. Attivalo solo per ragionamenti complessi o matematica avanzata. Quando è acceso, i token volano via che è una bellezza.
Styles: dalla home di Claude puoi impostare lo stile Concise. Risposte più corte, meno token in uscita. Molti non sanno nemmeno che esista questa opzione.
Low Effort: in Claude Code c’è una modalità Low per task semplici. Costa meno ed è anche più veloce.
E un’ultima cosa: Claude non è l’unico strumento che esiste. Per ricerche, news, riassunti — task banali — modelli come Kimi o DeepSeek costano zero o quasi. Riserva Claude per quello che solo Claude sa fare bene.
Step 5: ogni tool ha la sua quota separata
Dettaglio che sfugge al 99%: i vari strumenti di Anthropic hanno quote indipendenti.
Claude Code e Claude Chat condividono la stessa quota del piano. Claude Design ha una quota completamente separata.
Tradotto: se fai un mockup UI in Claude Code, consumi la quota Code. Lo stesso task in Claude Design lascia la quota Code intatta. È un altro serbatoio.
Regola pratica: usa ogni tool per quello per cui è nato. Coding: Claude Code. Design: Claude Design. Chat e analisi: Claude Chat. Non forzare uno strumento a fare il lavoro di un altro solo perché ce l’hai già aperto.
Bonus tip: i piccoli accorgimenti che sommano
Qualche chicca sparsa che Miles butta lì alla fine.
Se a fine mese ti mancano pochi token, non fare subito l’upgrade da $20 a $100. Puoi comprare crediti aggiuntivi per pochi dollari. Spesso basta quello.
Claude Skills: se hai task ripetitivi, salvali come skill. Invece di rispiegare ogni volta la procedura, la richiami con un comando. Un’esecuzione, zero spiegazioni.
Monitora l’uso: in Claude Code digiti /Usage e vedi subito a che punto sei. Se sei sotto il 20%, cambi strategia: passi a Haiku, spegni Extended Thinking, accorci i chat. Consapevolezza è controllo.
Risultato: tre settimane senza limiti
Miles applica questo sistema da tre settimane. Zero volte ha raggiunto il limite. Stesso piano da $200/mese. Nessun upgrade, nessun trucco magico — solo metodo.
I cinque step: pianificazione separata con Haiku (-67% su ogni task). Chat corti gestiti con Projects. Memoria esterna con file MD per non rispiegare mai nulla. Escalation intelligente tra modelli, con Opus solo quando serve. Tool diversi per task diversi, sfruttando le quote separate.
Il punto finale di Miles è scomodo ma vero: i costi AI non scenderanno. Man mano che i modelli diventano più potenti, il costo per token tende a salire. Imparare a usarli bene adesso non è un’ottimizzazione — è una necessità.
