Mandi tre messaggi e Claude ti dice che hai raggiunto il limite fino al pomeriggio. Sembra arbitrario, ma non lo è. Il limite non si conta in messaggi, si conta in quanto lavoro deve fare Claude, e alcune cose pesano molto più di quanto sembri.
Qui vediamo come funzionano i limiti sui piani a pagamento, cosa li consuma davvero, cosa puoi fare e dove aiuta una memoria fuori dalla chat. Tutto quello che diciamo sui piani di Claude viene dalle pagine di assistenza di Anthropic, lette il 10 ottobre 2026. Anthropic non pubblica quanti messaggi o quanti token dà ogni piano, e quindi non li troverai nemmeno qui.
Come funzionano i limiti di utilizzo di Claude
I piani a pagamento hanno due limiti che corrono insieme:
- un limite di sessione, che si azzera ogni cinque ore;
- un limite settimanale, che si azzera una volta a settimana, a un orario fisso assegnato al tuo account.
Su Pro il limite settimanale vale per tutti i modelli insieme. Max ha due livelli: Max 5x dà cinque volte l'utilizzo di Pro per sessione, Max 20x venti volte. Anche Max ha un limite settimanale su tutti i modelli, e la pagina di Anthropic su Claude Code ne cita uno separato per i modelli Fable. Anthropic scrive anche che può aggiungere altri tetti, per esempio su modelli o funzioni specifiche, per gestire la capacità.
Un numero di messaggi non c'è. La pagina di Pro lo dice chiaro: quanti messaggi puoi mandare dipende da quanto sono lunghi. Anthropic dà solo misure relative («cinque volte Pro»), niente di assoluto.
Due dettagli che sfuggono. Le app di claude.ai, Claude Desktop e Claude Code attingono agli stessi limiti: una lunga sessione di codice nel terminale consuma quello che volevi usare in chat. E puoi vedere a che punto sei in Settings > Usage: una barra per la sessione di cinque ore in corso, con il tempo che manca, e una per la settimana, con l'orario del reset.
Quando arrivi al limite puoi aspettare il reset, passare a un piano più alto o, se hai attivato i crediti di utilizzo, continuare a consumo.
Cosa include ogni piano, affiancato a ChatGPT, lo trovi in Limiti di ChatGPT e Claude, piano per piano.
Limite di utilizzo e limite di lunghezza non sono la stessa cosa
C'è un secondo limite che somiglia al primo e non lo è. La finestra di contesto è quanto Claude riesce a tenere in una sola chat, la sua memoria di lavoro. Sui piani a pagamento, a seconda del modello, è di 200.000, 500.000 o un milione di token.
Il limite di utilizzo misura quanto usi Claude in tutte le chat nel tempo. Il limite di lunghezza misura quanto può crescere una chat. Anche le soluzioni di Anthropic sono diverse: per l'utilizzo aspetti o cambi piano, per la lunghezza apri una conversazione nuova o usi un progetto.
Cosa consuma davvero il limite
Anthropic elenca i fattori: lunghezza del messaggio, peso dei file allegati, lunghezza della conversazione in corso, strumenti (ricerca web, Research), modello, livello di effort, artifact e compiti in più passaggi come eseguire codice o navigare.
Quello che sorprende è la lunghezza della conversazione. Claude non ricorda una chat fra un messaggio e l'altro: ogni risposta viene calcolata su tutta la conversazione fatta fin lì. Anthropic lo dice nel modo più esplicito nelle pagine di Claude Code: a ogni turno si rimandano tutti i messaggi precedenti della sessione, insieme ai file che Claude ha letto. Per questo il decimo messaggio di una chat lunga costa più del primo, anche se è una riga.
Le chat lunghe hanno un secondo costo. Sui piani a pagamento con l'esecuzione del codice attiva, quando la chat si avvicina alla finestra di contesto Claude riassume i messaggi più vecchi per poter andare avanti. Anthropic avverte che le conversazioni in cui scatta questa gestione automatica del contesto consumano di più.
Il terzo sono strumenti e connettori. Anthropic li definisce «ad alto consumo di token»: occupano spazio nella finestra di contesto e pesano sull'utilizzo. Vale anche per i connettori che hai aggiunto e dimenticato. Ognuno spiega a Claude cosa sa fare, e quella spiegazione ha un peso.
Progetti e cache invece giocano a tuo favore. I documenti di un progetto vengono messi in cache, e quando Claude riusa contenuto in cache, dice Anthropic, conta meno del contenuto nuovo. Quanto meno non lo dice, e non lo indoviniamo noi. La cache poi scade dopo un periodo di inattività: dopo una pausa lunga il primo messaggio conta di nuovo tutto per intero.
Cosa puoi fare
Non serve nessuno strumento nuovo. Sono indicazioni di Anthropic:
- Apri una chat nuova per un lavoro diverso. Una chat nuova non si porta dietro la conversazione vecchia a ogni messaggio.
- Metti in un progetto i documenti che riusi. I progetti usano il recupero, quindi si carica solo la parte che serve, e il contenuto in cache conta meno. Tieni corte le istruzioni del progetto e togli i file che non usi più.
- Spegni quello che non serve. Ragionamento esteso, ricerca web e connettori che in quella chat non usi. Per le domande semplici abbassa l'effort.
- Scegli il modello adatto. Il modello è uno dei fattori elencati, e la pagina di Anthropic su Claude Code dice che Opus consuma per turno parecchie volte più di Sonnet.
- Scrivi un messaggio completo invece di cinque piccoli. Dai il contesto all'inizio e raggruppa le domande collegate. Meno scambi vuol dire meno riletture.
- Richiama invece di ripetere. «Come dicevamo prima» costa meno che incollare di nuovo lo stesso testo.
Dove aiuta una memoria fuori dalla chat
Dietro molti limiti consumati in fretta c'è un'abitudine: ogni chat comincia dando a Claude il contesto. La scheda del progetto, le note sul cliente, le decisioni prese. Incollate o allegate, ogni volta. E quel contesto poi viaggia con ogni messaggio della chat.
Una memoria fuori dalla chat cambia quello che Claude riceve. Invece di tutti i file all'inizio, tramite un connettore Claude riceve un riepilogo breve, poi cerca e apre solo le note che servono alla domanda.
L'abbiamo misurato su un progetto vero del nostro brain: 134 note, contate con il contatore di token di Claude, ricavato da 258 conversazioni vere. I file che quel progetto dichiara sempre necessari (scheda, indice, decisioni) fanno circa 69.400 token. Il riepilogo di apertura di Cobrain sullo stesso progetto è di 4.700 token.
Anche il connettore ha un costo, e va detto. Cobrain collegato aggiunge un peso fisso di circa 5.200 token: le definizioni dei suoi strumenti. Quindi al primo messaggio sono 69.400 contro circa 9.900, cioè 7 volte meno. Su una chat di lavoro intera (35 chat vere dello stesso progetto, con tutte le note lette) la mediana è 2,9 volte meno, e 3,6 volte meno se conti che il modello rilegge il contesto a ogni risposta.
Non vince sempre. In 4 di quelle 35 chat Cobrain ha portato più token del caso «senza». Erano chat che aprivano molte note, note che senza Cobrain avresti dovuto incollare lo stesso. Il metodo completo è nei costi di contesto.
Cobrain è questo: una memoria in Markdown, in cartelle vere, che Claude legge e scrive tramite un connettore e che può condividere con ChatGPT, Claude Code e Codex. Non cambia i limiti di Claude, e non cambia cosa fa Claude con quello che legge. Cambia quanto devi dargli tu. La guida per Claude richiede pochi minuti, e per provarlo basta il piano gratuito.
Domande rapide
Perché Claude raggiunge il limite di utilizzo così in fretta? Perché ogni risposta viene calcolata su tutta la conversazione, più allegati, strumenti e connettori. Una chat lunga con file pesanti può consumare una sessione in pochi messaggi.
Ogni quanto si azzera il limite di Claude? Il limite di sessione ogni cinque ore. Il limite settimanale una volta a settimana, a un orario fisso per il tuo account. Li vedi tutti e due in Settings > Usage.
Quanti messaggi si possono mandare con Claude Pro? Anthropic non dà un numero. Dice che dipende da lunghezza dei messaggi, peso dei file, lunghezza della conversazione e da funzioni e modello che usi.
Claude ha un limite settimanale? Sì. Pro e Max hanno un limite settimanale su tutti i modelli, oltre al limite di 5 ore. Max ne ha anche uno separato per i modelli Fable.
«Limite di utilizzo raggiunto» vale anche per Claude Code? Sì. Su Pro e Max Claude, Claude Desktop e Claude Code attingono agli stessi limiti.
I connettori consumano il limite di Claude? Sì. Anthropic definisce strumenti e connettori ad alto consumo di token: occupano contesto e utilizzo. Spegni quelli che non usi.

