Istruzioni e contesto di progetto in Claude, le differenze
Nei progetti di Claude le istruzioni entrano per intero a ogni chat, il contesto cambia regime quando il progetto cresce. Cosa mettere dove, e perché.
Nei progetti di Claude le istruzioni e i file del contesto non entrano nelle chat allo stesso modo. Le istruzioni entrano per intero all’avvio di ogni chat, e occupano spazio anche quando non servono. I file entrano all’avvio finché il progetto resta sotto una certa dimensione, mentre oltre quel limite Claude attiva il RAG e ne porta in chat solo le parti pertinenti alla domanda. L’articolo spiega la differenza e il criterio per decidere cosa mettere nelle istruzioni, cosa nei file e cosa conviene incollare nella singola chat.
Cosa vuol dire contesto
Questo articolo usa spesso la parola contesto, che nel campo degli LLM ha tre significati diversi.
Contesto. È tutto quello che il modello legge per produrre una risposta in una chat. Comprende la parte visibile e una parte che l’utente non vede, cioè le istruzioni di sistema e le descrizioni degli strumenti collegati.
Finestra di contesto. È lo spazio che una chat ha a disposizione per ospitare il contesto. Si misura in token, e quando è piena le parti più vecchie della chat restano fuori. Il funzionamento e i limiti sono trattati in questo articolo come funzionano i token nelle chat di Claude.
Contesto di un progetto. È la sezione del progetto dove si caricano i file che valgono per tutte le sue chat.
Cosa sono i progetti
Un progetto è un contenitore che raccoglie un gruppo di chat e tre elementi che valgono per tutte, cioè le istruzioni di progetto, la memoria generata dalle chat e il contesto.
I tre elementi entrano nelle chat in modi diversi. Questo articolo tratta le istruzioni e i file, mentre la memoria funziona in un altro modo e non è trattata qui.
I due modi in cui i contenuti entrano nella chat
Quello che compone il contesto di una chat non entra tutto allo stesso modo. I modi sono due.
Caricamento all’avvio. Alcuni contenuti sono nella finestra fin dall’inizio della chat, per intero, senza che nessuno li richiami, è il caso delle istruzioni di progetto.
Caricamento in due tempi. Di altri contenuti all’avvio entra solo una parte, mentre il resto entra su richiesta. Succede con le skill attive, di cui all’avvio entrano il nome e una descrizione, mentre il testo completo si carica quando la skill viene usata. Per i server MCP collegati vale un criterio simile, con i nomi degli strumenti all’avvio e le descrizioni complete al momento dell’uso.
Le istruzioni di progetto
Le istruzioni rientrano nel caricamento all’avvio. Entrano per intero in ogni chat del progetto, con due conseguenze pratiche.
La prima è che le istruzioni sono il posto giusto per tutto quello che deve valere sempre ma solo in quel progetto, cioè convenzioni, tono, vincoli, regole di formato, criteri di lavoro. Sono le cose che il modello deve applicare anche quando la chat non le nomina.
La seconda è che occupano spazio in ogni chat, comprese quelle in cui non servono. Istruzioni lunghe riducono lo spazio disponibile per il lavoro. Conviene tenerci quello che vale per tutte le chat del progetto e spostare nella singola chat quello che serve una volta sola.
I file di progetto
I file caricati nella sezione contesto rientrano ora in una tipologia di caricamento ora nell’altra, a seconda di quanto occupano.
Finché il contesto sta dentro la capienza, il contenuto dei file entra nelle chat come le istruzioni, tutto all’avvio. Anthropic chiama questo funzionamento «in-context processing» e dichiara di preferirlo quando è possibile.
Quando i file si avvicinano al limite si passa al caricamento in due tempi. Claude attiva il RAG, sigla di retrieval augmented generation, il metodo che invece di tenere tutto in finestra cerca dentro i file e ne porta solo le parti pertinenti alla domanda. La documentazione lo dà come automatico, «when your project approaches or exceeds the context window limits». Il passaggio non si configura, e se il progetto si alleggerisce il funzionamento torna quello di prima.
Il RAG risolve un limite che c’era prima. La capienza del contesto era legata alla finestra, e una volta raggiunta non si potevano aggiungere altri contenuti. Con il RAG la capienza cresce fino a dieci volte, e Anthropic dichiara che l’accuratezza delle risposte resta quella del caricamento all’avvio.
La soglia esatta non è pubblicata. La documentazione dice soltanto «approaches or exceeds», quindi il passaggio può avvenire prima che la finestra sia piena. Per sapere quale dei due caricamenti sta usando un progetto si guarda l’indicatore che compare nell’interfaccia.
Cosa mettere dove
Il criterio è la frequenza d’uso, non l’importanza.
Nelle istruzioni va quello che serve in ogni chat, cioè come si scrive, cosa non si fa mai, quali convenzioni valgono, che formato deve avere l’output. Va scritto in forma breve, perché il costo si paga a ogni chat.
Nei file va quello che serve in più chat, cioè materiali di riferimento, testi lunghi, dati, esempi da consultare. Finché il progetto è piccolo anche questi occupano spazio a ogni chat. Il vantaggio arriva quando il progetto cresce, perché da lì in avanti si pagano solo quando servono.
Sui file conviene curare il modo in cui vengono recuperati. Titoli espliciti e un argomento per file funzionano meglio di un unico file che contiene tutto, perché è più facile individuare quello pertinente alla richiesta.
Quando un contenuto serve in una chat sola, non va né nelle istruzioni né nei file. Si allega alla chat, dove costa una volta sola.
Cosa resta quando la chat finisce
La finestra di contesto resta collegata alla chat, tutto quello che è stato scritto, incollato o recuperato durante quella chat non esiste più nella chat successiva. Restano le istruzioni e i file, perché stanno nel progetto e non nella chat. Valgono le stesse regole, cioè le istruzioni per intero e i file secondo il caricamento in cui si trova il progetto.
Chi ha scritto questo articolo
Sono Paolo Dalprato, formatore sulle AI generative. Lavoro con professionisti, studi e PMI da una parte, con scuole, biblioteche e istituzioni culturali dall'altra, sull'ecosistema Claude e NotebookLM. Quello che insegno è lo stesso che uso ogni giorno, e finisce qui sul blog prima ancora che in aula.
Autore di «Creatività ibrida: autore e opera nell'era delle macchine intelligenti».
