Compito
📝 **Domanda:** **Scrivi la funzione** \`chunk_count(total_tokens, Chunk_size,overlap)\` che restituisce il numero di blocchi prodotti da un documento con la suddivisione in finestre scorrevoli.
Specifica: ogni pezzo è un token \`chunk_size\`. Ogni blocco si sovrappone al precedente tramite token \`overlap\`, quindi il *passaggio* (nuovi token effettivi per blocco) è \`chunk_size -overlap\`. Il primo pezzo inizia da 0; nuovi blocchi continuano ad essere aggiunti finché la posizione iniziale non supera \`total_tokens\`.
Formula:
\`\`\`
passo = dimensione_pezzo - sovrapposizione
conteggio = ceil(max(0, total_tokens - sovrapposizione) / passo)
\`\`\`
(Caso limite: se \`total_tokens <= Chunk_size\`, è ancora 1 pezzo.)
Quindi stampa i conteggi dei blocchi per queste tre configurazioni di un documento da 50.000 token:
\`\`\`
500/50: 111
800/80:70
1500/200: 39
\`\`\`
Il calo di 3 volte da 111 a 39 blocchi → questo è il compromesso sui costi di incorporamento che gli sviluppatori senior rendono esplicito prima di indicizzare 1 milione di documenti.
📋 Scegli la risposta giusta.
💡 **Suggerimento:** Rileggi la teoria sopra se non sei sicuro.