Vai al contenuto principale
🔒 Modalità anteprima. Le prime quindici lezioni di Foundations sono gratuite; questa è Pro. Avvia un trial di 7 giorni per sbloccare l'editor, i suggerimenti AI e il resto del programma. Carta richiesta, disdici in qualsiasi momento dalla Dashboard.Avvia trial di 7 giorni →
← CorsiAI Engineering with PythonModulo 3 · RAG (Retrieval-Augmented Generation)Strategie di suddivisione in blocchiwrite36 / 105
+100 XP
Compito
📝 **Domanda:** **Scrivi la funzione** \`chunk_count(total_tokens, Chunk_size,overlap)\` che restituisce il numero di blocchi prodotti da un documento con la suddivisione in finestre scorrevoli. Specifica: ogni pezzo è un token \`chunk_size\`. Ogni blocco si sovrappone al precedente tramite token \`overlap\`, quindi il *passaggio* (nuovi token effettivi per blocco) è \`chunk_size -overlap\`. Il primo pezzo inizia da 0; nuovi blocchi continuano ad essere aggiunti finché la posizione iniziale non supera \`total_tokens\`. Formula: \`\`\` passo = dimensione_pezzo - sovrapposizione conteggio = ceil(max(0, total_tokens - sovrapposizione) / passo) \`\`\` (Caso limite: se \`total_tokens <= Chunk_size\`, è ancora 1 pezzo.) Quindi stampa i conteggi dei blocchi per queste tre configurazioni di un documento da 50.000 token: \`\`\` 500/50: 111 800/80:70 1500/200: 39 \`\`\` Il calo di 3 volte da 111 a 39 blocchi → questo è il compromesso sui costi di incorporamento che gli sviluppatori senior rendono esplicito prima di indicizzare 1 milione di documenti. 📋 Scegli la risposta giusta. 💡 **Suggerimento:** Rileggi la teoria sopra se non sei sicuro.
✏️ Scrivi il tuo codice qui
🐍
Caricamento Python...
Download una tantum (~1 MB). Poi è istantaneo.
📊 Risultato
Premi Esegui per vedere il risultato...

💬 Discussione

Sii il primo a fare una domanda o condividere un consiglio.
Accedi per partecipare alla discussione. La lettura è gratuita.
Caricamento discussione…