Úloha
📝 **Otázka:** **Napíšte funkciu** \`chunk_count(total_tokens, chunk_size, overlap)\`, ktorá vráti počet kusov, ktoré dokument vytvorí pri delení pomocou posuvného okna.
Špecifikácia: každý blok má tokeny \`veľkosť_chunku\`. Každý kus sa prekrýva s predchádzajúcim o \`prekrytie\` tokenov – takže *krok* (efektívne nové tokeny na blok) je \`veľkosť_bloku - prekrytie\`. Prvý blok začína na 0; nové kusy sa pridávajú, kým počiatočná pozícia nepresiahne \`total_tokens\`.
Vzorec:
\`\`\`
step = chunk_size - prekrytie
počet = ceil(max(0, total_tokens - prekrytie) / krok)
\`\`\`
(Okrajové veľké písmená: ak \`celkové_tokeny <= veľkosť_dielu\`, stále je to 1 kus.)
Potom vytlačte počty kusov pre tieto tri konfigurácie dokumentu s 50 000 tokenmi:
\`\`\`
500/50: 111
800/80:70
1500/200: 39
\`\`\`
3× pokles zo 111 kusov na 39 kusov → to je kompromis medzi nákladmi na vkladanie, ktorý starší vývojári jasne uvádzajú pred indexovaním 1 milióna dokumentov.
📋 Vyberte správnu odpoveď.
💡 **Tip:** Ak si nie ste istí, prečítajte si znova teóriu vyššie.