Úkol
📝 **Otázka:** **Napište funkci** \`chunk_count(total_tokens, chunk_size, overlap)\`, která vrátí počet bloků, které dokument vytvoří pomocí segmentů posuvných oken.
Spec: každý blok má tokeny \`velikost_chunků\`. Každý blok překrývá předchozí o tokeny \`překrytí\` — takže *krok* (účinné nové tokeny na blok) je \`velikost_chunků - překrytí\`. První blok začíná na 0; nové kusy se přidávají, dokud počáteční pozice nepřekročí \`total_tokens\`.
vzorec:
\`\`\`
step = chunk_size - překrytí
count = ceil(max(0, total_tokens - overlap) / step)
\`\`\`
(Okrajová velikost písmen: pokud \`celkové_tokeny <= velikost_části\`, je to stále 1 blok.)
Poté vytiskněte počty kusů pro tyto tři konfigurace dokumentu s 50 000 tokeny:
\`\`\`
500/50: 111
800/80:70
1500/200: 39
\`\`\`
3× pokles ze 111 kousků na 39 kousků → to je kompromis mezi náklady na vkládání, který starší vývojáři výslovně uvádějí před indexováním 1 milionu dokumentů.
📋 Vyberte správnou odpověď.
💡 **Tip:** Pokud si nejste jisti, přečtěte si znovu teorii výše.