Prejsť na hlavný obsah
🔒 Režim náhľadu. Prvých pätnásť lekcií Foundations je zadarmo; táto je Pro. Spustite 7-dňový trial pre odomknutie editora, AI nápovied a zvyšku kurzu. Karta vyžadovaná, zrušte kedykoľvek v Dashboard.Spustiť 7-dňový trial →
← KurzyAI Engineering with PythonModul 3 · RAG (generovanie rozšíreného získavania)Trhacie stratégiewrite36 / 105
+100 XP
Úloha
📝 **Otázka:** **Napíšte funkciu** \`chunk_count(total_tokens, chunk_size, overlap)\`, ktorá vráti počet kusov, ktoré dokument vytvorí pri delení pomocou posuvného okna. Špecifikácia: každý blok má tokeny \`veľkosť_chunku\`. Každý kus sa prekrýva s predchádzajúcim o \`prekrytie\` tokenov – takže *krok* (efektívne nové tokeny na blok) je \`veľkosť_bloku - prekrytie\`. Prvý blok začína na 0; nové kusy sa pridávajú, kým počiatočná pozícia nepresiahne \`total_tokens\`. Vzorec: \`\`\` step = chunk_size - prekrytie počet = ceil(max(0, total_tokens - prekrytie) / krok) \`\`\` (Okrajové veľké písmená: ak \`celkové_tokeny <= veľkosť_dielu\`, stále je to 1 kus.) Potom vytlačte počty kusov pre tieto tri konfigurácie dokumentu s 50 000 tokenmi: \`\`\` 500/50: 111 800/80:70 1500/200: 39 \`\`\` 3× pokles zo 111 kusov na 39 kusov → to je kompromis medzi nákladmi na vkladanie, ktorý starší vývojári jasne uvádzajú pred indexovaním 1 milióna dokumentov. 📋 Vyberte správnu odpoveď. 💡 **Tip:** Ak si nie ste istí, prečítajte si znova teóriu vyššie.
✏️ Piš kód tu
🐍
Načítanie Pythonu...
Jednorazové stiahnutie (~1 MB). Potom okamžite beží.
📊 Výsledok
Klikni na Spustiť a uvidíš výsledok...

💬 Diskusia

Buď prvý — polož otázku alebo sa podeľ o tip.
Prihlás sa aby si sa zapojil do diskusie. Čítanie je zadarmo.
Načítava sa diskusia…