Přejít k hlavnímu obsahu
🔒 Režim náhledu. Prvních patnáct lekcí Foundations je zdarma; tato je Pro. Spusťte 7denní trial pro odemčení editoru, AI nápověd a zbytku kurzu. Karta vyžadována, zrušte kdykoli v Dashboard.Spustit 7denní trial →
← KurzyAI Engineering with PythonModul 3 · RAG (generování rozšířeného vyhledávání)Strategie trháníwrite36 / 105
+100 XP
Úkol
📝 **Otázka:** **Napište funkci** \`chunk_count(total_tokens, chunk_size, overlap)\`, která vrátí počet bloků, které dokument vytvoří pomocí segmentů posuvných oken. Spec: každý blok má tokeny \`velikost_chunků\`. Každý blok překrývá předchozí o tokeny \`překrytí\` — takže *krok* (účinné nové tokeny na blok) je \`velikost_chunků - překrytí\`. První blok začíná na 0; nové kusy se přidávají, dokud počáteční pozice nepřekročí \`total_tokens\`. vzorec: \`\`\` step = chunk_size - překrytí count = ceil(max(0, total_tokens - overlap) / step) \`\`\` (Okrajová velikost písmen: pokud \`celkové_tokeny <= velikost_části\`, je to stále 1 blok.) Poté vytiskněte počty kusů pro tyto tři konfigurace dokumentu s 50 000 tokeny: \`\`\` 500/50: 111 800/80:70 1500/200: 39 \`\`\` 3× pokles ze 111 kousků na 39 kousků → to je kompromis mezi náklady na vkládání, který starší vývojáři výslovně uvádějí před indexováním 1 milionu dokumentů. 📋 Vyberte správnou odpověď. 💡 **Tip:** Pokud si nejste jisti, přečtěte si znovu teorii výše.
✏️ Piš svůj kód zde
🐍
Načítání Pythonu...
Jednorázové stažení (~1 MB). Pak hned běží.
📊 Výsledek
Klikni na Spustit a uvidíš výsledek...

💬 Diskuze

Buď první — polož otázku nebo se podělej o tip.
Přihlas se abys se zapojil do diskuze. Čtení je zdarma.
Načítání diskuze…