Перейти до основного вмісту
🔒 Режим прев'ю. Перші 15 уроків Foundations — безкоштовні; цей — Pro. Запусти 7-денний trial щоб відкрити редактор, AI-підказки і решту курсу. Потрібна картка, скасування в Dashboard у будь-який момент.Почати 7-денний trial →
← КурсиAI Engineering with PythonМодуль 3 · RAG (доповнена пошуково-пошукова генерація)Стратегії чанкінгуwrite36 / 105
+100 XP
Завдання
📝 **Питання:** **Напишіть функцію** \`chunk_count(total_tokens, chunk_size, overlap)\`, яка повертає кількість фрагментів, створених документом за допомогою фрагментації у ковзному вікні. Специфікація: кожен шматок — це токени \`chunk_size\`. Кожна послідовність перекриває попередню на маркери \`перекриття\`, тому *крок* (нові ефективні маркери на послідовність) є \`розмір_фрагмента - перекриття\`. Перший фрагмент починається з 0; нові блоки продовжують додаватися, поки початкова позиція не перевищить \`total_tokens\`. формула: \`\`\` step = chunk_size - перекриття count = ceil(max(0, total_tokens - overlap) / step) \`\`\` (Граничний випадок: якщо \`total_tokens <= chunk_size\`, це все одно 1 фрагмент.) Потім кількість фрагментів друку для цих трьох конфігурацій документа з 50 000 маркерів: \`\`\` 500/50: 111 800/80: 70 1500/200: 39 \`\`\` Зменшення в 3 рази зі 111 фрагментів до 39 фрагментів → це компроміс вартості вбудовування, який старші розробники чітко пояснюють перед індексацією 1 мільйона документів. 📋 Виберіть правильну відповідь. 💡 **Підказка:** Перечитайте наведену вище теорію, якщо не впевнені.
✏️ Пиши код тут
🐍
Завантаження Python...
Одноразове завантаження (~1 МБ). Далі — миттєво.
📊 Результат
Натисніть «Запустити», щоб побачити результат...

💬 Обговорення

Будьте першим — поставте запитання або поділіться порадою.
Увійдіть щоб приєднатися до обговорення. Читання безкоштовне.
Завантаження обговорення…