Завдання
📝 **Питання:** **Напишіть функцію** \`chunk_count(total_tokens, chunk_size, overlap)\`, яка повертає кількість фрагментів, створених документом за допомогою фрагментації у ковзному вікні.
Специфікація: кожен шматок — це токени \`chunk_size\`. Кожна послідовність перекриває попередню на маркери \`перекриття\`, тому *крок* (нові ефективні маркери на послідовність) є \`розмір_фрагмента - перекриття\`. Перший фрагмент починається з 0; нові блоки продовжують додаватися, поки початкова позиція не перевищить \`total_tokens\`.
формула:
\`\`\`
step = chunk_size - перекриття
count = ceil(max(0, total_tokens - overlap) / step)
\`\`\`
(Граничний випадок: якщо \`total_tokens <= chunk_size\`, це все одно 1 фрагмент.)
Потім кількість фрагментів друку для цих трьох конфігурацій документа з 50 000 маркерів:
\`\`\`
500/50: 111
800/80: 70
1500/200: 39
\`\`\`
Зменшення в 3 рази зі 111 фрагментів до 39 фрагментів → це компроміс вартості вбудовування, який старші розробники чітко пояснюють перед індексацією 1 мільйона документів.
📋 Виберіть правильну відповідь.
💡 **Підказка:** Перечитайте наведену вище теорію, якщо не впевнені.