Tarefa
📝 **Pergunta:** **Escreva a função** \`chunk_count(total_tokens, chunk_size,lap)\` que retorna o número de pedaços que um documento produz com o chunking de janela deslizante.
Especificação: cada pedaço são tokens \`chunk_size\`. Cada pedaço se sobrepõe ao anterior por tokens \`overlap\` — então a *etapa* (novos tokens efetivos por pedaço) é \`chunk_size - overlap\`. O primeiro pedaço começa em 0; novos pedaços continuam sendo adicionados até que a posição inicial exceda \`total_tokens\`.
Fórmula:
\`\`\`
passo = chunk_size - sobreposição
contagem = ceil(max(0, total_tokens - sobreposição) / etapa)
\`\`\`
(Caso extremo: se \`total_tokens <= chunk_size\`, ainda é 1 pedaço.)
Em seguida, imprima as contagens de blocos para estas três configurações de um documento de 50.000 tokens:
\`\`\`
500/50: 111
800/80: 70
1500/200: 39
\`\`\`
A queda de 3× de 111 pedaços para 39 pedaços → essa é a compensação de custo de incorporação que os desenvolvedores seniores tornam explícita antes de indexar 1 milhão de documentos.
📋 Escolha a resposta certa.
💡 **Dica:** Releia a teoria acima se não tiver certeza.