Saltar para o conteúdo principal
🔒 Modo de pré-visualização. As primeiras quinze aulas de Foundations são grátis; esta é Pro. Inicie um trial de 7 dias para desbloquear o editor, as dicas AI e o resto do programa. Cartão necessário, cancele a qualquer momento no Dashboard.Iniciar trial de 7 dias →
← CursosAI Engineering with PythonMódulo 3 · RAG (Geração Aumentada por Recuperação)Estratégias de fragmentaçãowrite36 / 105
+100 XP
Tarefa
📝 **Pergunta:** **Escreva a função** \`chunk_count(total_tokens, chunk_size,lap)\` que retorna o número de pedaços que um documento produz com o chunking de janela deslizante. Especificação: cada pedaço são tokens \`chunk_size\`. Cada pedaço se sobrepõe ao anterior por tokens \`overlap\` — então a *etapa* (novos tokens efetivos por pedaço) é \`chunk_size - overlap\`. O primeiro pedaço começa em 0; novos pedaços continuam sendo adicionados até que a posição inicial exceda \`total_tokens\`. Fórmula: \`\`\` passo = chunk_size - sobreposição contagem = ceil(max(0, total_tokens - sobreposição) / etapa) \`\`\` (Caso extremo: se \`total_tokens <= chunk_size\`, ainda é 1 pedaço.) Em seguida, imprima as contagens de blocos para estas três configurações de um documento de 50.000 tokens: \`\`\` 500/50: 111 800/80: 70 1500/200: 39 \`\`\` A queda de 3× de 111 pedaços para 39 pedaços → essa é a compensação de custo de incorporação que os desenvolvedores seniores tornam explícita antes de indexar 1 milhão de documentos. 📋 Escolha a resposta certa. 💡 **Dica:** Releia a teoria acima se não tiver certeza.
✏️ Escreve o teu código aqui
🐍
A carregar Python...
Download único (~1 MB). Depois, instantâneo.
📊 Resultado
Clica em Executar para ver o resultado...

💬 Discussão

Seja o primeiro a fazer uma pergunta ou compartilhar uma dica.
Faça login para entrar na discussão. A leitura é gratuita.
Carregando discussão…