Aller au contenu principal
🔒 Mode aperçu. Les quinze premières leçons Foundations sont gratuites ; celle-ci est Pro. Démarrez un trial de 7 jours pour débloquer l'éditeur, les conseils AI et le reste du programme. Carte requise, annulez à tout moment dans Dashboard.Démarrer le trial de 7 jours →
← CoursAI Engineering with PythonModule 3 · RAG (Récupération-Génération Augmentée)Stratégies de regroupementwrite36 / 105
+100 XP
Tâche
📝 **Question :** **Écrivez la fonction** \`chunk_count(total_tokens, chunk_size, chevauchement)\` qui renvoie le nombre de morceaux qu'un document produit avec la segmentation par fenêtre coulissante. Spécification : chaque morceau est constitué de jetons \`chunk_size\`. Chaque morceau chevauche le précédent par des jetons \`overlap\` — donc l'*étape* (nouveaux jetons effectifs par morceau) est \`chunk_size - chevauchement\`. Le premier morceau commence à 0 ; de nouveaux morceaux continuent d'être ajoutés jusqu'à ce que la position de départ dépasse \`total_tokens\`. Formule : \`\`\` step = chunk_size - chevauchement count = ceil(max(0, total_tokens - chevauchement) / pas) \`\`\` (Cas limite : si \`total_tokens <= chunk_size\`, cela fait toujours 1 morceau.) Imprimez ensuite le nombre de blocs pour ces trois configurations d'un document de 50 000 jetons : \`\`\` 500/50 : 111 800/80 : 70 1500/200 : 39 \`\`\` La baisse de 3 × de 111 morceaux à 39 morceaux → c'est le compromis sur le coût d'intégration que les développeurs seniors rendent explicite avant d'indexer 1 million de documents. 📋 Choisissez la bonne réponse. 💡 **Indice :** Relisez la théorie ci-dessus en cas de doute.
✏️ Écris ton code ici
🐍
Chargement de Python...
Téléchargement unique (~1 Mo). Ensuite, c’est instantané.
📊 Résultat
Cliquez sur Exécuter pour voir le résultat...

💬 Discussion

Soyez le premier à poser une question ou partager une astuce.
Connectez-vous pour rejoindre la discussion. La lecture est gratuite.
Chargement de la discussion…