Comment iDBQuery évite-t-il de compter deux fois les lignes en double ?
iDBQuery évite les doubles comptages en rédigeant un SQL à la bonne granularité — en utilisant DISTINCT, un GROUP BY correct et des jointures qui ne démultiplient pas les lignes — afin qu'un client ne soit pas compté deux fois parce qu'il a deux commandes. Il montre le SQL et source les lignes d'origine, de sorte que vous pouvez confirmer que le décompte correspond à la réalité.
Le double comptage est l'une des façons les plus courantes de fausser une analyse : joignez une table de clients à des commandes et soudain le "nombre de clients" est gonflé parce que chaque client se répète pour chaque commande. iDBQuery est conçu pour éviter ce piège.
- Bonne granularité. Il rédige un SQL qui compte au niveau demandé — `COUNT(DISTINCT customer_id)` pour des clients uniques, et non des lignes brutes — et structure les jointures pour qu'une relation un-à-plusieurs ne multiplie pas vos totaux.
- Déduplication à la demande. Si vos données contiennent réellement des enregistrements en double (la même facture importée deux fois), vous pouvez demander à iDBQuery de les repérer et de les exclure, et il montrera quelles lignes il a traitées comme doublons.
- Résultat vérifiable. Le SQL généré et les citations au niveau de la ligne vous permettent de vérifier qu'un décompte de 5 000 clients reflète bien 5 000 personnes distinctes.
Il existe une tâche liée mais distincte — repérer et nettoyer les enregistrements en double dans les données elles-mêmes — qu'iDBQuery prend aussi en charge. Le point ici est que, pour le comptage et l'agrégation du quotidien, il retient par défaut la bonne granularité afin que vos chiffres principaux ne se gonflent pas silencieusement chaque fois qu'une jointure démultiplie les lignes.
Updated 2026-06-22
Related questions
- Comment trouver des enregistrements en double avec iDBQuery ?
- Comment iDBQuery gère-t-il les valeurs nulles et manquantes dans un calcul ?
- Comment iDBQuery établit-il les classements top-N et le « plus grand » ou le « plus petit » ?
- Comment exécuter des contrôles de qualité des données avec iDBQuery ?
- Puis-je voir le SQL qu'iDBQuery exécute pour obtenir une réponse ?