← Retour au blog

12 juillet 2026 · Jean Yves BOUDA

Les 5 erreurs de l'échantillonnage avec Excel RAND()

Pourquoi la fonction RAND() d'Excel pose problème pour un échantillonnage rigoureux, et comment les éviter.

RAND() et RANDBETWEEN() sont les outils les plus accessibles pour tirer un échantillon sous Excel — et les plus faciles à mal utiliser. Voici les cinq erreurs les plus fréquentes.

1. Le recalcul qui change tout

RAND() se recalcule à chaque modification de la feuille, y compris sans lien avec votre tirage. Ouvrir le fichier, taper une valeur ailleurs, ou même simplement appuyer sur F9 : votre échantillon change silencieusement. Sans figer les valeurs immédiatement en "Copier / Collage spécial → Valeurs", il n'existe littéralement aucune garantie que l'échantillon que vous analysez est bien celui que vous avez initialement tiré.

2. L'absence de seed reproductible

Un tirage rigoureux doit pouvoir être reproduit à l'identique — par vous-même pour vérifier un résultat, ou par un tiers pour un contrôle. RAND() ne propose aucun mécanisme de "graine" (seed) : chaque tirage est unique et non reproductible, ce qui pose un problème réel dès qu'une preuve méthodologique est nécessaire (audit, publication scientifique, contrôle qualité).

3. Le classement mal géré sur les ex æquo

La méthode courante — attribuer un nombre aléatoire à chaque ligne puis trier — semble simple, mais elle gère mal les cas où deux lignes obtiennent une valeur très proche après un tri approximatif, ou quand une formule de tri en amont a été appliquée avant la génération des nombres aléatoires, biaisant silencieusement l'ordre final.

4. L'oubli de la population réelle

RANDBETWEEN(1, N) suppose que N est exactement le nombre de lignes de votre population au moment du tirage. Si des lignes ont été filtrées, masquées ou supprimées depuis, les index générés ne correspondent plus aux bonnes lignes — un tirage silencieusement corrompu, sans message d'erreur.

5. Aucune trace d'intégrité du fichier source

Rien n'empêche, techniquement, de modifier le fichier source après le tirage mais avant l'analyse — et rien ne le détecte. Sans hash ou vérification d'intégrité, impossible de prouver que le fichier analysé est identique à celui utilisé au moment du tirage.

Ce qu'un outil dédié corrige

Un moteur d'échantillonnage rigoureux doit garantir trois choses que RAND() ne fournit pas nativement : un seed enregistré et reproductible, un hash d'intégrité du fichier source vérifié à chaque nouvelle exécution, et un historique horodaté de chaque tirage effectué.

SamplePro répond aux cinq problèmes ci-dessus par construction : chaque tirage enregistre son seed, le fichier source est identifié par un hash SHA-256 recalculé et comparé avant toute nouvelle opération sur ce fichier, et l'historique complet reste consultable. C'est un point particulièrement sensible pour les cabinets d'audit, où la reproductibilité du tirage fait partie des exigences méthodologiques normales.

Essayez SamplePro gratuitement

5 000 lignes et 3 tirages par mois inclus, sans carte bancaire.