Définition
Méthode d’échantillonnage par renvoi destinée aux populations difficiles d’accès ou fortement en réseau : des « seeds » initiaux recrutent des pairs au moyen d’un nombre limité de coupons, les chaînes de recrutement sont suivies et les enquêteurs collectent la taille du réseau personnel et les informations de recrutement pour appliquer des estimateurs qui pondèrent les observations afin d’approcher les paramètres de population sous des hypothèses de réseau et de recrutement spécifiques.
Principe
Principe
Le recrutement par pairs via les liens sociaux permet d’accéder à des populations autrement inaccessibles ; en enregistrant les schémas de recrutement et la taille du réseau personnel (degré) et en appliquant des pondérations modèle‑basées, les analystes cherchent à corriger les probabilités d’inclusion différentielles—à condition que des hypothèses clés (suffisance des vagues, recrutement aléatoire conditionnel au degré, reportage fiable du degré, et composante réseau connectée) soient approximativement satisfaites.
Démonstration
Démonstration
Scénario illustratif → Une étude sur une population stigmatisée en milieu urbain commence avec 8 seeds choisis de façon raisonnée, chacun recevant 3 coupons pour recruter des pairs. Le recrutement se poursuit sur plusieurs vagues ; l’étude enregistre les liens de recrutement et interroge chaque répondant sur le nombre de pairs éligibles qu’il connaît. Les analystes utilisent les arbres de recrutement, le degré déclaré et des estimateurs RDS appropriés pour produire des estimations pondérées de prévalence et calculer des intervalles de confiance tenant compte de la dépendance en réseau.
Mauvaise application
Mauvaise application
Traiter les données RDS comme un échantillon aléatoire simple et ignorer la dépendance en réseau et la pondération requise (erreur : sous‑estimation du biais et de la variance), ou omettre d’enregistrer/utiliser les informations de degré et de recrutement lors de l’application des estimateurs—ces pratiques entraînent des estimations biaisées et des mesures d’incertitude invalides.
Conséquence
Conséquence
Quand les hypothèses sont au moins approximativement respectées et que les données sont correctement consignées et pondérées, RDS peut fournir des estimations de population utiles là où l’échantillonnage probabiliste est impraticable ; si les hypothèses échouent (p. ex. homophilie extrême, déclaration de degré inexacte, sous‑réseaux déconnectés), les estimations peuvent être fortement biaisées et l’incertitude sous‑estimée.
Inversion
Inversion
Si le réseau social sous‑jacent est déconnecté, si les chaînes de recrutement restent courtes, si les répondants déclarent systématiquement un degré inexact ou si le recrutement est très non‑aléatoire au sein des classes de degré, le modèle de pondération s’effondre et les estimateurs RDS deviennent non fiables ; dans ces contextes, des approches alternatives (échantillonnage multi‑lieux, méthodes probabilistes ciblées) peuvent être préférables.
Limite
Limite
Clairement inclus : études de populations cachées et en réseau où le renvoi par pairs est faisable et où des seeds peuvent initier des chaînes longues. Cas limite : populations partiellement en réseau ou études avec très peu de vagues ou petit effectif (hypothèses des estimateurs fragiles). Clairement exclu : échantillons de commodité non en réseau, échantillonnage en un stade fondé sur lieux sans renvoi contrôlé, ou échantillonnage en boule de neige sans enregistrement des recrutements et du degré.
Tension sémantique
Tension sémantique
Accès pratique et faisabilité (recrutement de répondants autrement inaccessibles) versus les hypothèses statistiques strictes nécessaires à l’estimation non biaisée ; il faut arbitrer entre faisabilité de terrain et crédibilité des allégations inférentielles.
Synthèse
Synthèse
Le RDS est un compromis pragmatique : il exploite un recrutement pair‑contrôlé et des pondérations fondées sur le degré pour transformer des données par chaîne en estimations de population sous des hypothèses explicites de réseau. Sa validité dépend de la satisfaction de ces hypothèses et d’un signalement transparent de la dynamique de recrutement et des diagnostics.