Méthodologie
Comment le classement des red flags est construit
1. D'où viennent les données
Le classement n'est pas établi par une rédaction : il est produit par les votes des personnes qui jouent. À chaque duel, deux comportements sont proposés et le joueur désigne celui qu'il juge le plus problématique. Ce sont ces arbitrages, répétés, qui font monter ou descendre un comportement dans le classement.
Le corpus compte actuellement 260 comportements en lice.
Aucun compte n'est nécessaire pour voter. Deux informations facultatives sont demandées avant de jouer — tranche d'âge et sexe — uniquement pour permettre les comparaisons décrites plus bas. Elles ne sont rattachées à aucune identité.
2. Le score Elo
Nous utilisons le système Elo, conçu à l'origine pour classer les joueurs d'échecs. Son intérêt ici : il ne compte pas les victoires, il pondère chaque duel par la difficulté de l'adversaire. Battre un comportement déjà jugé très problématique rapporte davantage que d'en battre un anodin.
Chaque comportement démarre à 1000 points. Après un duel, la probabilité attendue de victoire se calcule ainsi :
E = 1 / (1 + 10^((score adverse − score) / 400))
Le score est ensuite ajusté de K × (résultat − E). Le facteur K décroît à mesure qu'un comportement accumule des votes : 40 en dessous de 30 participations, 32 jusqu'à 100, puis 24 au-delà. Autrement dit, un comportement récent bouge vite, un comportement bien établi ne bouge plus qu'avec des votes nombreux et cohérents. Un plancher à 100 points empêche un score de s'effondrer indéfiniment.
3. Les comparaisons par groupe
Un score Elo distinct est tenu pour chaque groupe déclaré : par sexe, et par tranche d'âge (16-18, 19-22, 23-26, 27 et plus). C'est ce qui permet de mesurer les désaccords — un même comportement peut être jugé sévèrement par un groupe et bien moins par un autre.
Ces sous-classements reposent mécaniquement sur moins de votes que le classement général. Plus le groupe est étroit, plus l'écart doit être important pour être significatif.
4. Ce que ce classement n'est pas
Il faut être clair sur la portée de ces chiffres.
- Ce n'est pas une enquête représentative. L'échantillon est auto-sélectionné : ce sont les personnes qui ont choisi de jouer, pas un panel construit. Les résultats décrivent notre communauté, pas la population française.
- Ce n'est pas un diagnostic. Un score élevé signale un consensus sur le caractère problématique d'un comportement, pas un verdict sur une personne ou une relation réelle.
- Le ton du jeu influence les réponses. Certaines propositions sont volontairement légères ou provocatrices. Elles sont votées dans un contexte ludique, ce qui pèse sur les arbitrages.
- Les déclarations ne sont pas vérifiées. Âge et sexe sont déclaratifs.
5. Modération du corpus
Les comportements soumis au vote sont rédigés et validés en amont, pas générés automatiquement. Les propositions relevant de la catégorie « Amour & Sexe » ne sont pas servies aux joueurs déclarant la tranche 16-18 ans.
6. Aller voir les données
Le classement complet est consultable et filtrable par catégorie, par sexe et par tranche d'âge sur la page classement des red flags. Les outils d'auto-évaluation, qui reposent sur des barèmes institutionnels et non sur nos votes, sont décrits dans nos sources.