Calculateur d'exactitude de classification

Calculez l'exactitude, la précision, le rappel, la spécificité et le score F1 à partir d'une matrice de confusion binaire.

Métriques de classification
Saisissez les quatre effectifs de la matrice de confusion pour évaluer un classifieur binaire.

À propos de l'exactitude de classification

L'exactitude de classification mesure la part des prédictions que le modèle a correctement classées. Elle additionne les vrais positifs et les vrais négatifs, puis divise cette somme par le nombre total d'observations de la matrice de confusion. Intuitive, elle doit pourtant rarement être interprétée seule. Lorsque les classes sont déséquilibrées, un modèle peut presque toujours prédire la classe majoritaire et afficher une exactitude élevée tout en échouant sur les cas les plus importants. Ce calculateur présente donc cinq métriques complémentaires de classification binaire. La précision est la proportion de positifs prédits réellement positifs : TP divisé par TP plus FP. Le rappel, aussi appelé sensibilité, est la proportion de positifs réels détectés par le modèle : TP divisé par TP plus FN. La spécificité mesure la capacité à identifier les négatifs : TN divisé par TN plus FP. Le score F1 est la moyenne harmonique de la précision et du rappel ; il favorise leur équilibre plutôt que la maximisation de l'un au détriment de l'autre. Commencez par organiser vos résultats dans une matrice de confusion. Un vrai positif est un cas positif correctement prédit positif. Un faux positif est un cas négatif prédit positif à tort. Un vrai négatif est un cas négatif correctement prédit négatif, et un faux négatif est un cas positif manqué par le classifieur. Les quatre valeurs doivent être des effectifs issus du même jeu de test et du même seuil de décision. Mélanger des pourcentages, des observations d'entraînement ou des résultats de seuils différents invalide les métriques. Les priorités dépendent de l'application. En dépistage médical, manquer une maladie peut coûter cher ; le rappel reçoit donc souvent davantage d'attention. Dans le filtrage antispam ou la sanction automatisée, les accusations erronées peuvent être coûteuses, ce qui rend la précision importante. La spécificité est utile lorsque l'exclusion correcte des négatifs compte. Comparez les métriques sur le même jeu de données, examinez la fréquence des classes et considérez les intervalles de confiance avant de déclarer un modèle supérieur. Ce calculateur fournit des estimations ponctuelles déterministes pour l'analyse rapide, la documentation et la comparaison des seuils ; il ne remplace pas une validation sur des données représentatives.

Exemples de calcul d'exactitude

Matrice de confusionRésultats principauxInterprétation
TP 80, FP 20, TN 90, FN 10Exactitude 85.00% ; F1 84.21%Bonne performance, assez équilibrée
TP 50, FP 0, TN 50, FN 0Toutes les métriques à 100.00%Classification parfaite sur cet échantillon
TP 10, FP 5, TN 180, FN 5Exactitude 95.00% ; rappel 66.67%L'exactitude élevée masque des positifs manqués

Comment calculer les métriques de classification

  1. Comptez les vrais positifs et les faux positifs des prédictions évaluées.
  2. Comptez les vrais négatifs et les faux négatifs du même jeu de données.
  3. Saisissez les quatre effectifs positifs ou nuls dans les champs correspondants.
  4. Sélectionnez Calculer les métriques et comparez l'exactitude à la précision, au rappel, à la spécificité et au score F1.

Questions fréquentes

Qu'est-ce qu'une bonne exactitude de classification ?

Cela dépend de l'équilibre des classes, de la performance de référence et du coût des erreurs. Comparez-la à une référence simple et examinez les autres métriques avant de juger le modèle.

Pourquoi l'exactitude peut-elle être trompeuse ?

Elle donne le même poids à chaque prédiction correcte et peut être dominée par une classe très majoritaire. Un modèle peut afficher une exactitude élevée tout en détectant très peu de cas minoritaires.

Quelle différence entre précision et rappel ?

La précision indique combien de positifs prédits étaient corrects. Le rappel indique combien de positifs réels le classifieur a réussi à détecter.

Quand utiliser le score F1 ?

Utilisez F1 lorsque faux positifs et faux négatifs comptent et que vous souhaitez une mesure d'équilibre. Il ne tient pas compte des vrais négatifs : examinez aussi l'exactitude et la spécificité.

Puis-je saisir des pourcentages plutôt que des effectifs ?

Privilégiez les effectifs, car toutes les cellules doivent avoir le même dénominateur. Des valeurs proportionnelles ne conviennent que si leur échelle est cohérente et représente toute la matrice.