Calculadora de exactitud de clasificación

Calcula exactitud, precisión, sensibilidad, especificidad y puntuación F1 a partir de una matriz de confusión binaria.

Métricas de clasificación
Introduce los cuatro recuentos de la matriz de confusión para evaluar un clasificador binario.

Acerca de la exactitud de clasificación

La exactitud de clasificación mide la proporción de predicciones que el modelo clasificó correctamente. Suma los verdaderos positivos y los verdaderos negativos y divide el resultado entre todas las observaciones de la matriz de confusión. Es intuitiva, pero rara vez debe interpretarse sola. Cuando las clases están desequilibradas, un modelo puede predecir casi siempre la clase mayoritaria y mostrar una exactitud alta mientras falla en los casos más importantes. Por ello, esta calculadora ofrece cinco métricas complementarias de clasificación binaria. La precisión es la proporción de positivos predichos que son realmente positivos: TP dividido entre TP más FP. La sensibilidad, también llamada recall, es la proporción de positivos reales detectados por el modelo: TP dividido entre TP más FN. La especificidad mide la capacidad para identificar negativos: TN dividido entre TN más FP. La puntuación F1 es la media armónica de precisión y sensibilidad, por lo que favorece el equilibrio entre ambas en lugar de maximizar una a costa de la otra. Empieza organizando los resultados en una matriz de confusión. Un verdadero positivo es un caso positivo predicho correctamente como positivo. Un falso positivo es un caso negativo predicho erróneamente como positivo. Un verdadero negativo es un caso negativo predicho correctamente como negativo, y un falso negativo es un positivo que el clasificador no detectó. Los cuatro valores deben ser recuentos del mismo conjunto de prueba y del mismo umbral de decisión. Mezclar porcentajes, observaciones de entrenamiento o resultados de distintos umbrales invalida las métricas. La prioridad de cada métrica depende de la aplicación. En el cribado médico, pasar por alto una enfermedad puede ser costoso, por lo que suele darse más importancia a la sensibilidad. En filtros de correo no deseado o medidas automáticas contra infracciones, las acusaciones erróneas pueden ser costosas y la precisión resulta importante. La especificidad es útil cuando importa descartar correctamente los negativos. Compara las métricas sobre el mismo conjunto de datos, revisa la prevalencia de las clases y considera intervalos de confianza antes de declarar superior un modelo. La calculadora ofrece estimaciones puntuales deterministas para análisis rápidos, documentación y comparación de umbrales; no sustituye la validación con datos representativos.

Ejemplos de cálculo de exactitud

Matriz de confusiónResultados principalesInterpretación
TP 80, FP 20, TN 90, FN 10Exactitud 85.00%; F1 84.21%Buen rendimiento, bastante equilibrado
TP 50, FP 0, TN 50, FN 0Todas las métricas 100.00%Clasificación perfecta en esta muestra
TP 10, FP 5, TN 180, FN 5Exactitud 95.00%; sensibilidad 66.67%La exactitud alta oculta positivos no detectados

Cómo calcular métricas de clasificación

  1. Cuenta los verdaderos positivos y falsos positivos de las predicciones evaluadas.
  2. Cuenta los verdaderos negativos y falsos negativos del mismo conjunto de datos.
  3. Introduce los cuatro recuentos no negativos en los campos correspondientes.
  4. Selecciona Calcular métricas y compara la exactitud con precisión, sensibilidad, especificidad y F1.

Preguntas frecuentes

¿Qué se considera una buena exactitud de clasificación?

Depende del equilibrio de clases, el rendimiento de referencia y el costo de cada error. Compárala con una referencia sencilla y revisa las demás métricas antes de juzgar el modelo.

¿Por qué puede ser engañosa la exactitud?

Da el mismo peso a cada predicción correcta y puede quedar dominada por una clase mayoritaria grande. Un modelo puede tener exactitud alta y detectar muy pocos casos de la clase minoritaria.

¿Cuál es la diferencia entre precisión y sensibilidad?

La precisión indica cuántos positivos predichos fueron correctos. La sensibilidad indica cuántos positivos reales logró detectar el clasificador.

¿Cuándo conviene usar la puntuación F1?

Usa F1 si importan tanto los falsos positivos como los falsos negativos y buscas una medida de equilibrio. No contempla los verdaderos negativos, así que revisa también exactitud y especificidad.

¿Puedo introducir porcentajes en lugar de recuentos?

Usa recuentos siempre que sea posible, ya que todas las celdas deben compartir denominador. Los valores proporcionales solo sirven si tienen una escala coherente y representan la matriz completa.