분류 정확도 계산기

이진 혼동 행렬로 정확도, 정밀도, 재현율, 특이도, F1 점수를 계산합니다.

분류 평가 지표
혼동 행렬의 네 가지 개수를 입력해 이진 분류기를 평가하세요.

분류 정확도란?

분류 정확도는 전체 예측 중 모델이 올바르게 분류한 비율입니다. 참 양성과 참 음성을 더한 뒤 혼동 행렬의 전체 관측 수로 나눕니다. 직관적인 지표지만 대개 단독으로 해석해서는 안 됩니다. 클래스가 불균형하면 모델이 거의 항상 다수 클래스를 예측하기만 해도 높은 정확도를 보이면서 가장 중요한 사례를 놓칠 수 있습니다. 따라서 이 계산기는 서로 보완하는 다섯 가지 이진 분류 지표를 제공합니다. 정밀도는 양성으로 예측한 것 중 실제 양성의 비율로, TP를 TP와 FP의 합으로 나눕니다. 민감도라고도 하는 재현율은 실제 양성 중 모델이 찾아낸 비율로, TP를 TP와 FN의 합으로 나눕니다. 특이도는 음성을 얼마나 잘 식별하는지 나타내며 TN을 TN과 FP의 합으로 나눕니다. F1 점수는 정밀도와 재현율의 조화 평균이므로, 한쪽을 희생해 다른 쪽을 높이기보다 둘의 균형을 잘 맞춘 모델을 높게 평가합니다. 먼저 평가 결과를 혼동 행렬로 정리하세요. 참 양성은 양성을 올바르게 양성으로 예측한 사례입니다. 거짓 양성은 음성을 잘못 양성으로 예측한 사례입니다. 참 음성은 음성을 올바르게 음성으로 예측한 사례이고, 거짓 음성은 분류기가 놓친 양성 사례입니다. 네 항목 모두 같은 테스트 세트와 결정 임계값에서 얻은 개수여야 합니다. 백분율, 학습 관측값, 서로 다른 임계값의 결과를 섞으면 지표가 유효하지 않게 됩니다. 어떤 지표를 우선할지는 용도에 따라 다릅니다. 의료 선별 검사에서는 질환을 놓치는 비용이 클 수 있어 재현율이 더 주목받습니다. 스팸 필터링이나 자동 제재에서는 잘못된 판정의 비용이 클 수 있어 정밀도가 중요합니다. 음성을 올바르게 배제해야 할 때는 특이도가 유용합니다. 한 모델이 우수하다고 결론 내리기 전에 같은 데이터셋에서 지표를 비교하고, 클래스 비율을 확인하며, 신뢰구간을 고려하세요. 이 계산기는 빠른 분석, 문서화, 임계값 비교를 위한 결정론적 점 추정값을 제공하지만 대표성 있는 데이터 검증을 대신하지 않습니다.

정확도 계산 예시

혼동 행렬주요 결과해석
TP 80, FP 20, TN 90, FN 10정확도 85.00%; F1 84.21%우수하고 비교적 균형 잡힌 성능
TP 50, FP 0, TN 50, FN 0모든 지표 100.00%이 표본에서 완벽하게 분류
TP 10, FP 5, TN 180, FN 5정확도 95.00%; 재현율 66.67%높은 정확도가 놓친 양성을 가림

분류 지표 계산 방법

  1. 평가할 예측에서 참 양성과 거짓 양성 수를 세세요.
  2. 같은 데이터셋에서 참 음성과 거짓 음성 수를 세세요.
  3. 네 가지 음수가 아닌 개수를 해당 입력란에 입력하세요.
  4. 지표 계산을 선택하고 정확도를 정밀도, 재현율, 특이도, F1 점수와 비교하세요.

자주 묻는 질문

어느 정도의 분류 정확도가 좋은가요?

클래스 균형, 기준 모델 성능, 각 오류의 비용에 따라 다릅니다. 간단한 기준 모델과 비교하고 다른 지표도 살펴본 뒤 판단하세요.

정확도가 오해를 부를 수 있는 이유는 무엇인가요?

정확도는 모든 올바른 예측에 같은 가중치를 주므로 큰 다수 클래스의 영향을 많이 받습니다. 소수 클래스 사례를 거의 찾지 못해도 정확도가 높을 수 있습니다.

정밀도와 재현율의 차이는 무엇인가요?

정밀도는 양성으로 예측한 것 중 얼마나 맞았는지를 나타냅니다. 재현율은 실제 양성 중 얼마나 성공적으로 찾아냈는지를 나타냅니다.

F1 점수는 언제 사용하나요?

거짓 양성과 거짓 음성이 모두 중요하고 균형 중심의 단일 지표가 필요할 때 사용하세요. 참 음성은 반영하지 않으므로 정확도와 특이도도 확인하세요.

개수 대신 백분율을 입력해도 되나요?

모든 셀이 같은 분모를 공유해야 하므로 가능하면 개수를 사용하세요. 비례값은 같은 비율로 조정되고 전체 혼동 행렬을 나타낼 때만 사용할 수 있습니다.