해밍 거리 계산기

길이가 같은 두 문자열에서 서로 다른 위치 수를 세고 위치별 유사도를 즉시 확인하세요.

두 시퀀스 비교
길이가 같은 문자열을 입력하세요. 문자, 숫자, 공백, 기호를 그대로 정확히 비교합니다.

해밍 거리 계산기 알아보기

해밍 거리는 길이가 같은 두 문자열에서 대응하는 위치가 얼마나 다른지 측정합니다. 한 문자씩 비교하면서 서로 다를 때마다 하나를 더합니다. 최종 개수가 해밍 거리입니다. 거리가 영이면 문자열이 같고, 문자열 길이와 같으면 모든 위치가 다릅니다. 수학자 리처드 해밍의 이름을 딴 개념으로 부호 이론과 디지털 통신의 기초입니다. 예를 들어 hello와 hallo는 두 번째 위치만 달라 해밍 거리가 일입니다. 이진 문자열 1011101과 1001001은 세 번째와 다섯 번째 위치가 달라 거리가 이입니다. 이 도구는 위치를 일부터 세므로 첫 문자는 인덱스 영이 아닌 위치 일입니다. 일치하는 위치 수를 전체 길이로 나누고 백분율로 나타낸 위치별 유사도도 계산합니다. 표준 정의에서는 길이가 같아야 합니다. 해밍 거리는 한 위치의 문자를 다른 문자로 바꾸는 치환만 나타냅니다. 삽입과 삭제는 이후 위치를 이동시켜 직접적인 일대일 비교를 방해하므로 고려하지 않습니다. 길이가 다른 문자열에는 보통 레벤슈타인 거리 같은 편집 거리가 더 적합합니다. 따라서 계산기는 입력을 몰래 채우거나 자르지 않고 길이가 다른 입력을 거부합니다. 해밍 거리는 오류 검출 부호와 오류 정정 부호에 널리 쓰입니다. 유효한 부호어 사이에는 최소 거리가 있도록 설계합니다. 수신된 부호어가 유효한 부호어와 몇 비트만 다르면 복호기는 어떤 전송 오류가 발생했는지 추론할 수 있습니다. 표준 가정에서 최소 거리가 삼인 부호는 최대 두 비트 오류를 검출하고 한 비트 오류를 정정할 수 있습니다. 이 척도는 정보 이론, 암호학, 군집화, 컴퓨터 비전, 생물학적 서열 분석에도 쓰입니다. 해시 비교에서 서로 다른 비트를 세어 눈사태 효과를 연구할 수 있고, 이진 특징 벡터는 배타적 논리합으로 효율적으로 비교할 수 있습니다. 이 계산기는 정확한 문자 비교를 수행하며 대소문자를 구분하므로 대문자 A와 소문자 a는 다릅니다. 공백과 문장 부호도 문자로 셉니다. 입력 형식을 일관되게 맞추고 두 시퀀스가 정렬된 관측을 나타내는지 확인한 뒤 결과를 해석하세요.

해밍 거리 예시

시퀀스거리서로 다른 위치
hello 및 hallo1위치 2만 다릅니다.
1011101 및 10010012위치 3과 5가 다릅니다.
karolin 및 kathrin3위치 3, 4, 5가 다릅니다.

해밍 거리 계산 방법

  1. 비교하려는 모습 그대로 첫 번째 시퀀스를 입력하세요.
  2. 문자 수가 같은 두 번째 시퀀스를 입력하세요.
  3. 해밍 거리 계산을 선택해 불일치 위치 수를 구하세요.
  4. 거리, 유사도 백분율, 일부터 시작하는 불일치 위치를 확인하세요.

해밍 거리 자주 묻는 질문

해밍 거리가 영이면 무슨 뜻인가요?

대응하는 모든 위치의 문자가 일치한다는 뜻입니다. 대소문자를 구분하는 정확한 비교에서 두 시퀀스가 동일합니다.

문자열 길이가 달라도 되나요?

아니요. 표준 해밍 거리는 길이가 같은 문자열에 대해 정의됩니다. 삽입과 삭제를 고려해야 한다면 레벤슈타인 거리나 다른 편집 거리를 사용하세요.

대소문자를 구분하나요?

네. 대문자와 소문자는 서로 다른 문자입니다. 대소문자를 무시하는 분석이라면 문자열 입력 전에 대소문자를 통일하세요.

유사도 백분율은 어떻게 계산하나요?

시퀀스 길이에서 거리를 뺀 뒤 해당 길이로 나눕니다. 여기에 100을 곱하면 일치 비율이 백분율로 바뀝니다.

해밍 거리를 오류 정정에 어떻게 사용하나요?

부호화 체계는 유효한 부호어 사이에 알려진 최소 거리를 둡니다. 수신기는 가장 가까운 유효 부호어를 이용해 제한된 수의 비트 변화를 검출하거나 정정할 수 있습니다.