문자열 유사도

두 문자열을 비교해 레벤슈타인 편집 거리와 유사도 퍼센트를 즉시 계산합니다 — 100% 브라우저에서 실행되며 업로드되지 않습니다.

레벤슈타인 거리
3
유사도
57.1%
다메라우 거리
3

편집 거리는 한 문자열을 다른 문자열로 바꾸는 데 필요한 문자 단위 삽입·삭제·치환의 최소 횟수입니다.

다메라우–레벤슈타인은 인접한 두 문자를 바꾸는 것("form" ↔ "from")도 한 번의 편집으로 계산해 오타 감지에 더 적합합니다.

🔒 두 문자열은 브라우저에서 비교되며 업로드되지 않습니다.

이 도구가 하는 일

문자열 유사도는 두 텍스트를 비교해 입력하는 즉시 두 가지 수치를 보여줍니다. 첫 번째는 레벤슈타인 거리로, 한 문자열을 다른 문자열로 바꾸는 데 필요한 문자 단위 삽입·삭제·치환의 최소 횟수입니다. 두 번째는 유사도 퍼센트로, 1 - 거리 / max(길이)로 계산되어 완전히 같은 문자열은 100%, 길이가 같지만 전혀 다른 문자열은 0%가 됩니다. 이름, 상품 코드, 코드 조각, 문장 등 어떤 텍스트에도 사용할 수 있습니다.

거리 계산 방식

이 도구는 고전적인 동적 계획법 레벤슈타인 알고리즘을 사용해 가능한 모든 편집 경로를 고려하고 가장 비용이 낮은 값을 반환합니다. 치환을 한 번의 편집으로 세기 때문에 "cat"을 "bat"으로 바꾸는 비용은 1이고, "kitten"을 "sitting"으로 바꾸는 비용은 3입니다. 이와 함께 다메라우 거리도 보여주는데, 인접한 두 문자를 바꾸는 것("form"과 "from")까지 한 번의 편집으로 세어 실제 오타에 더 가깝습니다. 비교는 대소문자를 구분하며 유니코드 코드 포인트를 개별 문자로 취급합니다. 두 값은 어느 한 상자가 바뀌는 즉시 다시 계산되므로 버튼을 누르지 않고도 철자, 오타 교정, 유사 매칭을 실험해 볼 수 있습니다.

자주 묻는 질문

레벤슈타인 거리란 정확히 무엇인가요?

한 문자열을 다른 문자열로 바꾸는 데 필요한 문자 단위 편집(삽입·삭제·치환)의 최소 횟수입니다. 예를 들어 "kitten"에서 "sitting"까지의 거리는 3입니다.

유사도 퍼센트는 어떻게 계산되나요?

1에서 편집 거리를 더 긴 문자열의 길이로 나눈 값을 뺀 뒤 퍼센트로 표시합니다. 완전히 같은 문자열은 100%, 길이가 같고 공통 문자가 없는 두 문자열은 0%입니다. 두 빈 문자열은 100% 동일한 것으로 처리됩니다.

입력한 문자열이 어딘가로 업로드되나요?

아니요. 두 문자열은 전적으로 브라우저의 자바스크립트로 비교됩니다. 입력한 내용은 어떤 서버로도 전송·저장·업로드되지 않습니다.