ASCII Code

image.png

영문 알파벳과 키보드에 있는 문자들을 정리한 대표적인 문자 인코딩 방식

ASCII 코드는 초기 개발된 표준으로서, 다양한 컴퓨터 시스템 간의 호환성과 통일성을 제공

다만 영문 알파벳과 기본 문구들만 인코딩이 가능하다보니 ASCII 코드에는 한계점이 있음

ASCII는 주로 미국 영어를 기반으로 설계되어있기 때문에, 다른 언어의 문자나 특수 기호를 정확히 표현 할 수 없음

이를 해결하기 위해서 나온 것이 UniCode

UniCode

전 세계의 모든 문자를 컴퓨터에서 일관되게 나타내고 처리하기 위한 국제적인 표준 문자 전산 처리법

8비트에서 16비트 문자 체계로 확장되고 ASCII Code는 그대로 유니코드 안으로 흡수가 되고 나머지 여유 공간에 다른 문자 체계가 들어감

21비트로 표현이 되어있고 총 수는 약 111만 개가 할당이 가능하고 현재 실제로 할당된 건 15만 개정도

그 가운데 가장 많이 공간을 차지하는 것은 중국의 한자로 약 9만 개가 약속이 되어있음

한국의 같은 경우는 약 1만개가 약속이 되어있음

UniCode 문자를 특정 글자로 표기할 때 U+(4자리의 16자리 숫자)로 표현

ASCII Code에서 10진수 65로 표기됐던, 알파벳 대문자 “A”를 예로 들면 UniCode는 U+0041

U+는 코드 포인트를 나타내는 접두사이고

10진수 65를 16진수로 변환하게 되면 41이 되고

이 경우 코드 포인트는 0041이 됨