初始化内容
This commit is contained in:
+8
@@ -0,0 +1,8 @@
|
||||
$)CISO/IEC 20224B
|
||||
|
||||
9.@Z A}GU@; 7:qF. :NH# 6G4B 8:qF. :NH#7N G%GvGO1b @'GQ 1b<z
|
||||
5Q @L;s@G 9.@Z A}GU@; GO3*@G 9.@Z :NH#H- 9f=D@87N 8p5N G%GvGO4B 1b<z
|
||||
|
||||
@; 1TA$GO4B ISO G%AX@L4Y.
|
||||
|
||||
ISO/IEC 2022@G :NH#H- 9f=D@: Ek;s 9.@Z GO3*?! 19Y@LF.3* 29Y@LF. @L;s@; >24B 0!:/ 9.@Z :NH#H- 9f=D@L8g GQ19>n@G 0f?l EUC-KR@L @L :NH#H- 9f=D@; ;g?kGQ4Y.
|
||||
Vendored
+16
@@ -0,0 +1,16 @@
|
||||
<SAMI>
|
||||
<HEAD>
|
||||
<TITLE>EUC-KR.smi</TITLE>
|
||||
<STYLE TYPE="text/css">
|
||||
</STYLE>
|
||||
</HEAD>
|
||||
<BODY>
|
||||
<SYNC Start=0000><P>EUC-KR
|
||||
<SYNC Start=1000><P>EUC-KR은 KS X 1001와 KS X 1003을 사용하는 8비트 문자 인코딩으로, EUC의 일종이며 대표적인 한글 완성형 인코딩이기 때문에 보통 완성형이라고 불린다.
|
||||
<SYNC Start=2000><P>EUC-KR 인코딩은 다음과 같이 구성된다.
|
||||
<SYNC Start=3000><P>128보다 작은 바이트에 KS X 1003을 배당한다.
|
||||
<SYNC Start=4000><P>128보다 크거나 같은 바이트에 KS X 1001을 배당한다. 각 글자는 행과 열에 128을 더한 코드값을 사용하여 2바이트로 표현된다.
|
||||
<SYNC Start=5000><P>따라서 KS X 1001의 40-27에 배당된 "위"라는 글자는 EUC-KR에서 C0 A7라는 바이트 열로 표현된다.
|
||||
<SYNC Start=6000><P>KS X 1001에는 한글 채움 문자를 사용하여 규격의 문자 집합에 포함되지 않은 한글을 표현하는 확장 방법이 있지만, 대부분의 경우 이 방법은 EUC-KR에서 사용되지 않고 대신 CP949와 같은 다른 방법을 사용하여 KS X 1001 바깥의 현대 한글을 표현한다.
|
||||
</BODY>
|
||||
</SAMI>
|
||||
Vendored
BIN
Binary file not shown.
Vendored
BIN
Binary file not shown.
Vendored
+3
@@ -0,0 +1,3 @@
|
||||
UTF-8은 유니코드를 위한 가변 길이 문자 인코딩 방식 중 하나로, 켄 톰프슨과 롭 파이크가 만들었다. 본래는 FSS-UTF(File System Safe UCS/Unicode Transformation Format)라는 이름으로 제안되었다.
|
||||
|
||||
UTF-8 인코딩은 유니코드 한 문자를 나타내기 위해 1바이트에서 4바이트까지를 사용한다. 예를 들어서, U+0000부터 U+007F 범위에 있는 ASCII 문자들은 UTF-8에서 1바이트만으로 표시된다. 4바이트로 표현되는 문자는 모두 기본 다국어 평면(BMP) 바깥의 유니코드 문자이며, 거의 사용되지 않는다. UTF-16과 UTF-8 중 어느 인코딩이 더 적은 바이트를 사용하는지는 문자열에서 사용된 코드 포인트에 따라 달라지며, 실제로 DEFLATE와 같은 일반적인 압축 알고리즘을 사용할 경우 이 차이는 무시할 수 있을 정도이다. 이러한 압축 알고리즘을 사용하기 힘들고 크기가 중요할 경우 유니코드 표준 압축 방식을 대신 사용할 수 있다.
|
||||
Reference in New Issue
Block a user