Unicode 18.0.0

12 hours ago 4

Unicode 18.0 초안은 문자 13,007개를 추가해 총 172,808개를 수록하며, Proto-Cuneiform 숫자, Jurchen, Seal 문자 체계를 새로 지원함 줄바꿈과 자소 클러스터 분할 규칙이 바뀌며, 대시/하이픈 처리와 Balinese, Zanabazar Square, Bengali 텍스트의 분할 동작을 개선함 변형 선택자와 변형 시퀀스의 적합성 요구사항을 명확히 하고, CJK 획과 수학 기호 등의 변형 시퀀스를 추가하며 Mongolian 시퀀스를 중국 표준과 동기화함 정렬, 식별자 보안, Unihan 데이터 변경은 기존 구현에 영향을 줄 수 있으며, CJK 범위를 하드코딩한 구현과 일부 데이터 파일 파서는 수정이 필요함 현재 페이지는 출시 예정 버전의 예비 초안으로 세부 내용이나 링크가 부정확할 수 있으며, 베타 검토 기간의 마이그레이션 안내도 아직 미완성임 추가 문자와 새 블록 13,007개 문자가 추가돼 전체 문자 수가 172,808개로 늘어남 새 문자 체계는 Proto-Cuneiform, Jurchen, Seal이며, Jurchen과 Seal은 대규모 표의문자 체계임 Proto-Cuneiform은 이번 버전에서 고대 숫자만 추가하며, 숫자가 아닌 기호는 향후 버전에서 인코딩될 것으로 예상됨 새 문자는 대부분 신규 블록에 들어가지만 기존 블록에도 추가됨 신규 블록은 다음과 같으며, 추가 문자와 주요 글리프 변경은 변경 코드 차트에서 확인할 수 있음 11DF0..11DFF: Bengali Supplement 12550..1268F: Archaic Cuneiform Numerals 18E00..1919F: Jurchen 191A0..191DF: Jurchen Radicals 1D250..1D28F: Musical Symbols Supplement 1DB00..1DBFF: Miscellaneous Symbols and Arrows Extended 3D000..3FC3F: Seal Seal은 블록 이름과 Script 속성값이며, 코드 차트 제목과 핵심 명세에서는 Small Seal이라는 확장 명칭을 사용함 이 명칭 차이는 의도된 것으로 오류가 아님 Archaic Cuneiform Numerals에는 매우 많은 숫자 문자가 들어가며, 설형문자 전문 구현은 이를 고려해야 함 이 문자들은 서식 처리와 글꼴 설계에도 과제를 안겨줌 적합성 요구사항과 변형 시퀀스 변형 선택자와 변형 시퀀스 사용에 관한...

Read Entire Article