MySQL 데이터 정렬 utf8_unicode 차이점


10

그러나 MySQL Collation의 중요성에 대해 읽었으며 호환성과 정확성에 대해 지금까지 배운 것은이 4가 내 최선의 방법이라고 생각합니다.

  • utf8_unicode_ci
  • utf8_unicode_520_ci
  • utf8mb4_unicode_ci
  • utf8mb4_unicode_520_ci

내 이해에서 uft8mb4는 다양한 언어 (문자)를 지원하는 문자 (예 : 일본어)에 적합합니다. uf8은 3 바이트 만 지원하고 uf8mb4는 4 바이트를 지원합니다. 따라서 분명한 선택은 uf8mb4가 될 것 같지만 캐치에는 길이 제한이 있습니다.

그런 다음 520 표준을 고려합니다. 내가 찾을 수있는 것보다 더 많은 것을 제공합니다. 그러나 그것은 물론 문제이며, 나는 그것에 대해 거의 찾을 수 없습니다. 그 사람들 만이 그것이 개선이라고 말하면서 그것이 어떻게되는지 모호합니다.

가능한 한 적은 수의 제한으로 얻을 수있는 최대한의 것을 원합니다. 여기 누군가가 한 두 가지를 알고있을 것이라고 생각했습니다. 공식 MySQL 사이트는 내가 기대했던 것만 큼 유익하지 않았습니다.

가장 호환성, 정확성 및 스토리지 길이가 가장 큰 4 개 중에서? 또한 502 표준의 가장 큰 차이점은 무엇입니까?

답변:


10

유니 코드 데이터 정렬 이름에는 데이터 정렬의 기반이되는 UCA (Unicode Collation Algorithm)의 버전을 나타내는 버전 번호가 포함될 수 있습니다. 이름에 버전 번호가없는 UCA 기반 데이터 정렬 version-4.0.0UCA 가중치 키를 사용 합니다 . 데이터 정렬 이름 utf8_unicode_520_ciUCA 5.2.0 가중치 키를 기반으로 합니다 .

https://dev.mysql.com/doc/refman/5.6/en/charset-collation-names.html을 참조 하십시오 .


이것에 대해 더 설명하기 위해 : 데이터 정렬은 사용 된 인코딩 (MySQL이 잘못 호출하는 것 character set또는 charset)을 수정하지 않으므로 utf83 바이트 (비표준) UTF-8 utf8mb4을 제공 하고 4 바이트 UTF-8을 제공합니다.
jynus

1
따라서 간단한 영어로 UCA 4.0.0과 UCA 5.2.0의 차이점은 무엇입니까? 장점이나 단점은 무엇입니까?
Adam

4
정렬에 영향을줍니다. 최신 (아직 구식) 버전의 유니 코드 표준과 절대적으로 정렬해야하는 경우을 사용할 수 있습니다 520_ci. 내 웹 사이트의 경우 덜 신경 쓰지 못했습니다.
Mathias Bynens

utf8mb4_unicode_520_ci데이터 정렬 에서 가장 큰 바이트 크기 문자의 바이트 크기는 얼마입니까?
oldboy
당사 사이트를 사용함과 동시에 당사의 쿠키 정책개인정보 보호정책을 읽고 이해하였음을 인정하는 것으로 간주합니다.
Licensed under cc by-sa 3.0 with attribution required.