Encodage et décodage UTF‑8
On te donne les quatre caractères suivants :
- A
- é
- €
- 😄
Pour chacun des caractères, déterminer :
- Son code Unicode (exemple : U+0041).
- La taille UTF‑8 (1, 2, 3 ou 4 octets).
- Les octets UTF‑8 en hexadécimal.
- Pourquoi UTF‑8 utilise cette longueur pour ce caractère.
- La séquence binaire complète (avec les bits de tête : 0xxxxxxx, 110xxxxx, 1110xxxx, 11110xxx).
Décodage UTF-8
Pour chaque séquence UTF-8 ci-dessous, indique :
- Le point de code Unicode (ex : U+00E9)
- Le caractère correspondant
1. Séquence UTF-8 : C3 A7
2. Séquence UTF-8 : E2 82 AC
3. Séquence UTF-8 : C2 A9
4. Séquence UTF-8 : F0 9F 98 80
5. Séquence UTF-8 : E2 99 A5