Glossaire Données et encodage

UTF-8

L'UTF-8 est l'encodage Unicode dominant : il écrit chaque caractère sur un à quatre octets et reste identique à l'ASCII pour les 128 premiers caractères.

Dernière vérification:

AdSense Placeholder
Slot: header_reference_page

En détail

Comme sa longueur est variable, le nombre d'octets d'une chaîne n'est pas son nombre de caractères : é prend deux octets et la plupart des emojis quatre. C'est la valeur par défaut du web, de JSON et de la plupart des logiciels modernes.

Exemple

A vaut 41, é vaut C3 A9 et € vaut E2 82 AC. Voyez les octets de chaque caractère avec Inspecteur de Caractères Unicode.

Essayez ces outils

Voir aussi

  • Glossaire ASCII
    L'ASCII est un encodage de caractères sur 7 bits qui attribue les nombres 0 à 127 aux lettres anglaises, chiffres.
AdSense Placeholder
Slot: footer_leaderboard