Glosario Datos y codificación

UTF-8

UTF-8 es la codificación Unicode dominante: escribe cada carácter con uno a cuatro bytes y es idéntica a ASCII en los primeros 128 caracteres.

Última revisión:

AdSense Placeholder
Slot: header_reference_page

En detalle

Al ser de longitud variable, el número de bytes de una cadena no es su número de caracteres: é ocupa dos bytes y la mayoría de emojis cuatro. Es el valor por defecto en la web, JSON y la mayoría del software moderno.

Ejemplo

A es 41, é es C3 A9 y € es E2 82 AC. Vea los bytes de cada carácter con Inspector de Caracteres Unicode.

Pruebe estas herramientas

Véase también

  • Glosario ASCII
    ASCII es una codificación de caracteres de 7 bits que asigna los números 0 a 127 a letras inglesas, dígitos.
AdSense Placeholder
Slot: footer_leaderboard