Visor de bytes UTF-8
Pegue un texto para ver cuántos bytes ocupa cada carácter y cuáles son, en UTF-8 o, si prefiere, en UTF-16 y UTF-32.
Procesado localmente en tu navegador· Tus datos se quedan en tu navegador.
¿Qué es Visor de bytes UTF-8?
UTF-8 guarda cada punto de código Unicode en uno a cuatro bytes: el ASCII usa uno, las letras latinas con tilde, griegas, cirílicas, hebreas y árabes usan dos, la mayor parte del resto del plano multilingüe básico (incluidos € y CJK) usa tres, y los emoji usan cuatro. El primer byte indica la longitud de la secuencia; los siguientes siempre empiezan por los bits 10.
Este visor lista una fila por punto de código o por carácter visible, con su número de bytes, los bytes en hex, binario y decimal y el patrón de bits UTF-8 que ocupa. Un resumen da el total de bytes, la media por carácter, si el texto es solo ASCII y su tamaño en UTF-8, UTF-16 y UTF-32. Puede cambiar a UTF-16 o UTF-32 en ambos órdenes de bytes y anteponer un BOM.
¿Cómo funciona?
- Escriba o pegue su texto: la tabla y el flujo de bytes se actualizan al instante.
- Elija la codificación (UTF-8 por defecto) y si cada fila es un punto de código o un grafema.
- Elija el formato del flujo de bytes (hex, binario, decimal u octal) y active el BOM si lo necesita.
- Consulte el resumen para el tamaño total y copie el flujo de bytes.
Casos de uso habituales
- Entender por qué una cadena ocupa más bytes que caracteres cuando choca con una columna de base de datos o el límite de una API.
- Comprobar los bytes exactos de un carácter no ASCII antes de escribir un caso de prueba o un mensaje de protocolo binario.
- Comprender el mojibake: ver que é es C3 A9 en UTF-8 y por eso aparece como é si se lee como Latin-1.
- Comparar el espacio que ocupa el mismo texto en UTF-8, UTF-16 y UTF-32.
Ejemplos
Prueba esta entrada en la herramienta de arriba:
Héllo €😀
48 C3 A9 6C 6C 6F 20 E2 82 AC F0 9F 98 80
Privacidad
Visor de bytes UTF-8 se ejecuta por completo en tu navegador. El texto o los archivos que proporcionas se procesan en tu dispositivo y no se suben, registran ni almacenan en nuestros servidores.
Limitaciones
La herramienta muestra cómo se codifica un texto, no el contenido de un archivo en disco: para eso use un visor hexadecimal. Los sustitutos aislados no se pueden codificar en UTF-8 ni UTF-32 y se muestran como U+FFFD. Solo se analizan los primeros 100 000 caracteres.
Preguntas frecuentes
¿Cuántos bytes ocupa un emoji en UTF-8?
Casi siempre cuatro, porque los emoji están por encima de U+FFFF. Una secuencia como el emoji de familia une varios emoji con unidores de ancho cero (3 bytes cada uno) y puede llegar a 18 bytes o más.
¿En qué se diferencia del Inspector Unicode?
El inspector describe caracteres: categoría, escritura, entidad HTML. Esta herramienta se centra en los bytes: tamaños, patrones de bits, varias codificaciones, orden de bytes y BOM.
¿Por qué UTF-16 y UTF-32 muestran otros bytes para el mismo texto?
UTF-16 usa dos o cuatro bytes y UTF-32 siempre cuatro; ambos dependen del orden de bytes (little o big endian). UTF-8 no tiene ese problema, una de las razones de su dominio en la web.
Herramientas relacionadas
Inspector de Caracteres Unicode
Pegue un texto o un emoji y vea exactamente de qué puntos de código, bytes y escrituras se compone.
Codificación y decodificación
Convertidor de Texto a Hexadecimal
Vea los bytes exactos que hay tras cualquier texto, desde un simple "Hola" hasta emoji, con el formato que espera su código o depurador.
Codificación y decodificación
Convertidor de Texto a Binario
Convierta palabras en unos y ceros: cada byte de su texto se muestra en ocho bits.
Codificación y decodificación
Convertidor de Texto a Decimal
Obtenga el número Unicode de cada carácter: "é" es 233, "世" es 19990 y 😀 es 128512.
Codificación y decodificación
Buscador de punto de código (consulta Unicode)
Escriba puntos de código en cualquier notación habitual, o un rango, y vea los caracteres con sus formas decimal, hex, UTF-8, UTF-16 y entidad HTML.
Codificación y decodificación
Visor hexadecimal
Suelte un archivo para ver sus bytes en bruto con el conocido formato offset | hex | ASCII, más su tipo detectado y su tamaño.
Herramientas de archivos
Contador de caracteres
Vea la longitud exacta de su texto en caracteres, puntos de código Unicode y bytes, y cuántos le quedan antes de un límite.
Herramientas de texto
Convertidor de Escape Unicode
Convierta é, ☕ y 😀 en \u00E9, \u2615 y \uD83D\uDE00 (u otro estilo) para código fuente, JSON o CSS.
Codificación y decodificación