Nirmion
Ayuda encontrar una herramienta

Mide el texto visible y el tamaño codificado

Contador de caracteres

Cuenta los personajes percibidos por el usuario, los personajes sin espacio blanco UTF-8 bits, y líneas localmente, incluyendo el manejo más seguro para emoji y las letras combinadas.

  1. 01Privado por diseñoSu texto permanece en esta tabla de navegador.
  2. 02limitado y respondienteHasta 500.000 caracteres en cada campo de texto principal.
  3. 03Prepara para reutilizarCopiar el resultado o descargar un branded TXT El archivo.
Procesamiento local en el navegador

Las transformaciones y las transformaciones se realizan localmente. Nirmion No envíe el texto en este espacio de trabajo a uno API.

01 de entrada

Toma el texto cuya longitud importa

Los límites de carácter varían: algunas destinos cuentan las unidades de código, algunas Unicode puntos de código, y algunos clusters de grafema visibles. Esta herramienta informa de los clusters de grafema y UTF-8 BITES, por lo que la base es explícita.

Completar los campos necesarios para permitir esta acción.

En esta tabla se puede correr sin una API La petición.

Guía de producto

Seleccione la definición de caracteres que utiliza su destino

Un personaje no siempre es uno JavaScript Unidad de código. Nirmion Prefere la segmentación de gráficos, así que se unen emoji, combinaciones acentuadas, y muchos símbolos percibidos por el usuario permanecen juntos, mientras que el total de byte se mide por separado UTF-8 en codificación.
paso A

Prepara la entrada

Pase el título, el mensaje, el identificador o el valor de la base de datos. Conserva los espacios y las líneas se rompen cuando el objetivo los cuenta, porque ambos contribuyen a la medición total del carácter.

paso B

Elegir la regla

El total principal cuenta los clusters de grafema. La métrica no espacial elimina todo el espacio blanco antes de contar. UTF-8 Los bajos se calculan con TextEncoder y puede ser más grande que el número visible para los escritos no-ASCII y emoji.

paso C

Revisa la producción

Se ajusta la metrica relevante a la documentación de destino. Una plataforma que dice que los personajes pueden usar UTF-16 Unidades de código en lugar de gráficos, por lo que prueba el valor final allí cuando un personaje puede determinar la aceptación.

Cómo funciona

Clusteres de gráficos para la intención del personaje visible

Intl.Segmenter con grafema granularidad grupos de letras de base con combinar marcas y mantiene las secuencias emoji apoyadas juntos. Se utiliza un fallback de código punto donde la segmentación no está disponible. El número de contas sin espacio blanco se elimina Unicode El espacio blanco y UTF-8 El tamaño se genera de la línea de fuente exacta en lugar de estimado de los símbolos visibles.

útil cuando

Verifique los límites antes de la pasta final

La medición de caracteres es útil en cualquier lugar donde un campo conciso, formato de transporte o carga de carga codificada tenga un límite duro.

  1. Verificar copia de anuncios, metadatos, texto de App Store, respuestas de formularios, líneas de sujetos, capciones y bios de perfil antes de la publicación.
  2. Compare con el gráfico visible UTF-8 bits cuando se diseña columnas de base de datos API límites, importaciones o presupuestos de localización.
  3. Inspeccionar copias emoji pesadas o acentuadas sin tratar incorrectamente cada punto de código subyacente como un personaje visible separado.

Las preguntas se respondieron

Características de las preguntas

Las limitaciones prácticas son las de las herramientas de texto. Estas respuestas explican lo que se mide, lo que se conserva y cuando todavía se necesita una revisión manual.

¿Por qué puede UTF-8 ¿Los bajetas superan el número de caracteres?

Los personajes ASCII generalmente ocupan uno UTF-8 bits, mientras que muchas letras destacadas, escritos no latinos y emoji requieren múltiples bits. Un emoji adjunto también puede contener varios puntos de código codificados mientras aparecen como un único gráfico.

¿Se incluyen espacios y pausas de línea?

El carácter principal total incluye ellos. Una métrica separada remove el espacio blanco primero. Las líneas también se reportan, lo que le permite elegir el valor que corresponde a la documentación de campo que recibe.

¿Es que esto va a ser una plataforma social?

No siempre. Las plataformas pueden aplicar lenguas de URL pesadas, normalizar el texto o contar UTF-16 Unidades . Utilice esto como un prefixo transparente y confirme los casos de borde en el compositor de destino.

Privacidad y retención

Su proyecto se mantiene en su dispositivo.

Nirmion ejecuta estas operaciones con el navegador JavaScript. El espacio de trabajo no llama al catálogo API con su texto de fuente, y el contenido de trabajo completado se mantiene sólo en la memoria de este componente para re-download.

Un archivo descargado permanece en sus descargas de navegador, almacenamiento de dispositivos, backups, y cualquier lugar donde lo comparta. Limpiar o cerrar la página cuando se trabaja en un dispositivo compartido, y evitar que se apagan secretos en extensiones o administradores de clipboard de terceros.

Detalles de la herramienta

A y Unicode-Control de caracteres con contexto byte

Nirmion El Counter de Caracteres mide los clusters de gráficos percibidos por el usuario en lugar de reportar ciegamente JavaScript Longitud de la cordura. También se ha publicado un cuadro de caracteres sin espacio blanco UTF-8 Bytes codificados y cuentas de línea. Esta combinación es útil para los escritores, desarrolladores, equipos de localización, y cualquier persona que prepara copia para un campo restringido.

La medición se realiza localmente para texto hasta 500.000 caracteres y se puede descargar como text_nirmion_tools_character_report.txt. Debido a que los servicios externos pueden contar unidades de código o contenido pesado de manera diferente, el resultado debe compararse con la plataforma final cuando el límite es estricto.