Nirmion
Aide Trouver un outil

Mesure du texte visible et de la taille encodée

Compteur de caractères

Comptez les personnages perçus par l’utilisateur, les personnages sans espace blanc UTF-8 bits, et lignes locaux, y compris un traitement plus sûr pour les émoji et les lettres combinées.

  1. 01Privé par designVotre texte reste dans cette rubrique de navigateur.
  2. 02Limité et réactionnelJusqu’à 500 000 caractères dans chaque champ de texte principal.
  3. 03Prêt à réutiliserCopiez le résultat ou téléchargez un branded TXT fichier .
Traitement local dans le navigateur

Les calculs et les transformations se déroulent localement. Nirmion ne transmet pas le texte dans ce lieu de travail à un API.

01 / Entrée

Il faut respecter le texte dont la longueur est importante

Les limites de caractère varient : certains destinations comptent les unités de code, certains Unicode points de code, et quelques clusters de graphème visibles. Cet outil rapporte les clusters de graphème et UTF-8 Les bits sont donc explicites.

Complétez les champs nécessaires pour permettre cette action.

Il est dans cette boîte sans un API La demande.

Guide de produit

Choisissez la définition du caractère que vous utilisez

Un personnage n’est pas toujours un JavaScript Unité de code. Nirmion préfère la ségrégation de graphème, de sorte que les émoji joints, les combinaisons accentuées et de nombreux symboles perçus par l'utilisateur restent ensemble, tandis que le total de byte mesure séparément UTF-8 codage .
Étape A

Préparez l’entrée

Mettez le titre, le message, l’identificateur ou la valeur de base de données. Conserver les espaces et les lignes se rompent lorsque le cible les compte, car les deux contribuent à la mesure totale du caractère.

Étape B

Choisissez la règle

Le total principal compte les clusters de graphème. La métrice sans espace supprime tout l’espace blanc avant de compter. UTF-8 Les bytes sont calculés TextEncoder et peut être plus grand que le nombre visible pour les scripts non-ASCII et les emoji.

Étape C

Revue de la production

correspondre à la documentation de destination. Une plateforme qui dit que les personnages peuvent utiliser UTF-16 Unités de code plutôt que des graphèmes, donc tester la valeur finale là-bas quand un seul caractère peut déterminer l'acceptation.

Comment ça fonctionne

Clusters graphiques pour intention de caractère visible

Intl.Segmenter avec graphème granularité groupes de base des lettres avec des marques combinées et maintient les séquences émoji soutenues ensemble. Un code-point fallback est utilisé lorsque la segmentation n’est pas disponible. Le compte libre de Whitespace est supprimé Unicode Le blanc et UTF-8 La taille est générée à partir de la racine source exacte plutôt que estimée à partir de symboles visibles.

Utiles quand

Vérifiez les limites avant la dernière pâte

La mesure du caractère est utile n'importe où un champ concis, un format de transport ou une charge cryptée a une limite dure.

  1. Vérifiez la copie des annonces, les métadonnées, le texte de l'appstore, les réponses de formulaire, les lignes de sujet, les captions et les bios de profil avant la publication.
  2. Comparaison de graphiques visibles avec UTF-8 - les bytes lors de la conception des colonnes de base de données API Les limites, les importations ou les budgets de localisation.
  3. Inspectez la copie émoji-sérieuse ou accentuée sans traiter incorrectement chaque point de code sous-jacent comme un caractère visible séparé.

Les questions répondent

Les questions de caractère

Les limites pratiques sont les outils de texte. Ces réponses expliquent ce qui est mesuré, ce qui est conservé et quand une revue manuelle est encore nécessaire.

Pourquoi peut UTF-8 Les bytes dépassent le nombre de caractères ?

Les personnages ASCII occupent généralement un UTF-8 bits, tandis que de nombreuses lettres accentuées, des scripts non latins et des emoji nécessitent plusieurs bits. Un emoji joint peut également contenir plusieurs points de code encodés tout en apparaissant comme un graphème.

Les espaces et les interruptions de ligne sont-ils inclus ?

Le caractère principal en général les comprend. Une métrice distincte supprime d’abord le blanc. Les lignes sont également signalées, vous permettant de choisir la valeur qui correspond à la documentation de champ recevant.

Est-ce que cela va correspondre à une plateforme sociale exactement?

Pas toujours. Les plateformes peuvent appliquer des longs URL pesés, normaliser le texte ou compter UTF-16 Unités Utilisez ceci comme un préflet transparent et confirmez les cas de bord dans le compositeur de destination.

Confidentialité et Réservation

Votre projet reste sur votre appareil.

Nirmion Il effectue ces opérations avec le navigateur JavaScript. Le bureau ne fait pas appel au catalogue API avec votre texte source, et le contenu de travail complet est conservé uniquement dans cette mémoire composante pour le récupérer.

Un fichier téléchargé reste dans vos téléchargements de navigateur, stockage de dispositif, sauvegardes et n’importe quel endroit où vous le partagez. Nettoyer ou fermer la page lors de la fonctionnement sur un appareil partagé, et éviter de cacher des secrets dans les extensions ou les gestionnaires de clips tiers.

Les détails de l’outil

A et A Unicode- Contenu de caractère avec contexte byte

Nirmion Le caractère Counter mesure les clusters de graphème perçus par l’utilisateur plutôt que de rappeler aveuglement JavaScript longueur de la ligne. Il rapporte également un nombre de caractères sans espace blanc UTF-8 Les bits codés et le nombre de lignes. Cette combinaison est utile pour les auteurs, les développeurs, les équipes de localisation et tout le monde qui préparent une copie pour un champ restreint.

La mesure est effectuée localement pour le texte jusqu'à 500 000 caractères et peut être téléchargée comme text_nirmion_tools_character_report.txt. Parce que les services externes peuvent compter les unités de code ou le contenu pesé différemment, le résultat devrait être comparé à la plate-forme finale lorsque le seuil est strict.