Bereiten Sie den Eingang vor
Speichern Sie den genauen Titel, Titel, Nachricht, Identifier oder Datenbankwert. Bewahren Sie Räume und Linien brechen, wenn das Ziel sie zählt, weil beide zur Gesamtkaraktermessung beitragen.
Messung sichtbarer Text und verschlüsselte Größe
Berechnen Sie benutzergefühle Charaktere, Charaktere ohne Whitespace UTF-8 Bytes und Linien lokal, einschließlich sicherer Handhabung für Emoji und kombinierte Briefe.
Die Berechnung und Transformationen gehen lokal durch. Nirmion Sie senden den Text in diesem Arbeitsplatz nicht an einen API.
Produktführer
Speichern Sie den genauen Titel, Titel, Nachricht, Identifier oder Datenbankwert. Bewahren Sie Räume und Linien brechen, wenn das Ziel sie zählt, weil beide zur Gesamtkaraktermessung beitragen.
Das Hauptvolumen zählt die Graphem-Kluster. Die No-Space-Metrik entfernt alle weißen Räume vor der Berechnung. UTF-8 Bei den Bites wird berechnet TextEncoder und kann größer sein als die sichtbare Anzahl für nicht-ASCII-Scripts und Emoji.
Die entsprechende Metrik entspricht der Zielsetzungsdokumentation. Eine Plattform, die sagt, dass Charaktere verwenden können UTF-16 Code-Einheiten statt Grafen, also testen Sie die endgültige Wert dort, wenn ein Charakter die Akzeptanz bestimmen kann.
Wie es funktioniert
Intl.Segmenter mit Grapheme Granularity Gruppen Basis Buchstaben mit kombinierten Marken und hält unterstützte Emoji-Sektionen zusammen. Ein Code-Point Fallback wird verwendet, wenn die Segmentation nicht verfügbar ist. Whitespace-free-Zahlungen werden entfernt Unicode Weißes und UTF-8 Größe wird aus der genauen Quellstreifen generiert, anstatt von sichtbaren Symbole geschätzt.
Nützliches wann
Charaktermessung ist nützlich, wo ein konzises Feld, Transportformat oder verschlüsselte Zahlungsbelastung eine harte Grenze hat.
Fragen beantworten
Praktische Grenzen mit Texttools. Diese Antworten erklären, was gemessen wird, was beibehalten wird und wann eine manuelle Überprüfung noch erforderlich ist.
ASCII-Charakter besitzen in der Regel einen UTF-8 Byte, während viele accented Buchstaben, nicht-Latin-Scripts und Emoji mehrere Byte benötigen. Ein angeschlossener Emoji kann auch mehrere verschlüsselte Codepunkte enthalten, während es als ein Graphem erscheint.
Die Hauptfiguren insgesamt enthalten sie. Eine separate Metrik entfernt erstem Weißraum. Linien werden auch angegeben, so dass Sie den Wert wählen können, der der Empfangsfelddokumentation entspricht.
Nicht immer. Plattformen können gewogen URL-Längen anwenden, Text normalisieren oder zählen UTF-16 Einheiten zu haben. Verwenden Sie dies als transparente Vorblätter und bestätigen Sie die Randfälle im Zielkomponent.
Privatsphäre und Aufrechterhaltung
Nirmion Diese Operationen durchgeführt mit Browser JavaScript. Der Arbeitsplatz nennt nicht den Katalog API mit Ihrem Quelltext und vollendeten Job-Inhalte wird nur in diesem Komponenten-Memory gespeichert, um neu herunterzuladen.
Ein heruntergeladenes Datei bleibt in Ihren Browser-Download, Gerät-Speicher, Backups und jeder Ort, an dem Sie es teilen. Lärm oder schließt die Seite, wenn Sie auf einem geteilten Gerät arbeiten, und vermeiden Sie, Geheimnisse in Erweiterungen oder Drittanbieter-Clipboard-Manager zu verfassen.
Werkzeug Details
Nirmion Character Counter messen von Benutzern wahrgenommenen Graphem-Klustren anstatt blind zu melden JavaScript String Länge Es berichtet auch über eine WhiteSpace-freie Charakterzahlen UTF-8 Codierte Byte und Line count. Diese Kombination ist nützlich für Schriftsteller, Entwickler, Lokalisierungsteams und alle, die Kopien für ein beschränktes Feld vorbereiten.
Die Messung läuft lokal für Text bis zu 500.000 Zeichen und kann als heruntergeladen werden text_nirmion_tools_character_report.txt. Da externe Dienste Code-Einheiten oder Gewichtszunahme anders berechnen können, sollte das Ergebnis mit der endgültigen Plattform vergleichen, wenn die Grenze streng ist.