Bereid de input voor
Houd de exacte opname, titel, boodschap, identifier of database waarde vast. Behoud ruimtes en lijn breken wanneer de doelgroep ze telt, omdat beide bijdragen aan de totale karaktermeting.
De zichtbare tekst en de gecodeerde grootte meten
Het tellen van gebruikersgevoelde karakters, karakters zonder witruimte UTF-8 byten, en lijnen lokaal, inclusief veiliger handelen voor emoji en gecombineerde letters.
De berekening en transformaties worden lokaal uitgevoerd. Nirmion niet de tekst in deze werkruimte naar een API.
Product gids
Houd de exacte opname, titel, boodschap, identifier of database waarde vast. Behoud ruimtes en lijn breken wanneer de doelgroep ze telt, omdat beide bijdragen aan de totale karaktermeting.
Het belangrijkste totaal telt grafema clusters. De no-space metric verwijdert alle witte ruimte voordat het wordt geteld. UTF-8 Bijten worden berekend TextEncoder en kan groter zijn dan het zichtbare getal voor niet-ASCII-schriften en emoji.
De relevante methode voldoet aan de bestemmingdocumentatie. Een platform dat zegt dat de karakters kunnen gebruiken UTF-16 code-eenheden in plaats van grafemen, dus test de uiteindelijke waarde daar wanneer één personage de acceptatie kan bepalen.
Hoe het werkt
Intl.Segmenter met grafema granulariteit groepen basis letters met het combineren van tekens en houdt ondersteunde emoji sequences samen. Een code-point fallback wordt gebruikt wanneer segmentatie niet beschikbaar is. Whitespace-free tellen verwijderen Unicode De witte ruimte en UTF-8 De grootte wordt geproduceerd uit de exacte bronstreng in plaats van geschat uit zichtbare symbolen.
Gebruikelijk wanneer
Character meet is nuttig overal waar een concise veld, transportformaat of gecodeerde lading een harde lijn heeft.
Vragen geantwoord
Praktische grenzen met teksttools. Deze antwoorden verklaren wat wordt gemeten, wat wordt bewaard en wanneer een handmatige beoordeling nog steeds nodig is.
De ASCII-charakteren nemen meestal één in UTF-8 byte, terwijl veel accent letters, niet-Latin script en emoji meerdere bytes vereisen. Een aangesloten emoji kan ook meerdere gecodeerde codepunten bevatten terwijl het als één grafema verschijnt.
De belangrijkste karakter totaal omvat hen. Een afzonderlijke metrie verwijdert eerst witspace. Lijns worden ook aangegeven, waardoor u de waarde kunt kiezen die overeenkomt met de ontvangende velddocumentatie.
Niet altijd. Platforms kunnen gewogen URL-lengten toepassen, tekst normaliseren of tellen UTF-16 eenheden . Gebruik dit als een transparante voorlicht en bevestigt de randvallen in de bestemmingskomposer.
Privaciteit en behoud
Nirmion Deze operaties uitvoert met een browser JavaScript. De werkruimte noemt de catalogus niet API met uw bron tekst, en voltooide werk inhoud wordt alleen in dit component geheugen voor heropladen bewaard.
Een gedownload bestand blijft in uw browser downloads, apparaat opslag, backups en elke locatie waar u het delen. Verwijder of sluiten de pagina bij het werken op een gedeelde apparaat en vermijd het verspreiden van geheimen in extensie's of derde clipporadministratoren.
De details van de tool
Nirmion Character Counter meet door gebruikers waargenomen grafema-klusters in plaats van blind rapporteren JavaScript String lengte Het meldt ook een witspace-vrije karakterrekening UTF-8 coderen byten en line count. Deze combinatie is nuttig voor schrijvers, ontwikkelaars, localisatie teams en iedereen die een kopie voor een beperkte veld voorbereidt.
De meting loopt lokaal voor tekst tot 500.000 tekens en kan worden gedownload als text_nirmion_tools_character_report.txt. Omdat externe diensten code-eenheden of gewaardeerde inhoud anders kunnen tellen, moet het resultaat worden vergeleken met de uiteindelijke platform wanneer de limiet strikt is.