Przygotuj wejście
Wprowadź dokładną wartość tytułu, nazwy, wiadomości, identyfikatorów lub bazy danych. Zachowaj przestrzenia i linie pęknięcia, gdy cel ich liczy, ponieważ obie przyczyniają się do całkowitego pomiaru charakteru.
Pomiar widzialnego tekstu i rozmiaru kodowanego
Liczone postacie postrzegane przez użytkownika, postacie bez przestrzeni białej UTF-8 Byty i linie lokalne, w tym bezpieczniejsze obsługi dla emoji i kombinowanych liter.
Liczba i transformacja odbywają się lokalnie. Nirmion Nie wysyła tekstu w tym miejscu pracy do jednego API.
Przewodnik produktu
Wprowadź dokładną wartość tytułu, nazwy, wiadomości, identyfikatorów lub bazy danych. Zachowaj przestrzenia i linie pęknięcia, gdy cel ich liczy, ponieważ obie przyczyniają się do całkowitego pomiaru charakteru.
Główny łącznik liczy klastry grafemowe. Metrika bez przestrzeni usuwa cały biały przestrzeń przed liczeniem. UTF-8 Byty są obliczane TextEncoder i może być większa niż widoczny liczba dla nie-ASCII skryptów i emoji.
Odpowiednia metryka odpowiada dokumentacji docelowej. Platforma, która mówi, że postacie mogą używać UTF-16 Jednostki kodu zamiast grafem, więc sprawdź wartość końcową tam, gdy jeden znak może określić akceptację.
Jak to działa
Intl.Segmenter z gromady granularności grafemu grupy bazowe litery z kombinacją znaków i utrzymuje wspierane sekwencje emoji razem. W przypadku kod-punktu jest używany Fallback, w którym segmentacja nie jest dostępna. Wyłączanie bezpłatnego liczenia Whitespace Unicode Własny świat i UTF-8 Rozmiar jest generowany z dokładnej łańcucha źródłowego zamiast szacunkowego z widocznych symboli.
Przydatne kiedy
Mierzenie charakteru jest przydatne wszędzie, gdzie skrócone pole, format transportu lub kodowane obciążenie ma trudne granice.
Odpowiedzi na pytania
Praktyczne granice materiału z narzędziami tekstowymi. Odpowiedzi te wyjaśniają, co jest mierzone, co jest utrzymywane i kiedy wciąż potrzebna jest przegląd ręczny.
Zazwyczaj postacie ASCII zajmują jeden UTF-8 Byte, podczas gdy wiele liter, nie-latynskie skrypty i emoji wymagają wielokrotnych bajtów. Dołączony emoji może również zawierać kilka kodowanych punktów, podczas gdy pojawia się jako jeden grafema.
Główny charakter w sumie obejmuje je. Z drugiej strony, oddzielna metrika usuwa biały przestrzeń. Linie są również zgłaszane, umożliwiając wybór wartości, która odpowiada dokumentacji pola otrzymującego.
Nie zawsze. Platforma może zastosować ważone długości URL, normalizować tekst lub liczyć UTF-16 Jednostki . Użyj tego jako przejrzystego prefloku i potwierdź przypadki krawędzi w kompozytorze docelowym.
Prywatność i utrzymanie
Nirmion Wykonuje te operacje za pomocą przeglądarki JavaScript. Właściciele nie zwracają się do katalogu API z tekstem źródłowym, a zawartość zakończonej pracy jest przechowywana tylko w pamięci komponentów do ponownego pobrania.
Pobrany plik pozostaje w pobraniach przeglądarki, przechowywaniu urządzenia, kopiach zapasowych i wszelkim miejscu, w którym go udostępniasz. Wyczyść lub zamknąć stronę podczas pracy na udostępnionym urządzeniu, a także unikać pływania tajemnic w rozszerzeniach lub menedżerów klipów ze strony trzecich.
Szczegóły narzędzia
Nirmion Character Counter mierzy wykresy grafemowe postrzegane przez użytkownika zamiast ślepo zgłaszania JavaScript Długość strumienia. Oznacza to również liczbę znaków bez białego przestrzeni UTF-8 kodowane bajty i liczba linii. Ta kombinacja jest przydatna dla pisarzy, deweloperów, zespołów lokalizacji i każdego, kto przygotowuje kopię dla ograniczonego pola.
Mierzona jest lokalnie dla tekstu do 500 000 znaków i można go pobrać text_nirmion_tools_character_report.txt. Ponieważ usługi zewnętrzne mogą liczyć jednostki kodu lub rozważone treści inaczej, wynik powinien być porównywany z ostatnią platformą, gdy granica jest rygorystyczna.