Nirmion
Pomoc Znajdź narzędzie

Pomiar widzialnego tekstu i rozmiaru kodowanego

Licznik znaków

Liczone postacie postrzegane przez użytkownika, postacie bez przestrzeni białej UTF-8 Byty i linie lokalne, w tym bezpieczniejsze obsługi dla emoji i kombinowanych liter.

  1. 01Prywatne według projektuTwój tekst pozostaje w tej karcie przeglądarki.
  2. 02Ograniczona i reakcyjnaDo 500 000 znaków w każdym głównym polu tekstowym.
  3. 03Gotowy do ponownego użyciaKopiuj wynik lub pobierz branded TXT w pliku .
Przetwarzanie lokalne w przeglądarce

Liczba i transformacja odbywają się lokalnie. Nirmion Nie wysyła tekstu w tym miejscu pracy do jednego API.

01 / Wstęp

Pamiętaj o tekstach, których długość ma znaczenie

Limit charakteru różni się: niektóre miejsca docelowe liczą jednostki kodu, niektóre Unicode punktów kodowych i niektórych widocznych klastrów grafemowych. To narzędzie informuje o klastrach grafemowych i UTF-8 W tym przypadku baza jest wyraźna.

Wypełnij wymagane pola, aby umożliwić tę akcję.

W tym miejscu bez jednego API Wniosek .

Przewodnik produktu

Wybierz definicję charakteru, którą używasz do celów

Charakter nie zawsze jest jeden JavaScript Jednostka kodowa. Nirmion Preferuje segmentowanie grafemu, więc dołączone emoji, akcentowane kombinacje i wiele symboli postrzeganych przez użytkownika pozostają razem, podczas gdy całkowita liczba bytu mierzy się oddzielnie UTF-8 Kodowanie .
Krok A

Przygotuj wejście

Wprowadź dokładną wartość tytułu, nazwy, wiadomości, identyfikatorów lub bazy danych. Zachowaj przestrzenia i linie pęknięcia, gdy cel ich liczy, ponieważ obie przyczyniają się do całkowitego pomiaru charakteru.

Krok B

Wybierz zasadę

Główny łącznik liczy klastry grafemowe. Metrika bez przestrzeni usuwa cały biały przestrzeń przed liczeniem. UTF-8 Byty są obliczane TextEncoder i może być większa niż widoczny liczba dla nie-ASCII skryptów i emoji.

Krok C

Przegląd produkcji

Odpowiednia metryka odpowiada dokumentacji docelowej. Platforma, która mówi, że postacie mogą używać UTF-16 Jednostki kodu zamiast grafem, więc sprawdź wartość końcową tam, gdy jeden znak może określić akceptację.

Jak to działa

Gramatyczne klastry dla widocznych celów charakteru

Intl.Segmenter z gromady granularności grafemu grupy bazowe litery z kombinacją znaków i utrzymuje wspierane sekwencje emoji razem. W przypadku kod-punktu jest używany Fallback, w którym segmentacja nie jest dostępna. Wyłączanie bezpłatnego liczenia Whitespace Unicode Własny świat i UTF-8 Rozmiar jest generowany z dokładnej łańcucha źródłowego zamiast szacunkowego z widocznych symboli.

Przydatne kiedy

Sprawdź limity przed końcowym paskiem

Mierzenie charakteru jest przydatne wszędzie, gdzie skrócone pole, format transportu lub kodowane obciążenie ma trudne granice.

  1. Sprawdź kopię reklam, metadane, tekst App Store, odpowiedzi formularzy, linie tematyczne, kapsułki i bios profilu przed publikacją.
  2. Porównaj z widoczne liczenie grafemu UTF-8 przy tworzeniu kolumn bazy danych API limity, przywóz lub budżet lokalizacji.
  3. Sprawdź kopię ciężką lub podkreśloną emoji bez niewłaściwego traktowania każdego podstawowego punktu kodu jako oddzielnego widzialnego charakteru.

Odpowiedzi na pytania

Charakter przeciwko pytaniom

Praktyczne granice materiału z narzędziami tekstowymi. Odpowiedzi te wyjaśniają, co jest mierzone, co jest utrzymywane i kiedy wciąż potrzebna jest przegląd ręczny.

Dlaczego może UTF-8 Czy liczba bitów przekracza liczbę znaków?

Zazwyczaj postacie ASCII zajmują jeden UTF-8 Byte, podczas gdy wiele liter, nie-latynskie skrypty i emoji wymagają wielokrotnych bajtów. Dołączony emoji może również zawierać kilka kodowanych punktów, podczas gdy pojawia się jako jeden grafema.

Czy przestrzenia i przerwy linii są włączone?

Główny charakter w sumie obejmuje je. Z drugiej strony, oddzielna metrika usuwa biały przestrzeń. Linie są również zgłaszane, umożliwiając wybór wartości, która odpowiada dokumentacji pola otrzymującego.

Czy to będzie prawdziwa platforma społeczna?

Nie zawsze. Platforma może zastosować ważone długości URL, normalizować tekst lub liczyć UTF-16 Jednostki . Użyj tego jako przejrzystego prefloku i potwierdź przypadki krawędzi w kompozytorze docelowym.

Prywatność i utrzymanie

Twój projekt pozostaje na Twoim urządzeniu.

Nirmion Wykonuje te operacje za pomocą przeglądarki JavaScript. Właściciele nie zwracają się do katalogu API z tekstem źródłowym, a zawartość zakończonej pracy jest przechowywana tylko w pamięci komponentów do ponownego pobrania.

Pobrany plik pozostaje w pobraniach przeglądarki, przechowywaniu urządzenia, kopiach zapasowych i wszelkim miejscu, w którym go udostępniasz. Wyczyść lub zamknąć stronę podczas pracy na udostępnionym urządzeniu, a także unikać pływania tajemnic w rozszerzeniach lub menedżerów klipów ze strony trzecich.

Szczegóły narzędzia

A w Unicode- pewne współczynnik charakteru z kontekstem bytu

Nirmion Character Counter mierzy wykresy grafemowe postrzegane przez użytkownika zamiast ślepo zgłaszania JavaScript Długość strumienia. Oznacza to również liczbę znaków bez białego przestrzeni UTF-8 kodowane bajty i liczba linii. Ta kombinacja jest przydatna dla pisarzy, deweloperów, zespołów lokalizacji i każdego, kto przygotowuje kopię dla ograniczonego pola.

Mierzona jest lokalnie dla tekstu do 500 000 znaków i można go pobrać text_nirmion_tools_character_report.txt. Ponieważ usługi zewnętrzne mogą liczyć jednostki kodu lub rozważone treści inaczej, wynik powinien być porównywany z ostatnią platformą, gdy granica jest rygorystyczna.