Preparare l’ingresso
Inserisci il titolo, il messaggio, l’identificatore o il valore della base di dati. Preservare spazi e linee rompe quando l'obiettivo li conta, perché entrambi contribuiscono alla misurazione totale del carattere.
Misurare il testo visibile e la dimensione codificata
Contiamo i personaggi percepiti dall’utente, i personaggi senza spazio bianco UTF-8 bits, e linee localmente, tra cui un trattamento più sicuro per emoji e lettere combinate.
La trasformazione e la trasformazione si svolgono localmente. Nirmion non inviare il testo in questo spazio di lavoro a uno API.
Guida del prodotto
Inserisci il titolo, il messaggio, l’identificatore o il valore della base di dati. Preservare spazi e linee rompe quando l'obiettivo li conta, perché entrambi contribuiscono alla misurazione totale del carattere.
Il totale principale è il numero di cluster grafemici. La metrica senza spazio rimuove tutti gli spazi bianchi prima di contare. UTF-8 I byti sono calcolati TextEncoder e può essere più grande del numero visibile per gli scritti non ASCII e gli emoji.
Corrisponde alla documentazione di destinazione. Una piattaforma che dice che i personaggi possono usare UTF-16 Unità di codice piuttosto che grafemi, quindi testare il valore finale lì quando un carattere può determinare l'accettazione.
Come funziona
Intl.Segmenter con graffiti di granularità gruppi di lettere di base con combinazione di marchi e mantiene le sequenze emoji supportate insieme. Un fallback di codice viene utilizzato quando la segmentazione non è disponibile. Il conteggio libero di Whitespace viene rimosso Unicode Il bianco e UTF-8 La dimensione viene generata dalla righe esatta della fonte piuttosto che stimata dai simboli visibili.
utile quando
La misurazione del carattere è utile ovunque un campo conciso, un formato di trasporto o una carica codificata abbia un limite duro.
Le domande risposte
I limiti pratici sono i materiali con strumenti di testo. Queste risposte spiegano cosa viene misurato, cosa viene conservato e quando è ancora necessario un esame manuale.
I personaggi ASCII di solito occupano uno UTF-8 I byti, mentre molte lettere accentate, scripti non latini e emoji richiedono più byti. Un emoji aggiunto può anche contenere diversi punti di codice codificati mentre appare come un grafico.
Il carattere principale totale comprende loro. Una metrica separata rimuove prima lo spazio bianco. Le linee sono anche segnalate, consentendo di scegliere il valore che corrisponde alla documentazione del campo ricevente.
Non sempre Le piattaforme possono applicare lunghezze URL pesate, normalizzare il testo o contare UTF-16 Unità Utilizzare questo come un prefiamma trasparente e confermare i casi di bordo nel compositore di destinazione.
Privacy e Retenzione
Nirmion Eseguire queste operazioni con il browser JavaScript. Il sito non chiama il catalogo API con il testo di sorgente, e il contenuto di lavoro completato è conservato solo in questa memoria componente per il ri-download.
Un file scaricato rimane nelle scaricazioni del browser, nella memorizzazione del dispositivo, nelle backup e in qualsiasi luogo in cui lo condividi. Chiudere o chiudere la pagina quando si lavora su un dispositivo condiviso, e evitare di incollare segreti in estensioni o manager di clipboard di terze parti.
Dettagli degli strumenti
Nirmion Caratter Counter misura i cluster di grafema percepiti dall'utente piuttosto che la segnalazione cieca JavaScript lunghezza di string. Inoltre, si riferisce a un conteggio di caratteri liberi da spazio bianco UTF-8 codificato byte e linea di conte. Questa combinazione è utile per scrittori, sviluppatori, team di localizzazione e chiunque prepara una copia per un campo limitato.
La misurazione è eseguita localmente per testo fino a 500.000 caratteri e può essere scaricata come text_nirmion_tools_character_report.txt. Poiché i servizi esterni possono contare unità di codice o contenuti ponderati in modo diverso, il risultato dovrebbe essere confrontato con la piattaforma finale quando il limite è rigoroso.