Nirmion
ヘルプ ツールを探す

標準化等式 Unicode 意図的に順序を

Unicode 正常化

テキストを変換する NFC, NFD, NFKCあるいは NFKD コードポイントの変化を報告し、比較のためのソースを保存し、互換性リスクを文書化する。 カノニックフォームは、外観を変更せずに暗号化を変更することができるが、互換性フォームは、幅やプレゼンテーション文字などの区別を意図的に記入することができる。

  1. 01プライベートデザインあなたのテキストはこのブラウザのタブに残ります。
  2. 02限られた、反応的な各メインテキストフィールドに最大500,000文字を表示します。
  3. 03再利用の準備結果をコピーするか、ブランドをダウンロードするか TXT ファイル
ブラウザ内でローカル処理

計算と変換は地元で行われます。 Nirmion このワークスペースでテキストを送信しない API.

01 入力

テキストを貼り、Aを選択します Unicode 標準化形式

保存、匹敵、インデックス、輸入、または比較行動が正常化する必要がある正確なテキスト順序を使用します。 資源は500万に限定されています JavaScript ストリップユニットと操作は、選択されたブラウザの実装を使用します Unicode 標準化形式

この行動を可能にするために必要なフィールドを完了します。

このタブで1つなしで走る API 要請

製品ガイド

コンパクト性またはカノニック性の標準化を意識的に選択します

標準化は一貫した保管と比較に役立ちますが、選択します NFKC あるいは NFKD 特定の識別、学術テキスト、またはタイポグラフィーが必要とする区別を削除することができます。 自動テキストルールは、すべての言語、ホームスタイル、データモデル、または出版意図を指定できないため、目的地で完全な結果を検討します。
ステップA

入力の準備

アクセントを含む代表的なサンプルを組み合わせ、ブランド、幅の変数、結合、シンボル、または不一致に振る舞う輸入テキストを組み合わせる。

ステップB

ルールを選ぶ

NFC カノニックな順序を構成する NFD 解体する NFKC 合成後、合成後、および NFKD 合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成後、合成

ステップC

生産をチェック

コードポイントを比較し、保存された生産データを変更する前に、検索、認証、署名、識別、レンダー、ダウンストリームシステムで結果をテストします。

どのように機能するか

原産地 Unicode 明確な形状の選択を通じて標準化する

JavaScript String.normalize は、4つの標準化された形式のうちの1つを受け取ります。 NFC そして NFD たとえば、カノニック等式を用いる NFKC そして NFKD 同様に、コンパティビティマップも使用しています。 ツールは数える Unicode コードポイントは前と後ですが、無形の文字を振り回したり、ケースを切り、切り、削除したりしない。 操作は、500,000 以上の入力ユニットと 1 百万 の出力ユニットを処理し、リストされていない標準化の形態を拒否します。 この操作は、このブラウザのタブで実行され、高価な作業の前に明確な制限を適用し、ワークスペーステキストを送信しません Nirmion API.

いつ役に立つか

テキスト比較と保存をより一貫して行う

使用する Unicode 標準化は、同等見た順序が知られている技術的な問題を生み出し、選択された形式がデータ契約と一致する場合。

  1. 輸入された名前、検索テキスト、ファイル名、タグ、またはカタログ値を記録された標準化パイプラインの前にプレフロントします。
  2. 同じようにするが、異なるコードポイントとバイトの順序を生み出す合成と分解されたアクセントを比較する。
  3. インデックスまたは認証のために採用する前に幅フォームまたは結合に付属する試験互換性。

質問回答

Unicode 質問の正常化

テキストツールの実用的な限界を意味します。 これらの回答は、測定されているもの、保存されているもの、そして手動レビューがまだ必要とされるときを説明します。

どんな形で使うべきか。

NFC 通常のストレージデフォルトですが、正しい選択は受信規格に属します。 合致性の形態を選択しないで、彼らのフラッグ行動を理解しないでください。

標準化はアクセントを削除するのか?

ノー NFD 基礎文字とマークを分離することができますが、両方とも残ります。 Accent Remover を使用するのは、マーク削除が実際に意図されている場合にのみです。

外観は同じですか?

はい。 カノニカルに等しい順序は、コードポイント数とバイトが変わる間に、しばしば同じように表示されます。

プライバシーと保留

あなたのデザインはあなたのデバイスに残ります。

Nirmion これらの操作はブラウザで実行します JavaScript. ワークスペースはカタログを呼びません API ソーステキストと完成した作業コンテンツは、再ダウンロードするためにこのコンポーネントメモリにのみ保存されます。

ダウンロードされたファイルは、ブラウザのダウンロード、デバイスのストレージ、バックアップ、およびあなたがそれを共有する場所に残ります。 共有デバイスで作業する際にページをクリアまたは閉じ、拡張子や第三者のクリップボードマネージャーに秘密を隠すのを避ける。

ツールの詳細

4位 Unicode 見えるカエイツの正常化形態

Nirmion Unicode 標準化が適用される NFC, NFD, NFKCあるいは NFKD 最大500,000文字をテキストし、入力と出力コードポイントを数える。 開発者、編集者、データチーム、および位置化作業の流れは、ストレージや比較の前に同等の見た目の順序を検証するのに役立ちます。 JavaScript String.normalize は、4つの標準化された形式のうちの1つを受け取ります。 NFC そして NFD たとえば、カノニック等式を用いる NFKC そして NFKD 同様に、コンパティビティマップも使用しています。 ツールは数える Unicode コードポイントは前と後ですが、無形の文字を振り回したり、ケースを切り、切り、削除したりしない。 これは、不明な結果を示す代わりに、行動を検証し、繰り返すことができる。

結果はダウンロードする text_nirmion_tools_unicode_normalized.txt. ページは、互換性のフィールドからカノニック構成を区別し、識別、署名、ハッシュ、バイットオフセット、幅形式、リンク、およびシンボルについて警告します。 この操作は、このブラウザのタブで実行され、高価な作業の前に明確な制限を適用し、ワークスペーステキストを送信しません Nirmion API. ダウンロードはアクティブワークスペースをクリアし、最後の3つの完了結果は再ダウンロードのためのこのタブで利用できます。