Nirmion
मदद एक उपकरण खोजें

एक नियंत्रित सीमा के साथ चिह्नों को जोड़ने से हटा दें।

Accent हटाने के लिए

केवल या प्रत्येक स्क्रिप्ट से लैटिन-स्क्रिप्ट पत्रों से विघटित संयोजन चिह्नों को हटा दें, जबकि गैर-विघटित चिह्नों को बनाए रखें और रिपोर्ट करें कि कितने चिह्न बदल गए हैं। यह चिह्न हटाने है, न कि ट्रांसलिटरेशन: चिह्न जैसे कि ł, ø, đ, æ, œ, और ß रह सकते हैं, और सभी-स्क्रिप्ट मोड उन भाषाओं में अर्थ को नुकसान पहुंचा सकता है जिनके लिए चिह्नों की आवश्यकता होती है।

  1. 01डिजाइन के अनुसार निजीआपका पाठ इस ब्राउज़र टैब में रहता है।
  2. 02सीमित और प्रतिक्रियाशील।प्रत्येक मुख्य पाठ फ़ील्ड में 500,000 वर्ण तक।
  3. 03पुन: उपयोग करने के लिए तैयारपरिणाम को कॉपी करें या एक ब्रांड डाउनलोड करें। TXT फ़ाइल
ब्राउज़र में स्थानीय प्रोसेसिंग

गणना और परिवर्तन स्थानीय रूप से चलते हैं। Nirmion इस कार्यक्षेत्र में पाठ को एक को नहीं भेजता है। API.

01 में प्रवेश

पाठ को पस्ट करें और मार्क-रिमोजेशन स्पेस का चयन करें।

एक संकीर्ण सफाई के लिए केवल लैटिन मोड का उपयोग करें, या सभी संयोजन ब्रांडों का चयन करें केवल जब नीचे की प्रक्रिया अनुबंध स्पष्ट रूप से स्क्रिप्ट के माध्यम से विनाशकारी ब्रांड हटाने की आवश्यकता होती है। इनपुट 500,000 वर्णों तक सीमित है; पाठ को निरीक्षण के लिए कैनोनी रूप से विघटित किया जाता है और चयनित चिह्नों को हटाने के बाद पुन: स्थापित किया जाता है।

इस कार्य को सक्षम करने के लिए आवश्यक क्षेत्रों को पूरा करें।

इस टैब में बिना किसी के चलता है। API अनुरोध है।

उत्पाद गाइड

ध्यान से ट्रांसलिटरेशन से अलग करें।

संयुक्त-मार्क हटाने एक विरासत के अनुरूप कुंजी की मदद कर सकते हैं, लेकिन यह हानि है और प्रत्येक भाषा या नाम का एक सही ASCII प्रतिनिधित्व नहीं बनाता है। अपने लक्ष्य पर पूर्ण परिणाम की समीक्षा करें क्योंकि स्वचालित पाठ नियम किसी भी भाषा, घर शैली, डेटा मॉडल, या प्रकाशन इरादा का निर्धारण नहीं कर सकते हैं।
चरण ए।

इनपुट तैयार करें।

प्रतिनिधि पाठ को पस्ट करें और एक स्रोत प्रतिलिपि रखें। सभी स्क्रिप्ट मोड का परीक्षण करते समय गैर-लैटिन उदाहरण शामिल करें ताकि क्षति को अपनाने से पहले दिखाई दे।

चरण बी।

नियम चुनें।

केवल लैटिन मोड केवल तब मार्क को हटा देता है जब पूर्व विघटित आधार लैटिन स्क्रिप्ट में आता है। सभी-संयुक्त मोड हर को हटा देता है। Unicode विघटन के बाद निशान

चरण C।

उत्पादन की समीक्षा करें।

आउटपुट का उपयोग एक माध्यमिक खोज या आयात कुंजी के रूप में करें जहां अनुमोदित किया गया है, और अनुमोदित नामों, भाषा सामग्री, कानूनी पाठ या प्रदर्शित प्रति के लिए प्रतिस्थापन के रूप में नहीं।

कैसे काम करता है।

कैननिक विघटन के बाद, स्पॉट मार्क हटाया जाता है।

स्रोत को सामान्य किया जाता है। NFD और जांच कर रहे हैं। Unicode कोड बिंदु लैटिन स्कोप में, एक संयोजन चिह्न को केवल तभी हटा दिया जाता है जब इसका वर्तमान आधार चरित्र स्क्रिप्ट = लैटिन होता है; सभी संयोजन स्कोप प्रत्येक चिह्न को हटा देता है। बाकी का अनुक्रम फिर से सामान्य हो जाता है। NFCऔर गैर-विघटन पत्रों को अनदेखा किया जाता है। स्रोत कवर 500,000 वर्ण है और आउटपुट कवर एक मिलियन है; कोई ट्रांसलिटेशन टेबल, भाषा मॉडल, या बाहरी पहचान सेवा का उपयोग नहीं किया जाता है। ऑपरेशन इस ब्राउज़र टैब में चलता है, महंगा काम से पहले स्पष्ट सीमाओं को लागू करता है, और कार्यक्षेत्र पाठ को नहीं भेजता है। Nirmion API.

उपयोगी कब

एक समीक्षा की गई माध्यमिक तुलना कुंजी बनाएं।

केवल तब उपयोग करें जब एक दस्तावेजित संगतता आवश्यकता खो से अधिक हो और मूल पाठ उपलब्ध रहता है।

  1. ध्यान-अनावश्यक खोज कुंजी का परीक्षण करते हुए, प्रदर्शित करने के लिए मूल सही रूप से रिकॉर्ड मूल्य बनाए रखें।
  2. एक विरासत निर्यात या पहचान नीति को प्राथमिकता दें जो स्पष्ट रूप से लैटिन संयोजन-मार्क हटाने की अनुमति देता है।
  3. यह दिखाएं कि सभी स्क्रिप्ट मार्क हटाने को लागू करने से पहले बहुभाषी इनपुट और आउटपुट की तुलना करके असुरक्षित क्यों है।

सवालों का जवाब दिया।

प्रश्नों को हटाने के लिए ध्यान दें।

पाठ उपकरणों के साथ व्यावहारिक सीमाएं हैं। ये जवाब बताते हैं कि क्या मापा जाता है, क्या बनाए रखा जाता है, और कब एक मैनुअल समीक्षा अभी भी आवश्यक है।

क्यों रहते हैं या रहते हैं?

ये पत्र एक बुनियादी लैटिन पत्र में विभाजित नहीं होते हैं, साथ ही साथ कैननिक के तहत चिह्नों को जोड़ते हैं। NFDतो, मार्क हटाने के लिए अकेले उन्हें ट्रांसलिटर नहीं करता है।

क्या नामों के लिए केवल लैटिन मोड सुरक्षित है?

यह अधिक संकीर्ण है, नुकसानहीन नहीं है। एक जोर हटाने से अभी भी किसी व्यक्ति या स्थान का नाम बदल सकता है और प्राधिकरण प्रदर्शित डेटा को प्रतिस्थापित नहीं किया जाना चाहिए।

सभी संयुक्त ब्रांड क्या करते हैं?

यह विघटन के बाद प्रत्येक स्क्रिप्ट से चिह्नों को हटा देता है और गैर-लैटिन पाठ को गंभीर रूप से बदल सकता है। इसे केवल एक स्पष्ट तकनीकी अनुबंध के लिए उपयोग करें।

गोपनीयता और रखरखाव।

आपका डिज़ाइन आपके डिवाइस पर रहता है।

Nirmion इन कार्यों को ब्राउज़र के साथ किया जाता है। JavaScript. कार्यशाला कैटलॉग को नहीं बुलाती है। API आपके स्रोत पाठ के साथ, और पूरा-काम सामग्री केवल इस घटकों की स्मृति में रखा जाता है पुन: डाउनलोड करने के लिए।

एक डाउनलोड फ़ाइल आपके ब्राउज़र डाउनलोड, डिवाइस स्टोरेज, बैकअप, और किसी भी स्थान पर रहता है जहां आप इसे साझा करते हैं। साझा उपकरण पर काम करते समय पृष्ठ को साफ या बंद करें, और एक्सटेंशन या तीसरे पक्ष के क्लिपबोर्ड प्रबंधकों में रहस्यों को पतला करने से बचें।

उपकरण विवरण

कोई ट्रांसलिटर के दावे के साथ स्कोप एक्सेंट हटाने के लिए।

Nirmion विघटन को हटाने के लिए ध्यान दें। Unicode पाठ, फिर एक स्पष्ट दायरे के अनुसार लैटिन-स्क्रिप्ट आधारों से या प्रत्येक स्क्रिप्ट से संयोजन चिह्नों को हटा देता है। यह रिपोर्ट हटाए गए संकेतों और चरित्र की गिनती है ताकि उपयोगकर्ता एक छिपे हुए पुनरावृत्ति को स्वीकार करने के बजाय एक हानि संगतता परिवर्तन की जांच कर सकें। स्रोत को सामान्य किया जाता है। NFD और जांच कर रहे हैं। Unicode कोड बिंदु लैटिन स्कोप में, एक संयोजन चिह्न को केवल तभी हटा दिया जाता है जब इसका वर्तमान आधार चरित्र स्क्रिप्ट = लैटिन होता है; सभी संयोजन स्कोप प्रत्येक चिह्न को हटा देता है। बाकी का अनुक्रम फिर से सामान्य हो जाता है। NFCऔर गैर-विघटन पत्रों को अनदेखा किया जाता है। यह व्यवहार की जांच और पुनरावृत्ति के बजाय एक स्पष्ट परिणाम प्रस्तुत करता है।

आउटपुट डाउनलोड करें। text_nirmion_tools_accents_removed.txt 500,000 वर्णों तक के स्रोत के लिए। पृष्ठ गैर-डिस्कोप पत्र, बहुभाषी क्षति, नाम की अखंडता, प्राधिकरण स्रोत रखरखाव, और स्ट्रिप और ट्रांसलिटर के बीच अंतर बताता है। ऑपरेशन इस ब्राउज़र टैब में चलता है, महंगा काम से पहले स्पष्ट सीमाओं को लागू करता है, और कार्यक्षेत्र पाठ को नहीं भेजता है। Nirmion API. डाउनलोड सक्रिय कार्यक्षेत्र को साफ करता है जबकि अंतिम तीन पूरा परिणाम फिर से डाउनलोड के लिए इस टैब में उपलब्ध रहते हैं।