TL
Tool Lab
💰Donate
💰Donate

Unicode कनवर्टर

किसी भी टेक्स्ट के Unicode कोड पॉइंट, UTF-8 बाइट सीक्वेंस और कैरेक्टर कैटेगरी की जांच करें।

पाठ → Unicode जानकारी
कोड पॉइंट खोज

इस टूल के बारे में

Unicode कनवर्टर किसी भी पाठ का विश्लेषण करता है और प्रत्येक वर्ण के लिए Unicode कोड पॉइंट (U+XXXX), UTF-8 बाइट अनुक्रम और वर्ण श्रेणी लौटाता है।

UTF-8 एक परिवर्तनीय-चौड़ाई एन्कोडिंग है: ASCII (U+0000-U+007F) 1 बाइट, U+0080-U+07FF 2 बाइट, U+0800-U+FFFF (CJK, अरबी, हंगुल) 3 बाइट, और U+10000+ (अधिकांश इमोजी) 4 बाइट उपयोग करता है।

कैसे उपयोग करें

  1. विश्लेषण फ़ील्ड में पाठ टाइप करें या पेस्ट करें और विश्लेषण करें पर क्लिक करें।
  2. तालिका प्रत्येक वर्ण के लिए कोड पॉइंट, UTF-8 बाइट और श्रेणी दिखाती है।
  3. किसी विशिष्ट वर्ण को खोजने के लिए, खोज फ़ील्ड में उसका कोड पॉइंट (जैसे U+1F600) दर्ज करें।
  4. खोजें पर क्लिक करें और वर्ण व उसकी एन्कोडिंग विवरण देखें।

उपयोग के मामले

डेवलपर्स स्ट्रिंग में वर्ण एन्कोडिंग समस्याओं को डीबग करते हैं। वेब डेवलपर्स विशेष वर्णों की एन्कोडिंग सत्यापित करते हैं। सुरक्षा शोधकर्ता homograph हमलों में उपयोग किए गए Unicode वर्णों का विश्लेषण करते हैं।

अक्सर पूछे जाने वाले प्रश्न

  • Unicode कोड पॉइंट क्या है?Unicode मानक में प्रत्येक वर्ण को दिया गया एक अद्वितीय नंबर, U+XXXX हेक्साडेसिमल में लिखा जाता है (जैसे U+0041 = 'A')।
  • UTF-8 क्या है?एक परिवर्तनीय-चौड़ाई वर्ण एन्कोडिंग जो Unicode कोड पॉइंट को 1-4 बाइट के रूप में दर्शाती है। यह वेब पर सबसे प्रचलित एन्कोडिंग है।
  • इमोजी UTF-8 में 4 बाइट क्यों लेते हैं?इमोजी Unicode Supplementary Multilingual Plane (U+10000+) में हैं जिसके लिए UTF-8 एन्कोडिंग में 4 बाइट आवश्यक हैं।