डेवलपर टूल · HTML इकाई एस्केपर
संख्यात्मक HTML इकाइयां: © बनाम © और इमोजी एक संदर्भ क्यों है
· यह काम किस प्रकार करता है
HTML यूनिकोड एन्कोडिंग
संख्यात्मक वर्ण संदर्भ दशमलव या हेक्साडेसिमल में एक यूनिकोड कोड बिंदु लिखते हैं। यह पोस्ट बताती है कि उन्हें कैसे पढ़ा जाए, इमोजी दो के बजाय एक संदर्भ क्यों है, और संख्याएँ कहाँ से आती हैं।
😀 जो डेटाबेस निर्यात में दिखाई दिया - लुकअप तालिका के बिना एक संख्यात्मक इकाई को पढ़ना
😀 जो डेटाबेस निर्यात में दिखाई दिया - लुकअप तालिका के बिना एक संख्यात्मक इकाई को पढ़ना। एक दशमलव संदर्भ सीधे इसके मूल्य को उजागर करता है: 😀 यूनिकोड कोड बिंदु 128512 मांगता है। संख्या मौजूद होने पर डिकोडर को नामित-प्रविष्टि लुकअप की आवश्यकता नहीं होती है।
HTML संख्यात्मक वर्ण संदर्भ को सत्यापित करने के लिए, 128512 का निर्माण करें जो निर्यातित सामग्री में 😀 देखने वाले डेवलपर के लिए दिखाई दिया। डेटाबेस निर्यात में संरक्षित करें जबकि संख्यात्मक-संदर्भ अंकगणित एक संख्यात्मक इकाई को पढ़ने का उत्पादन करता है; पहचानें कि लुकअप तालिका के बिना कहां उपभोग किया जाता है। संख्यात्मक-संदर्भ अंकगणितीय साक्ष्य के बारे में अवलोकन केवल HTML पाठ से संबंधित है।
दशमलव और हेक्साडेसिमल रूप — &#NNN; और &#xHHHH;, x और अंकों और अर्धविराम के लिए केस नियम
दशमलव और हेक्साडेसिमल रूप — &#NNN; और &#xHHHH;, x और अंकों और अर्धविराम के लिए केस नियम। स्वीकृत वाक्यविन्यास सख्त और समाप्त है: एक से सात दशमलव अंक, या एक एक्स या एक्स के बाद एक से छह हेक्साडेसिमल अंक, फिर एक अर्धविराम। गुम टर्मिनेटर अछूते रहते हैं।
निर्यातित सामग्री में 😀 देखने वाला एक डेवलपर संख्यात्मक-संदर्भ अंकगणित पास से पहले एनएनएन और एक्सएचएचएचएच केस रिकॉर्ड करके दशमलव और हेक्साडेसिमल रूपों का परीक्षण कर सकता है। बाद में x के लिए नियमों की तुलना करें और इसके लिए जिम्मेदार पार्सर और अंकों का पता लगाएं। यह HTML संख्यात्मक वर्ण संदर्भ परिणाम अर्धविराम की व्याख्या करता है, निष्पादन योग्य संदर्भों की नहीं।
कोड बिंदु, बाइट्स नहीं - पेज के वर्णसेट की परवाह किए बिना é é क्यों है
कोड बिंदु, बाइट्स नहीं - पेज के वर्णसेट की परवाह किए बिना é é क्यों है। संख्यात्मक संदर्भ एन्कोडेड बाइट्स के बजाय यूनिकोड कोड बिंदुओं की पहचान करते हैं। इसलिए दशमलव 233 और हेक्साडेसिमल E9 इस बात से स्वतंत्र होते हैं कि आसपास की फ़ाइल उस वर्ण का प्रतिनिधित्व कैसे करती है।
एक संक्षिप्त संख्यात्मक-संदर्भ अंकगणितीय नमूने में कोड बिंदुओं को अलग करें न कि बाइट्स को। दिखाएँ कि 233 शाब्दिक स्रोत के रूप में क्यों नहीं है, पेज का उसके गंतव्य तक अनुसरण करें, और API पढ़ने वाले वर्णसेट को नाम दें। HTML संख्यात्मक चरित्र संदर्भ के लिए, संख्यात्मक-संदर्भ अंकगणितीय साक्ष्य पार्सर-बाध्य साक्ष्य बना हुआ है।
सूक्ष्म वर्ण और UTF-16 - क्यों HTML में 😀 एक संदर्भ है लेकिन JavaScript में दो कोड इकाइयाँ हैं
सूक्ष्म वर्ण और UTF-16 - क्यों HTML में 😀 एक संदर्भ है लेकिन JavaScript में दो कोड इकाइयाँ हैं। एन्कोडर JavaScript स्ट्रिंग्स को फॉर-ऑफ़ के साथ पुनरावृत्त करता है, जो एक पूर्ण सूक्ष्म चरित्र उत्पन्न करता है। एक इमोजी को 😀 या इसके दशमलव समकक्ष के रूप में एन्कोड किया गया है, दो सरोगेट संदर्भों के रूप में नहीं।
सूक्ष्म वर्णों और यूटीएफ को एक सीमा प्रयोग के रूप में मानें। निर्यातित सामग्री में 😀 देखने वाले डेवलपर को 16 को बनाए रखना चाहिए, x1f600 क्यों है, एक संख्यात्मक-संदर्भ अंकगणितीय ऑपरेशन निष्पादित करें, और दो कोड इकाइयों को बदलने से पहले HTML वर्ण में एक संदर्भ का प्रत्येक वर्ण का निरीक्षण करें। जावास्क्रिप्ट में दावा इस HTML परत पर रुकता है।
व्यावहारिक उदाहरण: 😀, 😀, स्वयं वर्ण और JavaScript स्ट्रिंग - सभी चार रूपों के बीच कन्वर्ट करना
व्यावहारिक उदाहरण: 😀, 😀, स्वयं वर्ण और JavaScript स्ट्रिंग - सभी चार रूपों के बीच कन्वर्ट करना। गणना की गई श्रृंखला सटीक है: 😀 U+1F600, दशमलव 128512, हेक्साडेसिमल 1F600, HTML 😀 या 😀 है, और JavaScript स्ट्रिंग में समान दृश्यमान स्केलर मान होता है।
ग्राहक सामग्री के बजाय हानिरहित इनपुट के बीच परिवर्तित करने का कार्यशील उदाहरण पुन: प्रस्तुत करें। x1f600 128512 वर्ण को रिकॉर्ड करें, स्वयं और जावास्क्रिप्ट का निरीक्षण करें, और प्रत्येक जानबूझकर संख्यात्मक-संदर्भ अंकगणितीय पास की गणना करें। वह html संख्यात्मक वर्ण संदर्भ पथ एक डेवलपर को निर्यातित सामग्री में 😀 देखकर अनुमान लगाए बिना स्ट्रिंग के सभी चार रूपों और संख्यात्मक-संदर्भ अंकगणितीय साक्ष्य का मूल्यांकन करने देता है।
अमान्य और अस्वीकृत मान - 0x10FFFF से ऊपर सरोगेट्स, शून्य और कोड बिंदु, और पार्सर उन्हें कैसे बदलते हैं
अमान्य और अस्वीकृत मान—0x10FFFF से ऊपर के surrogate, null और code point—और parser उन्हें कैसे बदलते हैं। NUL, अलग surrogate value और U+10FFFF से ऊपर के मान U+FFFD में decode होते हैं। टेस्ट U+0000, अलग surrogate D800 और � को cover करते हैं, इसलिए अमान्य reference exception के बजाय replacement character देते हैं।
संख्यात्मक-संदर्भ अंकगणितीय समीक्षा के दौरान अमान्य और अस्वीकृत मान रखें, शून्य और कोड, और बिंदुओं को 0x10ffff से ऊपर और साथ-साथ रखें। निर्यात की गई सामग्री में 😀 देखने वाला एक डेवलपर तब यह तय कर सकता है कि रूपांतरण या डाउनस्ट्रीम पर पार्सर्स ने उन्हें कैसे बदला है। संख्यात्मक-संदर्भ अंकगणितीय साक्ष्य के बारे में HTML संख्यात्मक वर्ण संदर्भ निष्कर्ष को सामान्य सुरक्षा दावों से बाहर रखें।
इसमें क्या शामिल नहीं है - - की विरासत Windows-1252 रीमैपिंग, एक अलग पोस्ट में बताई गई है
इसमें क्या शामिल नहीं है - - की विरासत Windows-1252 रीमैपिंग, एक अलग पोस्ट में बताई गई है। दशमलव 128 से 159 तक के मान Windows-1252 मानचित्र द्वारा प्रबंधित एक जानबूझकर संगतता अपवाद हैं। उनकी विशेष मैपिंग को यहां सामान्य कोड-बिंदु स्पष्टीकरण से अलग किया गया है।
संख्यात्मक-संदर्भ अंकगणित चलाने से पहले परिभाषित करें कि यह क्या नहीं करता है। विरासत विंडो को नियंत्रण के रूप में कवर करें, 128 के 1252 रीमैपिंग के पीछे कोड बिंदुओं का निरीक्षण करें, और अगले दुभाषिया में 159 को मैप करें। यह HTML संख्यात्मक वर्ण संदर्भ की जांच करने वाली निर्यातित सामग्री में 😀 देखने वाले डेवलपर के लिए अलग पोस्ट को ऑडिट करने योग्य बनाता है।
टेकअवे: एक संख्यात्मक इकाई भेष में एक कोड बिंदु है - कैसे HTML इकाई एस्केपर का डिकोडर संदर्भों को वापस डेटा के रूप में वर्णों में बदल देता है, कभी मार्कअप नहीं करता है
टेकअवे: एक संख्यात्मक इकाई भेष में एक कोड बिंदु है - कैसे HTML इकाई एस्केपर का डिकोडर संदर्भों को वापस डेटा के रूप में वर्णों में बदल देता है, कभी मार्कअप नहीं करता है। संख्यात्मक इकाइयाँ पाठ के रूप में लिखे गए कोड बिंदु हैं। टूल उन्हें अंकगणित और String.fromCodePoint के साथ हल करता है, जबकि आसपास के इनपुट को कभी भी HTML पार्सर को निर्दिष्ट नहीं करता है।
एक संख्यात्मक इकाई को एक अवलोकनीय संख्यात्मक-संदर्भ अंकगणितीय आउटपुट से कनेक्ट करें। कीप वन-पास परिणाम के बगल में एक कोड बिंदु है, फिर सत्यापित करें कि HTML इकाई एस्केपर एस में कैसे प्रवेश करती है। निर्यातित सामग्री में 😀 देखने वाला एक डेवलपर अब डिकोडर की समीक्षा कर सकता है जो संदर्भों को एक संकीर्ण HTML संख्यात्मक चरित्र संदर्भ खोज के रूप में वापस बदल देता है। इस आलेख के पीछे व्यावहारिक निर्णय विशिष्ट है: संख्यात्मक वर्ण संदर्भ दशमलव या हेक्साडेसिमल में एक यूनिकोड कोड बिंदु लिखते हैं। यह पोस्ट बताती है कि उन्हें कैसे पढ़ा जाए, इमोजी दो के बजाय एक संदर्भ क्यों है, और संख्याएँ कहाँ से आती हैं। पाठक की कार्रवाई समान रूप से ठोस है: HTML इकाई एस्केपर से लिंक और एक संख्यात्मक संदर्भ को डिकोड करना प्रदर्शित करता है, जो इसे स्वीकार किए जाने वाले संदर्भ रूपों के लिए टूल पेज के 'समर्थित इनपुट और आउटपुट' अनुभाग की ओर इंगित करता है।