JIS X 0208

JIS X 0208 عبارة عن مجموعة أحرف مكونة من 2 بايت تم تحديدها كمعيار صناعي ياباني ، وتحتوي على 6879 حرفًا رسوميًا مناسبة لكتابة النص وأسماء الأماكن والأسماء الشخصية وما إلى ذلك باللغة اليابانية . العنوان الرسمي للمعيار الحالي هو مجموعات كانجي المشفرة ذات 7 بت و8 بت مزدوجة البايت لتبادل المعلومات ( 7ビット及び8ビットの2バイト情報交換用符号化漢字集合, Nana-Bitto) (Oyobi Hachi-Bitto no Ni-Baito Jōhō Kōkan'yō Fugōka Kanji Shūgō ) . أُنشئت هذه المواصفة في الأصل تحت اسم JIS C 6226 عام 1978، وتم تنقيحها في أعوام 1983 و1990 و1997. وتُعرف أيضاً باسم صفحة الترميز 952 لدى شركة IBM. كما تُعرف نسخة عام 1978 باسم صفحة الترميز 955 لدى شركة IBM أيضاً.

نطاق الاستخدام والتوافق

تُستخدم مجموعة الأحرف التي يحددها معيار JIS X 0208 بشكل أساسي لتبادل المعلومات (情報交換، jōhō kōkan ) بين أنظمة معالجة البيانات والأجهزة المتصلة بها، أو بين أنظمة اتصالات البيانات فيما بينها. ويمكن استخدام هذه المجموعة لمعالجة البيانات ومعالجة النصوص.

لا تُعتبر التطبيقات الجزئية لمجموعة الأحرف متوافقة. ونظرًا لوجود حالاتٍ حدث فيها مثل حرص اللجنة الأصلية لصياغة المعيار الأول على فصل الأحرف بين المستويين الأول والثاني، ثم قيام المعيار الثاني بإعادة ترتيب بعض الأحرف المتغيرة (إيتايجي ) بين المستويين، على الأقل في المعيارين الأول والثاني، يُفترض أن أنظمة الحاسوب اليابانية التي لا تستخدم الكانجي وتعتمد على المستوى الأول فقط قد نُظر في تطويرها في وقتٍ ما. مع ذلك، لم يُحدد توافق هذه التطبيقات قط، على الرغم من وجود أمثلة مثل جهاز NEC PC-9801 المبكر . [ 1 ]

على الرغم من وجود بنود في معيار JIS X 0208:1997 تتعلق بالتوافق، إلا أنه يُعتبر حاليًا أن هذا المعيار لا يُصدّق على التوافق، كما أنه ليس معيارًا رسميًا للتصنيع يُعد بمثابة إعلان عن التوافق الذاتي. [ 2 ] ونتيجةً لذلك، عمليًا ، لا تُعتبر المنتجات "المتوافقة" مع معيار JIS X 0208 موجودة. يتضمن معيار JIS X 0208 مصطلحات مثل "متوافق" (準拠، junkyo ) و "دعم" (対応، taiō ) ، ولكن دلالات هذه المصطلحات تختلف من شخص لآخر.

مخططات الترميز

مقدمة

يتوافق بايت التشفير الأول مع رقم الصف أو الخلية مضافًا إليه 0x20، أو 32 بالنظام العشري (انظر أدناه). وبالتالي، فإن مجموعة الرموز التي تبدأ بـ 0x21 يكون رقم صفها 1، وخلية رقم 1 فيها يكون بايت الاستمرار 0x21 (أو 33)، وهكذا.

بالنسبة للبايتات الأولية المستخدمة لأحرف غير الكانجي ، ستجد روابط لجداول في هذه الصفحة تُفصّل الأحرف المُشفّرة تحت كل بايت أولي. أما بالنسبة للبايتات الأولية المستخدمة للكانجي، فستجد روابط للقسم المناسب في فهرس الكانجي في ويكاموس .

JIS X 0208 (بايتات الرصاص)
0123456789أبجدهـF
2x إس بي 1-_2-_3-_4-_5-_6-_7-_8-_9-_10-_11-_12-_13-_14-_15-_
3x16-_17-_18-_19-_20-_21-_22-_23-_24-_25-_26-_27-_28-_29-_30-_31-_
4x32-_33-_34-_35-_36-_37-_38-_39-_40-_41-_42-_43-_44-_45-_46-_47-_
5x48-_49-_50-_51-_52-_53-_54-_55-_56-_57-_58-_59-_60-_61-_62-_63-_
6x64-_65-_66-_67-_68-_69-_70-_71-_72-_73-_74-_75-_76-_77-_78-_79-_
7x80-_81-_82-_83-_84-_85-_86-_87-_88-_89-_90-_91-_92-_93-_94-_دل

صفوف غير كانجي

مجموعة الأحرف 0x21 (رقم الصف 1، أحرف خاصة)

يستخدم بعض البائعين ترميز يونيكود مختلفًا قليلًا لهذه المجموعة عن الترميز الموضح أدناه. على سبيل المثال، تُربط مايكروسوفت الأحرف kuten 1-29 (JIS 0x213D) بالرمز U+2015 (الخط الأفقي)، [ 3 ] بينما تُربطها آبل بالرمز U+2014 (الشرطة الطويلة). [ 4 ] وبالمثل، تُربط مايكروسوفت الأحرف kuten 1-61 (JIS 0x215D) بالرمز U+FF0D [ 3 ] (الشكل الكامل للرمز U+002D شرطة ناقصة)، بينما تُربطها آبل بالرمز U+2212 (علامة الطرح). [ 4 ] كما يختلف ترميز يونيكود لشرطة الموجة بين البائعين. انظر إلى الخلايا التي تحتوي على الحواشي السفلية أدناه.

قد تستخدم علامات الترقيم ASCII و JISCII (الموضحة هنا بخلفية صفراء) تعيينات بديلة لكتلة Halfwidth و Fullwidth Forms إذا تم استخدامها في ترميز يجمع بين JIS X 0208 مع ASCII أو مع JIS X 0201 ، مثل Shift JIS أو EUC-JP أو ISO 2022-JP .

JIS X 0208 (مسبوق بـ 0x21)
0123456789أبجدهـF
2xIDSP،.:؛؟!يو´`¨
3x^_-[ ج ]-/
4x\[ د ][ هـ ]|...''""()[]
5x{}«+- [ f ]±×
6x÷=<>أنثى°"درجة مئوية¥
7xدولار¢جنيه إسترليني%8و*@§

مجموعة الأحرف 0x22 (الصف رقم 2، أحرف خاصة)

تمت إضافة معظم الأحرف في هذه المجموعة في عام 1983، باستثناء الأحرف 0x2221 0x222E (kuten 2-1 إلى 2-14، أو السطر الأول من الجدول أدناه)، والتي تم تضمينها في النسخة الأصلية لعام 1978 من المعيار.

JIS X 0208 (مسبوق بـ 0x22)
0123456789أبجدهـF
2x
3x
4x¬
5x
6x
7xÅ

مجموعة الأحرف 0x23 (رقم الصف 3، أرقام وأحرف رومانية)

تتضمن هذه المجموعة جزءًا من مجموعة ISO 646 الثابتة (وبالتالي جزءًا من كلٍّ من ASCII ومجموعة JIS X 0201 الرومانية)، باستثناء علامات الترقيم والرموز، وتشمل الأرقام العربية الغربية وكلا حالتي الأحرف اللاتينية الأساسية . قد تستخدم الأحرف في هذه المجموعة خرائط Unicode بديلة لكتلة الأشكال نصف العرض والعرض الكامل إذا استُخدمت في ترميز يجمع بين JIS X 0208 وASCII أو مع JIS X 0201، مثل EUC-JP أو Shift JIS أو ISO 2022-JP .

قارن الصف الثالث من معيار KPS 9566 ، الذي يتطابق معه هذا الصف تمامًا. قارن أيضًا الصف الثالث من معيار KS X 1001 ومعيار GB 2312 ، اللذين يتضمنان جميع المتغيرات الوطنية لمعيار ISO 646 في هذا الصف، وليس فقط المجموعة الفرعية الأبجدية الرقمية.

JIS X 0208 (مسبوق بـ 0x23)
0123456789أبجدهـF
2x
3x0123456789
4xأبجدهـFجيحأناجكلمشماليا
5xPسؤالRSتييوVدبليوXYZ
6xأبجدهـوزحأناجكلمنo
7xصqرsتuvwxyz

مجموعة الأحرف 0x24 (رقم الصف 4، هيراغانا)

يحتوي هذا الصف على حروف الهيراغانا اليابانية .

قارن الصف الرابع من GB 2312 ، الذي يطابق هذا الصف. قارن واذكر أوجه التشابه والاختلاف بين الصف العاشر من KPS 9566 و KS X 1001 ، اللذين يستخدمان نفس التخطيط، ولكن في صف مختلف.

JIS X 0208 (مسبوق بـ 0x24)
0123456789أبجدهـF
2x
3xنعم
4x
5x
6x
7x

مجموعة الأحرف 0x25 (رقم الصف 5، كاتاكانا)

يحتوي هذا الصف على حروف الكاتاكانا اليابانية .

قارن الصف الخامس من GB 2312 ، الذي يطابق هذا الصف. قارن واذكر أوجه التشابه والاختلاف بين الصف الحادي عشر من KPS 9566 و KS X 1001 ، اللذين يستخدمان نفس التخطيط، ولكن في صف مختلف. قارن تخطيط الكاتاكانا المختلف تمامًا المستخدم في JIS X 0201 .

JIS X 0208 (مسبوق بـ 0x25)
0123456789أبجدهـF
2x
3x
4x
5x
6x
7x

مجموعة الأحرف 0x26 (رقم الصف 6، يوناني)

يحتوي هذا الصف على دعم أساسي للأبجدية اليونانية الحديثة ، بدون علامات التشكيل أو علامة سيجما النهائية .

قارن بين الصف السادس من GB 2312 وGB 12345 والصف السادس من KPS 9566 ، حيث تتضمن جميعها نفس الأحرف اليونانية بنفس التنسيق، مع العلم أن GB 12345 يضيف أشكال عرض عمودية، بينما يضيف KPS 9566 الأرقام الرومانية. قارن أيضًا بين الصف الخامس من KS X 1001 ، حيث تم إزاحة الأحرف اليونانية لتشمل الأرقام الرومانية أولًا.

JIS X 0208 (مسبوق بـ 0x26)
0123456789أبجدهـF
2xأبΓΔΕΖΗΘأناكΛمنΞأو
3xΠΡΣΤΥΦΧΨΩ
4xαβγدلتاεζηθأناκλμνξأو
5xπρστυφχψω
6x
7x

مجموعة الأحرف 0x27 (رقم السطر 7، السيريلية)

يحتوي هذا الصف على الأبجدية الروسية الحديثة ، وهو ليس بالضرورة كافياً لتمثيل الأشكال الأخرى من الكتابة السيريلية .

قارن الصف 7 من GB 2312 ، الذي يطابق هذا الصف. قارن واذكر أوجه التشابه والاختلاف بين الصف 12 من KS X 1001 والصف 5 من KPS 9566 ، اللذين يستخدمان نفس التخطيط (ولكن في صف مختلف).

JIS X 0208 (مسبوق بـ 0x27)
0123456789أبجدهـF
2xأببجدإيЁج3وЙكلمن
3xأوبرجتيوفXЦЧشЩЪيبЭ
4xيوأنا
5xأببгدهـёج3وйكلمن
6xأوпрجتيوф×цчشщъыьэ
7xюأنا

مجموعة الأحرف 0x28 (رقم الصف 8، رسم المربع)

تمت إضافة جميع الأحرف في هذه المجموعة في عام 1983، ولم تكن موجودة في النسخة الأصلية لعام 1978 من المعيار.

JIS X 0208 (مسبوق بـ 0x28)
0123456789أبجدهـF
2x
3x
4x
5x
6x
7x

مجموعة أحرف الامتداد 0x2D (رقم الصف 13، أحرف NEC الخاصة)

تُترك الصفوف من 9 إلى 15 من معيار JIS X 0208 فارغة.

مع ذلك، يُعدّ التخطيط التالي للصف 13، الذي قدمته شركة NEC لأول مرة ، امتدادًا شائعًا. ويُستخدم (مع اختلافات طفيفة، مذكورة في الحواشي) في Windows-932 [ 3 ] (المتوافق مع معيار ترميز WHATWG المستخدم في HTML5 )، وفي إصدار PostScript (ولكن ليس الإصدار العادي منذ إصدار KanjiTalk 7) [ 5 ] من MacJapanese ، وفي JIS X 0213 (الخليف لـ JIS X 0208). [ 5 ] [ 6 ] على عكس الامتدادات الأخرى التي طورتها Windows-932/WHATWG وJIS X 0213، يتطابق هذان الامتدادان بدلًا من أن يتعارضا، لذا فإن فك ترميز معظم هذا الصف مدعوم بشكل أفضل من الامتدادات الأخرى التي طورتها JIS X 0213.

الأحرف الخاصة لشركة NEC لمعيار JIS X 0208 (المسبوقة بـ 0x2D)
0123456789أبجدهـF
2x٢
3x1010رابعاً٥[ g ]
4xبيأون
5xمموكوكوم[ g ][ h ]
6xرقمكيون
7x[ i ][ i ][ i ][ i ][ i ][ i ][ i ][ i ][ i ][ g ][ g ]

صفوف كانجي

بنية الكود

لتمثيل نقاط الترميز ، تُستخدم أرقام الأعمدة/الأسطر للرموز أحادية البايت، وأرقام الكوتين للرموز ثنائية البايت. ولتحديد الحرف دون الاعتماد على رمزه، تُستخدم أسماء الأحرف.

رموز البايت المفردة

تُمثَّل جميع رموز الأحرف الرسومية في معيار JIS X 0208 تقريبًا ببايتين، كل منهما يتكون من سبعة بتات على الأقل. مع ذلك، يُمثَّل كل حرف تحكم ، بالإضافة إلى المسافة العادية - باستثناء المسافة التصويرية - برمز من بايت واحد. ولتمثيل تركيبة البتات (ット組合せ، bitto kumiawase ) لرمز البايت الواحد، يُستخدم رقمان عشريان: رقم العمود ورقم السطر . تُشكِّل ثلاثة بتات من أصل سبعة، أو أربعة بتات من أصل ثمانية، بدءًا من صفر إلى سبعة أو من صفر إلى خمسة عشر على التوالي، رقم العمود. بينما تُشكِّل أربعة بتات من أصل خمسة، بدءًا من صفر إلى خمسة عشر، رقم السطر. يُقابل كل رقم عشري خانة سداسية عشرية واحدة . على سبيل المثال، تركيبة البتات المقابلة لحرف "المسافة" الرسومي هي 010 0000 كرقم من سبعة بتات، و0010 0000 كرقم من ثمانية بتات. في تدوين العمود/السطر، يتم تمثيل هذا على أنه 2/0. تشمل التمثيلات الأخرى لنفس رمز البايت الواحد 0x20 كنظام سداسي عشري، أو 32 كرقم عشري واحد.

نقاط الترميز وأرقام الترميز

تُرتّب رموز البايت المزدوج في 94 مجموعة مرقمة، تُسمى كل منها صفًا (، ku ؛ وتعني حرفيًا "قسم") . يحتوي كل صف على 94 رمزًا مرقمًا، تُسمى كل منها خلية (، ten ؛ وتعني حرفيًا "نقطة") . [ j ] ينتج عن ذلك ما مجموعه 8836 (94 × 94) نقطة رمزية ممكنة (مع العلم أنه لم يتم تخصيص جميعها، انظر أدناه)؛ وهي مُرتبة في المعيار في جدول رموز مكون من 94 سطرًا و94 عمودًا.

يُشكّل رقم الصف ورقم الخلية (يُرقم كل منهما من 1 إلى 94، وفقًا لمعيار JIS X 0208) نقطة كوتين (区点) ، والتي تُستخدم لتمثيل نقاط الترميز ثنائية البايت. يُعبّر عن رقم الترميز أو رقم كوتين (区点番号، kuten bangō ) بصيغة "صف-خلية"، حيث يُفصل بين رقم الصف ورقم الخلية بشرطة . على سبيل المثال، الحرف "" له نقطة ترميز في الصف 16، الخلية 1، لذا يُكتب رقم ترميزه "16-01".

في ترميز JIS X 0208 ذي 7 بت (كما هو الحال في JIS X 0202 / ISO-2022-JP )، يجب أن يكون كلا البايتين ضمن نطاق 94 بايت، من 0x21 (المستخدم للصف أو الخلية رقم 1) إلى 0x7E (المستخدم للصف أو الخلية رقم 94) - وهو النطاق نفسه المستخدم لأحرف الطباعة ASCII ذات 7 بت، باستثناء المسافة. وبناءً على ذلك، يتم الحصول على البايتات المشفرة بإضافة 0x20 (32) إلى كل رقم. [ 7 ] على سبيل المثال، يُمثل المثال أعلاه للرقم 16-01 ("亜") بالبايتات . أما ترميز EUC-JP0x30 0x21 ذو 8 بت، فيستخدم النطاق من 0xA1 إلى 0xFE (مع ضبط البت الأعلى على 1)، بينما تستخدم ترميزات أخرى، مثل Shift JIS، تحويلات أكثر تعقيدًا. يتضمن Shift JIS مساحة تشفير أكبر من تلك المطلوبة لترميز JIS X 0208 نفسه. تستخدم بعض ملحقات Shift JIS الخاصة بـ JIS X 0208 أرقام الصفوف التي تزيد عن 94. [ 8 ]

يُستخدم هذا الهيكل أيضًا في المخطوطة الصينية GB 2312 ، حيث يُعرف محليًا باسم区位( qūwèi )، وفي المخطوطة الكورية الجنوبية KS C 5601 (المُعرفة حاليًا باسم KS X 1001 )، حيث يُعرف الحرفان ku و ten على التوالي باسم hang [ 9 ] ( ؛؛ haeng ) و yol [ 9 ] ( ؛؛ yeol ). وقد وسّع المخطوط JIS X 0213 اللاحق هذا الهيكل ليشمل أكثر من مستوى واحد (، men ؛ وتعني حرفيًا "وجه") من الصفوف، وهو نفس الهيكل المُستخدم في المخطوطة CNS 11643 ، ويرتبط بالهيكل المُستخدم في المخطوطة CCCII .

نقاط الترميز غير المخصصة

من بين رموز البايت الثنائي، تُعتبر الصفوف من 9 إلى 15 ومن 85 إلى 94 نقاط رمز غير مُخصصة (空き領域، aki ryōiki ) ؛ أي أنها نقاط رمز لم تُخصص لها أحرف. كذلك، تُعتبر بعض الخلايا في صفوف أخرى نقاط رمز غير مُخصصة أيضًا.

تحتوي هذه المساحات الفارغة على رموز لا يُنصح باستخدامها. باستثناء وجود اتفاق مسبق بين الأطراف المعنية، لا يجوز تخصيص رموز ( gaiji ) لتبادل المعلومات في هذه المساحات غير المخصصة.

حتى عند تعيين الأحرف لنقاط الترميز غير المعينة، لا ينبغي تعيين الأحرف الرسومية المحددة في المعيار لها، ولا ينبغي تعيين نفس الحرف لنقاط ترميز متعددة غير معينة؛ لا ينبغي تكرار الأحرف في المجموعة.

علاوة على ذلك، عند تخصيص رموز لنقاط الترميز غير المخصصة، يجب توخي الحذر من التوحيد فيما يتعلق بأشكال الكانجي. على سبيل المثال، تتوافق الخلية 66 في الصف 25 مع الكانجي الذي يعني "عالي" أو "غالي"؛ حيث يُدمج كل من الشكل الذي يحتوي على عنصر يشبه حرف "الفم" () في المنتصف () والشكل الأقل شيوعًا الذي يشبه السلم في نفس الموضع () ضمن نقطة الترميز نفسها. وبالتالي، فإن حصر النقاط من 25 إلى 66 على شكل "الفم" وتخصيص شكل "السلم" الأخير لنقطة ترميز غير مخصصة يُعدّ، من الناحية الفنية، انتهاكًا للمعيار.

لكن عملياً، تقوم العديد من متغيرات Shift JIS الخاصة بالبائعين، بما في ذلك Windows-932 و MacJapanese ، بتشفير امتدادات البائع في صفوف غير مخصصة من مساحة التشفير لـ JIS X 0208. كما أن معظم الرموز غير المخصصة في JIS X 0208 يتم تخصيصها بواسطة معيار JIS X 0213 الأحدث .

أسماء الشخصيات

يُعطى كل حرف في معيار JIS X 0208 اسمًا . وباستخدام اسم الحرف، يُمكن تحديد الأحرف دون الاعتماد على رموزها. وتتوافق أسماء الأحرف مع معايير مجموعات الأحرف الأخرى، ولا سيما مجموعة الأحرف المشفرة العالمية (UCS/ Unicode )، لذا يُعد هذا أحد المصادر المحتملة لربط الأحرف بمجموعات أحرف مثل Unicode. على سبيل المثال، يحمل كل من الحرف الموجود في العمود 4، السطر 1 من الإصدار المرجعي الدولي ISO/IEC 646 ( US-ASCII ) والحرف الموجود في الصف 3، الخلية 33 من JIS X 0208 الاسم "الحرف اللاتيني الكبير A". وبالتالي، يُمكن اعتبار الحرف الموجود في 4/1 في ASCII والحرف الموجود في 3-33 في JIS X 0208 حرفًا واحدًا (مع العلم أنه عمليًا، يُستخدم ربط بديل لحرف JIS X 0208 نظرًا لأن بعض الترميزات تُقدم ASCII بشكل منفصل). وعلى العكس من ذلك، يمكن اعتبار الأحرف ASCII 2/2 (علامة اقتباس)، و2/7 (فاصلة عليا)، و2/13 (شرطة ناقصة)، و7/14 (علامة مد) أحرفًا غير موجودة في هذا المعيار.

تستخدم أسماء الأحرف غير الكانجي الأحرف اللاتينية الكبيرة والمسافات والواصلات. تُعطى الأحرف غير الكانجي اسمًا شائعًا باللغة اليابانية (日本語通用名称، Nihongo tsūyō meishō ) ، ولكن بعض الأحكام المتعلقة بهذه الأسماء غير موجودة. [ k ] أما أسماء الكانجي، فتُحدد آليًا وفقًا للتمثيل الست عشري المقابل لرمزها في نظام UCS/Unicode. يمكن الحصول على اسم الكانجي بإضافة "CJK UNIFIED IDEOGRAPH-" قبل رمز Unicode. على سبيل المثال، الخلية 1 في الصف 16 () تُقابل U+4E9C في UCS، لذا سيكون اسمها "CJK UNIFIED IDEOGRAPH-4E9C". لا تُعطى أحرف الكانجي أسماءً شائعة باللغة اليابانية.

مجموعة كانجي

ملخص

يحدد معيار JIS X 0208 مجموعة من 6879 حرفًا رسوميًا تتوافق مع رموز ثنائية البايت إما بسبعة أو ثمانية بتات للبايت؛ في معيار JIS X 0208، يطلق على هذا اسم مجموعة الكانجي (漢字集合، kanji shūgō ) ، والتي تتضمن 6355 كانجي بالإضافة إلى 524 غير كانجي (非漢字، hikanji ) ، بما في ذلك أحرف مثل الأحرف اللاتينية ، والكانا ، وما إلى ذلك.

الأحرف الخاصة
يشغل الصفين 1 و 2. هناك 18 رمزًا واصفًا (記述記号، كيجوتسو كيغو ) مثل "المساحة الإيديوغرافية" ( ) ، والفاصلة والنقطة اليابانية ؛ ثماني علامات تشكيل مثل dakuten وhandakuten ؛ 10 أحرف للأشياء التي تتبع كانا أو كانجي (仮名又は漢字に準じるもの، كانا ماتا وا كانجي ني جونجيرو مونو ) مثل علامة التكرار ؛ 22 رمزًا قوسيًا (括弧記号، kakko kigō ) ؛ 45 رمزًا رياضيًا (学術記号، gakujutsu kigō ) ؛ و32 رمزًا للوحدات ، والتي تشمل رمز العملة والعلامة البريدية ، ليصبح المجموع 147 حرفًا.
الأرقام
يشغل جزءًا من الصف 3. الأرقام العشرة من "0" إلى "9".
الحروف اللاتينية
يشغل جزءًا من الصف 3. الأحرف الـ 26 من الأبجدية الإنجليزية بأحرف كبيرة وصغيرة ليصبح المجموع 52 حرفًا.
هيراغانا
يشغل الصف 4. يحتوي على 48 حرف كانا غير صوتي (بما في ذلك wi و we القديمة )، و 20 حرف كانا صوتي ( dakuten )، و 5 أحرف كانا شبه صوتية ( handakuten )، و 10 أحرف كانا صغيرة للأصوات الحنكية والمستوعبة، ليصبح المجموع 83 حرفًا.
كاتاكانا
يحتل الصف 5. هناك 86 حرفًا؛ بالإضافة إلى مرادفات الكاتاكانا لأحرف الهيراغانا، فإن الحرف ka / ke kana الصغير (/) و vu kana ().
الحروف اليونانية
يشغل الصف السادس. الأحرف الـ 24 من الأبجدية اليونانية بأحرف كبيرة وصغيرة (باستثناء حرف سيجما الأخير ) ليصبح المجموع 48 حرفًا.
حروف سيريلية
يشغل الصف السابع. الأحرف الـ 33 من الأبجدية الروسية بأحرف كبيرة وصغيرة ليصبح المجموع 66 حرفًا.
شخصيات الرسم المربع
يشغل الصف الثامن. قطاعات رقيقة، قطاعات سميكة، وقطاعات مختلطة رقيقة وسميكة، 32 إجمالي.
كانجي
2965 حرفًا من المستوى 1 (第1水準، dai ichi suijun ) من الصف 16 إلى الصف 47، و3390 حرفًا من المستوى 2 (第2水準، dai ni suijun ) من الصف 48 إلى الصف 84 بإجمالي 6355.

الأحرف الخاصة والأرقام والأحرف اللاتينية

أما بالنسبة للأحرف الخاصة في مجموعة الكانجي، فإن بعض الأحرف من مجموعة الأحرف الرسومية للنسخة المرجعية الدولية (IRV) من معيار ISO/IEC 646 :1991 (المكافئ لـ ASCII ) غير موجودة في معيار JIS X 0208. وهذه الأحرف الأربعة هي: علامة الاقتباس، والفاصلة العليا، والواصلة، وعلامة المد. الأحرف الثلاثة الأولى مُقسّمة إلى نقاط ترميز مختلفة في مجموعة الكانجي (نيشيمورا، 1978؛ معيار JIS X 0221-1:2001، القسم 3.8.7). أما علامة المد (TILDE) في النسخة المرجعية الدولية (IRV) فلا يوجد لها حرف مُقابل في مجموعة الكانجي.

في الجدول التالي، تتم مقارنة أحرف IRV المذكورة في معيار ISO/IEC 646:1991 مع مكافئاتها المتعددة في معيار JIS X 0208، باستثناء حرف IRV "TILDE" الذي تتم مقارنته بحرف "WAVE DASH" في معيار JIS X 0208. تستخدم الإدخالات الموجودة تحت أعمدة "الرمز" نقاط ترميز UCS/Unicode، لذا قد تختلف تفاصيل العرض.

تم لاحقًا تعيين نقاط رمزية لأحرف ASCII/IRV التي لا يوجد لها مكافئات دقيقة في JIS X 0208 بواسطة JIS X 0213 ، وهي مدرجة أيضًا أدناه، بالإضافة إلى تعيين Microsoft للأحرف الأربعة.

لا يوجد تطابق تام بين معيار ISO/IEC 646:1991 IRV (ASCII) ومعيار JIS X 0208
ISO/IEC 646:1991 IRVJIS X 0208
العمود/السطرx0213 [ 6 ]مايكروسوفترمزاسمكوتينرمزاسم
2/21-2-1692-94 [ أ ] 115-24 [ ب ]"علامة اقتباس1-15¨الإسهال
1-40"علامة اقتباس مزدوجة يسارية
1-41"علامة اقتباس مزدوجة يمنى
1-77"برايم مزدوج
2/71-2-1592-93 [ أ ] 115-23 [ ب ]'الفاصلة العليا1-13´لهجة حادة
1-38'علامة اقتباس مفردة يسرى
1-39'علامة اقتباس مفردة يمنى
1-76برايم
2/131-2-171-61 [ ج ]-الواصلة1-30-الواصلة
1-61-علامة ناقص
14/71-2-181-33 [ د ]~علامة المد(لا يوجد حرف مطابق)
(لا يوجد حرف مطابق)1-33~موجة سريعة [ D ]
  1. 1 2 من "مجموعة ملحقات IBM المختارة من NEC". يشغل نقطة رمز غير مخصصة في JIS X 0208.
  2. 1 2 من "ملحقات IBM". خارج نطاق JIS X 0208، ولكن يمكن ترميزه في Shift_JIS.
  3. تعامل مايكروسوفت علامة الطرح JIS كشكل كامل العرض لعلامة الطرح.
  4. يُعامل رمز الموجة المتقطعة أحيانًا كشكل كامل العرض لرمز التلدة، كما هو الحال في مايكروسوفت (انظر التلدة § ترميز Unicode و Shift JIS لرمز الموجة المتقطعة ). يُعد رمز التلدة في ASCII / IRV رمزًا غامضًا، إذ قد يظهر إما كعلامة تلدة (˜) أو كشرطة بنفس الانحناء (∼)، مع أن الشرطة أكثر شيوعًا نظرًا لوجود رمز منفصل لعلامة التباعد في Windows-1252 ؛ ولا يوجد حرف JIS X 0208 لعلامة التلدة. يظهر الحرف 1-2-18 في JIS X 0213 كعلامة تلدة في جدول الرموز. [ 6 ]

وهذا يعني أن مجموعة الكانجي هي مجموعة الأحرف غير المتوافقة مع الإصدارات الأحدث الأكثر انتشارًا في العالم؛ وهي تعتبر واحدة من نقاط الضعف في هذا المعيار.

على الرغم من وجود 90 حرفًا خاصًا ورقمًا وحروفًا لاتينية مشتركة بين مجموعة الكانجي ومجموعة IRV، إلا أن هذا المعيار لا يتبع ترتيب ISO/IEC 646. يتم تقسيم هذه الأحرف التسعين بين الصف 1 (علامات الترقيم) والصف 3 (الأحرف والأرقام)، على الرغم من أن الصف 3 يتبع ترتيب ISO 646 للأحرف والأرقام الـ 62 فقط (على سبيل المثال، 4/1يصبح ("A") في ISO 646 2/3 4/1(ie 3-33) في JIS X 0208).

أما بالنسبة لسبب كون هذه الأرقام والحروف اللاتينية وما إلى ذلك في مجموعة الكانجي هي "أحرف أبجدية رقمية كاملة العرض" (全角英数字, zenkaku eisūji ) وكيف ظهر التنفيذ الأصلي بتفسير مختلف مقارنة بـ IRV، فيُعتقد أن ذلك يرجع إلى هذه التناقضات.

منذ صدور المعيار الأول، أصبح من الممكن تمثيل الرموز المركبة (合成، gōsei ) مثل الأرقام المحاطة بدائرة ، والوصلات المستخدمة لأسماء وحدات القياس، والأرقام الرومانية ؛ [ 10 ] ولم تُمنح هذه الرموز نقاط ترميز مستقلة . ورغم أن الشركات المصنعة لأنظمة المعلومات قد تبذل جهدًا لتمثيل هذه الرموز وفقًا لمتطلبات العملاء من حيث تركيبها، إلا أن أيًا منها لم يطلب إضافتها إلى المعيار، بل اختارت بدلًا من ذلك تقديمها بشكل خاص كرموز مستقلة ( gaiji) .

في المعيار الرابع (1997)، عُرِّفت جميع هذه الأحرف صراحةً بأنها أحرف تُستخدم لتمييز الموضع الحالي؛ أي أنها أحرف فاصلة . علاوة على ذلك، حُكم بعدم جواز تكوينها من خلال تركيب الأحرف. ولهذا السبب، مُنع تمثيل الأحرف اللاتينية بعلامات التشكيل منعًا باتًا، باستثناء رمز الأنجستروم ( Å ) في الصف الثاني، الخلية 82.

الهيراغانا والكاتاكانا

تتضمن حروف الهيراغانا والكاتاكانا في معيار JIS X 0208، على عكس معيار JIS X 0201 ، علامات داكوتين وهانداكوتين كجزء من الحرف. كما تتضمن حروف الكاتاكانا wi () و we () (وكلاهما مهجور في اللغة اليابانية الحديثة)، بالإضافة إلى حرف wa () الصغير ، غير الموجود في معيار JIS X 0201.

يختلف ترتيب كانا في JIS X 0208 عن ترتيب الكاتاكانا في JIS X 0201. في JIS X 0201، يبدأ المقطع بـ wo () ، متبوعًا بـ kana الصغيرة مرتبة حسب ترتيب gojūon ، متبوعًا بـ kana بالحجم الكامل، وأيضًا بترتيب gojūon. (ヲ ァ ィ ゥ ェ ォ ャ ュ ョ ッ ー ア イ ウ エ オ ...... ラ リ ル レ ロ ワ ン). من ناحية أخرى، في JIS X 0208، يتم فرز الكانا أولاً حسب ترتيب gojūon ، ثم بترتيب "كانا الصغيرة، كانا بالحجم الكامل، كانا مع داكوتين، وكانا مع هانداكوتين" بحيث يتم تجميع نفس الكانا الأساسية مع مشتقاتها (ぁあぃいぅうぇえぉお......っつづ......はばぱひびぴふぶぷへべぺほぼぽ......ゎわゐゑをん). تم اختيار هذا الترتيب لتسهيل فرز عمليات البحث في القاموس المستندة إلى كانا (ياسوكا، 2006). [ ل ]

كما ذُكر سابقًا، لم يُراعَ في هذا المعيار ترتيب الكاتاكانا المُحدد سابقًا في معيار JIS X 0201 في معيار JIS X 0208. ويُعتقد أن كون كاتاكانا JIS X 0201 " كاتاكانا نصف العرض " نشأ نتيجةً لعدم توافقها مع كاتاكانا هذا المعيار. وتُعد هذه النقطة أيضًا إحدى نقاط ضعف هذا المعيار.

كانجي

يشرح المعيار الرابع (1997) بالتفصيل كيفية اختيار الكانجي في هذا المعيار، ومصادرها، وسبب تقسيمها إلى المستوى الأول والثاني، وكيفية ترتيبها. وبناءً على هذا الشرح، فإن الكانجي المدرجة في قوائم الكانجي الأربع التالية تنعكس في الأحرف الـ 6349 الواردة في المعيار الأول (1978).

  • قائمة كانجي للرمز القياسي (مؤقت) (標準コド用漢字表 (試案) ، Hyōjun Kōdo-yō Kanjihyō (Shian) ) قامت لجنة كود كانجي في جمعية معالجة المعلومات اليابانية بتجميع هذه القائمة في عام 1971. في "نتائج تحليل المراسلات" أدناه، يبدو أن هذا يتكون من 6086 حرفًا.
  • كانجي أساسي لاستخدام معالجة البيانات الإدارية (行政情報処理用基本漢字، Gyōsei Jōhō Shoriyō Kihon Kanji ) تم اختياره من قبل وكالة الإدارة الإدارية اليابانية في عام 1975، ويتكون من 2817 حرفًا. بالنسبة للبيانات لغرض الاختيار، أعدت الوكالة تقريرًا، بدءًا من "قائمة كانجي للرموز القياسية (مؤقت)"، والتي تتناقض مع العديد من قوائم كانجي، و "نتائج تحليل المراسلات وتكرار استخدام كانجي لمعالجة البيانات الإدارية، واستخدام الاختيار العادي للكانجي" (行政情報処理用標準漢字選定のための漢字の使用頻度および対応分析結果, Gyōsei Jōhō Shoriyō Kihon Kanji Sentei no Tame no Kanji no Shiyō Hindo Oyobi Taiō Bunseki Kekka ) أو "نتائج تحليل المراسلات" (対応分析結果، Taiō Bunseki Kekka ) للاختصار.
  • كانجي اسم تسجيل الشخصية الياباني (日本生命収容人名漢字، Nihon Seimei Shūyō Jinmei Kanji ) أحد قوائم الكانجي التي تُشكّل "نتائج تحليل التطابق"، والتي تتألف من 3044 حرفًا. لم يعد هذا الكانجي موجودًا. لم تكن القائمة الأصلية موجودة لدى لجنة الصياغة الأصلية؛ وقد انعكست هذه القائمة في المعيار الذي سيتبع "نتائج تحليل التطابق".
  • كانجي لقائمة المنطقة الإدارية الوطنية (国土行政区画総覧使用漢字، Kokudo Gyōsei Kukaku Sōran Shiyō Kanji ) إحدى قوائم كانجي التي تتكون من "نتائج تحليل المراسلات"، والتي تتكون من 3251 حرفًا. وهي حروف الكانجي المستخدمة في قائمة جميع أسماء الأماكن الإدارية التي جمعها مركز البيانات الجغرافية الياباني ، "قائمة المنطقة الإدارية الوطنية" (国土行政区画総覧، Kokudo Gyōsei Kukaku Sōran ) . ولم تقم لجنة الصياغة الأصلية بالتحقيق في الإدراج نفسه؛ كانجي المستخدم من هذه القائمة يتبع "نتائج تحليل المراسلات".

في المعيارين الثاني والثالث، أُضيفت أربعة أحرف وحرفان إلى المستوى الثاني على التوالي، ليصل إجمالي عدد أحرف الكانجي إلى 6355 حرفًا. كما شهد المعيار الثاني تغييرات في أشكال الأحرف، بالإضافة إلى تبديل مواقعها بين المستويات؛ وفي المعيار الثالث أيضًا، طرأت تغييرات على أشكال الأحرف. وسيتم شرح هذه التغييرات بمزيد من التفصيل لاحقًا.

تقسيم المستوى

تشغل 2965 حرف كانجي من المستوى 1 الصفوف من 16 إلى 47. وتشغل 3390 حرف كانجي من المستوى 2 الصفوف من 48 إلى 84.

بالنسبة للمستوى الأول، تم اختيار الأحرف المشتركة بين قوائم رموز الكانجي المتعددة، بالاستناد إلى كانجي تويو ، ومسودة تصحيح كانجي تويو، وكانجي جينمييو . كما تم الرجوع إلى معيار JIS C 6260 ("رمز تعريف المحافظة"؛ وهو حاليًا JIS X 0401 ) ومعيار JIS C 6261 ("رمز تعريف المدن والبلدات والقرى"؛ وهو حاليًا JIS X 0402 ). وتم وضع رموز الكانجي الخاصة بجميع المحافظات والمدن والأحياء والبلدات والقرى اليابانية تقريبًا، وما إلى ذلك، في المستوى الأول عمدًا. [ م ] علاوة على ذلك، أُضيفت تعديلات من قِبل خبراء.

تم تخصيص المستوى 2 للكانجي الذي ظهر في القوائم الرئيسية الأربعة المذكورة أعلاه ولكن لم يتم اختياره للمستوى 1. وكما هو مذكور أدناه، تم ترتيب الكانجي في المستوى 1 حسب نطقها، لذلك من بين الكانجي التي كان من الصعب تحديد نطقها، كانت هناك تلك التي تم نقلها من المستوى 1 إلى المستوى 2 على هذا الأساس (نيشيمورا، 1978).

نتيجةً لهذه القرارات، يحتوي المستوى الأول في الغالب على أحرف كانجي أكثر استخدامًا، بينما يحتوي المستوى الثاني على أحرف كانجي أقل استخدامًا، ولكن بالطبع، تم تقييم ذلك وفقًا لمعايير ذلك الوقت. مع مرور الوقت، أصبح استخدام بعض أحرف كانجي المستوى الثاني أكثر شيوعًا، مثل حرف كانجي بمعنى "يرتفع" () وآخر بمعنى "يتألق" (). وعلى العكس، أصبح استخدام بعض أحرف كانجي المستوى الأول أقل شيوعًا، لا سيما تلك التي تعني "سنتيمتر" () و"مليمتر" (). من بين أحرف كانجي جويو الحالية ، يندرج 30 حرفًا ضمن المستوى الثاني، بينما يغيب ثلاثة أحرف تمامًا (塡󠄀، 剝󠄀، و頰󠄀). من بين أحرف كانجي جينميو الحالية ، يندرج 192 حرفًا ضمن المستوى الثاني، بينما لا يُعد 105 أحرف جزءًا من المعيار. [ q ]

ترتيب

تُرتب حروف الكانجي في المستوى الأول وفقًا لقراءتها التمثيلية (أي القراءة المعيارية المختارة لأغراض هذا المعيار فقط)؛ وقد تكون قراءة الكانجي في هذا المستوى قراءة " أون " أو " كون" ؛ وتُرتب القراءات وفقًا لترتيب "جوجون " . [ r ] كقاعدة عامة، تُعتبر قراءة " أون" (الصوت الصيني) هي القراءة التمثيلية؛ وفي حال وجود أكثر من قراءة "أون" لحرف الكانجي، تُستخدم القراءة الأكثر شيوعًا كقراءة تمثيلية (معيار JIS C 6226-1978، القسم 3.4). أما بالنسبة للنسبة الضئيلة من حروف الكانجي التي لا تحتوي على قراءة "أون" أو التي تحتوي على قراءة "أون" غير شائعة الاستخدام، فقد استُخدمت قراءة "كون" كقراءة تمثيلية. وعندما يكون من الضروري استخدام قراءة "كون" فعلية كقراءة تمثيلية، يُستخدم شكل "رين يوكي" (بدلًا من " شوشيكي ").

على سبيل المثال، تحتوي الخلايا من 1 إلى 41 في الصف 16 على 41 حرفًا مُرتبة حسب قراءتها الأولى . ضمن هذه الخلايا، يوجد 22 حرفًا، بما في ذلك 16-10 (: تُقرأ " kiتُقرأ " aoi ") و16-32 (: تُقرأ " zoku " و" shoku "؛ تُقرأ " awa ")، وذلك بناءً على قراءاتها . أما 16-09 (: تُقرأ " تُقرأ " a(i) ") و16-23 (: تُقرأ " " و" kyūتُقرأ " atsuka(i) ")، فهما مثالان فقط على أفعال صيغة ren'yōkei المستخدمة للقراءة التمثيلية.

عندما تكون القراءة التمثيلية متطابقة بين أحرف الكانجي المختلفة، يُوضع حرف الكانجي الذي يستخدم قراءة "أون" قبل حرف الكانجي الذي يستخدم قراءة "كون" . وعندما تكون قراءات "أون " أو "كون" متطابقة بين أكثر من حرف كانجي، يتم ترتيبها وفقًا لجذرها الأساسي وعدد ضرباتها .

سواءً في المستوى الأول أو الثاني، تُرتّب حروف الإيتايجي لتتبع شكلها النموذجي مباشرةً. على سبيل المثال، في المستوى الثاني، مباشرةً بعد الصف 49، الخلية 88 () ، تنحرف الأحرف التالية مباشرةً عن القاعدة العامة (عدد الضربات في هذه الحالة ) لتشمل ثلاثة متغيرات من 49 إلى 88 (،، و) .

تُرتب حروف الكانجي في المستوى الثاني وفقًا للجذر الأساسي وعدد الخطوط. وعندما تتشابه هاتان الخاصيتان في حروف كانجي مختلفة، يتم ترتيبها حسب القراءة.

كانجي من مصادر غير معروفة

الكانجي التي تكون مصادرها غير واضحة أو غير معروفة أو غير قابلةللتحديد في الملحق 7 من معيار JIS X 0208:1997
كوتينرمزالتصنيف​​
52-55مجهول
52-63مجهول
54-12المصدر غير واضح
55-27غير محدد وقابل للتحقق
57-43المصدر غير واضح
58-83المصدر غير واضح
59-91المصدر غير واضح
60-57المصدر غير واضح
74-12المصدر غير واضح
74-57المصدر غير واضح
79-64المصدر غير واضح
81-50المصدر غير واضح

لوحظ وجود بعض حروف الكانجي في مجموعة الكانجي غير الموجودة في قواميس الكانجي الشاملة وغير المختصرة، وأن مصادرها غير معروفة. فعلى سبيل المثال، بعد عام واحد فقط من وضع المعيار الأول، أفاد تاجيما (1979) بأنه قد تأكد من وجود 63 حرف كانجي غير موجودة في قاموس شينجيجين (قاموس كانجي ضخم نشرته دار كادوكاوا شوتين )، ولا في قاموس داي كان-وا جيتين ، وأنها لا تُشكل أي معنى كحروف كانجي من أي نوع؛ وأشار إلى أنه من الأفضل اختيار حروف الكانجي غير المتوفرة في قواميس الكانجي من مصادر محددة. عُرفت هذه الحروف باسم "الحروف الشبحية" (幽霊文字، يوري موجي ) أو "كانجي الشبح" (幽霊漢字، يوري كانجي ) ، من بين أسماء أخرى.

رأت لجنة صياغة النسخة الرابعة من المعيار أن وجود رموز كانجي مجهولة المصدر يمثل مشكلة، ولذا أجرت تحقيقًا حول طبيعة المصادر التي استندت إليها لجنة صياغة النسخة الأولى. ونتيجة لذلك، تبيّن أن اللجنة الأصلية اعتمدت بشكل كبير على "نتائج تحليل التطابق" لجمع رموز الكانجي. وعندما فحصت اللجنة "نتائج تحليل التطابق"، اتضح أن العديد من رموز الكانجي المدرجة في مجموعة رموز الكانجي، والتي لم تُعثر عليها في قواميس الكانجي الشاملة، يُفترض أنها مأخوذة من قائمتي "كانجي تسجيل أسماء الشخصيات اليابانية" و"كانجي قوائم المناطق الإدارية الوطنية" المذكورتين في "نتائج تحليل التطابق".

تأكد عدم وجود نص أصلي لـ"كانجي اسم تسجيل الشخصية اليابانية" المشار إليه في "نتائج تحليل المراسلات". أما بالنسبة لـ"قائمة المناطق الإدارية الوطنية"، فقد قام ساساهارا هيرويوكي، عضو لجنة صياغة النسخة الرابعة، بفحص الكانجي الذي ظهر في صفحات التطوير قيد الإعداد للمعيار الأول. كما استشارت اللجنة العديد من الكتابات القديمة، بالإضافة إلى العديد من الأمثلة على الأسماء الشخصية في قاعدة بيانات أدلة هواتف شركة NTT .

بفضل هذا التحقيق الدقيق، تمكنت اللجنة من تقليص عدد حروف الكانجي التي لا يمكن تفسير مصدرها بشكل قاطع إلى اثني عشر حرفًا، موضحة في الجدول المجاور. ويُعتقد أن العديد من هذه الحروف نشأت نتيجة أخطاء في النسخ. على وجه الخصوص، يُرجح أن حرف 妛 قد نشأ عندما حاول الطابعون إنشاء حرف 𡚴 عن طريق قص ولصق حرفي 山 و女 معًا. وقد فُسِّر ظل هذه العملية خطأً على أنه خط، مما أدى إلى ظهور حرف 妛 (يمكن الاطلاع على صورة لهذا في كتاب Jōyō kanji jiten ).

توحيد متغيرات الكانجي

وفقًا للمواصفات الواردة في المعيار الرابع (1997)، فإن التوحيد (包摂، hōsetsu ؛ وهو مصطلح مختلف عن مصطلح " التوحيد " المستخدم في يونيكود ، مع أنه يكاد يكون المفهوم نفسه) هو عملية إعطاء نفس رمز النقطة للحرف بغض النظر عن أشكاله المختلفة. في المعيار الرابع، تُحدَّد الرسوميات المسموح بها؛ ويُحدَّد بوضوح مدى توحيد الرسوميات المختلفة في رمز نقطة واحد.

علاوة على ذلك، ووفقًا للمواصفات الواردة في المعيار، فإنّ الرمز (字体، jitai ؛ وتعني حرفيًا "جسم الحرف") هو مفهوم مجرد يتعلق بالتمثيل الرسومي للحرف الرسومي؛ أما شكل الحرف (字形، jikei ؛ وتعني حرفيًا "هيئة الحرف"؛ وهو أيضًا "رمز" بمعنى ما، ولكن يتم تمييزه على مستوى مختلف لأغراض التوحيد القياسي) فهو التمثيل كشكل رسومي يتخذه الرمز في الواقع (على سبيل المثال، بسبب كتابة الرمز بخط اليد، أو طباعته، أو عرضه على الشاشة، وما إلى ذلك). بالنسبة لرمز واحد، يوجد نطاق لا نهائي من أشكال الأحرف الممكنة المختلفة بشكل ملموس و/أو مرئي. ويُطلق على الاختلاف بين شكل حرف واحد اسم "اختلاف التصميم" (デザインの差، dezain no sa ) .

يتم تحديد مدى توحيد الرمز الرسومي مع نقطة رمز واحدة وفقًا لـ "الرمز الرسومي النموذجي" (例示字体، reiji jitai ) و "معايير التوحيد" (包摂規準، hōsetsu kijun ) التي يمكن تطبيقها على هذا الرمز الرسومي النموذجي؛ أي أن الرمز الرسومي النموذجي لنقطة رمز ينطبق على تلك النقطة الرمزية، وأي رموز رسومية يتم استبدال أجزائها التي تشكل الرمز الرسومي النموذجي وفقًا لمعايير التوحيد تنطبق أيضًا على تلك النقطة الرمزية.

على سبيل المثال، يتكون الرمز الرسومي في الخانة 33-46 () من الجذر 9 () وحرف الكانجي الذي انبثق منه لاحقًا السوكانا (). كذلك، في معيار التوحيد 101، تظهر ثلاثة أحرف كانجي: الأول يأخذ الشكل الأكثر شيوعًا في اللغة اليابانية ()؛ والثاني يحتوي على شكل أكثر تقليدية () حيث يشكل الخطان الأولان الجذر 12 (رقم الكانجي للعدد 8:)؛ والثالث مشابه للثاني، باستثناء أن الجذر 12 معكوس (). بالتالي، تنطبق جميع التباديل الثلاثة (،،) على نقطة الترميز في السطر 33، الخلية 46.

في المعيار الرابع، بما في ذلك أحد الأخطاء المطبعية للطبعة الأولى، يوجد 186 معيارًا للتوحيد.

عندما يتكون رمز نقطة الترميز من أكثر من جزء، يمكن تطبيق معايير التوحيد على كل جزء. بعد تطبيق معيار توحيد على جزء، لا يمكن تطبيق أي معايير توحيد أخرى عليه. كما لا يُسمح بتطبيق معيار توحيد إذا كان الرمز الناتج سيتطابق تمامًا مع رمز نقطة ترميز أخرى.

إنّ رمز الرسم التوضيحي ليس إلا مثالاً توضيحياً لنقطة الترميز تلك، وليس رمزاً "معتمداً" من قِبل المعيار. كما أن معايير التوحيد لا تُستخدم إلا مع رموز الكانجي الشائعة الاستخدام، ولغرض ربط العناصر بنقاط الترميز في هذا المعيار. ويطلب المعيار عدم إنشاء رموز كانجي غير شائعة الاستخدام استناداً إلى رموز الرسم التوضيحي التوضيحية ومعايير التوحيد.

لا يتم اختيار حروف الكانجي في مجموعة الكانجي بشكل متسق تمامًا وفقًا لمعايير التوحيد. على سبيل المثال، على الرغم من أن 41-7 يتوافق مع الشكل الذي تتقاطع فيه الخطتان الثالثة والرابعة () وكذلك الشكل الذي لا تتقاطع فيه () وفقًا لمعيار التوحيد 72، فإن 20-73 يتوافق فقط مع الشكل الذي لا تتقاطع فيه ()، و80-90 يتوافق فقط مع الشكل الذي تتقاطع فيه ().

تم اعتماد مصطلحات "التوحيد" و"معايير التوحيد" و"الرمز النموذجي" في المعيار الرابع. من الإصدار الأول إلى الثالث، صُنفت حروف الكانجي والعلاقات بينها إلى ثلاثة أنواع: "مستقلة" (独立، دوكوريتسو ) ، و "متوافقة" (対応، تايو ) ، و "متكافئة" (同値، دوتشي ) . وقد وُضِّح أن الأحرف المُعترف بها على أنها متكافئة "تتحد في نقطة واحدة". وشمل "التكافؤ"، باستثناء حروف الكانجي ذات الشكل المتطابق تمامًا، حروف الكانجي التي تختلف في الأسلوب، وحروف الكانجي التي يكون فيها الاختلاف في شكل الحرف طفيفًا.

نصّ المعيار الأول على أن "هذا المعيار... لا يُحدد تفاصيل أشكال الأحرف" (القسم 3.1)؛ كما نصّ على أن "هدف هذا المعيار هو إرساء الفكرة العامة للأحرف ورموزها؛ أما تصميم أشكال الأحرف وما شابه ذلك فيقع خارج نطاقه". وفي المعيارين الثاني والثالث أيضًا، وردت ملاحظات تفيد بأن التصاميم المحددة لأشكال الأحرف تقع خارج نطاقهما (الملاحظة على البند 1). وينص المعيار الرابع أيضًا على أن "هذا المعيار يُنظم الأحرف الرسومية وأنماطها الثنائية، وأن استخدام الأحرف الفردية وتصميماتها المحددة وما إلى ذلك لا يندرج ضمن نطاق هذا المعيار" (JIS X 0208:1997، البند 1).

معايير التوحيد للتوافق

في المعيار الرابع، تم تعريف "معايير التوحيد للحفاظ على التوافق مع المعايير السابقة" (過去の規格との互換性を維持するための包摂規準, kako no kikaku to no gokansei wo iji suru tame no hōsetsu kijun ) . يقتصر تطبيقها على 29 نقطة رمز تختلف حروفها الرسومية بشكل كبير بين معايير JIS C 6226-1983 وما بعدها وJIS C 6226-1978. بالنسبة لنقاط الكود الـ 29 هذه، يتم عرض الحروف الرسومية من JIS C 6226-1983 وما بعدها كـ "A"، والصور الرمزية من JIS C 6226-1978 كـ "B". يمكن استخدام كل من الرموز "أ" و"ب" على كل منها. ومع ذلك، وللتأكد من التوافق مع المعيار، يجب تحديد ما إذا كان قد تم استخدام الشكل "أ" أو "ب" لكل نقطة رمزية بشكل صريح.

ترميزات الأحرف

أنظمة التشفير المنصوص عليها في معيار JIS X 0208

في JIS X 0208:1997، تحدد المادة 7 بالإضافة إلى الملحقين 1 و 2 ما مجموعه ثمانية مخططات ترميز.

في الأوصاف أدناه، تُمثل مناطق "CL" (التحكم الأيسر)، و"GL" (الرسم الأيسر)، و"CR" (التحكم الأيمن)، و"GR" (الرسم الأيمن) على التوالي، وفقًا لتدوين الأعمدة/الأسطر، من 0/0 إلى 1/15، ومن 2/1 إلى 7/14، ومن 8/0 إلى 9/15، ومن 10/1 إلى 15/14. لكل رمز، يُخصص للرمز 2/0 الحرف الرسومي "SPACE"، وللرمز 7/15 حرف التحكم "DELETE". تُخصص أحرف التحكم C0 (المُعرّفة في JIS X 0211 والمتوافقة مع ISO/IEC 6429 ) لمنطقة CL.

ترميز 7 بت للكانجي
ينص المعيار نفسه على ذلك. يتم تخصيص مجموعة البايت المزدوجة JIS X 0208 لمنطقة GL.
ترميز 8 بت للكانجي
منصوص عليه في المعيار نفسه. وهو مماثل لترميز 7 بت، ولكنه مُعرَّف بدلالة بايتات 8 بت. قد تكون منطقة CR غير مستخدمة، أو قد تُرمِّز أحرف التحكم C1 من معيار JIS X 0211. منطقة GR غير مستخدمة.
النسخة المرجعية الدولية + ترميز 7 بت للكانجي
ينص المعيار نفسه على ذلك. يشير تغيير حرف التحكم إلى أن معيار ISO/IEC 646 :1991 IRV (الإصدار المرجعي الدولي، المكافئ لـ US-ASCII ) يشير إلى منطقة GL. ويشير تغيير الحرف للخارج إلى أن مجموعة البايتات المزدوجة JIS X 0208 تشير إلى نفس المنطقة.
الأحرف اللاتينية + ترميز 7 بت للكانجي
منصوص عليه في المعيار نفسه. كما هو الحال مع IRV+7-bit، ولكن مع استبدال ISO/IEC 646:IRV بـ ISO/IEC 646:JP (المجموعة الرومانية من JIS X 0201 ).
النسخة المرجعية الدولية + ترميز 8 بت للكانجي
ينص المعيار نفسه على ذلك. يُخصص معيار ISO/IEC 646:IRV لمنطقة GL، ومعيار JIS X 0208 لمنطقة GR. وهذا في الواقع مجموعة فرعية من معيار EUC-JP ، باستثناء حروف الكاتاكانا ذات العرض النصفي من معيار JIS X 0201 وحروف الكانجي الإضافية من معيار JIS X 0212 .
الأحرف اللاتينية + ترميز 8 بت للكانجي
منصوص عليه في المعيار نفسه. كما هو الحال مع IRV+8-bit، ولكن مع استبدال ISO/IEC 646:IRV بـ ISO/IEC 646:JP.
مجموعة الأحرف المشفرة بتقنية Shift
منصوص عليه في الملحق 1: "التمثيل المشفر بالإزاحة" (シフト符号化表現، Shifuto Fugōka Hyōgen ) . التعريف الرسمي لـ Shift JIS .
مجموعة الأحرف المشفرة وفقًا لـ RFC 1468
ينص الملحق 2 على ما يلي: " التمثيل المشفر وفقًا لـ RFC 1468 " ( RFC 1468符号化表現، RFC 1468 Fugōka Hyōgen ) . يشبه هذا التمثيل معيار ISO-2022-JP (المحدد بشكل رسمي في RFC 1468 )، ولكنه مُعرَّف باستخدام بايتات ثمانية بت، بينما يُعرَّف معيار ISO-2022-JP باستخدام بايتات سبعة بت.

من بين الترميزات المنصوص عليها في المعيار الرابع، تم تسجيل مجموعة الأحرف المشفرة "Shift" فقط بواسطة IANA . [ 11 ] ومع ذلك، فإن بعض الترميزات الأخرى ترتبط ارتباطًا وثيقًا بالترميزات المسجلة لدى IANA والمحددة في أماكن أخرى (EUC-JP وISO-2022-JP).

تسلسلات الهروب لمعيار JIS X 0202 / ISO 2022

يمكن استخدام JIS X 0208 ضمن معيار ISO 2022 / JIS X 0202 (الذي يُعد ISO-2022-JP جزءًا منه). ترد أدناه تسلسلات الهروب لتعيين JIS X 0208 لكل مجموعة من مجموعات رموز ISO 2022 الأربع. هنا، يشير "ESC" إلى حرف التحكم " الهروب " (0x1B، أو 1/11).

تسلسلات الهروب ISO 2022 لاختيار JIS C 6226 و JIS X 0208
معيارG0G1G2جي 3
78ESC 2/4 4/0ESC 2/4 2/9 4/0ESC 2/4 2/10 4/0ESC 2/4 2/11 4/0
83ESC 2/4 4/2ESC 2/4 2/9 4/2ESC 2/4 2/10 4/2ESC 2/4 2/11 4/2
90 وما بعدهاESC 2/6 4/0 ESC 2/4 4/2ESC 2/6 4/0 ESC 2/4 2/9 4/2ESC 2/6 4/0 ESC 2/4 2/10 4/2ESC 2/6 4/0 ESC 2/4 2/11 4/2

يُحدد تسلسل الهروب الذي يبدأ بـ ESC 2/4 مجموعة أحرف متعددة البايتات. ويُحدد تسلسل الهروب الذي يبدأ بـ ESC 2/6 مراجعة لمجموعة الأحرف المختارة. يُعرَّف معيار JIS C 6226:1978 بواسطة مُعرِّف مجموعة الأحرف متعددة البايتات 94، البايت 4/0 (المُطابق لـ ASCII @). ويُعرَّف معيار JIS C 6226:1983 / JIS X 0208:1983 بواسطة مُعرِّف مجموعة الأحرف متعددة البايتات 94، البايت 4/2 B. كما يُعرَّف معيار JIS X 0208:1990 بواسطة مُعرِّف مجموعة الأحرف 94، البايت 4/2، ولكن يُمكن تمييزه بواسطة مُعرِّف المراجعة 4/0 @.

ترميزات مكررة لـ ASCII و JIS X 0201

عند استخدام مجموعة الكانجي الخاصة بهذا المعيار مع مجموعة الأحرف الرسومية ISO/IEC 646:1991 IRV ( ASCII ) أو مجموعة الأحرف الرسومية JIS X 0201 للأحرف اللاتينية ( JIS-Roman )، يصبح التعامل مع الأحرف المشتركة بين المجموعتين إشكاليًا. فما لم تُتخذ تدابير خاصة، لا تتطابق جميع الأحرف في المجموعتين تطابقًا تامًا، وقد يُعطى الحرف الواحد أكثر من رمز واحد، مما قد يؤدي إلى تكرار الترميز.

تنص المواصفة القياسية اليابانية JIS X 0208:1997، فيما يتعلق بحالات استخدام حرف مشترك بين مجموعتي الأحرف، على منع استخدام رمز نقطة الترميز في مجموعة الكانجي (وهو أحد رمزي نقطتي الترميز)، مما يمنع تكرار الترميز. ويُعتبر الحرفان اللذان يحملان الاسم نفسه حرفًا واحدًا.

على سبيل المثال، يُكتب اسم الحرف المقابل لنمط البت 4/1 في نظام ASCII، واسم الحرف المقابل للصف الثالث، الخلية 33، في مجموعة الكانجي، على النحو التالي: "الحرف اللاتيني الكبير A". في النسخة المرجعية الدولية + رمز 8 بت للكانجي، سواءً باستخدام نمط البت 4/1 أو نمط البت المقابل للصف الثالث، الخلية 33، في مجموعة الكانجي (10/3 12/1)، يُكتب الحرف " A " (أي "الحرف اللاتيني الكبير A"). يمنع المعيار استخدام نمط البت "10/3 12/1" في محاولةٍ لتجنب تكرار الترميز.

بالنظر إلى التطبيقات التي تُعامل أحرف نقاط الترميز في مجموعة الكانجي على أنها " أحرف كاملة العرض "، وتُعامل أحرف ASCII أو JIS-Roman على أنها أحرف مختلفة، فإن استخدام نقاط ترميز مجموعة الكانجي مسموح به فقط لأغراض التوافق مع الإصدارات السابقة. على سبيل المثال، ولأغراض التوافق مع الإصدارات السابقة، يُسمح باعتبار 10/3 12/1 في الإصدار المرجعي الدولي + رمز 8 بت للكانجي مُطابقًا لحرف "A" كامل العرض.

إذا استُخدمت مجموعة الكانجي مع ASCII أو JIS-Roman، فحتى مع الالتزام الصارم بالمعيار، لا يُضمن ترميز فريد للحرف. على سبيل المثال، في النسخة المرجعية الدولية + رمز 8 بت للكانجي، من الصحيح تمثيل الواصلة بنمط البت 2/13 للحرف "HYPHEN-MINUS"، وكذلك باستخدام الخلية 30 من الصف 1 في مجموعة الكانجي (نمط البت 10/1 11/14) للحرف "HYPHEN". إضافةً إلى ذلك، لا يُحدد المعيار أيًّا من النمطين يُستخدم لأي غرض، وبالتالي لا يُمنح الواصلة ترميزًا فريدًا. وتؤثر المشكلة نفسها على علامة الطرح ، وعلامات الاقتباس ، وما إلى ذلك.

علاوة على ذلك، حتى في حال استخدام مجموعة الكانجي كرمز منفصل، لا يوجد ما يضمن تطبيق ترميز فريد للأحرف. في كثير من الحالات، تتعايش المساحة التصويرية الكاملة في الخلية الأولى من الصف الأول مع المساحة النصفية (2/0). ولا يُوضح الفرق بينهما، كما أنه غير مُحدد في المعيار.

مقارنة بين أنظمة التشفير المستخدمة عملياً

التشفيراسم بديل7 بت؟ [ أ ]ISO 2022 ؟هل هذا أقل تفصيلاً؟ [ ب ]هل يقبل ASCII ؟0x00 7F دائمًا ASCII؟مجموعة فرعية من JIS X 0201 ذي 8 بت ؟يدعم معيار JIS X 0212 ؟التزامن الذاتي على مستوى البايت ؟التزامن الذاتي على مستوى البتات ؟
ISO-2022-JP" JIS " (JIS X 0202)نعمنعملا [ ج ]نعميمكن أن تكون التسلسلات غير ASCII [ C ]لا (الترميز ممكن) [ D ]ممكن [ هـ ]لالا
Shift_JIS"SJIS"لالانعمتقريبًا [ F ]يمكن أن تكون البايتات المعزولة غير ASCII [ G ]نعملالالا
EUC-JP"UJIS" (JIS المُعَدَّلَةَ بِالِوَنيكسِيدَةِ)لانعم [ H ]نعم [ H ]عادةً [ أنا ]نعملا (مشفر) [ J ]متوفر عادةً [ K ]لالا
تنسيقات يونيكود للمقارنة [ L ]
UTF-8 لالانعمنعمنعملا (مشفر)متاحنعمعادةً [ م ]
UTF-16"يونيكود" [ N ]لالانعملالالا (مشفر)متاحالكلمات التي تتجاوز 16 بت فقط.لا
GB 18030 لالا [ O ]نعمنعميمكن أن تكون البايتات المعزولة غير ASCIIلا (مشفر)متاحلالا
UTF-32 لالانعملالالا (مشفر)متاحعادةً، في الممارسة العملية [ P ]لا
  1. لا يتطلب الأمر نقلًا نظيفًا بـ 8 بت .
  2. أي أن التسلسل المستخدم لترميز حرف معين يكون دائمًا هو نفسه، بغض النظر عن الحرف (الأحرف) السابق. انظر الحالة (علوم الحاسوب) .
  3. 1 2 ISO-2022-JP هو ترميز ذو حالة : يتم ترميز جميع مجموعات الأحرف على النطاق 0x21 7E ويتم التبديل بينها باستخدام رموز ANSI. وبالتالي، على الرغم من أنه ASCII في حالته الأولية، إلا أنه يمكن ترميز سلاسل كاملة من الأحرف غير ASCII باستخدام بايتات ASCII.
  4. تتوفر حروف الكاتاكانا JIS X 0201 في JIS X 0202 و ISO 2022، ولكنها غير مدرجة في ملف تعريف ISO-2022-JP الأساسي، على الرغم من أنها امتداد شائع.
  5. يتوفر JIS X 0212 في JIS X 0202 و ISO 2022، وهو مدرج في ملفات تعريف ISO-2022-JP-1 و ISO-2022-JP-2، ولكنه غير موجود في ملف تعريف ISO-2022-JP الأساسي.
  6. الأحرف أحادية البايت 0x21 7E في Shift_JIS هي بشكل صحيح ISO-646-JP ، لكي تكون مجموعة فرعية من 8 بت JIS X 0201، ولكن غالبًا ما يتم فك تشفيرها (وليس بالضرورة عرضها) على أنها ASCII، والتي تختلف فقط في مكانين.
  7. قد تظهر بعض (وليس كل) بايتات ASCII كبايتات ثانية، ولكن ليس كبايتات أولى، من الأحرف ثنائية البايت في Shift_JIS. لذا، في تسلسل من بايتين أو أكثر من بايتات ASCII، يكون البايت الثاني وما يليه بالضرورة حرف ASCII (أو ISO-646-JP).
  8. يعتمد تنسيق Packed-format EUC على آليات ISO 2022، مع تحديد مسبق لمجموعات الأحرف. يتم تجنب عمليات الهروب من مجموعات الأحرف وعمليات الإزاحة المُقفلة، بينما يمكن تنفيذ استخدام عمليات الإزاحة الفردية بطريقة غير مُعتمدة على الحالة. ومع ذلك، يتم الالتزام بقيود ISO 2022.
  9. تعتبرالأحرف أحادية البايت 0x21 – 7E في EUC-JP بشكل عام ASCII، ولكن يتم التعامل معها أحيانًا على أنها ISO-646-JP .
  10. على عكس Shift_JIS، لن يتعامل EUC-JP مع إدخال JIS X 0201 العادي ذي 8 بت بدون تحويل مسبق، وذلك بسبب التمثيل المختلف لـ JIS X 0201 katakana (مع عمليات إزاحة مفردة).
  11. لا يتم تطبيق معيار JIS X 0212 في EUC-JP دائمًا.
  12. إلى جانب خصائص الترميزات نفسها، تتمتع تنسيقات يونيكود بمزايا إضافية نابعة من مجموعة الأحرف الأساسية: فهي لا تقتصر على الأحرف المشفرة وفقًا لمعيار JIS، بل يمكنها تمثيل مجموعة الأحرف الموحدة (UCS) بأكملها (بما في ذلك جميع الأحرف المشفرة وفقًا لمعيار JIS)، وبالتالي فهي مناسبة للاستخدام الدولي. كما أنها أقل تأثرًا بتداخل الامتدادات الخاصة، نظرًا لمجموعة الأحرف الأساسية الأوسع ومجالات الاستخدام الخاصة المخصصة لها.
  13. معظم عمليات إزاحة الإطار على مستوى البتات للنص المشفر بـ UTF-8 ستنتج UTF-8 غير صالح، ولكن من الممكن إنشاء تسلسلات من الأحرف التي تظل UTF-8 صالحة حتى عند إزاحتها بمقدار بت واحد أو أكثر.
  14. حصريًا من مايكروسوفت.
  15. في حين أن GB 18030 و GBK هما امتدادات لشكل EUC-CN من GB/T 2312، فإنهما لا يتبعان قيود EUC أو ISO 2022، على عكس EUC-JP (أو EUC-CN الأصلي).
  16. على الرغم من أن UTF-32 نظريًا يقوم بالمزامنة الذاتية على الكلمات المزدوجة 32 بت فقط، إلا أن استخدام قيمة 32 بت لتمثيل قيمة 21 بت يعني عمليًا أن UTF-32 يحتوي على سلسلة متصلة من 11 بت صفر على الأقل في الطرف الأعلى لكل حرف، والتي يمكن استخدامها عادةً للمحاذاة مع حدود الأحرف، اعتمادًا على نقطة (نقاط) الترميز المعنية.

تاريخ

إلى حين مرور خمس سنوات على وضع معيار صناعي ياباني أو إعادة تأكيده أو مراجعته، يخضع المعيار السابق لعملية إعادة تأكيد أو مراجعة أو سحب. ومنذ وضعه، خضع المعيار للمراجعة ثلاث مرات، والمعيار الرابع هو الساري حالياً.

المعيار الأول

المعيار الأول هو JIS C 6226-1978 "رمز مجموعة الأحرف الرسومية اليابانية لتبادل المعلومات" (情報交換用漢字符号系، Jōhō Kōkan'yō Kanji Fugōkei ) ، الذي وضعه وزير التجارة الدولية والصناعة الياباني في 1 يناير 1978. ويُعرف اختصارًا بـ 78JIS . وقد أعدّت مسودة هذا المعيار لجنة بحث ودراسة تابعة لـ JIPDEC ، بتكليف من وكالة العلوم والتكنولوجيا الصناعية . وكان رئيس اللجنة آنذاك موريغوتشي شيغيتشي .

تضمنت الشفرة 453 حرفًا غير كانجي (بما في ذلك الهيراغانا والكاتاكانا والأبجديات الرومانية واليونانية والسيريلية وعلامات الترقيم) و6349 حرفًا كانجي (2965 حرفًا كانجي من المستوى الأول و3384 حرفًا كانجي من المستوى الثاني) ليصبح المجموع 6802 حرفًا. [ 12 ] ولم تكن تتضمن آنذاك أحرف رسم المربعات . وقد وُضعت المعايير نفسها باستخدام خط إيشي مينشو من شركة شاكين المحدودة .

الصف الثاني

نقّح المعيار الثاني JIS C 6226-1983 "رمز مجموعة الأحرف الرسومية اليابانية لتبادل المعلومات" (情報交換用漢字符号系، Jōhō Kōkan'yō Kanji Fugōkei ) المعيار الأول في 1 سبتمبر 1983. ويُعرف أيضًا باسم 83JIS . وقد أعدّت لجنة JIPDEC المعنية برموز الكانجي، بتكليف من المعهد الوطني للعلوم والتكنولوجيا الصناعية المتقدمة (AIST)، مسودة هذا المعيار. وكان موتوكا تورو رئيسًا للجنة .

استندت مسودة المعيار الثاني إلى مراعاة عوامل مثل إصدار كانجي جويو ، وإنفاذ كانجي جينميو ، وتوحيد لغة تيليتكس اليابانية من قبل وزارة البريد والاتصالات ؛ كما تم إجراء التعديل التالي لمواكبة JIS C 6234-1983 (أشكال أحرف طابعة المصفوفة 24 بكسل؛ حاليًا JIS X 9052).

إضافة أحرف خاصة
أُضيفت 39 حرفًا إلى الأحرف الخاصة. ومن بين هذه الأحرف الـ 39، وبناءً على توصيات اللجنة المشتركة لتكنولوجيا المعلومات والاتصالات ، ومن معايير مثل JIS Z 8201-1981 (الرموز الرياضية) وJIS Z 8202-1982 (رموز الكمية والوحدات والرموز الكيميائية)، تم اختيار الأشياء التي لا يمكن تمثيلها بالتركيب.
شخصيات رسم الصناديق المضافة حديثًا
تمت إضافة 32 شخصية للرسم المربع .
تبديل نقاط رمز إيتايجي
تم تبديل رموز 22 زوجًا من حروف الكانجي المختلفة ، بحيث نُقل الحرف المختلف في المستوى 2 إلى المستوى 1 والعكس صحيح. [ 12 ] [ 13 ] على سبيل المثال، نُقلت الخلية 59 من الصف 36 في المستوى 1 () إلى الخلية 68 من الصف 52 في المستوى 2؛ ثم نُقلت النقطة التي كانت في الأصل في الخلية 68 من الصف 52 () إلى الخلية 59 من الصف 36.
إضافات إلى الكانجي من المستوى 2
أُضيفت رموز جديدة لثلاثة أحرف من المستوى الأول وحرف واحد من المستوى الثاني في الصف 84، حيث كانت هذه الرموز غير مُخصصة سابقًا، وذلك كأحرف كانجي من المستوى الثاني. وتمت إعادة تخصيص رموز الإيتايجي لكل رمز من هذه الرموز إلى موقعه الأصلي. [ 14 ] على سبيل المثال، نُقلت الخلية 1 من الصف 84 في المعيار الثاني () إلى موقعها الأصلي لاستيعاب شكل مختلف غير موجود في المعيار الأول، وهو الخلية 38 من الصف 22، كحرف كانجي من المستوى الأول ().
تعديل أشكال الأحرف
تم تعديل أشكال الأحرف لما يقرب من 300 حرف كانجي. [ 15 ]

من بين التغييرات التي طرأت على تلك الأشكال الـ 300 تقريبًا من حروف الكانجي، تم تغيير العديد من رموز المستوى الأول التي كانت على نمط قاموس كانغشي إلى أشكال مختلفة، وخاصة الأشكال المبسطة (مثل رياكوجي وشينجيتاي الموسع ). على سبيل المثال، هناك نقطتان من نقاط الترميز غالبًا ما تكونان موضع انتقاد بسبب تغييرهما بشكل كبير، وهما الصف 18، الخلية 10 (78JIS:، 83JIS:) والصف 38، الخلية 34 (78JIS:، 83JIS:).

طرأت تغييرات طفيفة عديدة على أشكال كانغشي؛ فعلى سبيل المثال، فقدت الخلية 84 () في الصف 25 جزءًا من أحد الخطوط. كذلك، في حين أن بعض رموز الكانجي من المستوى 1 لم تكن على نمط كانغشي، فقد تم تغيير بعضها إلى نمط كانغشي؛ فعلى سبيل المثال، اكتسبت الخلية 49 () في الصف 80 جزءًا من أحد الخطوط (أي نفس الجزء الذي فقدته الخلايا من 25 إلى 84).

بهدف توضيح الغاية الأصلية للمعيار الأول، أُدرجت هذه العناصر ضمن معايير التوحيد في المعيار الرابع. ويندرج اختلاف الشكل بين المثالين المذكورين أعلاه ("" و"") ضمن معايير التوحيد رقم 42 (المتعلقة بالمكون ""). [ t ]

تُعزى معظم التغييرات في أشكال الأحرف إلى الاختلافات بين كانجي المستوى الأول وكانجي المستوى الثاني. تحديدًا، تم تبسيط كانجي المستوى الأول بشكل أكبر من كانجي المستوى الثاني؛ فالتبسيطات التي طُبقت على كانجي المستوى الأول (مثل تحويل "" إلى "" و"" إلى "") لم تُطبق عمومًا على كانجي المستوى الثاني ("" بقي كما هو). وبالمثل، خضعت الأحرف المذكورة سابقًا من 25 إلى 84 () ومن 80 إلى 49 () لمعاملة مختلفة، نظرًا لأن الأول في المستوى الأول والثاني في المستوى الثاني. ومع ذلك، طرأت بعض التغييرات بغض النظر عن المستوى؛ فعلى سبيل المثال، تم تغيير الأحرف التي تحتوي على مكوني "الباب" () و"الشتاء" () دون أي اختلاف في المعاملة بين كانجي المستوى الأول وكانجي المستوى الثاني.

مع ذلك، بالنسبة لـ ٢٩ نقطة ترميز (مثل النقطتين ١٨-١٠ و٣٨-٣٤ المذكورتين أعلاه)، فإن الصيغ الموروثة من المعيار الرابع تتعارض مع الغرض الأصلي للمعيار الأول. ولذلك، توجد معايير توحيد خاصة للحفاظ على التوافق مع المعايير السابقة عند هذه النقاط.

عندما تم إدخال فئة "X" الجديدة للمعايير الصناعية اليابانية (للمجالات المتعلقة بالمعلومات)، تمت إعادة تسمية المعيار الثاني إلى JIS X 0208-1983 [ 12 ] في 1 مارس 1987.

الصف الثالث

نقّح المعيار الثالث JIS X 0208-1990 "رمز مجموعة الأحرف الرسومية اليابانية لتبادل المعلومات" (情報交換用漢字符号، Jōhō Kōkan'yō Kanji Fugō ) المعيار الثاني في 1 سبتمبر 1990. ويُعرف اختصارًا باسم 90JIS . وقد كلّفت الجمعية اليابانية للمعايير (JISA) المعهد الوطني للعلوم والتكنولوجيا الصناعية المتقدمة (AIST) بإعداد مسودة المعيار JIS X 0208، برئاسة تاجيما كازو .

تم تغيير 225 رمزًا من رموز الكانجي، وأُضيف رمزان إلى المستوى الثاني (84-05 "" و84-06 ""). وقد مثّل هذا تغييرًا في نظام الإيتايجي لرمزين كانا مُدرجين فيه سابقًا (49-59 "" و63-70 ""). بعض هذه التغييرات والإضافتان تتوافق مع رموز الكانجي الـ 118 الخاصة بنظام جينميو التي أُضيفت في مارس 1990. [ 12 ] وقد وُضع المعيار نفسه في وثيقة هيسي مينتشو .

الصف الرابع

المعيار الرابع JIS X 0208:1997 "مجموعات KANJI المشفرة بالبايت المزدوج 7 بت و8 بت لتبادل المعلومات" ( 7 ビット及び8ビットの2バイト情報交換用符号化漢字集合, Nana-Bitto Oyobi Hachi-Bitto no Ni-Baito Jōhō Kōkan'yō Fugōka Kanji Shūgō ) تم تنقيح المعيار الثالث في 20 يناير 1997. ويسمى أيضًا 97JIS للاختصار. بتكليف من AIST، قامت لجنة JSA للبحث ودراسة مجموعات الأحرف المشفرة بإنتاج المسودة. وكان رئيس اللجنة شيبانو كوجي .

تمثلت السياسات الأساسية لهذه المراجعة في عدم إجراء أي تغييرات على مجموعة الأحرف، وتوضيح الأحكام الغامضة، وتسهيل استخدام المعيار نسبيًا. لم تُجرَ أي إضافة أو حذف أو إعادة ترتيب لنقاط الترميز، كما بقيت أمثلة الرموز دون تغيير. مع ذلك، أُعيدت كتابة بنود المعيار بالكامل أو أُضيفت إليها معلومات جديدة. فبينما بلغ طول المعيار الثالث 65 صفحة دون الشروحات، بلغ طول المعيار الرابع 374 صفحة دون الشروحات.

النقاط الرئيسية للمراجعة هي:

تعريف أساليب التشفير
حتى المعيار الثالث، لم يُحدد سوى أسلوب التشفير القائم على امتداد رمز JIS X 0202. وهذا أمر غير معتاد في مجموعات الأحرف المشفرة. أما في المعيار الرابع، فقد حُددت أساليب تشفير لا تستخدم تسلسلات الهروب لغرض امتداد الرمز.
تعريف الحظر العام لاستخدام نقاط الترميز غير المخصصة وطرق استخدامها
أما المعيار الثالث، فقد وصف الأمور في شرحٍ لم يكن جزءًا من المعيار نفسه، وكأن هناك مواضع يُسمح فيها بتعيين رموز غير مُخصصة. وفي المعيار الرابع، تم توضيح أن استخدام الرموز غير المُخصصة ممنوعٌ عمومًا، كما تم تحديد شروط استخدامها.
الإزالة العامة للترميزات المكررة
تم تخصيص اسم لكل حرف، يُطابق أسماء الأحرف في المعايير الأخرى. كما تم تحديد طرق التشفير لاستخدامها مع الإصدار المرجعي الدولي ISO/IEC 646 أو JIS X 0201. عند استخدام JIS X 0208 مع أيٍّ منهما، يُسمح باستخدام نقطة ترميز واحدة فقط من بين نقطتي ترميز مُخصصتين لأحرف تحمل الاسم نفسه؛ وبالتالي، تم تجنب التشفيرات المُكررة بشكل عام.
التحقيق في مصادر الكانجي
تم تحديد الأحرف المدرجة في المعيار حتى الآن والتي لم تُعثر عليها في قاموس كانغشي ولا في قاموس داي كانوا جيتن . وبناءً على ذلك، تم التحقق من الغرض من إدراج هذه الأحرف الكانجي ومصادرها أثناء تجميع المعيار الأول.
تعريف معايير توحيد الكانجي
استنادًا إلى أمورٍ مثل المواد المستخدمة في صياغة المعيار الأول، بُذلت محاولة لاستعادة الغرض من المعيار الأول فيما يتعلق بنطاق الرموز التي يمثلها كل رمز. علاوة على ذلك، تم تحديد معايير توحيد رموز الكانجي بوضوح.
إدراج معايير الأمر الواقع
بحلول وقت صدور المعيار الرابع، أصبحت طرق التشفير Shift JIS و ISO-2022-JP معيارين فعليين للحوسبة الشخصية والبريد الإلكتروني على التوالي. وقد أُدرجت طرق التشفير هذه تحت مسمى "التمثيل المشفر بالإزاحة" و" التمثيل المشفر وفقًا لـ RFC 1468 " (كما هو موضح أعلاه).

الخلفاء

صُمم معيار JIS X 0213 ( الكانجي الموسع ) بهدف توفير مجموعة أحرف كافية لأغراض ترميز اللغة اليابانية الحديثة، وهو الهدف الذي كان معيار JIS X 0208 يهدف إليه منذ البداية؛ [ 16 ] وهو يُعرّف مجموعة أحرف تُوسّع مجموعة الكانجي الخاصة بمعيار JIS X 0208. يوصي واضعو معيار JIS X 0213 بالانتقال من معيار JIS X 0208 إلى معيار JIS X 0213، ومن بين مزايا ذلك توافق معيار JIS X 0213 مع قائمة رموز الكانجي Hyōgai ومع رموز الكانجي jinmeiyō الأحدث .

على عكس توقعات واضعي المواصفة، لم يكن اعتماد معيار JIS X 0213 سريعًا على الإطلاق منذ إصداره عام 2000. فقد كتبت لجنة صياغة معيار JIS X 0213:2004 (عام 2004): "لا يزال الوضع قائمًا حيث يقتصر استخدام غالبية أنظمة المعلومات على معيار JIS X 0208 فقط." (JIS X 0213:2000، الملحق 1:2004، القسم 2.9.7)

بالنسبة لنظام التشغيل مايكروسوفت ويندوز ، وهو النظام السائد (وبالتالي يوفر بيئة سطح المكتب الرئيسية ) في قطاع الحوسبة الشخصية، فقد تم تضمين مجموعة أدوات JIS X 0213 منذ إصدار ويندوز فيستا في نوفمبر 2006. كما أصبح نظام ماك أو إس إكس متوافقًا مع JIS X 0213 منذ الإصدار 10.1 (الذي صدر عام 2001). ويمكن للعديد من أنظمة التشغيل الشبيهة بنظام يونكس ، مثل لينكس ، دعم JIS X 0213 (اختياريًا) عند الرغبة. لذا، يُعتقد أنه مع مرور الوقت، لن يُشكل دعم JIS X 0213 على أجهزة الكمبيوتر الشخصية عائقًا أمام اعتماده على نطاق واسع.

من بين واضعي معيار JIS X 0213، يتوقع البعض رؤية مزيج من معياري JIS X 0208 وJIS X 0213 قبل اعتماد JIS X 0213 بشكل كامل (ساتو، 2004). مع ذلك، لا يزال معيار JIS X 0208 مستخدمًا حتى الآن، ويتوقع الكثيرون استمراره كمعيار. ثمة عقبات لا بد من تجاوزها لكي يحل JIS X 0213 محل JIS X 0208 في الاستخدام الشائع.

  • تعتمد مجموعات الأحرف المستخدمة حاليًا في الهواتف المحمولة اليابانية على معيار JIS X 0208. ولا توجد أي خطط معلنة رسميًا لنقلها إلى معيار JIS X 0213. ونظرًا لأن الهواتف المحمولة أصبحت جزءًا لا يتجزأ من التواصل النصي في اليابان (انظر ثقافة الهواتف المحمولة اليابانية )، ووسيلة شائعة الاستخدام لإرسال البريد الإلكتروني والوصول إلى شبكة الإنترنت العالمية ، فإن قلة استخدامها في أماكن أخرى يُعيق انتشارها.
  • لا يتوافق معيار JIS X 0213 تمامًا مع معيار JIS X 0208 من حيث معايير التوحيد (انظر أدناه ). بالنسبة للأرشيفات واسعة النطاق (مثل قواعد البيانات الببليوغرافية و Aozora Bunko ) التي تستخدم معيار JIS X 0208 وتلتزم بمعايير توحيده بدقة، يُعتقد أن تحويل جميع البيانات إلى معيار JIS X 0213 مع الحفاظ على نفس مستوى سلامة النصوص سيكون مهمة بالغة الصعوبة.
  • عمليًا، تُعرّف العديد من الأنظمة نقاط ترميز غير مُخصصة وتستخدمها في معيار JIS X 0208. على سبيل المثال، يُخصص نظام ويندوز أحرفًا موسعة من IBM وNEC ومناطق أحرف مُعرّفة من قِبل المستخدم (انظر Windows-932 )، وتُخصص الهواتف المحمولة رموزًا تعبيرية (إيموجي ) في بعض هذه المواضع. تتعارض نقاط الترميز الخاصة بهذه الرموز مع نقاط الترميز التي يستخدمها معيار JIS X 0213، مما يُصعّب عملية نقل هذه الأنظمة من JIS X 0208 إلى JIS X 0213. توجد أيضًا خطط للانتقال إلى UCS / Unicode واستخدام مجموعة رموز JIS X 0213 منه، ولكن إلى أن يتأكد مسؤول النظام من استقرار تطبيقات أزواج الأحرف البديلة وتراكيب الأحرف في UCS/Unicode، فمن المرجح أن يتردد في استخدام مجموعة رموز JIS X 0213 التي تتطلب هذه التطبيقات.
  • تتركز التحسينات التي يوفرها معيار JIS X 0213 في الغالب على الأحرف التي لا تُستخدم بنفس القدر الذي تُستخدم به الأحرف الموجودة بالفعل في معيار JIS X 0208. ونظرًا لوجود ما يقرب من ضعف عدد الرموز الرسومية التي يجب تنفيذها مع استخدام أقل لتلك الرموز الإضافية، فقد يكون العائد على الاستثمار منخفضًا في كثير من الحالات، لا سيما في ظل محدودية الموارد.

التطبيقات

لأن JIS X 0208 / JIS C 6226 هي في الأساس مجموعة أحرف وليست ترميز أحرف محدد بدقة ، فقد قامت العديد من الشركات بتنفيذ ترميزاتها الخاصة لمجموعة الأحرف.

تتضمن العديد من هذه المعايير تخصيصات أحرف خاصة بالموردين بدلاً من المناطق غير المخصصة في المعيار. وتشمل هذه المعايير Windows-932 وMacJapanese، بالإضافة إلى ترميز الأحرف PC98 الخاص بشركة NEC . في حين أن IBM-932 وIBM-942 تتضمنان أيضاً تخصيصات خاصة بالموردين، إلا أنهما تتضمنانها خارج المنطقة المستخدمة في JIS X 0208.

العلاقة بالمعايير الأخرى

ISO/IEC 646 IRV و ASCII

كما ذُكر أعلاه، فإن مجموعة الكانجي غير متوافقة مع مجموعة الأحرف الرسومية ISO/IEC 646:1991 IRV (ASCII). يمكن استخدام مجموعة الكانجي ومجموعة الأحرف الرسومية IRV معًا وفقًا لما هو محدد في JIS X 0208 (IRV + رمز 7 بت للكانجي وIRV + رمز 8 بت للكانجي). ويمكن استخدامهما معًا في EUC-JP أيضًا.

JIS X 0201

تفتقر مجموعة الكانجي إلى ثلاثة أحرف موجودة في مجموعة الأحرف الرسومية JIS X 0201 للأحرف اللاتينية: 2/2 (علامة اقتباس)، 2/7 (فاصلة علوية)، و2/13 (واصلة ناقصة). وتحتوي مجموعة الكانجي على جميع الأحرف الموجودة في مجموعة الأحرف الرسومية JIS X 0201 للكاتاكانا.

يمكن استخدام مجموعة الكانجي ومجموعة الأحرف الرسومية للأحرف اللاتينية معًا وفقًا لما هو محدد في معيار JIS X 0208 (الأحرف اللاتينية + رمز 7 بت للكانجي، والأحرف اللاتينية + رمز 8 بت للكانجي). كما يمكن استخدام مجموعة الكانجي ومجموعة الأحرف الرسومية للأحرف اللاتينية ومجموعة الأحرف الرسومية للكاتاكانا في معيار JIS X 0201 معًا وفقًا لما هو محدد في معيار JIS X 0208 (مجموعة الأحرف المشفرة بالإزاحة؛ أي Shift JIS ). ويمكن استخدام مجموعة الكانجي ومجموعة الأحرف الرسومية للكاتاكانا معًا في لغة EUC-JP .

JIS X 0212

يحدد معيار JIS X 0212 (الكانجي التكميلي) أحرفًا إضافية بنقاط رمزية لأغراض معالجة المعلومات التي تتطلب أحرفًا غير موجودة في معيار JIS X 0208. وبدلاً من تخصيص الأحرف ضمن مجموعة الكانجي الرئيسية JIS X 0208، فإنه يحدد مجموعة كانجي ثانية بحجم 94 × 94 تحتوي على أحرف تكميلية.

يمكن استخدام معيار JIS X 0212 مع معيار JIS X 0208 في EUC-JP . كما أن كلا المعيارين JIS X 0208 وJIS X 0212 هما معياران أساسيان لتوحيد حروف الكانجي في نظام UCS/Unicode ، مما يعني إمكانية تضمين حروف الكانجي من كلا المجموعتين في مستند واحد بتنسيق Unicode.

من بين رموز الأحرف التي عدّلتها النسخة الثانية من معيار JIS X 0208، تعكس 28 رمزًا في معيار JIS X 0212 أشكال الأحرف قبل التعديلات. [ 17 ] كما أعاد معيار JIS X 0212 تعيين " علامة الإغلاق " التي كان معيار JIS X 0208 يصنفها كرمز غير كانجي ( ، في الصف 1، الخلية 26) إلى رمز كانجي (، في الصف 16، الخلية 17). لا يشترك معيار JIS X 0212 مع معيار JIS X 0208 في أي أحرف أخرى غير هذه. لذا، فهو غير مناسب للاستخدام العام بمفرده.

مع ذلك، لم يُحدد في الإصدار الرابع من معيار JIS X 0208 أي ارتباط بمعيار JIS X 0212. ويُعتقد أن السبب في ذلك هو أن لجنة صياغة الإصدار الرابع من معيار JIS X 0208 كان لديها رأي نقدي حول أساليب اختيار وتحديد الأحرف في معيار JIS X 0212. [ 18 ] لم تُوثق معاني الأحرف وأسباب اختيارها بشكل كافٍ، مما صعّب تحديد ما إذا كانت أحرف الكانجي المطلوبة تتطابق مع تلك الموجودة في مجموعتها. [ 19 ] وينص نص المعيار الرابع، بالإضافة إلى إشارته إلى النقاط الإشكالية في اختيار الأحرف في معيار JIS X 0212، على أنه "يُعتقد أنه ليس من المستحيل فقط اختيار الأحرف، بل من المستحيل أيضًا استخدامها معًا؛ فالارتباط بمعيار JIS X 0212 غير مُحدد على الإطلاق." (القسم 3.3.1)

JIS X 0213

مخطط أويلر الذي يقارن بين مجموعات JIS X 0208 و JIS X 0212 و JIS X 0213 و Windows-31J ومجموعة Microsoft القياسية و Unicode .

يحدد معيار JIS X 0213 (الكانجي الممتد) مجموعة كانجي تتوسع على مجموعة الكانجي الخاصة بمعيار JIS X 0208. ووفقًا لهذا المعيار، فقد تم تصميمه بهدف توفير مجموعة أحرف كافية لأغراض ترميز اللغة اليابانية الحديثة التي كان معيار JIS X 0208 يهدف إلى تحقيقها منذ البداية. [ 16 ]

تتضمن مجموعة الكانجي في معيار JIS X 0213 جميع الأحرف التي يمكن تمثيلها في مجموعة الكانجي في معيار JIS X 0208، مع العديد من الإضافات. إجمالاً، يُعرّف معيار JIS X 0213 ما مجموعه 1183 حرفًا غير كانجي و10050 حرف كانجي (ليصبح المجموع 11233 حرفًا)، ضمن مستويين (، men ) بحجم 94×94 . يعتمد المستوى الأول (الأحرف غير الكانجي وأحرف الكانجي من المستوى 1 إلى 3) على معيار JIS X 0208، بينما صُمم المستوى الثاني (أحرف الكانجي من المستوى 4) ليتناسب مع الصفوف غير المخصصة في معيار JIS X 0212، مما يسمح باستخدامه في EUC-JP . [ 20 ] كما يُعرّف معيار JIS X 0213 أيضًا Shift_JISx0213 ، وهو نوع مُعدّل من Shift_JIS قادر على ترميز كامل معيار JIS X 0213.

في معظم الحالات، يُعتبر المستوى 1 من معيار JIS X 0213 مجموعةً شاملةً لمعيار JIS X 0208. مع ذلك، تُطبَّق معايير توحيد مختلفة على بعض رموز الأحرف في JIS X 0213 مقارنةً بـ JIS X 0208. ونتيجةً لذلك، تُمنح بعض أزواج أحرف الكانجي، التي كانت تُمثَّل برمز واحد في JIS X 0208، رموزًا منفصلةً في JIS X 0213 نظرًا لتوحيدها. على سبيل المثال، يُوحِّد الحرف الموجود في الصف 33، الخلية 46 من JIS X 0208 (""، الموصوف أعلاه ) بعض المتغيرات بسبب مُكوِّنه الأيمن. في معيار JIS X 0213، تم توحيد نموذجين (النموذج الذي يحتوي على المكون "丷") في المستوى 1، الصف 33، الخلية 46، بينما يقع النموذج الآخر (الذي يحتوي على المكون "") في المستوى 1، الصف 14، الخلية 41. لذا، لا يمكن تحديد ما إذا كان ينبغي ربط الخلية 46 من الصف 33 في معيار JIS X 0208 بالخلية 46 من الصف 33 في معيار JIS X 0213 أو بالخلية 41 من الصف 1 في المستوى 1. [ u ] هذا يحد من مدى إمكانية اعتبار معيار JIS X 0213 متوافقًا مع معيار JIS X 0208، كما أقرت بذلك لجنة صياغة معيار JIS X 0213. [ 21 ]

مع ذلك، في أغلب الأحيان، تتوافق الخلية رقم n في الصف m من معيار JIS X 0208 مع الخلية رقم n في المستوى 1 من معيار JIS X 0213؛ لذا، لا يحدث لبس يُذكر عمليًا. ويعود ذلك إلى أن معظم الخطوط باتت تستخدم الرموز الموضحة في معيار JIS X 0208، ومعظم المستخدمين غير مدركين لمعايير التوحيد.

ISO/IEC 10646 و Unicode

تُعدّ مجموعة الكانجي الخاصة بمعيار JIS X 0208 من بين المعايير المصدرية الأصلية لتوحيد لغة الهان في معيار ISO/IEC 10646 (UCS) ونظام يونيكود . ويقابل كل كانجي في JIS X 0208 رمزًا خاصًا به في المستوى الأساسي متعدد اللغات (BMP) لنظام UCS/يونيكود.

تتوافق الأحرف غير الكانجي في معيار JIS X 0208 مع نقاط ترميزها الخاصة في معيار BMP. مع ذلك، بالنسبة لبعض الأحرف الخاصة، تُطبّق بعض الأنظمة تطابقات مختلفة عن تلك الخاصة بنظام UCS/Unicode (المستندة إلى أسماء الأحرف الواردة في معيار JIS X 0208:1997).

الحواشي

شرحي

  1. علامات التشكيل اليونانية المفقودةوعلامة سيجما النهائية .
  2. 1 2 3 4 ( تم سحبه )
  3. JIS و Apple: U+2014.Unicode، [ b ] Microsoft و WHATWG: U+2015.
  4. مايكروسوفت و WHATWG: U+FF5E.يونيكود، [ ب ] JIS وأبل: U+301C.
  5. مايكروسوفت و WHATWG: U+2225.يونيكود، [ ب ] JIS وأبل: U+2016.
  6. مايكروسوفت: U+FF0D.يونيكود، [ ب ] JIS وأبل: U+2212.WHATWG: U+FF0D عند فك التشفير، واستثناءً عند التشفير.
  7. ١ ٢ ٣ ٤ تمت إضافته في JIS X 0213
  8. غير موجود في النسخة الأصلية من الامتداد، والتي تعود إلى ما قبل عصر هيسي . تم اختيار موضع الكود إما بواسطة NEC أو Microsoft. [ 5 ] غير موجود في Macintosh PostScript.
  9. ١ ٢ ٣ ٤ ٥ ٦ ٧ ٨ ٩ مُكررة بإضافات أُجريت على الصف ٢ في عام ١٩٨٣. غير مُشفّرة هنا (ولكن تُركت غير مُخصصة) في JIS X ٠٢١٣، [ ٥ ] ولكن تم تشفيرها بشكل مُكرر هنا بواسطة مايكروسوفت وWHATWG. أما بالنسبة لتشفير ماكنتوش بوست سكريبت، فقد تم إلحاق استخدام خاص U+F٨٧F بالنموذج الذي تم فك تشفيره باستخدام وظائف مكتبة macOS للسماح بالتحويل ذهابًا وإيابًا.
  10. كما هو موضح في جداول الرموز المسجلة في السجل الدولي لمجموعات الأحرف المشفرة المستخدمة مع تسلسلات الهروب، قبل المعيار الرابع (1997)، كان يُطلق على الرمزين ku () و ten () في اللغة الإنجليزية اسمي "section" و "position" على التوالي. أما بالنسبة لخلفية هذا التغيير في اللغة الإنجليزية، ففي معيار JIS X 0221-1995 (UCS) الذي ترجم معيار ISO/IEC 10646-1:1993، يمكن ترجمة كلمات "group" و "plane" و "row" و "cell" إلى gun () و men () و ku () و ten () على التوالي . ومع ذلك، فإن مفهومي الصف والخلية في معيار JIS X 0221يختلفان عن مفهوميهما في معيار UCS .
  11. تُكتب أسماء الأحرف بالحروف اللاتينية وتُستخدم دوليًا، لذا يمكن اعتبارها اتفاقية دولية، على غرار الأسماء العلمية للكائنات الحية. وبناءً على هذا التشبيه، فإن الأسماء الشائعة للأحرف اليابانية تُشبه استخدام الأسماء الشائعة للكائنات الحية.
  12. لإجراء بحث أو فرز كامل الميزات وفقًا لترتيب الكانا، يجب مراعاة قراءات الكلمات وعلامات التكرار وما إلى ذلك. يُحدد ترتيب سلاسل الأحرف اليابانية في معيار JIS X 4061 (ترتيب سلاسل الأحرف اليابانية).
  13. وفقًا لياسوكا (2001أ)، يبدو أن هناك بعض الإغفالات غير المقصودة. ويشير، على سبيل المثال، إلى أن حرفي " با" (؛ 58-57) من اسم إنبا و "شي" (؛ 61-89) من اسم شيسوي، كوماموتو ليسا جزءًا من المستوى 1.
  14. القائمة: عرض المزيد ؟؟؟؟
  15. يتم تضمين الكانجي jōyō 𠮟󠄀 فقط في شكله الرسمي المتغير 叱.
  16. القائمة:乘؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟ 😇 عرض المزيد 😇 عرض المزيد ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟
  17. القائمة: ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ �� ���� عرض المزيد ؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟؟ عرض المزيد عرض المزيد عرض المزيد
  18. بالنسبة للخليتين 30 و31 في الصف 19، تم خلط ترتيب قراءاتهما التمثيلية. ونتيجة لذلك، فبدلاً من الترتيب الصحيح الذي يجب أن يكون فيه kaeru (، "ضفدع") متبوعًا بـ kaori (، "رائحة") ، تم تبديل موقعيهما بحيثتسبق kaori كلمة kaeru .
  19. بالإضافة إلى ذلك، فإن المتغير المستخدم بشكل أساسي () موجود في الصف 23 الخلية 85 في المستوى 1، ويمكن العثور علىمتغير آخر () مجمعًا على أنه يحتوي على الجذر "الذهبي" في الصف 78 الخلية 63 في المستوى 2.
  20. يُترك تحديد الرموز المستخدمة ضمن معايير التوحيد لمصمم الخط. وبناءً على ذلك (وظروف المستخدم النهائي)، فمن الممكن ألا يتبع أيٌّ من هذين الرمزين، أو كلاهما، أو أحدهما، شكله على نمط كانغشي.
  21. هذا هو نفس عدم اليقين بشأن ما إذا كان ينبغي ربط "HYPHEN-MINUS" في ISO/IEC 646 بـ "HYPHEN" أو "MINUS SIGN" في JIS X 0208.

حواشي مرجعية

  1. "لماذا لم تصنع اليابان جهاز iPod؟" . جاتونكا . 5 مايو 2008.
  2. لم يكن معيار JIS X 0208 أحد المعايير المدرجة في قائمة أنظمة العرض المستهدفة المطبقة لعرض علامة JIS الجديدة التي أعلنتها وزارة الاقتصاد والتجارة والصناعة في 17 يناير 2007.
  3. 1 2 3 ستيل، شون (15 أبريل 1998). "CP932.TXT: جدول تحويل cp932 إلى Unicode" . مايكروسوفت.(الرموز بتنسيق Shift_JIS؛ SJIS 0x815C = 1-29 = JIS 0x213D؛ SJIS 0x817C = 1-61 = JIS 0x215D)
  4. 1 2 "خريطة (نسخة خارجية) من ترميز اللغة اليابانية لنظام التشغيل Mac OS إلى Unicode 2.1 والإصدارات الأحدث" . Apple.(الرموز بتنسيق Shift_JIS؛ SJIS 0x815C = 1-29 = JIS 0x213D؛ SJIS 0x817C = 1-61 = JIS 0x215D)
  5. 1 2 3 4 لوندي، كين (21 مارس 2019). "نبذة تاريخية عن وصلات أسماء العصور في اليابان" . مدونة CJK Type . شركة أدوبي .
  6. 1 2 3 لجنة المعايير الصناعية اليابانية . ISO-IR-233: مجموعة الأحرف الرسومية اليابانية لتبادل المعلومات، المستوى 1 (تحديث ISO-IR 228) (PDF) . ITSCJ/ IPSJ .
  7. يونيكود، إنك. (14 أكتوبر 2011). "JIS X 0208 (1990) إلى يونيكود" .
  8. ^ فان كيسترين، آن ، “فهرس jis0208” ، معيار الترميز ، WHATWG
  9. 1 2 جونغشيك شين (14 أكتوبر 2011). "KSX1001.TXT: جدول تحويل KS X 1001 إلى Unicode" . Unicode, Inc.
  10. وفّرت المواصفة القياسية اليابانية JIS C 6225-1979 (رموز التحكم الخاصة بمجموعة الأحرف الرسومية اليابانية لتبادل المعلومات) أحرف تحكم لبداية ونهاية النص. أُعيد تسمية JIS C 6225 إلى JIS X 0207 في عام 1987، وسُحبت من التداول في عام 1997.
  11. في مجموعات أحرف IANA ، يتم تعريف Shift JIS بالرجوع إلى JIS X 0208:1997 الملحق 1.
  12. 1 2 3 4 "15. تاريخ JIS X 0208" (ملف PDF) ، مجموعة الأحرف الرسومية اليابانية من IBM لرمز UNIX الموسع (EUC) ، IBM، صفحة 371، مؤرشفة (ملف PDF) من الأصل في 8 ديسمبر 2017 ، تم استرجاعها في 8 ديسمبر 2017 
  13. لوندي، كين. "الملحق Q § 78-vs-83-3" . معالجة المعلومات CJKV (مواد تكميلية) . أورايلي.لاحظ تضمين رموز kuten مع حذف الواصلة.
  14. لوندي، كين. "الملحق Q § 78-vs-83-2" . معالجة المعلومات CJKV (مواد تكميلية) . أورايلي.لاحظ تضمين رموز kuten مع حذف الواصلة.
  15. وفقًا لنومورا (1984)، فإن عدد أشكال الأحرف التي تم تغييرها، بما في ذلك الانتقالات بين نقاط الترميز، هو 294. وفقًا لشيبانو (1997أ) ونص المعيار الرابع، فإن عدد أشكال الأحرف التي تم تغييرها هو 300.
  16. 1 2 اللغة اليابانية الأصلية:「JIS X 0208 النجاة من المرض المزيد من المعلومات
  17. لوندي، كين. "الملحق Q § TJ2" . معالجة المعلومات CJKV (مواد تكميلية) . أورايلي.لاحظ تضمين رموز kuten مع حذف الواصلة.
  18. على سبيل المثال، ذكر شيبانو كوجي (1997 أ)، الذي شغل منصب رئيس لجنة صياغة المعيار الرابع، ما يلي حول طريقة الاختيار: "إنها تعتمد على فهم سطحي لاختيار مجموعة أحرف JIS X 0208؛ إنه فهم خاطئ" (الأصل الياباني:「JIS X) 0208の文字集合選定の表層的理解に基づくものであり、間違った理解である」 ) و"هناك مشكلة كبيرة في التحقيق في كل مجموعة الشخصيات التي يتجاوز 10000 حرف." (اليابانية الأصلية:「1万字を越える水準の文字集合の検討としては、大きな問題がある」 )
  19. ماروكاوا، كازوشي. "مجموعات الأحرف اليابانية - JIS X 0212:1990" . مؤرشف من الأصل في 22 مايو 2005.
  20. تشانغ، هيشيك (31 أكتوبر 2021). "ملف تعليمات لبرامج ترميز CJK" . سي بايثون . مؤسسة برمجيات بايثون.
  21. JIS X 0213:2000 القسم 5.3.2، JIS X 0213:2000 الملحق 1:2004 القسم 3.2.2

انظر أيضاً

  • مجموعات الأحرف المشفرة وفقًا لمعيار JIS
    • JIS X 0201 "مجموعات الأحرف المشفرة ذات 7 بت و8 بت لتبادل المعلومات"
    • JIS X 0202 "تكنولوجيا المعلومات - بنية رمز الأحرف وتقنيات التمديد" ( ISO/IEC 2022 )
    • JIS X 0208 "مجموعات كانجي ذات 7 بت و8 بت مشفرة بثنائي البايت لتبادل المعلومات"
    • JIS X 0211 "وظائف التحكم لمجموعات الأحرف المشفرة" ( ISO/IEC 6429 )
    • JIS X 0212 "رمز مجموعة الأحرف الرسومية اليابانية التكميلية لتبادل المعلومات"
    • JIS X 0213 "مجموعات كانجي موسعة مشفرة بـ 7 بت و 8 بت مزدوجة البايت لتبادل المعلومات"
    • JIS X 0221 "مجموعة الأحرف المشفرة متعددة الثمانيات العالمية (UCS)" ( ISO/IEC 10646 )
  • شينجيتاي الممتد
  • مساعدة: يابانية

مراجع

لأغراض الاستشهاد، يتم عرض هذه الأسماء اليابانية كما لو كانت بالترتيب الغربي حيثما تم تحويلها إلى اللاتينية، وتحتفظ بالترتيب الشرقي حيثما لم يتم ذلك.

  • نيشيمورا، هيروهيكو [西村 恕彦] ، 1978. كانجي JIS [漢字のJIS ] . مجلة التقييس [標準化ジャーナル] , 171: 3–8.
  • نومورا، ماساكي [野村 雅昭] ، 1984. مراجعة JIS C 6226: رموز كانجي لتبادل المعلومات [ JIS C 6226 情報交換用漢字符号系の改正] . مجلة التقييس [標準 化ジャーナル] ، 14 (3): 4–9.
  • أوجاتا، كاتسوهيرو [小形 克宏] ، 2006 أ. الأشياء التي لم يتم توحيدها في 97JIS من بين أمثلة الحروف الرسومية التي تم تغييرها في JIS C 6226-1983 (83JIS) ( JIS C 6226-1983 (83JIS)で例示字体を変更したうち、97JISで包摂とされなかったもの) ( تمت الزيارة في 29 يناير 2007).
  • أوجاتا، كاتسوهيرو [小形 克宏] ، 2006ب. الأشياء التي تدخل في نطاق التوحيد بين أمثلة الحروف الرسومية التي تم تغييرها في JIS C 6226-1983 (83JIS) ( JIS C 6226-1983 (83JIS)例示字体変更のうち、包摂の範囲内だったもの) (تمت الزيارة في 29 يناير 2007).
  • ساتو، تاكايوكي [佐藤 敬幸] ، 2004. فيما يتعلق بمراجعة JIS X 0213 (مجموعات كانجي موسعة مشفرة مزدوجة البايت 7 بت و8 بت لتبادل المعلومات) [ JIS X 0213 (7ビット及び8ビットの2バイト情報交換用符号化拡張漢字集合) の改正について] . مجلة التقييس [標準 化ジャーナル] ، 34 (4): 8-12.
  • شيبانو، كوجي [芝野 耕司] ، 1997 أ. فيما يتعلق بمراجعة JIS X 0208 (مجموعات كانجي المشفرة ذات 7 بت و8 بت مزدوجة البايت لتبادل المعلومات) [ JIS X0208 (7ビット及び8ビットの2バイト情報交換用符号化漢字集合) の改正について] . مجلة التقييس [標準 化ジャーナル] ، 27 (3): 8-12.
  • شيبانو، كوجي [芝野 耕司] ، 1997 ب. خطة لتوسيع كانجي JIS [ JIS漢字の拡張計画] . مجلة التقييس [標準 化ジャーナル] ، 27 (7): 5–11.
  • شيبانو، كوجي [芝野 耕司] ، 2000. إنشاء JIS X 0213 (مجموعات كانجي موسعة مشفرة مزدوجة البايت 7 بت و8 بت لتبادل المعلومات) [ JIS X 0213 (7ビット及び8ビットの2バイト情報交換用符号化拡張漢字集合) の制定] . مجلة التقييس [標準 化ジャーナル] ، 30 (3): 3–7.
  • شيبانو، كوجي [芝野 耕司] ، 2001. بخصوص JIS كانجي [漢字について] . التقييس ومراقبة الجودة [標準化と品質管理] ، 54 (8): 44-50.
  • شيبانو، كوجي [芝野 耕司] (محرر)، 2002. قاموس JIS كانجي، طبعة موسعة ومنقحة [増補改訂 JIS漢字字典] . طوكيو: جمعية المعايير اليابانية ( ردمك 4-542-20129-5).
  • شيبانو، كوجي [芝野 耕司] ، 2002. تطوير تقنيات كانجي ومعالجة اللغة اليابانية: توحيد رموز كانجي [漢字・日本語処理技術の発展: 漢字コドの標準化] . مجلة IPSJ [情報処理] ، 43 (12): 1362–1367
  • تاجيما، كازو [田嶋 一夫] ، 1979. المشاكل المتعلقة باستخدام قائمة كانجي JIS: تصميم ومعالجة كانجي في أنظمة معالجة كانجي [ JIS漢字表の利用上の問題:漢字処理システムにおける漢字のデザインと管理] . مجلة جمعية معالجة المعلومات اليابانية [情報管理] ، 21 (10): 753-761.
  • أوشيدا، توميو [内田 富雄] ، 1990. إنشاء JIS X 0212 (رموز كانجي لتبادل المعلومات – كانجي التكميلي) [ JIS X 0212 (情報交換用漢字符号―補助漢字)の制定] . مجلة التقييس [標準 化ジャーナル] ، 20 (11): 6-11.
  • ياسوكا، كويتشي [安岡 孝一] ، 2001 أ. حالة أحدث رموز الشخصيات في اليابان (الجزء السابق) [日本における最新文字コド事情 (前編) ] . الأنظمة والتحكم والمعلومات [システム/制御/情報] ، 45 (9): 528-535.
  • ياسوكا، كويتشي [安岡 孝一] ، 2001 ب. حالة أحدث رموز الشخصيات في اليابان (الجزء الأخير) [日本における最新文字コド事情 (後編) ] . الأنظمة والتحكم والمعلومات [システム/制御/情報] ، 45 (12): 687–694.
  • ياسوكا، كويتشي [安岡 孝一] ، 2006 "الاختلافات بين خطة JIS kanji (1976) وJIS C 6226-1978" [ JIS漢字案 (1976) とJIS C 6226-1978の異同] في السابع عشر ندوة بحثية بعنوان "استخدام الكمبيوتر في الدراسات الشرقية" [東洋学へのコンピュータ利用] 3-51.
  • ياسوكا، كويتشي [安岡 孝一] وموتوكو ياسوكا [安岡 素子] ، 2006. تاريخ رموز الشخصيات: أوروبا وأمريكا واليابان [文字符号の歴史: 欧米と日本編] . طوكيو: كيوريتسو شوبان ( ردمك 4-32012102-3).