توحيد الهان

الاختلافات لنفس نقطة رمز Unicode (U+8FD4) في الإصدارات الإقليمية من Source Han Sans

يُعدّ توحيد الأحرف الصينية (هان) جهدًا بذله واضعو نظام يونيكود ومجموعة الأحرف العالمية لربط مجموعات الأحرف المتعددة للغات الصينية واليابانية والكورية ( CJK ) في مجموعة واحدة موحدة من الأحرف . وتُعتبر الأحرف الصينية سمة مشتركة بين الكتابة الصينية ( هانزيواليابانية ( كانجيوالكورية ( هانجاوالفيتنامية ( تشو هان ).

تستخدم الخطوط الصينية واليابانية والكورية الحديثة عادةً أشكالًا إقليمية أو تاريخية مختلفة لحرف هان معين . وفي صياغة يونيكود، بُذلت محاولة لتوحيد هذه الأشكال المختلفة من خلال اعتبارها أشكالًا كتابية مختلفة - أي رموزًا مختلفة تمثل نفس "الرسم الكتابي" أو الوحدة الإملائية - ومن هنا جاء مصطلح "توحيد الهان"، ويُشار أحيانًا إلى مجموعة الأحرف الناتجة باسم Unihan . [ 1 ]  

ومع ذلك، فإن العديد من الأحرف لها متغيرات إقليمية مخصصة لنقاط ترميز مختلفة ، مثل التقليدية(U+500B) مقابل المبسطة(U+4E2A).

الأساس المنطقي والجدل

يُفصّل معيار يونيكود مبادئ توحيد اللغة الصينية. [ 2 ] [ 3 ] وتتولى مجموعة أبحاث الكتابة التصويرية (IRG)، المؤلفة من خبراء من الدول الناطقة بالصينية، وكوريا الشمالية والجنوبية، واليابان، وفيتنام، ودول أخرى، مسؤولية هذه العملية. [ 4 ]

كان أحد الأسباب هو الرغبة في الحد من حجم مجموعة أحرف يونيكود الكاملة، حيث قد يصل عدد أحرف اللغات الصينية واليابانية والكورية، المُمثلة برموز تصويرية منفصلة، ​​إلى 100,000 حرف أو يتجاوزها . صُممت النسخة الأولى من يونيكود لتناسب 16 بت، وتم تخصيص 20,940 حرفًا فقط (32%) من أصل 65,536 حرفًا ممكنًا لهذه الرموز التصويرية الموحدة للغات الصينية واليابانية والكورية . لاحقًا، تم توسيع يونيكود إلى 21 بت، مما أتاح تخصيص عدد أكبر بكثير من أحرف اللغات الصينية واليابانية والكورية (تم تخصيص 101,996 حرفًا، مع وجود مساحة لمزيد من الأحرف).

تحاول مقالة استضافتها شركة IBM توضيح جزء من دوافع توحيد سلالة هان: [ 5 ]

تكمن المشكلة في أن نظام يونيكود يُشفّر الأحرف بدلاً من "الرموز"، وهي التمثيلات المرئية للأحرف. توجد أربعة تقاليد أساسية لأشكال الأحرف في شرق آسيا: الصينية التقليدية، والصينية المبسطة، واليابانية، والكورية. مع أن الحرف الجذري الصيني قد يكون متطابقًا في لغات الصين واليابان وكوريا، إلا أن الرموز الشائعة الاستخدام لنفس الأحرف قد تختلف. على سبيل المثال، يستخدم الرمز الصيني التقليدي لكلمة "عشب" أربعة خطوط لجذر "العشب" [ ⺿ ]، بينما يستخدم الرمز الصيني المبسط والياباني والكوري [ ] ثلاثة خطوط. ولكن يوجد رمز واحد فقط في يونيكود لحرف العشب (U+8349) [] بغض النظر عن نظام الكتابة. مثال آخر هو الرمز التصويري لكلمة "واحد"، والذي يختلف في الصينية واليابانية والكورية. يعتقد الكثيرون أنه ينبغي تشفير النسخ الثلاث بشكل مختلف.

في الواقع، تُشفّر الرموز الثلاثة التي تُشير إلى "واحد" (،، أو) بشكل منفصل في نظام يونيكود، لأنها لا تُعتبر أشكالاً وطنية. يُعدّ الرمز الأول هو الشكل الشائع في البلدان الثلاثة، بينما يُستخدم الرمزان الثاني والثالث في الأدوات المالية لمنع التلاعب (وقد يُعتبران شكلين مختلفين).

أثار توحيد الهان جدلاً واسعاً، لا سيما بين عامة الشعب الياباني، الذين لطالما احتجوا، إلى جانب أدباء البلاد، على حذف الصيغ ذات الأهمية التاريخية والثقافية. [ 6 ] [ 7 ] (انظر كانجي §  الإصلاح الإملائي وقوائم الكانجي . واليوم، لا تزال قائمة الأحرف المعترف بها رسمياً للاستخدام في الأسماء تتوسع بوتيرة معتدلة.)

في عام 1993، نشرت جمعية تطوير الصناعات الإلكترونية اليابانية (JEIDA) كتيبًا بعنوان "未来の文字コド体系に私達は不安をもっています。 " (نحن قلقون بشأن نظام ترميز الأحرف المستقبلي JPNO). 20985671 )، يلخص الانتقادات الرئيسية ضد نهج توحيد هان الذي اعتمدته يونيكود. 

الرسوم البيانية مقابل الرموز الرسومية

للحرف اللاتيني الصغير " a " أشكالٌ مختلفة تمثل حالاتٍ لنفس الرسم المجرد. ورغم أن قارئ الأبجدية اللاتينية الأصلي يتعرف على هذين الشكلين باعتبارهما نفس الرسم، إلا أنهما قد يبدوان للآخرين غير مرتبطين.

الرسم الكتابي هو أصغر وحدة مجردة للمعنى في نظام الكتابة. لكل رسم كتابي العديد من التعبيرات الرسومية الممكنة، ولكن جميعها تُعرف على أنها الرسم الكتابي نفسه من قِبل من لديهم معرفة بالقراءة والكتابة بنظام كتابة معين. على الرغم من أن يونيكود عادةً ما يُخصص أحرفًا لنقاط الترميز للتعبير عن الرسومات الكتابية داخل نظام الكتابة، إلا أن معيار يونيكود ( القسم 3.4 D7 ) يُحذر مما يلي:

لا يتطابق الحرف المجرد بالضرورة مع ما يفكر فيه المستخدم على أنه "حرف" ولا ينبغي الخلط بينه وبين الرسم البياني .

مع ذلك، يشير هذا الاقتباس إلى أن بعض الوحدات الكتابية تتكون من عدة عناصر رسومية أو "أحرف". فعلى سبيل المثال، قد يفهم المستخدم الحرف U+0061 (حرف لاتيني صغير A) مع الحرف U+030A ( حلقة الربط العلوية ̊ ) (مكونًا التركيبة "å") على أنه وحدة كتابية واحدة، بينما هو في الواقع يتكون من عدة أحرف مجردة في يونيكود. إضافةً إلى ذلك، يخصص يونيكود أيضًا بعض نقاط الترميز لعدد قليل (لأسباب أخرى غير التوافق) من أحرف التنسيق، وأحرف المسافات البيضاء، وأحرف مجردة أخرى ليست وحدات كتابية، بل تُستخدم للتحكم في الفواصل بين الأسطر والكلمات والوحدات الكتابية ومجموعات الوحدات الكتابية. مع توحيد رموز الكتابة الصينية (هان)، يختلف معيار يونيكود عن الممارسات السابقة في تخصيص الأحرف المجردة ليس كوحدات كتابية، بل وفقًا للمعنى الأساسي للوحدة الكتابية: ما يسميه اللغويون أحيانًا بالوحدات الدلالية . لذا، لا يُفسَّر هذا الاختلاف ببساطة بالتمييز الشائع بين الحرف المجرد والرمز، بل هو متجذر في الفرق بين الحرف المجرد المُصنَّف كوحدة كتابية والحرف المجرد المُصنَّف كرمز. على النقيض من ذلك، لننظر إلى توحيد ASCII لعلامات الترقيم والتشكيل ، حيث تُوحَّد الوحدات الكتابية ذات المعاني المختلفة (مثل الفاصلة العليا وعلامة الاقتباس المفردة) لأن رموزها متطابقة. أما في Unihan، فلا تُوحَّد الأحرف بمظهرها، بل بتعريفها أو معناها.

إن تمثيل وحدة كتابية بأشكال رسومية متعددة يعني أن لهذه الوحدة تنوعات رسومية، تُحدد عادةً باختيار خط معين أو باستخدام ميزات استبدال الرسوم حيث تُدمج عدة رسوم في خط واحد. يعتبر يونيكود هذه التنوعات الرسومية سمةً من سمات بروتوكولات النصوص المنسقة، ولا يتعامل معها بشكل صحيح ضمن أهداف النص العادي في يونيكود. مع ذلك، عندما يُشكل التغيير من رسم إلى آخر تغييرًا من وحدة كتابية إلى أخرى - حيث لا يمكن لرسم ما، على سبيل المثال، أن يُشير إلى نفس الوحدة الكتابية المفهومة كحرف "a" الصغير - يفصل يونيكود هذه التغييرات إلى نقاط ترميز منفصلة. بالنسبة إلى لغة الهان، يُطبق الأمر نفسه كلما تغير المعنى المجرد، ولكن بدلًا من الحديث عن المعنى المجرد لوحدة كتابية (حرف "a")، يُخصص توحيد رموز الهان نقطة ترميز جديدة لكل معنى مختلف - حتى لو كان هذا المعنى مُعبرًا عنه بوحدات كتابية مختلفة في لغات مختلفة. على الرغم من أن حرفًا مثل "ö" قد يحمل معنى مختلفًا في الإنجليزية (كما في كلمة "coördinated") عنه في الألمانية (كما في كلمة "schön")، إلا أنه يظل الحرف نفسه، ويمكن توحيده بسهولة بحيث تشترك الإنجليزية والألمانية في نظام كتابة لاتيني مجرد مشترك (إلى جانب اللاتينية نفسها). يشير هذا المثال أيضًا إلى سبب آخر لعدم تطابق "الحرف المجرد" والحرف كوحدة مجردة في اللغة المكتوبة بالضرورة تطابقًا تامًا. ففي الإنجليزية، قد يُنظر إلى علامة التشكيل ◌̈ والحرف "o" الذي تُعدّله على أنهما حرفان منفصلان، بينما في لغات مثل السويدية، قد يُنظر إلى الحرف "ö" على أنه حرف واحد. وبالمثل، في اللغة الإنجليزية، تُفهم النقطة الموجودة على حرف "i" على أنها جزء من الرسم "i"، بينما في لغات أخرى، مثل اللغة التركية، يمكن اعتبار النقطة رسمًا منفصلاً مضافًا إلى حرف "ı" بدون نقطة .

لمعالجة استخدام رموز كتابية مختلفة لنفس رمز Unihan، اعتمد يونيكود على آليات متعددة، لا سيما فيما يتعلق بعرض النصوص. تمثلت إحدى هذه الآليات في التعامل مع الأمر كمسألة خطية بحتة، بحيث يمكن استخدام خطوط مختلفة لعرض الصينية أو اليابانية أو الكورية. كما تسمح تنسيقات الخطوط، مثل OpenType، بربط الرموز البديلة وفقًا للغة، بحيث يمكن لنظام عرض النصوص الرجوع إلى إعدادات بيئة المستخدم لتحديد الرمز المناسب. تكمن مشكلة هذه الأساليب في أنها لا تفي بأهداف يونيكود المتمثلة في تحديد طريقة متسقة لترميز النصوص متعددة اللغات. [ 8 ]

بدلاً من معالجة المسألة كمشكلة نصية منسقة تتعلق ببدائل الأحرف، أضافت يونيكود مفهوم مُحدِّدات التباين ، الذي طُرح لأول مرة في الإصدار 3.2، ثم جرى استكماله في الإصدار 4.0. [ 9 ] وبينما تُعامل مُحدِّدات التباين كأحرف مركبة، إلا أنها لا ترتبط بأي علامة تشكيل أو علامة. وبدلاً من ذلك، من خلال دمجها مع حرف أساسي، تُشير إلى أن تسلسل الحرفين يُحدد تباينًا (عادةً من حيث الرسم، ولكن أيضًا من حيث المعنى الضمني كما في حالة اسم موقع أو اسم علم آخر) للحرف الأساسي. وبالتالي، فإن هذا ليس اختيارًا لحرف بديل، بل هو اختيار لتباين في الرسم أو تباين في الحرف الأساسي المجرد. ومع ذلك، يُمكن بسهولة ربط تسلسل الحرفين هذا بحرف واحد منفصل في الخطوط الحديثة. وبما أن يونيكود قد خصصت 256 مُحدِّد تباين منفصل، فهي قادرة على تخصيص 256 تباينًا لأي حرف صيني. يمكن أن تكون هذه الاختلافات خاصة بلغة معينة أو أخرى، وتتيح ترميز النصوص العادية التي تتضمن هذه الاختلافات في الحروف.

أونيهان "شخصيات مجردة"

بما أن معيار Unihan يُشفّر "الأحرف المجردة" وليس "الرموز"، فقد اعتُبرت التشوهات الرسومية الناتجة عن Unicode عقبات تقنية مؤقتة، وفي أحسن الأحوال، تحسينات شكلية. مع ذلك، وخاصة في اليابان، ويعود ذلك جزئيًا إلى الطريقة التي دُمجت بها الأحرف الصينية في أنظمة الكتابة اليابانية تاريخيًا، فقد اعتُبر عدم القدرة على تحديد شكل معين عائقًا كبيرًا أمام استخدام Unicode في العمل الأكاديمي. على سبيل المثال، توحيد رمز "العشب" (الموضح أعلاه) يعني أنه لا يمكن تشفير نص تاريخي بحيث يحافظ على تهجئته الخاصة. بدلًا من ذلك، على سبيل المثال، سيُطلب من الباحث تحديد الرمز المطلوب في نوع خط معين لنقل النص كما هو مكتوب، مما يُفقد الغرض من مجموعة الأحرف الموحدة. استجاب Unicode لهذه الاحتياجات من خلال تخصيص مُحدِّدات للاختلافات بحيث يمكن للمؤلفين اختيار اختلافات الرسوم البيانية لرموز معينة (أو حتى أحرف أخرى). [ 9 ]

تُشكّل الاختلافات الطفيفة في التمثيل الرسومي مشكلةً أيضًا عندما تؤثر على سهولة القراءة أو تنتمي إلى تقاليد ثقافية خاطئة. فإلى جانب جعل بعض خطوط يونيكود غير قابلة للاستخدام في النصوص التي تتضمن لغات يونيكود متعددة، قد تُعرض الأسماء أو المصطلحات الأخرى الحساسة إملائيًا بشكل غير صحيح. (تميل الأسماء إلى أن تكون محافظة إملائيًا بشكل خاص - قارن هذا بتغيير تهجئة اسم الشخص ليتناسب مع إصلاح لغوي في الولايات المتحدة أو المملكة المتحدة). في حين أنه يمكن اعتبار هذا في المقام الأول مشكلة تمثيل أو عرض رسومي يمكن التغلب عليها باستخدام خطوط أكثر أناقة، فإن الاستخدام الواسع النطاق ليونيكود سيجعل من الصعب الحفاظ على هذه الفروق. كما أن مشكلة تمثيل حرف واحد لمفاهيم مختلفة دلاليًا موجودة أيضًا في الجزء اللاتيني من يونيكود. فحرف يونيكود للفاصلة العليا المنحنية هو نفسه حرف علامة الاقتباس المفردة اليمنى ('). من ناحية أخرى، لا يتم توحيد الحرف اللاتيني الكبير A مع الحرف اليوناني Α أو الحرف السيريلي А. وهذا، بالطبع، أمر مرغوب فيه لأسباب تتعلق بالتوافق، ويتعامل مع مجموعة أحرف أبجدية أصغر بكثير.

في حين أن جانب التوحيد في يونيكود مثير للجدل في بعض الأوساط للأسباب المذكورة أعلاه، فإن يونيكود نفسه يقوم الآن بتشفير عدد كبير من الأحرف التي نادراً ما تستخدم والتي لها طبيعة قديمة إلى حد ما.

ينبع جزء من الجدل من حقيقة أن قرار توحيد الأحرف الصينية (هان) اتُخذ من قِبل اتحاد يونيكود الأولي، الذي كان آنذاك اتحادًا لشركات ومنظمات من أمريكا الشمالية (معظمها في كاليفورنيا)، [ 10 ] ولكنه لم يضم أي ممثلين عن حكومات شرق آسيا. كان الهدف الأولي من التصميم هو إنشاء معيار 16 بت، [ 11 ] ولذلك كان توحيد الأحرف الصينية خطوة حاسمة لتجنب عشرات الآلاف من تكرار الأحرف. تم التخلي لاحقًا عن شرط الـ 16 بت، مما جعل حجم مجموعة الأحرف أقل أهمية اليوم.

امتد الجدل لاحقًا إلى المنظمة الدولية للتوحيد القياسي (ISO) الممثلة لها: فقد أيدت المجموعة البحثية المشتركة الصينية اليابانية الكورية (CJK-JRG) في بدايتها اقتراحًا (DIS 10646) لمجموعة أحرف غير موحدة، "والذي رُفض لصالح التوحيد مع مجموعة الأحرف الموحدة لاتحاد يونيكود بتصويت أعضاء ISO الأمريكيين والأوروبيين" (على الرغم من أن الموقف الياباني لم يكن واضحًا). [ 12 ] وكان اعتماد توحيد يونيكود هان خطوة ضرورية لدمج ISO 10646/يونيكود الذي شهد جدلًا واسعًا.

يرتكز جزء كبير من الجدل الدائر حول توحيد سلالة هان على التمييز بين الرموز الرسومية ، كما هو مُعرّف في يونيكود، ومفهوم الرسوميات المشابه له ولكنه مختلف. يُخصّص يونيكود أحرفًا مجردة (رسوميات)، على عكس الرموز الرسومية، التي تُمثّل تمثيلات بصرية مُحدّدة لحرفٍ ما في خطٍّ مُعيّن . قد يُمثّل حرفٌ واحدٌ بعدة رموز رسومية مُختلفة، على سبيل المثال "g" أو "a"، وكلاهما قد يحتوي على حلقة واحدة ( ɑ ، ɡ ) أو حلقتين ( a ، g ). ومع ذلك، بالنسبة لقارئ اللغات المُعتمدة على الكتابة اللاتينية، فإن كلا شكلي حرف "a" يُعتبران نفس الرسمية. أُضيفت الرسوميات الموجودة في معايير رموز الأحرف الوطنية إلى يونيكود، وفقًا لما تقتضيه قاعدة فصل المصادر في يونيكود، حتى عندما يُمكن تكوينها من أحرف مُتاحة بالفعل. تُعدّ معايير رموز الأحرف الوطنية الموجودة في لغات الصين واليابان وكوريا أكثر تعقيدًا بكثير، نظرًا للقيود التقنية التي تطورت في ظلها، ولذلك ربما كان المشاركون الرسميون من لغات الصين واليابان وكوريا في توحيد سلالة هان مُستعدّين للإصلاح.

على عكس النسخ الأوروبية، تتميز خطوط يونيكود الصينية واليابانية والكورية، نتيجةً لتوحيد الأحرف الصينية (هان)، بأنماط تداخل كبيرة وغير منتظمة، مما يستلزم استخدام خطوط خاصة بكل لغة. لسوء الحظ، تُصعّب هذه الخطوط الخاصة الوصول إلى أحد المتغيرات، كما في مثال كلمة "grass"، الذي يظهر عادةً في لغة أخرى. (بمعنى آخر، يصعب الوصول إلى كلمة "grass" باستخدام الجذر ذي الأربع ضربات الأكثر شيوعًا في الصينية التقليدية في بيئة يابانية، حيث تُظهر الخطوط اليابانية عادةً الجذر ذي الثلاث ضربات). يميل مؤيدو يونيكود إلى تفضيل لغات الترميز لتعريف سلاسل اللغة، لكن هذا لا يضمن استخدام متغير محدد في الحالة المذكورة، بل يضمن فقط استخدام الخط الخاص باللغة الذي يُرجّح أن يُظهر الحرف بهذا المتغير. (في هذه الحالة، تبرز الاختلافات الأسلوبية فقط، إذ من غير المرجح أن تكون مجموعة مختارة من الخطوط اليابانية والصينية متوافقة بصريًا).

يبدو أن المستخدمين الصينيين أقل اعتراضًا على توحيد أحرف الهان، ويعود ذلك في الغالب إلى أن يونيكود لم تحاول توحيد الأحرف الصينية المبسطة مع الأحرف الصينية التقليدية . (تُستخدم الأحرف الصينية المبسطة بين المتحدثين بالصينية في جمهورية الصين الشعبية وسنغافورة وماليزيا . أما الأحرف الصينية التقليدية فتُستخدم في هونغ كونغ وتايوان (مجموعة الأحرف الصينية Big5 ) ، وهي، مع بعض الاختلافات، أكثر ألفةً للمستخدمين الكوريين واليابانيين). يُنظر إلى يونيكود على أنها محايدة فيما يتعلق بهذه القضية ذات الطابع السياسي، وقد قامت بترميز رموز الأحرف الصينية المبسطة والتقليدية بشكل منفصل (على سبيل المثال، رمز كلمة "discard" هوU+4E1F لمجموعة الأحرف الصينية التقليدية Big5 #A5E1 وU+4E22 لمجموعة الأحرف الصينية المبسطة GB #2210). يُشار أيضًا إلى أنه ينبغي ترميز الأحرف التقليدية والمبسطة بشكل منفصل وفقًا لقواعد توحيد أحرف الهان في يونيكود، نظرًا لتمييزها في مجموعات الأحرف الصينية الموجودة مسبقًا. علاوة على ذلك، وكما هو الحال مع المتغيرات الأخرى، فإن العلاقة بين الأحرف التقليدية والمبسطة ليست علاقة تطابق تام.

البدائل

توجد عدة مجموعات أحرف بديلة لا تخضع لمبدأ توحيد هان، وبالتالي فهي خالية من قيوده:

كما يُنظر إلى مجموعات الأحرف هذه، التي تعتمد على المنطقة، على أنها غير متأثرة بتوحيد هان بسبب طبيعتها الخاصة بكل منطقة:

  • ISO/IEC 2022 (يعتمد على رموز التسلسل للتبديل بين مجموعات الأحرف الصينية واليابانية والكورية - وبالتالي بدون توحيد)
  • ملحقات Big5
  • GCCS وخليفتها HKSCS

ومع ذلك، لم يتم اعتماد أي من هذه المعايير البديلة على نطاق واسع مثل Unicode ، الذي أصبح الآن مجموعة الأحرف الأساسية للعديد من المعايير والبروتوكولات الجديدة، والمعتمد دوليًا، والمدمج في بنية أنظمة التشغيل ( Microsoft Windows و Apple macOS والعديد من الأنظمة الشبيهة بـ Unix )، ولغات البرمجة ( Perl و Python و C# و Java و Common Lisp و APL و C و C++ ) ، والمكتبات ( مكونات IBM الدولية لـ Unicode (ICU) إلى جانب محركات العرض Pango و Graphite و Scribe و Uniscribe و ATSUI )، وتنسيقات الخطوط ( TrueType و OpenType ) وما إلى ذلك.

في مارس 1989، اعتمدت مؤسسة "مركز الحوسبة التعليمية" التابعة للحكومة اليابانية نظامًا قائمًا على (B)TRON كنظام مفضل للتعليم المدرسي، بما في ذلك التعليم الإلزامي . [ 13 ] مع ذلك، في أبريل، أدرج تقرير بعنوان "تقرير التقديرات التجارية الوطنية لعام 1989 بشأن عوائق التجارة الخارجية" صادر عن مكتب الممثل التجاري للولايات المتحدة، هذا النظام تحديدًا كعائق تجاري في اليابان. وادعى التقرير أن اعتماد الحكومة اليابانية لنظام TRON يُفيد المصنّعين اليابانيين، وبالتالي يستبعد أنظمة التشغيل الأمريكية من السوق الجديدة الضخمة؛ وذكر التقرير على وجه التحديد أنظمة MS-DOS وOS/2 وUNIX كأمثلة. ويُزعم أن مكتب الممثل التجاري للولايات المتحدة كان تحت تأثير شركة مايكروسوفت، حيث عُرض على مسؤوله السابق، توم روبرتسون، منصب مربح من قبل الشركة. [ 14 ] على الرغم من إزالة نظام TRON نفسه لاحقًا من قائمة العقوبات بموجب المادة 301 من قانون التجارة لعام 1974 بعد احتجاجات المنظمة في مايو 1989، إلا أن النزاع التجاري دفع وزارة التجارة الدولية والصناعة إلى قبول طلب من ماسايوشي سون بإلغاء اختيار مركز الحوسبة التعليمية لنظام TRON لاستخدامه في الحواسيب التعليمية. [ 15 ] يُنظر إلى هذه الحادثة على أنها حدث رمزي لفقدان نظام BTRON زخمه وزواله في نهاية المطاف، مما أدى إلى انتشار نظام MS-DOS على نطاق واسع في اليابان، ثم اعتماد نظام Unicode لاحقًا مع نظام Windows الذي خلفه.

دمج جميع الأحرف المتكافئة

لم تُبذل جهودٌ حثيثة لتوحيد دلالات جميع الأحرف المرتبطة دلاليًا، مع أن الفكرة تفترض معاملة مستخدمي لغات شرق آسيا معاملةً واحدة، سواءً أكانوا يكتبون بالكورية، أو الصينية المبسطة، أو الصينية التقليدية، أو اليابانية (كيوجيتاي )، أو اليابانية (شينجيتاي )، أو الفيتنامية. فبدلًا من حصول بعض المتغيرات على رموز مميزة بينما تتشارك مجموعات أخرى من المتغيرات رموزًا واحدة، يمكن التعبير عن جميع المتغيرات بشكلٍ موثوق باستخدام وسوم البيانات الوصفية فقط (مثل تنسيق CSS في صفحات الويب). وسيكون العبء على جميع من يستخدمون إصدارات مختلفة من الأحرف،،،، سواءً أكان هذا الاختلاف ناتجًا عن التبسيط، أو التباين الدولي، أو التباين داخل الدولة الواحدة. مع ذلك، بالنسبة لبعض المنصات (مثل الهواتف الذكية)، قد يأتي الجهاز بخط واحد مُثبّت مسبقًا. ويتعين على نظام الخط تحديد الشكل الافتراضي لكل رمز، وقد تختلف هذه الأشكال اختلافًا كبيرًا، مما يدل على اختلاف الرسوم البيانية الأساسية.

وبالتالي، فإن الاعتماد على ترميز اللغة بشكل شامل كنهج يواجه مشكلتين رئيسيتين. أولاً، توجد سياقات لا يتوفر فيها ترميز اللغة (مثل عمليات دمج التعليمات البرمجية، والنصوص العادية). ثانياً، أي حل يتطلب أن يأتي كل نظام تشغيل مُثبّتاً مسبقاً بالعديد من الرموز لأحرف متطابقة دلالياً ولها العديد من المتغيرات. بالإضافة إلى مجموعات الأحرف القياسية في الصينية المبسطة، والصينية التقليدية، والكورية، والفيتنامية، واليابانية الكيوجيتاي، واليابانية الشينجيتاي، توجد أيضاً أشكال "قديمة" من الأحرف تهم المؤرخين واللغويين وعلماء اللغة.

لقد ربطت قاعدة بيانات Unihan التابعة لـ Unicode بالفعل بين العديد من الأحرف. وتُفهرس قاعدة بيانات Unicode الروابط بين الأحرف المتغيرة ذات نقاط الترميز المختلفة. مع ذلك، بالنسبة للأحرف التي تشترك في نقطة ترميز واحدة، فإن صورة الرمز المرجعي عادةً ما تكون منحازة نحو النسخة الصينية التقليدية. كما أن قرار تصنيف الأزواج كمتغيرات دلالية أو متغيرات z ليس دائمًا متسقًا أو واضحًا، على الرغم من التبريرات الواردة في الدليل. [ 16 ]

تُعدّ ما يُسمى بالمتغيرات الدلالية للحرفين(U+4E1F) و(U+4E22) أمثلةً تُقدّمها يونيكود على أنها تختلف اختلافًا جوهريًا في أشكالها المجردة، بينما تُصنّف يونيكود الحرفينوكمتغيرات z، لا تختلف إلا في نمط الخط. ومن المفارقات، أن يونيكود تعتبر الحرفينومتغيرين z متطابقين تقريبًا، بينما تُصنّفهما في الوقت نفسه كمتغيرات دلالية مختلفة اختلافًا كبيرًا. وهناك أيضًا حالاتٌ لبعض أزواج الأحرف التي تُعتبر في آنٍ واحد متغيرات دلالية ومتغيرات دلالية متخصصة ومتغيرات مُبسّطة:(U+500B) و(U+4E2A). وهناك حالاتٌ لا يكون فيها التكافؤ متبادلًا. على سبيل المثال، يعتبر إدخال قاعدة بيانات Unihan لـ亀(U+4E80) أن(U+9F9C) هو متغير z الخاص به، لكن إدخاللا يدرجكمتغير z، على الرغم من أنكان موجودًا بالفعل في قاعدة البيانات في الوقت الذي تم فيه كتابة إدخال.

أدت بعض الأخطاء الكتابية إلى تكرار أحرف متطابقة تمامًا، مثل(U+FA23) و � (U+27EAF). إذا كان الخط يحتوي على رموز مُشفّرة لكلا النقطتين بحيث يُستخدم خط واحد لكليهما، فيجب أن يظهرا متطابقين. تُدرج هذه الحالات كمتغيرات z على الرغم من عدم وجود أي اختلاف بينها. أُضيفت الأحرف المُكررة عمدًا لتسهيل التحويل ثنائي الاتجاه . ولأن التحويل ثنائي الاتجاه كان من أوائل مزايا يونيكود، فهذا يعني أنه إذا كرر معيار وطني مُستخدم حرفًا دون داعٍ، كان على يونيكود أن يفعل الشيء نفسه. يُطلق يونيكود على هذه التكرارات المُتعمدة اسم " متغيرات التوافق "، كما هو الحال مع 漢 (U+FA9A) الذي يُطلق على(U+6F22) اسم متغير التوافق الخاص به. طالما أن التطبيق يستخدم نفس الخط لكليهما، فيجب أن يظهرا متطابقين. أحيانًا، كما في حالة الرمز 車مع U+8ECA وU+F902، يُدرج رمز التوافق المُضاف النسخة الموجودة مسبقًا من الرمز 車كبديل توافقي وبديل z. يتجاوز حقل البديل التوافقي حقل البديل z، مما يفرض التوحيد في جميع الأشكال، بما في ذلك التكافؤ المتعارف عليه. على الرغم من الاسم، فإن البدائل التوافقية متكافئة متعارف عليها وتُوحد في أي نظام توحيد يونيكود، وليس فقط في ظل توحيد التوافق. هذا مشابه لكيفية تكافؤ U+212B Å (علامة أنغستروم) متعارف عليه مع U+00C5 Å (حرف لاتيني كبير A مع حلقة أعلاه) . تستبدل العديد من البرامج (مثل برنامج ميدياويكي الذي يستضيف ويكيبيديا) جميع الأحرف المتكافئة متعارف عليها والتي لا يُنصح باستخدامها (مثل رمز أنغستروم) بالأحرف المكافئة الموصى بها. على الرغم من الاسم، فإن "بدائل التوافق" في لغات CJK هي أحرف متكافئة متعارف عليها وليست أحرف توافق.

أُضيف الحرف 漢 (U+FA9A) إلى قاعدة البيانات لاحقًا من الحرف(U+6F22)، ويُعلم مدخله المستخدم بمعلومات التوافق. في المقابل، لا يُدرج الحرف 漢(U+6F22) هذا المكافئ في هذا المدخل. يشترط نظام يونيكود ألا تُغير أي من المدخلات، بمجرد قبولها، التوافق أو المكافئ، وذلك لضمان عدم تغيير قواعد التوحيد للأحرف الموجودة مسبقًا.

تُعتبر بعض أزواج الأحرف التقليدية والمبسطة متغيرات دلالية. ووفقًا لتعريفات يونيكود، من المنطقي أن تكون جميع التبسيطات (التي لا تؤدي إلى دمج أحرف مختلفة تمامًا لتشابهها الصوتي) شكلًا من أشكال المتغيرات الدلالية. يصنف يونيكود الحرفينوكمتغيرين تقليديين ومبسطين لبعضهما البعض، وكذلك كمتغيرات دلالية لبعضهما البعض. ومع ذلك، فبينما يصنف يونيكود الحرفين(U+5104) و亿(U+4EBF) كمتغيرين تقليديين ومبسطين لبعضهما البعض ، فإنه لا يعتبرهما متغيرين دلاليين لبعضهما البعض.

تزعم منظمة يونيكود أنه "من الناحية المثالية، لا ينبغي أن يكون هناك أي أزواج من المتغيرات z في معيار يونيكود". [ 16 ] وهذا يوحي بأن الهدف هو على الأقل توحيد جميع المتغيرات الثانوية، وتكرارات التوافق، والتكرارات العرضية، تاركًا التمييز للخطوط وعلامات اللغة. ويتعارض هذا مع الهدف المعلن ليونيكود، وهو إزالة هذا العبء، والسماح باستخدام أي عدد من أي نظام كتابة في العالم في نفس المستند بنظام ترميز واحد. يذكر الفصل الأول من الدليل أن "مع يونيكود، استبدلت صناعة تكنولوجيا المعلومات مجموعات الأحرف المتكاثرة باستقرار البيانات، وقابلية التشغيل البيني وتبادل البيانات عالميًا، وبرمجيات مبسطة، وتكاليف تطوير منخفضة. وبينما تنطلق من مجموعة أحرف ASCII، يتجاوز معيار يونيكود بكثير قدرة ASCII المحدودة على ترميز الأحرف الكبيرة والصغيرة من A إلى Z فقط. فهو يوفر القدرة على ترميز جميع الأحرف المستخدمة في اللغات المكتوبة في العالم - إذ يمكن ترميز أكثر من مليون حرف. ولا يتطلب الأمر أي تسلسل هروب أو رمز تحكم لتحديد أي حرف في أي لغة. ويتعامل ترميز أحرف يونيكود مع الأحرف الأبجدية والأحرف التصويرية والرموز على قدم المساواة، مما يعني إمكانية استخدامها بأي مزيج وبسهولة متساوية." [ 8 ]

يُتيح هذا خيار اعتماد رسم مرجعي موحد لجميع أشكال حرف z، وهو أمرٌ مثيرٌ للجدل، إذ قلّما يُدرك أحدٌ خارج اليابان أنومتكافئان. حتى داخل اليابان، تقع هذه الأشكال على طرفي نقيض من تبسيطٍ رئيسي يُسمى شينجيتاي. من شأن يونيكود أن يجعل تبسيط جمهورية الصين الشعبية للحرفين(U+4FA3) و(U+4FB6) فرقًا شاسعًا بالمقارنة. كما ستُزيل هذه الخطة الاختلافات الواضحة بصريًا لأحرفٍ مثل(U+76F4) و(U+96C7).

قد يتوقع المرء أن تكون جميع الأحرف المبسطة في الوقت نفسه متغيرات z أو متغيرات دلالية مع نظيراتها التقليدية، لكن الكثير منها ليس كذلك. يسهل تفسير الحالة الغريبة المتمثلة في أن المتغيرات الدلالية قد تكون في آنٍ واحد متغيرات دلالية ومتغيرات متخصصة، عندما يكون تعريف يونيكود أن المتغيرات الدلالية المتخصصة لها نفس المعنى فقط في سياقات معينة. تستخدم اللغات هذه المتغيرات بشكل مختلف. فزوج من الأحرف التي يمكن استبدالها ببعضها البعض تمامًا في اللغة اليابانية قد لا يكون بنفس المرونة في اللغة الصينية. لذا، فإن أي دمج شامل لنقاط الترميز الموصى بها سيضطر إلى الحفاظ على بعض المتغيرات التي تختلف اختلافًا طفيفًا في المظهر حتى لو كان المعنى متطابقًا تمامًا في جميع السياقات في لغة واحدة، لأنه في لغة أخرى قد لا يكون الحرفان بديلين متطابقين تمامًا.

أمثلة على الرموز الرسومية المعتمدة على اللغة

في كل صف من الجدول التالي، يتكرر الحرف نفسه في جميع الأعمدة الستة. كل عمود مُحدد كلغة مختلفة: الصينية ( المبسطة ونوعان من الصينية التقليديةاليابانية ، الكورية ، أو الفيتنامية . يجب على المتصفح اختيار رمز (من خط) مناسب لكل حرف، يتناسب مع اللغة المُحددة. (قد تعكس أنواع الخطوط أنماطًا طباعية مختلفة، كما هو الحال مع الأحرف ذات الزوائد والأحرف بدون زوائد). يعمل هذا فقط كخيار بديل لاختيار الرمز إذا كانت لديك خطوط CJK مُثبتة على نظامك، وكان الخط المُختار لعرض هذه المقالة لا يتضمن رموزًا لهذه الأحرف.

نقطة الترميزالصينية (المبسطة)الصينية (التقليدية)الصينية (التقليدية، هونغ كونغ)اليابانيةكوريالفيتناميينإنجليزي
zh-Hanszh-Hantzh-Hant-HKjakovi-Hani
U+ 4ECAالآن
U+4EE4السبب/الأمر
U+514Dمعفى/احتياطي
U+5165يدخل
U+5168الإجمالي
U+5173إغلاق (مبسط) / ضحك (تقليدي)
U+5177أداة
U+5203نعمنعمنعمنعمنعمنعمحافة حادة
U+5316تحويل/تغيير
U+5916الخارج
U+60C5إحساس
U+624Dموهبة
U+62B5الوصول/المقاومة
U+6B21ثانوي/متابعة
U+6D77بحر
U+753Bصورة
U+76F4مباشر/مستقيم
U+771Fحقيقي
U+793aيعرض
U+795Eإله
U+7A7Aفارغ/هواء
U+8005الشخص الذي يفعل
U+8349عشب
U+8525البصل
U+89D2الحافة/القرن
U+9053طريق/مسار/ممر
U+96C7توظيف
U+9AA8عظم

في القرن العشرين، وضعت دول شرق آسيا معايير ترميز خاصة بها. وضمن كل معيار، وُجدت متغيرات ذات نقاط ترميز مميزة، ومن هنا جاءت نقاط الترميز المميزة في يونيكود لمجموعات معينة من المتغيرات. على سبيل المثال، في اللغة الصينية المبسطة، يختلف متغيرا الحرفين(U+5167) و(U+5185) تمامًا كما يختلف المتغيران الكوري وغير الكوري للحرف(U+5168). لكل متغير من متغيرات الحرف الأول إما(U+5165) أو(U+4EBA). ولكل متغير من متغيرات الحرف الثاني إما(U+5165) أو(U+4EBA). لكل متغير من متغيرات الحرف الأول نقطة ترميز مميزة خاصة به. أما متغيرا الحرف الثاني، فيشتركان في نقطة الترميز نفسها.

يُبرر نظام يونيكود ذلك بأن هيئة المعايير الوطنية في جمهورية الصين الشعبية قد خصصت رموزًا منفصلة لنوعي الحرف الأول/، بينما لم تُخصص كوريا رموزًا منفصلة لأنواع الحرفالمختلفة . وهناك سبب لذلك لا علاقة له بكيفية تعامل الهيئات المحلية مع الأحرف نفسها. فقد شهدت الصين في القرن العشرين عملية تغيير (إن لم تكن تبسيطًا) لعدة أحرف. وخلال هذه المرحلة الانتقالية، برزت الحاجة إلى ترميز كلا النوعين في الوثيقة نفسها. لطالما استخدمت اللغة الكورية نوعالذي يحتوي على الجذر(U+5165) في الأعلى، لذا لم يكن هناك داعٍ لترميز كلا النوعين. وبالتالي، لم يكن هناك مبرر يُذكر لتمثيل كلا النوعين في الوثائق الكورية التي أُعدّت في القرن العشرين.

حصلت جميع المتغيرات التي طورتها أو اعتمدتها جمهورية الصين الشعبية تقريبًا على رموز مميزة، ويعود ذلك ببساطة إلى نجاح عملية التحول من اللغة الصينية المبسطة إلى عصر الحوسبة. مع ذلك، يبدو أن هذا الامتياز لا يُطبق بشكل متسق، إذ أن معظم التبسيطات التي أُجريت في اليابان والصين القارية، والتي تتضمن رموزًا في المعايير الوطنية، بما في ذلك الأحرف المبسطة بشكل مختلف في كل بلد، قد أُدرجت في نظام يونيكود كرموز مميزة.

تم دمج 62 حرفًا من أحرف شينجيتاي "المبسطة" ذات نقاط الترميز المختلفة في اليابان مع نظائرها التقليدية من أحرف كيوجيتاي، مثل حرف 海. قد يُسبب هذا مشاكل في استراتيجية ترميز اللغة. لا يوجد وسم موحد للنسختين التقليدية و"المبسطة" من اللغة اليابانية كما هو الحال في اللغة الصينية. لذا، قد يضطر أي كاتب ياباني يرغب في عرض شكل كيوجيتاي من حرفإلى وسم الحرف بأنه "صيني تقليدي" أو الاعتماد على أن خط اللغة اليابانية المستخدم لدى المُستلم يستخدم فقط رموز كيوجيتاي، ولكن قد يكون من الضروري استخدام وسوم "صيني تقليدي" و"صيني مبسط" لعرض الشكلين جنبًا إلى جنب في كتاب مدرسي ياباني. مع ذلك، سيمنع هذا استخدام نفس الخط لمستند كامل. يوجد نقطتا ترميز مختلفتان لحرففي يونيكود، ولكن فقط "لأسباب تتعلق بالتوافق". يجب أن يعرض أي خط متوافق مع يونيكود نقاط الترميز المكافئة لنسختي كيوجيتاي وشينجيتاي في يونيكود على أنها متطابقة. بشكل غير رسمي، قد يعرض الخطبشكل مختلف حيث يكون 海 (U+6D77) هو إصدار Shinjitai و 海 (U+FA45) هو إصدار Kyūjitai (وهو مطابق للإصدار التقليدي في الكتابة الصينية والكورية).

يُستخدم الجذر糸(U+7CF8) في أحرف مثل/، وله شكلان، الشكل الثاني هو ببساطة الشكل المائل. مكونات الجذر(U+7D05) و(U+7EA2) متطابقة دلاليًا، والاختلاف الوحيد بين الرموز هو استخدام الشكل المائل للمكونفي الشكل الأخير . مع ذلك، في الصين القارية، سعت هيئات التقييس إلى توحيد الشكل المائل عند استخدامه في أحرف مثل. ولأن هذا التغيير حدث مؤخرًا نسبيًا، فقد كانت هناك فترة انتقالية. حصل كل من(U+7D05) و(U+7EA2) على نقاط ترميز منفصلة في هيئات تقييس ترميز النصوص في جمهورية الصين الشعبية، بحيث يمكن للوثائق الصينية استخدام كلا الشكلين. كما حصل الشكلان على نقاط ترميز مميزة في يونيكود أيضًا.

تُثبت حالة الجذر(U+8278) مدى عشوائية الوضع الراهن. فعند استخدامه لتكوين أحرف مثل(U+8349)، كان الجذر يُوضع في الأعلى، لكنه كان له شكلان مختلفان. تستخدم الصينية والكورية التقليديتان شكلاً بأربعة خطوط. في أعلى حرف草، يجب أن يكون هناك ما يشبه علامتي زائد ( ⺿ ). أما الصينية المبسطة واليابانية الكيوجيتاي واليابانية الشينجيتاي فتستخدم شكلاً بثلاثة خطوط، مثل علامتي زائد تتشاركان خطوطهما الأفقية ( ، أي). لم تُشفّر هيئات ترميز النصوص في جمهورية الصين الشعبية هذين الشكلين بشكل مختلف. وحقيقة أن كل تغيير آخر تقريبًا أدخلته جمهورية الصين الشعبية، مهما كان طفيفًا، كان يستحق رمزًا خاصًا به، تشير إلى أن هذا الاستثناء ربما كان غير مقصود. لقد نسخ يونيكود المعايير الموجودة كما هي، محافظًا على هذه الاختلافات.

أقرّ اتحاد يونيكود بوجود أخطاء في حالات أخرى. فمجموعات يونيكود العديدة للأحرف الصينية واليابانية والكورية (CJK) تحتوي على تكرارات في المعايير الأصلية، وتكرارات ناتجة عن استيراد خاطئ للمعايير الأصلية، بالإضافة إلى عمليات دمج غير مقصودة تم تصحيحها لاحقًا، مما يُشكّل سابقةً لتفكك الأحرف.

بالنسبة للمتحدثين الأصليين، قد تكون الاختلافات غير مفهومة أو غير مقبولة في السياقات التعليمية. قد يفهم متحدثو الإنجليزية ملاحظة مكتوبة بخط اليد تقول "4P5 kg" على أنها "495 kg"، لكن كتابة الرقم تسعة معكوسًا (بحيث يبدو كحرف "P") قد يكون مزعجًا ويُعتبر خطأً في أي مدرسة. وبالمثل، بالنسبة لمستخدمي إحدى لغات الصين واليابان وكوريا الذين يقرؤون مستندًا يحتوي على رموز "أجنبية": قد تظهر اختلافات كلمةكصور معكوسة، وقد تكون كلمةناقصة أو تحتوي على خط زائد، وقد تكون كلمة 令(بدلاً من) غير قابلة للقراءة لغير اليابانيين. (في اليابان، كلا الاختلافين مقبولان).

أمثلة على بعض الرموز التصويرية غير الموحدة لسلالة هان

في بعض الحالات، وخاصةً عندما تكون التغييرات ملحوظة، يُشفّر يونيكود الأحرف المتغيرة، مما يُغني عن التبديل بين الخطوط أو langالخصائص. مع ذلك، تحصل بعض المتغيرات ذات الاختلافات الطفيفة على رموز مميزة، ولا يحصل كل متغير ذي تغييرات جوهرية على رمز مميز. على سبيل المثال، لنأخذ حرفًا مثل(U+5165)، حيث الطريقة الوحيدة لعرض متغيراته هي تغيير الخط (أو langالخاصية) كما هو موضح في الجدول السابق. من ناحية أخرى، بالنسبة لحرف 內(U+5167)، يحصل متغير(U+5185) على رمز مميز. بالنسبة لبعض الأحرف، مثل/(U+514C/U+5151)، يمكن استخدام أي من الطريقتين لعرض الأشكال المختلفة. في الجدول التالي، يقارن كل صف المتغيرات التي تم تخصيص رموز مميزة لها. للاختصار، تجدر الإشارة إلى أن متغيرات شينجيتاي ذات المكونات المختلفة عادةً (وهذا ليس مفاجئًا) ستأخذ رموزًا فريدة (مثل氣/気). لن تظهر هنا، وكذلك الأحرف الصينية المبسطة التي تأخذ مكونات جذرية مبسطة باستمرار (مثل/،/). [ 17 ] هذه القائمة ليست شاملة.

مبسطتقليدياليابانيةمتغير آخرإنجليزي
U+ 4E22U+4E1Fأن يخسر
U+4E24يو +5169U+4E21يو+34ب3اثنان، كلاهما
U+ 4E58U+ 4E58U+4E57يو+6909للركوب
U+ 4EA7يو +7522يو +7523تلد
U+ 4FA3U+4FB6رفيق
يو+5151U+ 514Cإلى النقد
يو+5185يو +5167داخل
U+ 522Bيو+5225للمغادرة
يو+7985U+ 79AAيو+7985التأمل (الزن)
U+ 7A0EU+ 7A05الضرائب
U+ 997Fيو+9913جائع
U+9AD8U+9AD8U+9AD9عالي
U+9F9FU+ 9F9CU+4E80سلحفاء
يو +7814U+ 784Fيو +7814للبحث
المصادر : قاموس MDBG الصيني-الإنجليزي

قاعدة بيانات التباين الإيديوغرافي (IVD)

لحل المشكلات الناجمة عن توحيد اللغة الصينية (هان)، تم إنشاء معيار تقني لليونيكود يُعرف باسم قاعدة بيانات التباينات الإيديوغرافية لليونيكود، وذلك لتحديد شكل معين في بيئة النصوص العادية. [ 18 ] من خلال تسجيل مجموعات الأشكال في قاعدة بيانات التباينات الإيديوغرافية (IVD)، يُمكن استخدام مُحدِّدات التباينات الإيديوغرافية لتكوين تسلسل التباينات الإيديوغرافية (IVS) لتحديد أو تقييد الشكل المناسب في معالجة النصوص في بيئة يونيكود.

نطاقات يونيكود

تظهر الأحرف التصويرية التي يخصصها نظام يونيكود في الكتل التالية:

يتضمن نظام يونيكود دعمًا للجذور والخطوط وعلامات الترقيم والرموز الصينية واليابانية والكورية والكورية في الكتل التالية:

تظهر رموز التوافق الإضافية (الاستخدام غير المستحب) في هذه الكتل:

تُضمَّن هذه الأحرف المتوافقة (باستثناء الأحرف الصينية واليابانية والكورية الاثني عشر الموحدة في مجموعة الأحرف الصينية واليابانية والكورية المتوافقة) لضمان التوافق مع أنظمة معالجة النصوص القديمة ومجموعات الأحرف القديمة الأخرى. وتشمل هذه الأحرف أشكالًا لتنسيق النصوص الرأسية وأحرفًا للنصوص المنسقة التي توصي يونيكود بمعالجتها بوسائل أخرى.

مجموعة الأفكار الدولية

تُعدّ مجموعة الرموز التصويرية الدولية الأساسية (IICore) مجموعة فرعية من 9810 رمزًا تصويريًا مُستمدة من جداول الرموز التصويرية الموحدة للغات الصينية واليابانية والكورية، وهي مُصممة للتنفيذ في الأجهزة ذات الذاكرة المحدودة، وقدرات الإدخال/الإخراج المحدودة، و/أو التطبيقات التي لا يُمكن فيها استخدام مجموعة الرموز التصويرية الكاملة لمعيار ISO 10646. يحتوي المعيار الحالي على 9810 رمزًا. [ 20 ]

انظر أيضاً

ملحوظات

  1. معظم هذه الأحرف قديمة وعفا عليها الزمن، ومع ذلك، وفقًا لهدف Unicode المتمثل في ترميز كل نظام كتابة مستخدم أو تم استخدامه على الإطلاق؛ فإن 2000 إلى 3000 حرف فقط ضرورية لاعتبارها قابلة للقراءة والكتابة.

مراجع

  1. "الملحق رقم 38 من معيار يونيكود® | قاعدة بيانات يونيكود هان (UNIHAN)" . اتحاد يونيكود . 2023-09-01.
  2. "الفصل 18: شرق آسيا، مبادئ توحيد هان" . معيار يونيكود . اتحاد يونيكود.
  3. ويستلر، كين (2010-10-25). "المذكرة الفنية رقم 26 من يونيكود: حول ترميز اللاتينية واليونانية والسيريلية والهان" .
  4. "تاريخ توحيد الهان" . معيار يونيكود . اتحاد يونيكود.
  5. "الحياة السرية لليونيكود" . آي بي إم . 16-12-2013. مؤرشف من الأصل في 16-12-2013 . تم الاطلاع عليه في 30-09-2023 .
  6. إعادة النظر في يونيكود، ستيفن ج. سيرل؛ مدير موقع TRON الإلكتروني
  7. ^ "IVD/IVSとは - 文字情報基盤整備事業" . mojikiban.ipa.go.jp .
  8. 1 2 "الفصل الأول: مقدمة" . معيار يونيكود . اتحاد يونيكود.
  9. 1 2 "قاعدة بيانات التباين الإيديوغرافي" . اتحاد يونيكود.
  10. "السنوات الأولى لليونيكود" . اتحاد اليونيكود.
  11. بيكر، جوزيف د. (29-08-1998). "يونيكود 88" (ملف PDF) .
  12. "يونيكود في اليابان: دليل إلى صراع تقني ونفسي" . مؤرشف من الأصل بتاريخ 27-06-2009.
  13. 小林紀興『松下電器の果し状』1章
  14. كريك، يان (15 أكتوبر 2003). "نظام التشغيل الأكثر شعبية في العالم" . LinuxInsider.com .
  15. 大下英治 『孫正義 起業の若き獅子』( ISBN 4-06-208718-9الصفحات 285-294
  16. 1 2 "UAX #38: قاعدة بيانات Unicode Han (Unihan)" . www.unicode.org .
  17. "البحث في قاعدة بيانات Unihan" . معيار Unicode . اتحاد Unicode.
  18. "UTS #37: قاعدة بيانات التباين الإيديوغرافي لليونيكود" . www.unicode.org .
  19. ^ "أورو" . ccjktype.fonts.adobe.com .
  20. "مكتب كبير مسؤولي المعلومات الحكوميين : منطقة التنزيل : أداة مقارنة الرموز الدولية الأساسية (IICORE)" . www.ogcio.gov.hk .