صفحة الترميز
في مجال الحوسبة ، تُعرف صفحة الترميز بأنها ترميز للأحرف ، وهي عبارة عن ربط محدد لمجموعة من الأحرف القابلة للطباعة وأحرف التحكم بأرقام فريدة. عادةً ما يُمثل كل رقم القيمة الثنائية في بايت واحد. (في بعض السياقات، تُستخدم هذه المصطلحات بدقة أكبر؛ انظر ترميز الأحرف § المصطلحات ).
مصطلح "صفحة الترميز" نشأ من أنظمة الحواسيب المركزية لشركة IBM القائمة على ترميز EBCDIC ، [ 1 ] لكن مايكروسوفت ، وساب ، [ 2 ] وأوراكل [ 3 ] من بين الشركات التي تستخدم هذا المصطلح. تُعرّف غالبية الشركات مجموعات الأحرف الخاصة بها باسمٍ ما. في حالة وجود عدد كبير من مجموعات الأحرف (كما هو الحال في IBM)، يُعدّ تحديد مجموعات الأحرف من خلال رقم طريقةً ملائمةً لتمييزها. في الأصل، كانت أرقام صفحات الترميز تُشير إلى أرقام الصفحات في دليل مجموعة الأحرف القياسي لشركة IBM، [ 4 ] [ 5 ] [ 6 ] وهو وضع لم يعد قائمًا منذ فترة طويلة. تُخصّص الشركات التي تستخدم نظام صفحة الترميز رقم صفحة ترميز خاص بها لترميز الأحرف، حتى لو كان معروفًا باسم آخر؛ على سبيل المثال، تم تخصيص أرقام الصفحات 1208 لترميز UTF-8 في IBM، و65001 في مايكروسوفت، و4110 في ساب.
تستخدم شركة هيوليت-باكارد مفهومًا مشابهًا في نظام التشغيل HP-UX وبروتوكول لغة أوامر الطابعة ( PCL ) الخاص بها (سواءً لطابعات HP أو غيرها). إلا أن المصطلحات تختلف: فما يُطلق عليه الآخرون اسم مجموعة الأحرف ، تُسميه HP مجموعة الرموز ، وما تُسميه IBM أو Microsoft صفحة الترميز ، تُسميه HP رمز مجموعة الرموز . وقد طورت HP سلسلة من مجموعات الرموز، [ 8 ] [ 9 ] لكل منها رمز مجموعة رموز خاص بها، لترميز مجموعات الأحرف الخاصة بها ومجموعات الأحرف الخاصة بالموردين الآخرين.
إن كثرة مجموعات الأحرف تدفع العديد من البائعين إلى التوصية باستخدام يونيكود .
نظام ترقيم صفحات الترميز
قدمت شركة IBM مفهوم تخصيص رقم صغير، ولكنه فريد عالميًا، مكون من 16 بت لكل ترميز أحرف قد يواجهه نظام حاسوبي أو مجموعة أنظمة حاسوبية. ويتجلى أصل نظام الترقيم هذا من IBM في حقيقة أن أصغر الأرقام (الأولى) تُخصص لأنواع مختلفة من ترميز EBCDIC الخاص بشركة IBM، بينما تشير الأرقام الأكبر قليلًا إلى أنواع مختلفة من ترميز ASCII الموسع الخاص بشركة IBM ، كما هو مستخدم في أجهزة الكمبيوتر الشخصية الخاصة بها.
مع إصدار نظام التشغيل PC DOS الإصدار 3.3 (ونظام MS-DOS 3.3 المطابق له تقريبًا )، قدمت شركة IBM نظام ترقيم صفحات الترميز لمستخدمي أجهزة الكمبيوتر الشخصية العاديين، حيث تم استخدام أرقام صفحات الترميز (وعبارة "صفحة الترميز") في الأوامر الجديدة للسماح بضبط ترميز الأحرف المستخدم من قبل جميع أجزاء نظام التشغيل بطريقة منهجية. [ 10 ]

بعد توقف تعاون شركتي IBM ومايكروسوفت في التسعينيات، احتفظت كل منهما بقائمة أرقام صفحات الترميز المخصصة بشكل مستقل، مما أدى إلى بعض التضارب في التخصيصات. كما أن لدى مورد خارجي واحد على الأقل ( أوراكل ) قائمة مختلفة خاصة به من التخصيصات الرقمية. [ 3 ] تُدرج تخصيصات IBM الحالية في مستودع CCSID الخاص بها ، بينما تُوثق تخصيصات مايكروسوفت في MSDN . [ 11 ] بالإضافة إلى ذلك، يمكن العثور على قائمة بأسماء صفحات الترميز المثبتة على أي جهاز يعمل بنظام ويندوز، واختصاراتها التقريبية الصادرة عن هيئة IANA ( هيئة أرقام الإنترنت المخصصة )، في سجل النظام الخاص بذلك الجهاز (تستخدم برامج مايكروسوفت، مثل إنترنت إكسبلورر، هذه المعلومات ).
معظم صفحات الترميز المعروفة، باستثناء تلك الخاصة بلغات CJK والفيتنامية ، تحتوي على جميع نقاط الترميز الخاصة بها في ثمانية بتات ولا تتضمن أي شيء أكثر من ربط كل نقطة ترميز بحرف واحد؛ علاوة على ذلك، لا يتم استخدام تقنيات مثل دمج الأحرف، والنصوص المعقدة، وما إلى ذلك.
يعتمد وضع النص في أجهزة الرسومات الحاسوبية القياسية ( المتوافقة مع VGA ) على استخدام صفحة ترميز 8 بت، مع إمكانية استخدام صفحتين في آنٍ واحد مع بعض التضحية بعمق الألوان، ويمكن تخزين ما يصل إلى 8 صفحات في محول العرض لتسهيل التبديل بينها. [ 12 ] كان هناك مجموعة مختارة من خطوط صفحات الترميز الخارجية التي يمكن تحميلها على هذه الأجهزة. ومع ذلك، أصبح من الشائع الآن أن توفر شركات أنظمة التشغيل أنظمة ترميز وعرض خاصة بها تعمل في وضع الرسومات، متجاوزةً بذلك هذا القيد المادي تمامًا. ومع ذلك، لا يزال نظام الإشارة إلى ترميزات الأحرف برقم صفحة الترميز ساريًا، كبديل فعال لمعرفات السلاسل النصية، مثل تلك التي حددتها IETF وIANA للاستخدام في بروتوكولات مختلفة كالبريد الإلكتروني وصفحات الويب.
العلاقة بـ ASCII
معظم صفحات الترميز المستخدمة حاليًا هي مجموعات فرعية من ASCII ، وهو ترميز ذو 7 بتات يمثل 128 رمز تحكم وحرفًا قابلًا للطباعة. في الماضي، كانت تطبيقات ASCII ذات 8 بتات تُعيّن البت العلوي إلى الصفر أو تستخدمه كبت تكافؤ في عمليات نقل البيانات عبر الشبكة. عندما أصبح البت العلوي متاحًا لتمثيل بيانات الأحرف، أمكن تمثيل ما مجموعه 256 حرفًا ورمز تحكم. استخدمت معظم الشركات المصنعة (بما في ذلك IBM) هذا النطاق الموسع لترميز الأحرف المستخدمة في لغات مختلفة وعناصر رسومية سمحت بمحاكاة الرسومات البدائية على أجهزة الإخراج النصية فقط. لم يكن هناك معيار رسمي لهذه "مجموعات أحرف ASCII الموسعة"، وكانت الشركات المصنعة تشير إلى هذه المتغيرات باسم صفحات الترميز، كما فعلت IBM دائمًا مع متغيرات ترميز EBCDIC.
العلاقة مع يونيكود
يُمثل يونيكود جهدًا يهدف إلى دمج جميع الأحرف من جميع اللغات البشرية المستخدمة حاليًا وتاريخيًا في ترقيم أحادي الحرف (أي صفحة ترميز واحدة كبيرة)، مما يُغني عن الحاجة إلى التمييز بين صفحات الترميز المختلفة عند التعامل مع النصوص المخزنة رقميًا. يسعى يونيكود إلى الحفاظ على التوافق مع العديد من صفحات الترميز القديمة، حيث ينسخ بعضها حرفيًا في عملية التصميم. كان أحد الأهداف التصميمية الرئيسية ليونيكود هو إتاحة التحويل المتبادل بين جميع صفحات الترميز القديمة الشائعة، على الرغم من أن هذا الهدف لم يتحقق دائمًا. وقد خصصت بعض الشركات، ولا سيما IBM ومايكروسوفت، أرقام صفحات الترميز لترميزات يونيكود، وهو أمر غير متوافق مع العصر. يسمح هذا الأسلوب باستخدام أرقام صفحات الترميز كبيانات وصفية لتحديد خوارزمية فك التشفير الصحيحة عند التعامل مع البيانات المخزنة بصيغة ثنائية.
صفحات ترميز IBM
صفحات الترميز المستندة إلى EBCDIC
تستخدم شركة IBM صفحات الترميز هذه في مجموعات أحرف EBCDIC الخاصة بها لأجهزة الكمبيوتر المركزية . [ 13 ]
- 1 – الولايات المتحدة الأمريكية، النسخة الأصلية
- 2 – الولايات المتحدة الأمريكية
- 3 - المحاسبة في الولايات المتحدة الأمريكية، الإصدار أ
- 4 – الولايات المتحدة الأمريكية
- 5 – الولايات المتحدة الأمريكية
- 6 - أمريكا اللاتينية
- 7 – ألمانيا فرنسا / النمسا
- 8 – ألمانيا فرنسا
- 9 – فرنسا، بلجيكا
- 10 – كندا (الإنجليزية)
- 11 – كندا (بالفرنسية)
- 12 - إيطاليا
- 13 - هولندا
- 14 – إسبانيا
- 15 – سويسرا (الفرنسية)
- 16 – سويسرا (الفرنسية / الألمانية)
- 17 – سويسرا (الألمانية)
- 18 – السويد / فنلندا
- 19 – السويد / فنلندا، ورقة عمل، الإصدار 2
- 20 – الدنمارك/النرويج
- 21 – البرازيل
- 22 – البرتغال
- 23 – المملكة المتحدة
- 24 – المملكة المتحدة
- 25 – اليابان (لاتينية)
- 26 – اليابان (لاتينية)
- 27 – اليونان (باللاتينية)
- 29 – أيسلندا
- 30 – تركيا
- 31 – جنوب أفريقيا
- 32 – تشيكوسلوفاكيا (التشيكية / السلوفاكية)
- 33 – تشيكوسلوفاكيا
- 34 – تشيكوسلوفاكيا
- 35 – رومانيا
- 36 – رومانيا
- 37 – الولايات المتحدة الأمريكية/كندا - CECP (نفس الشيء بالنسبة لليورو: 1140)
- 37-2 – صفحة ترميز APL 3279 الحقيقية، كما يستخدمها C/370. وهي قريبة جدًا من 1047، باستثناء علامة الإقحام وعلامة النفي المعكوسة. لا تعترف بها IBM رسميًا، على الرغم من أن SHARE قد أشارت إلى وجودها. [ 14 ]
- 38 – الولايات المتحدة الأمريكية ASCII
- 39 – المملكة المتحدة / إسرائيل
- 40 – المملكة المتحدة
- 251 – الصين
- 252 – بولندا
- 254 – المجر
- 256 – الرقم الدولي الأول (تم استبداله بالرقم 500)
- 257 – دولي T2
- 258 – دولي رقم 3
- 259 – الرموز، المجموعة 7
- 260 – الفرنسية الكندية - 116
- 264 - توسيع نطاق معالجة النصوص وطباعة القطار
- 273 – ألمانيا FR/النمسا - CECP (نفس الشيء مع اليورو: 1141)
- 274 – صفحة رموز بلجيكا القديمة
- 275 – البرازيل - CECP
- 276 – كندا (الفرنسية) - 94
- 277 – الدنمارك، النرويج - CECP (نفس الشيء مع اليورو: 1142)
- 278 – فنلندا، السويد - CECP (نفس الشيء مع اليورو: 1143)
- 279 – الفرنسية - 94 [ 14 ]
- 280 – إيطاليا - CECP (نفس الشيء مع اليورو: 1144)
- 281 – اليابان (لاتينية) - CECP
- 282 – البرتغال - CECP
- 283 – إسبانيا - 190 [ 14 ]
- 284 – إسبانيا/أمريكا اللاتينية - CECP (نفس الشيء مع اليورو: 1145)
- 285 – المملكة المتحدة - CECP (نفس الشيء مع اليورو: 1146)
- 286 – النمسا / ألمانيا (النسخة البديلة الفرنسية)
- 287 – الدنمارك / النرويج البديل
- 288 – فنلندا / السويد بديل
- 289 – البديل الإسباني
- 290 – اللغة اليابانية (كاتاكانا) الموسعة
- 293 – APL
- 297 – فرنسا (نفس الشيء مع اليورو: 1147) [ 14 ]
- 298 – اليابان (كاتاكانا)
- 300 – اليابان (كانجي) DBCS (لـ JIS X 0213)
- 310 – Graphic Escape APL/TN
- 320 – المجر
- 321 – يوغوسلافيا
- 322 – تركيا
- 330 – دولي رقم 4
- 340 – EBCDIC، OCR (نفس 893، تم استبداله بـ 892 و 893)
- 351 – الوضع الافتراضي لـ GDDM
- 352 – خيار الطباعة والنشر
- 353 – BCDIC-A
- 354 – BCDIC-B
- 355 – خيار PTTC/BCD القياسي
- 357 – خيار PTTC/BCD H
- 358 – خيار المراسلة PTTC/BCD
- 359 – خيار علبة أحادية PTTC/BCD
- 360 – خيار PTTC/BCD Duocase
- 361 – دار نشر EBCDIC الدولية
- 363 – الرموز، المجموعة 8
- 382 – دار نشر EBCDIC، النمسا، ألمانيا، نسخة بديلة فرنسية
- 383 – دار نشر EBCDIC بلجيكا
- 384 – دار نشر EBCDIC البرازيل
- 385 – دار نشر EBCDIC كندا (بالفرنسية)
- 386 – دار نشر EBCDIC، الدنمارك، النرويج
- 387 – دار نشر EBCDIC، فنلندا، السويد
- 388 – دار نشر EBCDIC فرنسا
- 389 – دار نشر EBCDIC إيطاليا
- 390 – دار نشر EBCDIC اليابان (اللاتينية)
- 391 – دار نشر EBCDIC البرتغال
- 392 – دار نشر EBCDIC، إسبانيا، الفلبين
- 393 – دار نشر EBCDIC لأمريكا اللاتينية (الناطقة بالإسبانية)
- 394 – دار نشر EBCDIC الصين (هونغ كونغ)، المملكة المتحدة، أيرلندا
- 395 – دار نشر EBCDIC أستراليا، نيوزيلندا، الولايات المتحدة الأمريكية، كندا (الإنجليزية)
- 396 – عروض خاصة من BookMaster
- 410 – السيريلية (المراجعات: 880، 1025، 1154)
- 420 – العربية
- 421 – المغرب/الفرنسية
- 423 – يوناني (تم استبداله في عام 875)
- 424 – العبرية (رمز النشرة)
- 425 – العربية / اللاتينية لنظام التشغيل OS/390 الإصدار المفتوح
- 435 – التليتكست المتماثل
- 500 – الرقم الدولي رقم 5 (ECECP؛ يحل محل 256) (نفس الشيء مع اليورو: 1148)
- 803 – مجموعة الأحرف العبرية أ (الرمز القديم)
- 829 – رموز الرياضيات المضيفة - النشر
- 830 – تنسيق الرياضيات
- 831 – البرتغال (بديل) (نفس 37)
- 833 – النسخة الكورية الموسعة (SBCS)
- 834 – الهانغول الكوري (KSC5601؛ DBCS مع UDCs)
- 835 – نظام DBCS الصيني التقليدي
- 836 – الصينية المبسطة الموسعة
- 837 – نظام DBCS الصيني المبسط
- 838 – اللغة التايلاندية ذات العلامات المنخفضة والأحرف المميزة (نفس الشيء بالنسبة لليورو: 1160)
- 839 – بنك التنمية التايلاندي
- 870 – اللاتينية 2 (نفس الشيء مع اليورو: 1153) (مراجعة: 1110)
- 871 – أيسلندا (نفس الشيء مع اليورو: 1149) [ 14 ]
- 875 – يوناني (يحل محل 423)
- 880 – السيريلية (مراجعة 410) (المراجعات: 1025، 1154)
- 881 – الولايات المتحدة - نظام الرسومات 5080
- 882 – المملكة المتحدة - نظام الرسومات 5080
- 883 – السويد - نظام الرسومات 5080
- 884 – ألمانيا - نظام الرسومات 5080
- 885 – فرنسا - نظام الرسومات 5080
- 886 – إيطاليا - نظام الرسومات 5080
- 887 – اليابان - نظام الرسومات 5080
- 888 – فرنسا AZERTY - نظام الرسومات 5080
- 889 – تايلاند
- 890 – يوغوسلافيا
- 892 – EBCDIC، OCR A
- 893 – EBCDIC، OCR B
- 905 – اللاتينية 3
- 918 – ثنائي اللغة الأردية
- 924 – اللاتينية 9
- 930 – مزيج ياباني (290 + 300) (نفس الشيء بالنسبة لليورو: 1390)
- 931 – مزيج ياباني (37 + 300)
- 933 – مزيج كوري (833 + 834) (نفس الشيء مع اليورو: 1364)
- 935 – الصينية المبسطة MIX (836 + 837) (نفس الشيء مع اليورو: 1388)
- 937 – مزيج صيني تقليدي (37 + 835) (نفس السعر باليورو: 1371)
- 939 – مزيج ياباني (1027 + 300) (نفس الشيء مع اليورو: 1399)
- 1001 – MICR
- 1002 – توافق إصدار EBCDIC DCF 2
- 1003 – مجموعة فرعية من نصوص EBCDIC DCF الأمريكية
- 1005 – التواصل النصي المتماثل EBCDIC
- 1007 – EBCDIC العربية (XCOM2)
- 1024 – EBCDIC T.61
- 1025 – السيريلية، متعددة اللغات (نفس الشيء مع اليورو: 1154) (مراجعة 880)
- 1026 – EBCDIC تركيا (اللاتينية 5) (نفس الشيء مع اليورو: 1155) (يحل محل 905 في ذلك البلد)
- 1027 – النسخة اليابانية (اللاتينية) الموسعة (JIS X 0201 الموسعة)
- 1028 – دار نشر EBCDIC العبرية
- 1030 – اللغة اليابانية (كاتاكانا) الموسعة
- 1031 – اليابانية (اللاتينية) الموسعة
- 1032 – MICR، E13-B مدمج
- 1033 – MICR، CMC-7 مدمج
- 1037 – كوريا - نظام الرسومات 5080/6090
- 1039 – توافق GML
- 1047 – اللاتينية 1/الأنظمة المفتوحة [ 14 ]
- 1068 – توافق DCF
- 1069 – اللاتينية 4
- 1070 – الولايات المتحدة الأمريكية / كندا الإصدار 0 (صفحة الكود 37 الإصدار 0)
- 1071 – ألمانيا FR / النمسا (صفحة الكود 273 الإصدار 0)
- 1072 – بلجيكا (صفحة الكود 274 الإصدار 0)
- 1073 – البرازيل (صفحة الكود 275 الإصدار 0)
- 1074 – الدنمارك، النرويج (صفحة الرموز 277 الإصدار 0)
- 1075 – فنلندا، السويد (صفحة الرموز 278 الإصدار 0)
- 1076 – إيطاليا (صفحة الكود 280 الإصدار 0)
- 1077 – اليابان (لاتينية) (صفحة الكود 281 الإصدار 0)
- 1078 – البرتغال (صفحة الرموز 282 الإصدار 0)
- 1079 – إسبانيا / أمريكا اللاتينية الإصدار 0 (صفحة الرموز 284 الإصدار 0)
- 1080 – المملكة المتحدة (صفحة الكود 285 الإصدار 0)
- 1081 – فرنسا الإصدار 0 (صفحة الكود 297 الإصدار 0)
- 1082 – إسرائيل (بالعبرية)
- 1083 – إسرائيل (بالعبرية)
- 1084 – الإصدار الدولي رقم 5 الإصدار 0 ( صفحة الترميز 500 الإصدار 0)
- 1085 – أيسلندا (صفحة الرموز 871 الإصدار 0)
- 1087 – مجموعة الرموز
- 1091 – الرموز المعدلة، المجموعة 7
- 1093 – شعار شركة IBM [ 15 ]
- 1097 – ثنائي اللغة الفارسية
- 1110 – اللاتينية 2 (مراجعة 870)
- 1112 – البلطيق متعدد اللغات (نفس الشيء مع اليورو: 1156)
- 1113 – اللاتينية 6
- 1122 – إستونيا (نفس الشيء بالنسبة لليورو: 1157)
- 1123 – السيريلية، أوكرانيا (نفس الشيء مع اليورو: 1158)
- 1130 – فيتنامي (نفس الشيء بالنسبة لليورو: 1164)
- 1132 – لاو EBCDIC
- 1136 - هيتاشي كاتاكانا
- 1137 – ديفاناغاري EBCDIC
- 1140 – الولايات المتحدة الأمريكية، كندا، إلخ. ECECP (نفس الشيء بدون اليورو: 37) (النسخة الصينية التقليدية: 1159)
- 1141 – النمسا، ألمانيا ECECP (نفس الشيء بدون اليورو: 273)
- 1142 – الدنمارك، النرويج ECECP (نفس الشيء بدون اليورو: 277)
- 1143 – فنلندا، السويد ECECP (نفس الشيء بدون اليورو: 278)
- 1144 – إيطاليا ECECP (نفس الشيء بدون اليورو: 280)
- 1145 – إسبانيا، أمريكا اللاتينية (بالإسبانية) ECECP (نفس الشيء بدون اليورو: 284)
- 1146 – المملكة المتحدة ECECP (نفس الشيء بدون اليورو: 285)
- 1147 – فرنسا ECECP باليورو (نفس الشيء بدون اليورو: 297)
- 1148 – برنامج ECECP الدولي باليورو (نفس الشيء بدون اليورو: 500)
- 1149 – ECECP الأيسلندي مع اليورو (نفس الشيء بدون اليورو: 871)
- 1150 – النسخة الكورية الموسعة مع الأحرف المربعة
- 1151 – الصينية المبسطة الموسعة مع أحرف مربعة
- 1152 – الصينية التقليدية الموسعة مع الأحرف المربعة
- 1153 – اللاتينية 2 متعددة اللغات مع اليورو (نفس الشيء بدون اليورو: 870)
- 1154 – السيريلية، متعددة اللغات مع اليورو (نفس الشيء بدون اليورو: 1025؛ الإصدار الأقدم هو * 1166)
- 1155 – تركيا باليورو (نفس الشيء بدون اليورو: 1026) (نفس الشيء مع الليرة: 1175)
- 1156 – Baltic Multi مع اليورو (نفس الشيء بدون اليورو: 1112)
- 1157 – إستونيا باليورو (نفس الشيء بدون اليورو: 1122)
- 1158 – الأبجدية السيريلية، أوكرانيا مع اليورو (نفس الشيء بدون اليورو: 1123)
- 1159 – T-Chinese EBCDIC (تحديث اليورو الصيني التقليدي لـ * 1140)
- 1160 – اللغة التايلاندية ذات العلامات المنخفضة والأحرف المميزة مع اليورو (نفس الشيء بدون اليورو: 838)
- 1164 – الفيتنامية مع اليورو (نفس الشيء بدون اليورو: 1130)
- 1165 – اللاتينية 2/الأنظمة المفتوحة
- 1166 – الكازاخية السيريلية
- 1175 – تركيا باليورو والليرة (نفس الشيء بدون الليرة: 1155)
- 1278 – ترميز EBCDIC القياسي من Adobe (PostScript)
- 1279 – جهاز هيتاشي الياباني كاتاكانا [ 6 ]
- 1300 – رمز شريطي عام/OCR-B
- 1301 – الرمز البريدي + 4 رمز شريطي POSTNET
- 1302 – مواجهة علامات التعريف
- 1303 – رمز شريطي EBCDIC
- 1364 – مزيج كوري (833 + 834 + يورو) (نفس الشيء بدون اليورو: 933)
- 1371 – مزيج صيني تقليدي (1159 + 835) (نفس الشيء بدون اليورو: 937)
- 1376 – امتداد مضيف DBCS باللغة الصينية التقليدية لنظام HKSCS
- 1377 – زراعة المضيف المختلط HKSCS (37 + 1376)
- 1378 – Traditional Chinese DBCS Host extension for HKSCS and Simplified Chinese (superset of 1376)
- 1379 – Mixed Host HKSCS and Simplified Chinese Growing (37 + 1378) (superset of 1377)
- 1388 – Simplified Chinese MIX (same without euro: 935) (836 + 837 + euro)
- 1390 – Simplified Chinese MIX Japan MIX (same without euro: 930) (290 + 300 + euro)
- 1399 – Japan MIX (1027 + 300 + euro) (same without euro: 939)
DOS code pages
These code pages are used by IBM in its PC DOS operating system. These code pages were originally embedded directly in the text mode hardware of the graphic adapters used with the IBM PC and its clones, including the original MDA and CGA adapters whose character sets could only be changed by physically replacing a ROM chip that contained the font. The interface of those adapters (emulated by all later adapters such as VGA) was typically limited to single byte character sets with only 256 characters in each font/encoding (although VGA added partial support for slightly larger character sets).
- 301 – IBM-PC Japan (Kanji) DBCS
- 437 – Original IBM PC hardware code page
- 720 – Arabic (Transparent ASMO)
- 737 – Greek
- 775 – Latin-7
- 808 – Russian with euro (same without euro: 866)
- 848 – Ukrainian with euro (same without euro: 1125)
- 849 – Belarusian with euro (same without euro: 1131)
- 850 – Latin-1
- 851 – Greek
- 852 – Latin-2
- 853 – Latin-3
- 855 – Cyrillic (same with euro: 872)
- 856 – Hebrew
- 857 – Latin-5
- 858 – Latin-1 with euro symbol
- 859 – Latin-9
- 860 – Portuguese
- 861 – Icelandic
- 862 – Hebrew
- 863 – Canadian French
- 864 – Arabic
- 865 – Danish/Norwegian
- 866 – Belarusian, Russian, Ukrainian (same with euro: 808)
- 867 – Hebrew + euro (based on CP862) (conflictive ID: NEC Czech (Kamenický), which was created before this codepage)
- 868 – Urdu
- 869 – Greek
- 872 – Cyrillic with euro (same without euro: 855)
- 874 – Thai with Low Tone Marks & Ancient Chars (conflictive ID with Windows 874; version with euro: 1161 Windows version: is IBM 1162)
- 876 – OCR A
- 877 – OCR B
- 878 – KOI8-R
- 891 – Korean PC SBCS
- 898 – IBM-PC WP Multilingual
- 899 – رمز IBM-PC
- 903 – نظام التشغيل الصيني المبسط لأجهزة الكمبيوتر الشخصية SBCS
- 904 – نظام الكمبيوتر الصيني التقليدي SBCS
- 906 – المجموعة الدولية رقم 5 3812/3820
- 907 – ASCII APL (3812)
- 909 – IBM-PC APL2 Extended
- 910 – IBM-PC APL2
- 911 – IBM-PC Japan #1
- 926 – نظام الكمبيوتر الكوري DBCS
- 927 – نظام الكمبيوتر الصيني التقليدي DBCS
- 928 – نظام ملفات تعريف الحاسوب الشخصي باللغة الصينية المبسطة
- 929 – Thai PC DBCS
- 932 – IBM-PC Japan MIX (DOS/V) (DBCS) ( 897 + 301 ) (معرف متعارض مع Windows 932؛ إصدار Windows هو IBM 943)
- 934 – IBM-PC Korea MIX (DOS/V) (DBCS) ( 891 + 926 )
- 936 – IBM-PC Simplified Chinese MIX (gb2312) (DOS/V) (DBCS) ( 903 + 928 ) (معرف متعارض مع Windows 936؛ إصدار Windows هو IBM 1386)
- 938 – IBM-PC Traditional Chinese MIX (DOS/V, OS/2) ( 904 + 927 )
- 942 – IBM-PC Japan MIX (Japanese SAA (OS/2)) ( 1041 + 301 )
- 943 – IBM-PC Japan OPEN ( 897 + 941 ) (Windows CP 932)
- 944 – IBM-PC Korea MIX (الكورية SAA (OS/2)) ( 1040 + 926 )
- 946 – IBM-PC الصينية المبسطة (Simplified Chinese SAA (OS/2)) ( 1042 + 928 )
- 948 – IBM-PC اللغة الصينية التقليدية (اللغة الصينية التقليدية SAA (OS/2)) ( 1043 + 927 )
- 949 – الكورية (وانسونغ الموسعة (ks_c_5601-1987)) ( 1088 + 951 ) (معرف متعارض مع ويندوز 949 (رمز هانغول الموحد)؛ إصدار ويندوز هو IBM 1363)
- 951 – نظام إدارة قواعد البيانات الكوري (رمز IBM KS) (معرف متعارض مع Windows 951، وهو تعديل لنظام Windows 950 مع تعيينات Unicode لبعض أحرف Unicode الخاصة بـ PUA الموجودة في HKSCS، بناءً على اسم الملف)
- 1034 – تطبيق الطابعة - ملصق الشحن، المجموعة رقم 2
- 1040 – النسخة الكورية الموسعة
- 1041 – النسخة اليابانية الموسعة (JIS X 0201 الموسعة)
- 1042 – الصينية المبسطة الموسعة
- 1043 – اللغة الصينية التقليدية الموسعة
- 1044 – تطبيق الطابعة - ملصق الشحن، المجموعة رقم 1
- 1086 – IBM-PC اليابان #1
- 1088 – النسخة الكورية المنقحة (SBCS)
- 1092 – رموز معدلة لأجهزة الكمبيوتر الشخصية من IBM
- 1098 – الفارسية
- 1108 – توافق قاعدة DITROFF
- 1109 – توافق منتجات ديتروف الخاصة
- 1115 – جهاز كمبيوتر شخصي من شركة IBM، جمهورية الصين الشعبية
- 1116 – إستوني
- 1117 – لاتفيا
- 1118 – الليتوانية (تطبيق شركة IBM لصفحة ترميز Lika رقم 774 )
- 1119 – الليتوانية والروسية (تطبيق شركة IBM لصفحة رموز Lika رقم 772 )
- 1125 – السيريلية، الأوكرانية (نفس الشيء مع اليورو: 848 ) (تعديل IBM لنظام RUSCII )
- 1127 – IBM-PC العربية / الفرنسية
- 1131 – بيانات IBM-PC، السيريلية، البيلاروسية (نفس الشيء مع اليورو: 849 )
- 1139 - الكاتاكانا الأبجدية الرقمية اليابانية
- 1161 – تايلاندي بعلامات نبرة منخفضة وأحرف قديمة مع اليورو (نفس الشيء بدون اليورو: 874 )
- 1167 – كوي8-رو
- 1168 – KOI8-U
- 1370 – مزيج اللغة الصينية التقليدية ( ترميز Big5 ) ( 1114 + 947 + يورو) (نفس الشيء بدون اليورو: 950 )
- 1380 – IBM-PC Simplified Chinese GB PC-DATA (DBCS PC IBM GB 2312-80)
- 1381 – IBM-PC الصينية المبسطة ( 1115 + 1380 )
- 1393 – المواصفة اليابانية JIS X 0213 DBCS
- 1394 – IBM-PC Japan (JIS X 0213) ( 897 + 1393 )
عند التعامل مع الأجهزة والبروتوكولات وتنسيقات الملفات القديمة، غالباً ما يكون من الضروري دعم صفحات الترميز هذه، ولكن يتم تشجيع أنظمة الترميز الأحدث، وخاصة Unicode، للتصميمات الجديدة.
تُخزَّن صفحات ترميز نظام التشغيل DOS عادةً في ملفات بامتداد .CPI. [ 16 ] [ 17 ] [ 18 ] [ 19 ] [ 20 ]
صفحات ترميز IBM AIX
تستخدم شركة IBM صفحات الترميز هذه في نظام التشغيل AIX الخاص بها . وهي تحاكي العديد من مجموعات الأحرف، وتحديداً تلك المصممة للاستخدام وفقاً لمعايير ISO، مثل أنظمة التشغيل الشبيهة بنظام UNIX.
- 367 – 7 بت US-ASCII
- 371 – 7 بت US-ASCII APL
- 806 – ISCII
- 813 – ISO 8859-7
- 819 – ISO 8859-1
- 895 – 7 بت ياباني لاتيني
- 896 – كاتاكانا يابانية موسعة 7 بت
- 901 – ISO 8859-13 مع اليورو (تم توسيعه لاحقًا) (نفس الشيء بدون اليورو: 921 )
- 902 – عملة إستونية بنظام ISO مع اليورو (نفس الشيء بدون اليورو: 922 )
- 912 – ISO 8859-2 (تم تمديده في عام 1999)
- 913 – ISO 8859-3
- 914 – ISO 8859-4
- 915 – ISO 8859-5 (تم تمديده بعد عام 1995)
- 916 – ISO 8859-8
- 919 – ISO 8859-10
- 920 – ISO 8859-9
- 921 – ISO 8859-13 (extended after 1995) (same with euro: 901)
- 922 – ISO Estonian (same with euro: 902)
- 923 – ISO 8859-15
- 952 – EUC Japanese for JIS X 0208
- 953 – EUC Japanese for JIS X 0212
- 954 – EUC Japanese (895 + 952 + 896 + 953)
- 955 – TCP Japanese, JIS X 0208-1978
- 956 – TCP Japanese (895 + 952 + 896 + 953)
- 957 – TCP Japanese (895 + 955 + 896 + 953)
- 958 – TCP Japanese (367 + 952 + 896 + 953)
- 959 – TCP Japanese (367 + 955 + 896 + 953)
- 960 – Traditional Chinese DBCS-EUC SICGCC Primary Set (1st plane)
- 961 – Traditional Chinese DBCS-EUC SICGCC Full Set + IBM Select + UDC
- 963 – Traditional Chinese TCP, CNS 11643 plane 2 only
- 964 – EUC Traditional Chinese (367 + 960 + 961)
- 965 – TCP Traditional Chinese (367 + 960 + 963)
- 970 – EUC Korean (367 + 971)
- 971 – EUC Korean DBCS (G1, KSC 5601 1989 (including 188 UDC))
- 1006 – ISO 8-bit Urdu
- 1008 – ISO 8-bit Arabic
- 1009 – 7-bit ISO IRV
- 1010 – 7-bit France
- 1011 – 7-bit Germany F.R.
- 1012 – 7-bit Italy
- 1013 – 7-bit United Kingdom
- 1014 – 7-bit Spain
- 1015 – 7-bit Portugal
- 1016 – 7-bit Norway
- 1017 – 7-bit Denmark
- 1018 – 7-bit Finland/Sweden
- 1019 – 7-bit Netherlands
- 1029 – Arabic Extended
- 1036 – CCITT T.61
- 1046 – Arabic Extended (Euro)
- 1089 – ISO 8859-6
- 1111 – Variant of ISO 8859-2
- 1124 – ISO Ukrainian, similar to ISO 8859-5
- 1129 – ISO Vietnamese (same with euro: 1163)
- 1133 – ISO Lao
- 1163 – ISO Vietnamese with euro (same without euro: 1129)
- 1350 – EUC Japanese (JISeucJP) (367 + 952 + 896 + 953)
- 1382 – EUC Simplified Chinese (DBCS PC GB 2312-80)
- 1383 – EUC Simplified Chinese (367 + 1382)
Code page 819 is identical to Latin-1, ISO/IEC 8859-1, and with slightly-modified commands, permits MS-DOS machines to use that encoding. It was used with IBM AS/400 minicomputers.
IBM OS/2 code pages
These code pages are used by IBM in its OS/2 operating system.
Windows emulation code pages
These code pages are used by IBM when emulating the Microsoft Windows character sets. Most of these code pages have the same number as Microsoft code pages, although they are not exactly identical. Some code pages, though, are new from IBM, not devised by Microsoft.
- 897 – IBM-PC SBCS Japanese (JIS X 0201-1976)
- 941 – IBM-PC Japanese DBCS for Open environment
- 947 – IBM-PC DBCS for (Big5 encoding)
- 950 – Traditional Chinese MIX (Big5 encoding) (1114 + 947) (same with euro: 1370)
- 1114 – IBM-PC SBCS (Simplified Chinese; GBK; Traditional Chinese; Big5 encoding)
- 1126 – IBM-PC Korean SBCS
- 1162 – Windows Thai (Extension of 874; but still called that in Windows)
- 1169 – Windows Cyrillic Asian
- 1174 – Windows Kazakh[22]
- 1250 – Windows Central Europe
- 1251 – Windows Cyrillic
- 1252 – Windows Western
- 1253 – Windows Greek
- 1254 – Windows Turkish
- 1255 – Windows Hebrew
- 1256 – Windows Arabic
- 1257 – Windows Baltic
- 1258 – Windows Vietnamese
- 1360 – Korean JOHAB DBCS
- 1361 – Korean (JOHAB)
- 1362 – Korean Hangul DBCS
- 1363 – Windows Korean (1126 + 1362) (Windows CP 949)
- 1372 – IBM-PC MS T Chinese Big5 encoding (Special for DB2)
- 1373 – ويندوز الصينية التقليدية (امتداد 950 )
- 1374 – امتداد ترميز Big5 لقاعدة بيانات IBM-PC لـ HKSCS
- 1375 – امتداد ترميز Big5 المختلط لـ HKSCS (يهدف إلى مطابقة 950 )
- 1385 – IBM-PC Simplified Chinese DBCS (Growing CS for GB18030, also used for GBK PC-DATA.)
- 1386 – IBM-PC Simplified Chinese GBK ( 1114 + 1385 ) (Windows CP 936)
- 1391 – الصينية المبسطة 4 بايت (تنمو CS لـ GB18030، وتستخدم أيضًا لـ GBK PC-DATA.)
- 1392 – IBM-PC Simplified Chinese MIX ( 1252 + 1385 + 1391 )
صفحات أكواد محاكاة ماكنتوش
تستخدم شركة IBM صفحات الترميز هذه عند محاكاة مجموعات الأحرف الخاصة بنظام Apple Macintosh .
صفحات أكواد محاكاة أدوبي
تستخدم شركة IBM صفحات الترميز هذه عند محاكاة مجموعات أحرف Adobe .
صفحات رموز محاكاة HP
تستخدم شركة IBM صفحات الترميز هذه عند محاكاة مجموعات أحرف HP .
- 1050 – ملحق HP Roman
- 1051 – HP Roman-8
- 1052 – HP Gothic Legal
- 1053 – HP Gothic-1 (مماثل تقريبًا لـ ISO 8859-1 )
- 1054 – HP ASCII
- 1055 – HP PC-Line
- 1056 – رسم خط HP
- 1057 – HP PC-8 (مماثل تقريبًا لصفحة الرموز 437 )
- 1058 – HP PC-8DN ( ليس هو نفسه رمز الصفحة 865 )
- 1351 – مجموعة أحرف DBCS HP اليابانية
- 5039 – مزيج ياباني ( 1041 + 1351 )
صفحات رموز محاكاة DEC
تستخدم شركة IBM صفحات الترميز هذه عند محاكاة مجموعات أحرف DEC .
- 1020 – مجموعة NRC الكندية (الفرنسية) ذات 7 بت
- 1021 – مجموعة NRC سويسرية ذات 7 بت
- 1023 – مجموعة NRC الإسبانية ذات 7 بت
- 1090 – مجموعة الأحرف الخاصة ورسومات الخطوط
- 1100 – شركة دي إي سي متعددة الجنسيات
- 1101 – مجموعة NRC البريطانية ذات 7 بت
- 1102 – مجموعة NRC الهولندية ذات 7 بت
- 1103 – مجموعة NRC الفنلندية ذات 7 بت
- 1104 – مجموعة NRC الفرنسية ذات 7 بت
- 1105 – مجموعة NRC النرويجية/الدنماركية ذات 7 بت
- 1106 – مجموعة NRC السويدية ذات 7 بت
- 1107 – نسخة بديلة من هيئة تنظيم الاتصالات النرويجية/الدنماركية ذات 7 بت
- 1287 - ديسمبر (يوناني)
- 1288 – ديسمبر (تركي)
صفحات ترميز يونيكود من IBM
- 1200 – UTF-16BE Unicode ( big-endian ) مع منطقة الاستخدام الخاصة لشركة IBM (PUA) [ 23 ]
- 1201 – UTF-16BE Unicode ( big-endian ) [ 23 ]
- 1202 – UTF-16LE Unicode ( little-endian ) مع IBM PUA [ 23 ]
- 1203 – UTF-16LE Unicode ( little-endian ) [ 23 ]
- 1208 – UTF-8 Unicode مع IBM PUA [ 23 ]
- 1209 – UTF-8 Unicode [ 23 ]
- 1400 – ISO 10646 UCS-BMP (مبني على Unicode 6.0) [ 23 ]
- 1401 – ISO 10646 UCS-SMP (استنادًا إلى Unicode 6.0) [ 23 ]
- 1402 – ISO 10646 UCS-SIP (مبني على Unicode 6.0) [ 23 ]
- 1414 – ISO 10646 UCS-SSP (مبني على Unicode 4.0) [ 23 ]
- 1445 – IBM AFP PUA رقم 1
- 1446 – ISO 10646 UCS-PUP15 (مبني على Unicode 4.0) [ 23 ]
- 1447 – ISO 10646 UCS-PUP16 (مبني على Unicode 4.0) [ 23 ]
- 1448 – UCS-BMP (رمز UDC عام)
- 1449 – برنامج IBM الافتراضي غير المرغوب فيه
صفحات ترميز مايكروسوفت
صفحات ترميز ويندوز
تستخدم مايكروسوفت صفحات الترميز هذه في نظام تشغيل ويندوز الخاص بها. وقد حددت مايكروسوفت عددًا من صفحات الترميز المعروفة باسم صفحات ترميز ANSI (حيث استندت الصفحة الأولى، 1252، إلى مسودة ANSI غير رسمية لما أصبح فيما بعد معيار ISO 8859-1 ). تعتمد صفحة الترميز 1252 على معيار ISO 8859-1، ولكنها تستخدم النطاق 0x80-0x9F للأحرف الإضافية القابلة للطباعة بدلاً من رموز التحكم C1 من معيار ISO 6429 المذكورة في معيار ISO 8859-1. [ 24 ] وتستند بعض الصفحات الأخرى جزئيًا إلى أجزاء أخرى من معيار ISO 8859، ولكن غالبًا ما يُعاد ترتيبها لجعلها أقرب إلى الصفحة 1252.
توصي مايكروسوفت باستخدام ترميز UTF-8 أو UCS-2/UTF-16 بدلاً من صفحات الترميز هذه في التطبيقات الجديدة. [ 25 ]
صفحات رموز DBCS
تمثل صفحات الترميز هذه ترميزات أحرف DBCS للغات الصينية واليابانية والكورية المختلفة. في أنظمة تشغيل مايكروسوفت، تُستخدم هذه الصفحات كصفحات ترميز "OEM" و"Windows" للغة المحلية المناسبة.
- 932 – يدعم نظام Shift-JIS الياباني
- 936 – يدعم اللغة الصينية المبسطة GB2312 أو GBK
- 949 – يدعم رمز الهانغول الكوري الموحد
- 950 – يدعم اللغة الصينية التقليدية Big5
- 951 – يدعم نظام Big5 الصيني التقليدي مع HKSCS
صفحات رموز نظام التشغيل MS-DOS
تستخدم مايكروسوفت صفحات الترميز هذه في نظام التشغيل MS-DOS. وتُشير إليها مايكروسوفت باسم صفحات ترميز OEM لأنها حُدِّدت من قِبَل مُصنِّعي المعدات الأصلية الذين رخصوا توزيع MS-DOS مع أجهزتهم، وليس من قِبَل مايكروسوفت أو أي منظمة معايير. معظم صفحات الترميز هذه تحمل نفس رقم صفحات ترميز IBM المُكافئة، مع أن بعضها ليس مُطابقًا تمامًا . [ 26 ]
- 708 – العربية (ASMO 708)
- 720 – العربية (ASMO الشفاف)
- 737 – يوناني
- 850 – اللاتينية-1
- 851 – يوناني
- 852 – اللاتينية-2
- 855 – السيريلية
- 857 – لاتين-5
- 858 – لاتين-1 مع رمز اليورو
- 859 – لاتين-9
- 860 – البرتغالية
- 861 – أيسلندية
- 862 – عبري
- 863 – الفرنسية الكندية
- 864 – العربية
- 865 – الدنماركية / النرويجية
- 866 – بيلاروسي، روسي، أوكراني
- 869 – يوناني
صفحات أكواد محاكاة ماكنتوش
تستخدم مايكروسوفت صفحات الترميز هذه عند محاكاة مجموعات أحرف أبل ماكنتوش .
- 10000 - أبل ماكنتوش رومان
- 10001 - أبل اليابانية
- 10002 - أبل - المطبخ الصيني التقليدي (Big5)
- 10003 - أبل الكورية
- 10004 - أبل العربية
- 10005 - تفاحة عبرية
- 10006 - تفاح يوناني
- 10007 - أبل ماكنتوش سيريلية
- 10008 - أبل الصينية المبسطة (GB 2312)
- 10010 - أبل روماني
- 10017 - أبل أوكراني
- 10021 - أبل تاي
- 10029 - أبل ماكنتوش أوروبا الوسطى
- 10079 - أبل أيسلندي
- 10081 - أبل تركي
- 10082 - أبل كرواتية
صفحات أكواد مايكروسوفت الأخرى المتنوعة
أرقام صفحات الترميز التالية خاصة بنظام التشغيل مايكروسوفت ويندوز. قد تستخدم شركة IBM أرقامًا مختلفة لهذه الصفحات. وهي تحاكي عدة مجموعات أحرف، وتحديدًا تلك المصممة للاستخدام وفقًا لمعايير ISO، مثل أنظمة التشغيل الشبيهة بنظام UNIX.
- 20000 – الجهاز العصبي المركزي الصيني التقليدي
- 20001 – TCA الصينية التقليدية
- 20002 – ETEN الصينية التقليدية
- 20003 – الصينية التقليدية IBM5500
- 20004 – التليتكست الصيني التقليدي
- 20005 – وانغ الصينية التقليدية
- 20105 – 7-bit IA5 IRV [ 27 ] [ 28 ] [ 29 ] ( CP 1009 )
- 20106 – 7 بت IA5 الألمانية ( DIN 66003 ) [ 27 ] [ 28 ] [ 30 ]
- 20107 – 7-bit IA5 Swedish (SEN 850200 C) [ 27 ] [ 28 ] [ 31 ]
- 20108 - 7-bit IA5 Norwegian (NS 4551-2) [ 27 ] [ 28 ] [ 32 ]
- 20127 – 7-bit US-ASCII [ 27 ] [ 28 ] [ 33 ]
- 20261 – CCITT T.61
- 20269 – ISO 6937
- 20273
- 20277
- 20278
- 20284
- 20285
- 20290 - اللغة اليابانية في نظام EBCDIC
- 20297
- 20420
- 20423
- 20424
- 20833
- 20838
- 20866 – KOI8-R
- 20871
- 20880 – EBCDIC Cyrillic (880)
- 20905
- 20924
- 20932 - EUC-JP
- 20936
- 20949
- 21025 – EBCDIC Cyrillic (1025)
- 21027
- 21866 – KOI8-U
- 28591 – ISO-8859-1
- 28592 – ISO-8859-2
- 28593 – ISO-8859-3
- 28594 – ISO-8859-4
- 28595 – ISO-8859-5
- 28596 – ISO-8859-6
- 28597 – ISO-8859-7
- 28598 – ISO-8859-8
- 28599 – ISO-8859-9
- 28600 – ISO-8859-10
- 28601 – ISO-8859-11
- 28602 – غير مستخدم (محجوز لـ ISO-8859-12 )
- 28603 – ISO-8859-13
- 28604 – ISO-8859-14
- 28605 – ISO-8859-15
- 28606 – ISO-8859-16
- 38596 – ISO-8859-6
- 38598 – ISO-8859-8
صفحات ترميز يونيكود من مايكروسوفت
- 1200 – UTF-16LE Unicode ( little-endian )
- 1201 – UTF-16BE Unicode ( big-endian )
- 12000 – UTF-32LE Unicode ( little-endian )
- 12001 – UTF-32BE Unicode ( big-endian )
- 65000 – UTF-7 Unicode
- 65001 – UTF-8 Unicode
- 65520 – مستوى يونيكود فارغ
مجموعات رموز HP
طورت شركة HP سلسلة من مجموعات الرموز (لكل منها رمزها الخاص) لترميز مجموعات الأحرف الخاصة بها أو مجموعات أحرف الموردين الآخرين. وهي عادةً مجموعات أحرف مكونة من 7 بتات، وعند نقلها إلى الجزء الأعلى وربطها بمجموعة أحرف ASCII، تُشكل مجموعات أحرف مكونة من 8 بتات.
مجموعات الرموز الخاصة بشركة HP
- مجموعة الرموز 0E — امتداد HP الروماني — مجموعة أحرف 7 بت مع أحرف مميزة (تم ترميزها بواسطة IBM كصفحة رمز 1050 )
- مجموعة الرموز 0G — HP 7-bit الألمانية
- مجموعة الرموز 0L — خط HP 7-bit PC (تم ترميزها بواسطة IBM كصفحة رمز 1055 )
- مجموعة الرموز 0M — HP Math-7
- مجموعة الرموز 0T — HP Thai-8
- مجموعة الرموز 1S — HP 7-bit الإسبانية
- مجموعة الرموز 1U — HP 7-bit Gothic Legal (تمت برمجتها بواسطة IBM كصفحة رمز 1052 )
- مجموعة الرموز 4Q — رسم الخطوط HP (مُرمّزة بواسطة IBM كصفحة رمز 1056 )
- مجموعة الرموز 4U — HP Roman-9 — Roman-8 + €
- مجموعة الرموز 7J — أجهزة سطح المكتب من HP
- مجموعة الرموز 7S — HP 7-bit European Spanish
- مجموعة الرموز 8E — HP East-8
- مجموعة الرموز 8G — HP Greek-8 (مستندة إلى IR 088؛ وليست على ELOT 927)
- مجموعة الرموز 8H — HP العبرية-8
- مجموعة الرموز 8I — MS LineDraw (ASCII + HP PC Line)
- مجموعة الرموز 8K — HP Kana-8 (ASCII + كاتاكانا يابانية)
- مجموعة الرموز 8L — HP LineDraw (ASCII + HP Line Draw)
- مجموعة الرموز 8M — HP Math-8 (ASCII + HP Math-8)
- مجموعة الرموز 8R — HP Cyrillic-8
- مجموعة الرموز 8S — HP 7-bit الإسبانية الأمريكية اللاتينية
- مجموعة الرموز 8T — HP Turkish-8
- مجموعة الرموز 8U — HP Roman-8 (ASCII + HP Roman Extension؛ تم ترميزها بواسطة IBM كصفحة رمز 1051 )
- مجموعة الرموز 8 فولت - HP Arabic-8
- مجموعة الرموز 9K — HP Korean-8
- مجموعة الرموز 9T — PC 8T (المعروفة أيضًا باسم صفحة الرموز 437-T؛ هذه ليست صفحة الرموز 857)
- مجموعة الرموز 9V — اللاتينية / العربية لنظام التشغيل ويندوز (هذه ليست صفحة الرموز 1256 )
- مجموعة الرموز 11U — PC 8D/N (المعروفة أيضًا باسم صفحة الرموز 437-N؛ تم ترميزها بواسطة IBM كصفحة رموز 1058 ؛ هذه ليست صفحة الرموز 865 )
- مجموعة الرموز 14G — PC-8 اليونانية البديلة (المعروفة أيضًا باسم صفحة الرموز 437-G؛ وهي تقريبًا نفس صفحة الرموز 737 )
- مجموعة الرموز 18 قيراط —
- مجموعة الرموز 18T —
- مجموعة الرموز 19C —
- مجموعة الرموز 19K —
مجموعات الرموز من موردين آخرين
- مجموعة الرموز 0D — ISO 60: النرويجية 7 بت
- مجموعة الرموز 0F — ISO 25: الفرنسية 7 بت
- Symbol Set 0H — HP 7-bit Hebrew — Practically the same as Israeli Standard SI 960
- Symbol Set 0I — ISO 15: 7-bit Italian
- Symbol Set 0K — ISO 14: 7-bit Japanese Katakana
- Symbol Set 0N — ISO 8859-1 Latin 1 (Initially called "Gothic-1"; coded by IBM as code page 1053)
- Symbol Set 0R — ISO 8859-5 Latin/Cyrillic (1986 version — IR 111)
- Symbol Set 0S — ISO 11: 7-bit Swedish
- Symbol Set 0U — ISO 6: 7-bit U.S.
- Symbol Set 0V — Arabic
- Symbol Set 1D — ISO 61: 7-bit Norwegian
- Symbol Set 1E — ISO 4: 7-bit U. K.
- Symbol Set 1F — ISO 69: 7-bit French
- Symbol Set 1G — ISO 21: 7-bit German
- Symbol Set 1K — ISO 13: 7-bit Japanese Latin
- Symbol Set 1T — Windows Thai (Practically the same as 874)
- Symbol Set 2K — ISO 57: 7-bit Simplified Chinese Latin
- Symbol Set 2N — ISO 8859-2 Latin 2
- Symbol Set 2S — ISO 17: 7-bit Spanish
- Symbol Set 2U — ISO 2: 7-bit International Reference Version
- Symbol Set 3N — ISO 8859-3 Latin 3
- Symbol Set 3R — PC-866 Russia (Practically the same as code page 866)
- Symbol Set 3S — ISO 10: 7-bit Swedish
- Symbol Set 4N — ISO 8859-4 Latin 4
- Symbol Set 4S — ISO 16: 7-bit Portuguese
- Symbol Set 5M — PS Math Symbol (Practically the same as Adobe Symbols)
- Symbol Set 5N — ISO 8859-9 Latin 5
- Symbol Set 5S — ISO 84: 7-bit Portuguese
- Symbol Set 5T — Windows 3.1 Latin-5 (Practically the same as code page 1254)
- Symbol Set 6J — Microsoft Publishing
- Symbol Set 6M — Ventura Math
- Symbol Set 6N — ISO 8859-10 Latin 6
- Symbol Set 6S — ISO 85: 7-bit Spanish
- Symbol Set 7H — ISO 8859-8 Latin/Hebrew
- Symbol Set 9E — Windows 3.1 Latin 2 (Practically the same as code page 1250)
- Symbol Set 9G — Windows 98 Greek (Practically the same as code page 1253)
- Symbol Set 9J — PC 1004
- Symbol Set 9L — Ventura ITC Zapf Dingbats
- Symbol Set 9N — ISO 8859-15 Latin 9
- Symbol Set 9R — Windows 98 Cyrillic (Practically the same as code page 1251)
- Symbol Set 9U — Windows 3.0
- Symbol Set 10G — PC-851 Latin/Greek (Practically the same as code page 851)
- Symbol Set 10J — PS Text (Practically the same as Adobe Standard)
- Symbol Set 10L — PS ITC Zapf Dingbats (Practically the same as Adobe Dingbats)
- Symbol Set 10N — ISO 8859-5 Latin/Cyrillic (1988 version — IR 144)
- Symbol Set 10R — PC-855 Cyrillic (Practically the same as code page 855)
- Symbol Set 10T — Teletex
- Symbol Set 10U — PC-8 (Practically the same as code page 437; coded by IBM as code page 1057)
- Symbol Set 10V — CP-864 (Practically the same as code page 864)
- Symbol Set 11G — CP-869 (Practically the same as code page 869)
- Symbol Set 11J — PS ISO Latin-1 (Practically the same as Adobe Latin-1)
- Symbol Set 11N — ISO 8859-6 Latin/Arabic
- مجموعة الرموز 12G — اللاتينية/اليونانية للحاسوب الشخصي (مماثلة عمليًا لصفحة الرموز 737 )
- مجموعة الرموز 12J — نص MC (مماثل عمليًا لخط ماكنتوش الروماني )
- مجموعة الرموز 12N — ISO 8859-7 اللاتينية/اليونانية
- مجموعة الرموز 12R — PC Gost (مماثلة عمليًا لـ PC GOST Main)
- مجموعة الرموز 12U — PC-850 اللاتينية 1 (مماثلة عمليًا لصفحة الرموز 850 )
- مجموعة الرموز 13J - فينتورا الدولية
- مجموعة الرموز 13R — لغة الحاسوب البلغارية (مماثلة عمليًا للغة الميكنة )
- مجموعة الرموز 13U — PC-858 اللاتينية 1 + € (عمليًا نفس صفحة الرموز 858 )
- مجموعة الرموز 14J - فينتورا، الولايات المتحدة الأمريكية
- مجموعة الرموز 14 لتر — Windows Dingbats
- مجموعة الرموز 14P - ABICOMP International (مماثلة عمليًا لـ ABICOMP )
- مجموعة الرموز 14R — الأوكرانية للحاسوب الشخصي (مماثلة عمليًا لـ RUSCII )
- مجموعة الرموز 15H — PC-862 إسرائيل (مماثلة عمليًا لصفحة الرموز 862 )
- مجموعة الرموز 16U — PC-857 اللاتينية 5 (عمليًا نفس صفحة الرموز 857)
- مجموعة الرموز 17U — PC-852 اللاتينية 2 (عمليًا نفس صفحة الرموز 852)
- مجموعة الرموز 18N — UTF-8
- مجموعة الرموز 18U — PC-853 اللاتينية 3 (عمليًا نفس صفحة الرموز 853)
- مجموعة الرموز 19L — ويندوز 98 البلطيقي (مماثلة عمليًا لصفحة الرموز 1257 )
- مجموعة الرموز 19 مليون — رموز ويندوز
- مجموعة الرموز 19U — ويندوز 3.1 لاتين 1 (مماثلة عمليًا لصفحة الرموز 1252 )
- مجموعة الرموز 20U — PC-860 البرتغال (مماثلة عمليًا لصفحة الرموز 860)
- مجموعة الرموز 21U — PC-861 أيسلندا (مماثلة عمليًا لصفحة الرموز 861 )
- مجموعة الرموز 23U — PC-863 كندا - الفرنسية (مماثلة عمليًا لصفحة الرموز 863 )
- مجموعة الرموز 24Q — PC-Polish Mazowia (تكاد تكون مطابقة لترميز Mazovia )
- مجموعة الرموز 25U — PC-865 الدنمارك/النرويج (مماثلة عمليًا لصفحة الرموز 865 )
- مجموعة الرموز 26U — PC-775 اللاتينية 7 (عمليًا نفس صفحة الرموز 775)
- مجموعة الرموز 27Q — PC-8 PC Nova (مماثلة عمليًا لـ [PC Nova])
- مجموعة الرموز 27U — الكمبيوتر الشخصي اللاتفي الروسي (المعروف أيضًا باسم 866-اللاتفي)
- مجموعة الرموز 28U — PC الليتوانية/الروسية (عمليًا نفس صفحة الرموز 774 )
- مجموعة الرموز 29U — PC-772 الليتوانية/الروسية (مماثلة عمليًا لصفحة الرموز 772 )
صفحات الترميز من موردين آخرين
تُعدّ صفحات الترميز هذه تخصيصات مستقلة من قِبل موردين خارجيين. ولأن صفحة ترميز IBM PC الأصلية ( رقم 437 ) لم تُصمّم للاستخدام الدولي، فقد ظهرت عدة نسخ متوافقة جزئيًا خاصة ببلدان أو مناطق محددة.
إنّ تخصيصات أرقام صفحات الترميز هذه غير رسمية ، لا من قِبل IBM ولا من قِبل Microsoft، ولا يُشار إلى أيٍّ منها تقريبًا على أنها مجموعة أحرف قابلة للاستخدام من قِبل IANA. الأرقام المُخصصة لهذه الصفحات عشوائية، وقد تتعارض مع الأرقام المُسجلة المُستخدمة من قِبل IBM أو Microsoft. قد يكون بعضها أقدم من إضافة ميزة تبديل صفحات الترميز في نظام DOS 3.3.
- 100 – صفحة خط الأجهزة العبرية لنظام التشغيل DOS (ليست من IBM؛ HDOS ) [ 34 ]
- 111 – DOS Greek (ليس من IBM؛ AST Premium Exec DOS 5.0 [ 35 ] [ 36 ] [ 37 ] )
- 112 – نظام التشغيل DOS التركي (ليس من شركة IBM؛ AST Premium Exec DOS 5.0 [ 35 ] [ 36 ] [ 37 ] )
- 113 – نظام التشغيل DOS اليوغوسلافي (ليس من شركة IBM؛ AST Premium Exec DOS 5.0 [ 35 ] [ 36 ] [ 37 ] )
- 151 – نظام التشغيل DOS نافيثة العربي (ليس من شركة IBM؛ ADOS )
- 152 – نظام التشغيل DOS نافيثة العربي (ليس من شركة IBM؛ ADOS )
- 161 – DOS Arabic (ليس من IBM؛ ADOS ) [ 34 ]
- 162 – نظام DOS العربي مع علامات التشكيل (ليس من IBM؛ ADOS)
- 163 – نظام التشغيل DOS باللغتين العربية والفرنسية (ليس من شركة IBM؛ ADOS) [ 34 ]
- 164 – نظام التشغيل DOS للغة العربية والفرنسية مع علامات التشكيل (ليس من شركة IBM؛ ADOS)
- 165 – DOS Arabic (864 Extended) (ليس من IBM؛ ADOS) [ 34 ]
- 166 – جهاز كمبيوتر شخصي عربي من شركة IBM (ADOS) [ 34 ]
- 190 – DEC DOS German (يبدو أنه مطابق لصفحة الكود 437)
- 210 – DEC DOS اليونانية (طابعات NEC Jetmate)
- 220 – DEC DOS Spanish (ليس من شركة IBM)
- 489 – تشيكوسلوفاكي [برنامج التعرف الضوئي على الحروف 1993]
- 620 – نظام التشغيل DOS البولندي (مازوفيا) (ليس من شركة IBM)
- 667 – نظام التشغيل DOS البولندي (مازوفيا) (ليس من شركة IBM)
- 668 – DOS Polish (ليس من IBM)
- 706 – خادم MS-DOS عربي Sakhr (ليس من IBM؛ برنامج Sakhr من MSX Computers)
- 707 – MS-DOS Arabic Sakhr (ليس من IBM؛ برنامج Sakhr من MSX Computers)
- 709 – MS-DOS العربية ( ASMO 449+ /BCON V4)
- 710 – MS-DOS العربية (العربية الشفافة)
- 711 – نظام تشغيل MS-DOS العربي المحسن نافيثة (ليس من إنتاج شركة IBM)
- 714 – MS-DOS Arabic Sakr (ليس من إنتاج IBM)
- 715 – MS-DOS Arabic APTEC (ليس من شركة IBM)
- 721 – MS-DOS Arabic Nafitha International (ليست من IBM)
- 768 – العربية (ليست من إنتاج شركة IBM)
- 770 – DOS الإستونية واللاتفية والليتوانية [ 38 ] (من برنامج Lika الليتواني؛ [ 39 ] المعيار الوطني الليتواني RST 1095-89)
- 771 – DOS الليتوانية/السيريلية — KBL [ 40 ] (من برنامج Lika الليتواني [ 39 ] )
- 772 – DOS الليتوانية/السيريلية [ 41 ] (من برنامج Lika الليتواني؛ [ 39 ] المعيار الوطني الليتواني LST 1284:1993؛ اعتمدته شركة IBM كصفحة رمز 1119 )
- 773 – DOS Latin-7 – KBL (من برنامج Lika الليتواني)
- 774 – DOS الليتوانية [ 42 ] (من برنامج Lika الليتواني؛ [ 39 ] المعيار الوطني الليتواني LST 1283:1993؛ اعتمدته شركة IBM كصفحة رمز 1118 )
- 775 – DOS Latin-7 Baltic Rim (من شركة Lika Software الليتوانية؛ [ 39 ] المعيار الوطني الليتواني LST 1590-1؛ تم اعتماده من قبل IBM وMicrosoft كصفحة رمز 775)
- 776 – DOS الليتوانية (CP770 الموسعة) [ 43 ] (من برنامج Lika الليتواني [ 39 ] )
- 777 – DOS Accented Lithuanian (قديم) (ممتد CP773) — KBL [ 43 ] (من برنامج Lika الليتواني [ 39 ] )
- 778 – DOS Accented Lithuanian (extended CP775) [ 43 ] (من برنامج Lika الليتواني [ 39 ] )
- 790 – لغة DOS البولندية (مازوفيا) مع علامات اقتباس متعرجة
- 854 – الإسبانية [ 44 ] [ 6 ]
- 881 – Latin 1 (ليس من IBM؛ AST Premium Exec DOS 5.0 [ 35 ] [ 36 ] [ 37 ] ) (معرف متعارض مع IBM EBCDIC 881)
- 882 – Latin 2 (ISO 8859-2) (ليس من IBM؛ نفس صفحة الترميز 912؛ AST Premium Exec DOS 5.0 [ 35 ] [ 36 ] [ 37 ] ) (معرف متعارض مع IBM EBCDIC 882)
- 883 – Latin 3 (ليس من IBM؛ AST Premium Exec DOS 5.0 [ 35 ] [ 36 ] [ 37 ] ) (معرف متعارض مع IBM EBCDIC 883)
- 884 – Latin 4 (ليس من IBM؛ AST Premium Exec DOS 5.0 [ 35 ] [ 36 ] [ 37 ] ) (معرف متعارض مع IBM EBCDIC 884)
- 885 – Latin 5 (ليس من IBM؛ AST Premium Exec DOS 5.0 [ 35 ] [ 36 ] [ 37 ] ) (معرف متعارض مع IBM EBCDIC 885)
- 895 – تشيكي (Kamenický) ، (ليس من IBM؛ معرف متعارض مع IBM CP895 — 7 بت EUC ياباني روماني)
- 896 – DOS Polish (Mazovia) (ليس من IBM؛ معرف متعارض مع IBM CP896 — 7-bit EUC Japanese Katakana)
- 900 – DOS Russian (Russian MS-DOS 5.0 LCD.CPI)
- 928 – يوناني (على طابعات ستار [ 45 ] )؛ نفس المعيار الوطني اليوناني ELOT 928 (ليس من IBM؛ معرف متعارض مع IBM CP928 — نظام إدارة قواعد بيانات الكمبيوتر الشخصي الصيني المبسط)
- 966 – السعودية (ليست من شركة IBM)
- 972 – العبرية (VT100) (ليست من شركة IBM)
- 991 – نظام التشغيل DOS البولندي (مازوفيا) (ليس من شركة IBM)
- 999 – DOS Serbo-Croatian I (ليس من IBM)؛ يُعرف أيضًا باسم PC Nova و CroSCII؛ الجزء السفلي هو JUSI.B1.002، والجزء العلوي هو صفحة الترميز 437؛ يدعم اللغتين السلوفينية والصربية الكرواتية (الأبجدية اللاتينية).
- 1001 – العربية (على طابعات Star [ 45 ] ) (ليس من IBM؛ معرف متعارض مع IBM CP1001 — MICR)
- 1261 – نظام التشغيل ويندوز الكوري IBM-1261 LMBCS-17، مشابه للطراز 1363
- 1270 – ويندوز سامي
- 1300 – ANSI [PTS-DOS 6.70، وليس 6.51] (ليس من IBM؛ معرف متعارض مع IBM EBCDIC 1300 — Generic Bar Code/OCR-B)
- 2001 – KBL الليتواني (على طابعات Star [ 45 ] )؛ نفس صفحة الترميز 771
- 3001 – إستونية 1 (على طابعات ستار [ 45 ] )؛ نفس صفحة الترميز 1116
- 3002 – إستونية 2 (على طابعات ستار [ 45 ] )؛ نفس صفحة الترميز 922
- 3011 – اللاتفية 1 (على طابعات ستار [ 45 ] )؛ نفس صفحة الترميز 437-اللاتفية
- 3012 – Latvian-2 (على طابعات Star [ 45 ] )؛ نفس صفحة الترميز 866-Latvian (المعيار الوطني Latvian RST 1040-90)
- 3021 – بلغاري (على طابعات ستار [ 45 ] )؛ نفس MIK
- 3031 – العبرية (على طابعات ستار [ 45 ] )؛ نفس صفحة الترميز 862
- 3041 – اللغة المالطية (على طابعات ستار [ 45 ] )؛ نفس معيار ISO 646 للغة المالطية
- 3840 – IBM-Russian (على طابعات Star [ 45 ] )؛ يكاد يكون مطابقًا لـ CP 866
- 3841 – غوست-روسي (على طابعات ستار [ 45 ] )؛ غوست 13052 بالإضافة إلى أحرف للغات آسيا الوسطى
- 3843 – بولندي (على طابعات ستار [ 45 ] )؛ نفس مازوفيا
- 3844 – CS2 (في طابعات Star [ 45 ] ); نفس كامينيكي
- 3845 – مجري (على طابعات ستار [ 45 ] )؛ نفس CWI
- 3846 – اللغة التركية (على طابعات ستار [ 45 ] )؛ نفس اللغة التركية في PC-8 + علامة الليرة التركية القديمة (Tʟ) عند نقطة الترميز A8
- 3847 – البرازيل-ABNT (على طابعات Star [ 45 ] )؛ نفس المعيار الوطني البرازيلي NBR-9614:1986
- 3848 – Brazil-ABICOMP (على طابعات Star [ 45 ] )؛ نفس ABICOMP
- 3850 – ترميز جامعة كاسيتسارت القياسي (على طابعات ستار [ 45 ] )؛ وهو شكل مختلف من ترميز جامعة كاسيتسارت للغة التايلاندية
- 3860 – Rajvitee KU (على طابعات Star [ 45 ] )؛ نسخة معدلة من ترميز جامعة كاسيتسارت للغة التايلاندية
- 3861 – Microwiz KU (على طابعات Star [ 45 ] )؛ نسخة معدلة من ترميز جامعة كاسيتسارت للغة التايلاندية
- 3863 – STD988 TIS (على طابعات Star [ 45 ] )؛ نسخة معدلة من ترميز TIS 620 للغة التايلاندية
- 3864 – نظام TIS شائع (على طابعات Star [ 45 ] )؛ وهو نسخة معدلة من ترميز TIS 620 للغة التايلاندية
- 3865 – Newsic TIS (على طابعات Star [ 45 ] )؛ نسخة معدلة من ترميز TIS 620 للغة التايلاندية
- 28799 – FOCAL (على طابعات Star [ 45 ] )؛ نفس مجموعة أحرف FOCAL
- 28800 – HP RPL (على طابعات Star [ 45 ] )؛ نفس RPL
- (الرقم مفقود) – يدعم برنامج CWI-2 (لنظام DOS) اللغة الهنغارية
- (الرقم مفقود) – يدعم برنامج MIK (لنظام DOS) اللغة البلغارية
- (الرقم مفقود) – DOS Serbo-Croatian II؛ يدعم اللغة السلوفينية والصربية الكرواتية (الخط اللاتيني)
- (رقم مفقود) - صفحة الترميز البديلة الروسية (لنظام التشغيل DOS)؛ هذا هو أصل IBM CP 866
قائمة تعيينات صفحات الترميز
قائمة بتخصيصات صفحات الترميز المعروفة (غير مكتملة):
| بطاقة تعريف | الأسماء | وصف | أصل | منصة | دوس | نظام التشغيل OS/2 | ويندوز | ماك | آخر | التشفير | تعليق |
|---|---|---|---|---|---|---|---|---|---|---|---|
| 0 | غير متوفر | محجوز | آي بي إم، مايكروسوفت | غير متوفر | 3.3+ | 1.0+ | ؟ | ؟ | ؟ | استخدام نظام التشغيل الداخلي [ 34 ] | |
| 437 | CP437، IBM437 | جهاز كمبيوتر أمريكي | آي بي إم [ 46 ] | جهاز كمبيوتر شخصي من IBM | 3.3+ | 1.0+ | نعم | ؟ | نعم | 8-bit SBCS | |
| 57344 - 61439 | N/a | Private use derivations | IBM | N/a | N/a | N/a | N/a | N/a | N/a | various | Private use code page derivations (E000h-EFFFh) |
| 65280 - 65533 | N/a | Private use definitions | IBM | N/a | N/a | N/a | N/a | N/a | N/a | various | Private use code page definitions (FF00h-FFFDh) |
| 65534 | N/a | Reserved | IBM, Microsoft | N/a | ? | ? | ? | ? | ? | various | Internal OS use (FFFEh) |
| 65535 | N/a | Reserved | IBM, Microsoft | N/a | 3.3+ | 1.0+ | ? | ? | ? | various | Internal OS use (FFFFh)[34] |
Criticism
Many older character encodings (unlike Unicode) suffer from several problems. Some vendors insufficiently document the meaning of all code point values in their code pages, which decreases the reliability of handling textual data consistently through various computer systems. Some vendors add proprietary extensions to established code pages, to add or change certain code point values: for example, byte 0x5C in Shift JIS can represent either a back slash or a yen sign depending on the platform. Finally, in order to support several languages in a program that does not use Unicode, the code page used for each string/document needs to be stored.
Applications may also mislabel text in Windows-1252 as ISO-8859-1. The only difference between these code pages is that the code point values in the range 0x80–0x9F, used by ISO-8859-1 for control characters, are instead used as additional printable characters in Windows-1252 – notably for quotation marks, the euro sign and the trademark symbol among others. Browsers on non-Windows platforms would tend to show empty boxes or question marks for these characters, making the text hard to read. Most browsers fixed this by ignoring the character set and interpreting as Windows-1252 to look acceptable. In HTML5, treating ISO-8859-1 as Windows-1252 is even codified as a W3C standard.[47] Although browsers were typically programmed to deal with this behaviour, this was not always true of other software. Consequently, when receiving a file transfer from a Windows system, non-Windows platforms would either ignore these characters or treat them as a standard control characters and attempt to take the specified control action accordingly.
Due to Unicode's extensive documentation, vast repertoire of characters and stability policy of characters, the problems listed above are rarely a concern for Unicode. UTF-8 (which can encode over one million codepoints) has replaced the code-page method in terms of popularity on the Internet.[48][49]
Private code pages
عندما لم يجد المستخدمون، في بدايات تاريخ الحواسيب الشخصية، ما يلبي متطلباتهم في ترميز الأحرف، تم إنشاء صفحات ترميز خاصة أو محلية باستخدام أدوات إنهاء وبقاء الذاكرة المقيمة أو عن طريق إعادة برمجة ذاكرة القراءة فقط القابلة للمسح والبرمجة ( EPROM) الخاصة بنظام الإدخال والإخراج الأساسي ( BIOS ) . وفي بعض الحالات، تم ابتكار أرقام صفحات ترميز غير رسمية (مثل CP895).
مع توفر دعم أوسع لمجموعات الأحرف، تراجعت أهمية معظم صفحات الترميز تلك، باستثناءات قليلة مثل ترميز Kamenický أو KEYBCS2 للأبجديتين التشيكية والسلوفاكية . وهناك مجموعة أحرف أخرى هي معيار ترميز نظام إيران ، الذي أنشأته شركة نظام إيران لدعم اللغة الفارسية . كان هذا المعيار مستخدمًا في إيران في برامج DOS، وبعد إدخال صفحة ترميز مايكروسوفت 1256، أصبح هذا المعيار قديمًا. مع ذلك، لا تزال بعض برامج ويندوز وDOS التي تستخدم هذا الترميز قيد الاستخدام، كما توجد بعض خطوط ويندوز التي تستخدمه.
للتغلب على هذه المشكلات، يخصص المستوى الثاني من بنية تمثيل بيانات الأحرف من IBM نطاقات محددة من معرّفات صفحات الترميز للاستخدام الشخصي ولأغراض قابلة للتخصيص من قِبل المستخدم. عند استخدام هذه المعرّفات، يجب على المستخدم عدم افتراض إمكانية إعادة إنتاج نفس الوظائف والمظهر في نظام آخر أو على جهاز أو نظام آخر، إلا إذا اتخذ المستخدم الإجراءات اللازمة لذلك. النطاق 57344-61439 ( E000h - EFFFh ) محجوز رسميًا لصفحات الترميز القابلة للتخصيص من قِبل المستخدم (أو معرّفات CCSIDs في سياق IBM CDRA )، بينما النطاق 65280-65533 ( FF00h - FFFDh ) محجوز لأي تخصيصات "للاستخدام الشخصي" قابلة للتخصيص من قِبل المستخدم. على سبيل المثال، يمكن تحويل نسخة مخصصة غير مسجلة من صفحة الترميز 437 ( 1B5h ) أو 28591 ( 6FAF ) إلى 57781 ( E1B5h ) أو 61359 ( EFAFh ) على التوالي، وذلك لتجنب أي تعارضات محتملة مع التعيينات الأخرى والحفاظ على المنطق العددي الداخلي الموجود أحيانًا في تعيينات صفحات الترميز الأصلية. ويمكن أن يكون لصفحة ترميز خاصة غير مسجلة لا تستند إلى صفحة ترميز موجودة، أو صفحة ترميز خاصة بجهاز معين مثل خط الطابعة، والتي تحتاج فقط إلى مُعرّف منطقي لتصبح قابلة للعنونة من قِبل النظام، أو خط تنزيل يتغير باستمرار، أو رقم صفحة ترميز ذي دلالة رمزية في البيئة المحلية، تعيين في النطاق الخاص مثل 65280 ( FF00h ).
تم حجز معرفات صفحة الترميز 0 و 65534 ( FFFEh ) و 65535 ( FFFFh ) للاستخدام الداخلي بواسطة أنظمة التشغيل مثل DOS ويجب عدم تعيينها لأي صفحات ترميز محددة.
انظر أيضاً
- صفحة ترميز ويندوز
- ترميز الأحرف
- تعريفات وتعيينات "صفحة الترميز" الرسمية لشركة IBM (CCSID)
- اكتشاف الأحرف
- يونيكود
مراجع
- ↑ "المحتويات" . www.ibm.com .
- ↑ "صفحة الترميز" . sap.com . مؤرشف من الأصل بتاريخ 14-11-2009 . تم الاطلاع عليه بتاريخ 08-08-2009 .
- 1 2 "مسرد المصطلحات" . oracle.com . مؤرشف من الأصل بتاريخ 30-09-2011 . تم الاطلاع عليه بتاريخ 08-08-2009 .
- ↑ "معلومات عن مبرمج طرفية الفيديو VT510" . شركة ديجيتال إكويبمنت (DEC). 7.1. مجموعات الأحرف - نظرة عامة. مؤرشف من الأصل بتاريخ 26-01-2016 . تم الاطلاع عليه بتاريخ 15-02-2017 .
بالإضافة إلى مجموعات أحرف
DEC
و
ISO
التقليدية ، التي تتوافق مع بنية وقواعد
ISO 2022
، يدعم
VT510
عددًا من صفحات رموز IBM PC (
أرقام الصفحات
في دليل مجموعة الأحرف القياسي لشركة IBM) في وضع
PCTerm
لمحاكاة
طرفية وحدة التحكم
لأجهزة الكمبيوتر الشخصية القياسية في الصناعة.
- ↑ "7.1. مجموعات الأحرف - نظرة عامة". معلومات مبرمج محطة الفيديو VT520/VT525 (ملف PDF) . شركة ديجيتال إكويبمنت (DEC). يوليو 1994. ص 7-1. EK-VT520-RM. A01. مؤرشف (ملف PDF) من الأصل بتاريخ 15-02-2017 . تم الاسترجاع بتاريخ 15-02-2017 .
بالإضافة إلى
مجموعات أحرف
DEC
و
ISO التقليدية، يدعم
VT520
عددًا من صفحات رموز IBM PC (والتي تشير إلى
أرقام الصفحات
في دليل مجموعة الأحرف القياسي لشركة IBM) في وضع
PCTerm
لمحاكاة
طرفية وحدة التحكم
لأجهزة الكمبيوتر الشخصية القياسية في الصناعة.
- 1 2 3 بول، ماتياس ر. (10-06-2001) [1995]. "نظرة عامة على صفحات ترميز DOS وOS/2 وWindows" (ملف CODEPAGE.LST) ( الإصدار الأولي 1.59). مؤرشف من الأصل في 20-04-2016 . تم الاسترجاع في 20-08-2016 .
- ↑ "مجموعات رموز لغة أوامر الطابعة" . www.pclviewer.com . مؤرشف من الأصل بتاريخ 31 يوليو 2020. تم الاطلاع عليه بتاريخ 25 مايو 2021 .
- ↑ "مجموعات رموز HP" . pclhelp.com . مؤرشف من الأصل بتاريخ 19-02-2015 . تم الاطلاع عليه بتاريخ 20-02-2017 .
- ↑ "دليل مقارنة PCL5" (ملف PDF) . مؤرشف (ملف PDF) من الأصل بتاريخ 21-02-2017 . تم الاطلاع عليه بتاريخ 20-02-2017 .
- ↑ زبيكوفسكي، مارك ؛ ألين، بول ؛ بالمر، ستيف ؛ بورمان، روبن؛ بورمان، روب؛ بتلر، جون؛ كارول، تشاك؛ تشامبرلين، مارك؛ تشيل، ديفيد؛ كولي، مايك؛ كورتني، مايك؛ دريفوس، مايك؛ دنكان، راشيل؛ إيكهارت، كورت؛ إيفانز، إريك؛ فارمر، ريك؛ غيتس، بيل ؛ جيري، مايكل؛ غريفين، بوب؛ هوغارث، دوغ؛ جونسون، جيمس دبليو؛ كرماني، كامل؛ كينغ، أدريان؛ كوخ، ريد؛ لاندوفسكي، جيمس؛ لارسون، كريس؛ لينون، توماس؛ ليبكي، دان؛ ماكدونالد، مارك ؛ ماكيني، بروس؛ مارتن، باسكال؛ ماذرز، إستيل؛ ماثيوز، بوب؛ ميلين، ديفيد؛ ميرجنتايم، تشارلز؛ نيفين، راندي؛ نيويل، دان؛ نيويل، تاني؛ نوريس، ديفيد؛ أوليري، مايك؛ أورير، بوب ؛ أولسون، مايك؛ أوسترمان، لاري؛ أوستلينغ، ريدج؛ باي، سونيل؛ باترسون، تيم ؛ بيريز، غاري؛ بيترز، كريس؛ بيتزولد، تشارلز ؛ بولوك، جون؛ رينولدز، آرون ؛ روبين، داريل؛ رايان، رالف؛ شولمايسترز، كارل؛ شاه، راجين؛ شو، باري؛ شورت، أنتوني؛ سليفكا، بن؛ سميرل، جون؛ ستيلمايكر، بيتي؛ ستودارد، جون؛ تيلمان، دينيس؛ ويتن، غريغ؛ يونت، ناتالي؛ زيك، ستيف (1988). "المستشارون التقنيون". موسوعة MS-DOS: الإصدارات من 1.0 إلى 3.2 . بقلم: دنكان، راي؛ بوستويك، ستيف؛ بورغوين، كيث؛ بايرز، روبرت أ.؛ هوغان، ثوم؛ كايل، جيم؛ ليتوين، غوردون ؛ بيتزولد، تشارلز ؛ رابينوفيتز، تشيب؛ توملين، جيم؛ ويلتون، ريتشارد؛ وولفرتون، فان؛ وونغ، ويليام؛ وودكوك، جوان ( طبعة منقحة بالكامل). ريدموند، واشنطن، الولايات المتحدة الأمريكية: مطبعة مايكروسوفت . ISBN 1-55615-049-0LCCN 87-21452 . OCLC 16581341 . تمت أرشفة هذه النسخة في 14 أكتوبر 2018 على موقع Wayback Machine (19+1570 صفحة؛ 26 سم) (ملاحظة: تم نشر هذه الطبعة في عام 1988 بعد إعادة صياغة شاملة للطبعة الأولى المسحوبة عام 1986 من قبل فريق مختلف من المؤلفين.)
- ↑ "معرفات صفحة الترميز" . microsoft.com . مايكروسوفت . مؤرشف من الأصل بتاريخ 27-10-2014 . تم الاسترجاع بتاريخ 27-10-2014 .
- ↑ "برمجة فيديو VGA/SVGA - تشغيل وضع نص VGA" . osdever.net . مؤرشف من الأصل بتاريخ 2010-09-01 . تم الاطلاع عليه بتاريخ 2006-09-23 .
- ↑ "عولمة نظام IBM i: صفحات الترميز" . شركة IBM. مؤرشف من الأصل بتاريخ 16-07-2012.
- ١ ٢ ٣ ٤ ٥ ٦ xlate - ترجمة محتويات السجلات ، شركة IBM ، ٢٠١٠ [١٩٨٦]، مؤرشف من الأصل في ٢٠١٩-٠٦-١٦ ، تم استرجاعه في ٢٠١٦-١٠-١٨
- ↑ "صفحة الترميز CPGID 01093 (pdf)" (PDF) . مؤرشفة من الأصل (PDF) بتاريخ 2015-07-08.
- ↑ بول، ماتياس ر. (10-06-2001) [1995]. "وصف تنسيق ملفات DOS وOS/2 وWindows NT بصيغة .CPI، وملفات Linux بصيغة .CP" (ملف CPI.LST) ( الإصدار 1.30). مؤرشف من الأصل بتاريخ 20-04-2016 . تم الاطلاع عليه بتاريخ 20-08-2016 .
- ↑ إليوت، جون سي. (14 أكتوبر 2006). "تنسيق ملف CPI" . Seasip.info . مؤرشف من الأصل بتاريخ 22 سبتمبر 2016. تم الاطلاع عليه بتاريخ 22 سبتمبر 2016 .
- ↑ براور، أندريس إيفرت (10 فبراير 2001). "خطوط CPI" . 0.2. مؤرشف من الأصل بتاريخ 22 سبتمبر 2016. تم الاطلاع عليه بتاريخ 22 سبتمبر 2016 .
- ↑ هارالامبوس، يانيس (سبتمبر 2007). الخطوط والترميزات . ترجمة هورن، ب. سكوت ( الطبعة الأولى). سيباستوبول، كاليفورنيا، الولايات المتحدة الأمريكية: أورايلي ميديا، الصفحات 601-602 ، 611. ISBN 978-0-596-10242-5.
- ↑ مرجع مبرمج MS-DOS . مطبعة مايكروسوفت . 1991. ISBN 1-55615-329-5.
- ↑ "صفحة الترميز 1004 - ويندوز الموسع" . آي بي إم . 2001. مؤرشف من الأصل بتاريخ 13-05-2018 . تم الاسترجاع بتاريخ 13-05-2018 .
- ↑ "بنية تمثيل بيانات الأحرف" . شركة آي بي إم . مؤرشف من الأصل بتاريخ 23 يونيو 2019. تم الاطلاع عليه بتاريخ 12 أكتوبر 2019 .
- 1 2 3 4 5 6 7 8 9 10 11 12 "معرّف مجموعة الأحرف المشفرة من IBM (CCSID)" . IBM . مؤرشف من الأصل بتاريخ 26-11-2009.
- ↑ ISO/IEC 8859-1:1998(E) . ISO . 15-04-1998. ص 1. مؤرشف من الأصل بتاريخ 30-10-2020 . تم الاطلاع عليه بتاريخ 30-10-2020 .
يمكن استخدام الأحرف المشفرة في هذه المجموعة بالتزامن مع وظائف التحكم المشفرة المختارة من ISO/IEC 6429.
- ↑ "صفحات الترميز" . microsoft.com . مايكروسوفت . مؤرشف من الأصل بتاريخ 27-02-2011 . تم الاطلاع عليه بتاريخ 21-12-2010 .
- ↑ "pentaho/pentaho-reporting" . GitHub . مؤرشف من الأصل بتاريخ 16-06-2019 . تم الاطلاع عليه بتاريخ 20-02-2017 .
- 1 2 3 4 5 "معرفات صفحة الترميز" . شبكة مطوري مايكروسوفت . مايكروسوفت. 2014. مؤرشف من الأصل بتاريخ 19-06-2016 . تم الاسترجاع بتاريخ 19-06-2016 .
- ١ ٢ ٣ ٤ ٥ "ترميزات الويب - إنترنت إكسبلورر - الترميزات" . ويكي WHATWG . ٢٠١٢-١٠-٢٣. مؤرشف من الأصل في ٢٠١٦-٠٦-٢٠ . تم الاسترجاع في ٢٠١٦-٠٦-٢٠ .
- ↑ فولر، أنتونين (2014) [2011]. "ترميز أوروبا الغربية (IA5) - مجموعات أحرف ويندوز" . WUtils.com - أداة مساعدة عبر الإنترنت . برمجيات موتوبيت. مؤرشف من الأصل بتاريخ 20-06-2016 . تم الاسترجاع بتاريخ 20-06-2016 .
- ↑ فولر، أنتونين (2014) [2011]. "ترميز اللغة الألمانية (IA5) - مجموعات أحرف ويندوز" . WUtils.com - أداة مساعدة عبر الإنترنت . شركة موتوبيت للبرمجيات. مؤرشف من الأصل بتاريخ 20 يونيو 2016. تم الاطلاع عليه بتاريخ 20 يونيو 2016 .
- ↑ فولر، أنتونين (2014) [2011]. "ترميز اللغة السويدية (IA5) - مجموعات أحرف ويندوز" . WUtils.com - أداة مساعدة عبر الإنترنت . شركة موتوبيت للبرمجيات. مؤرشف من الأصل بتاريخ 20 يونيو 2016. تم الاطلاع عليه بتاريخ 20 يونيو 2016 .
- ↑ فولر، أنتونين (2014) [2011]. "ترميز اللغة النرويجية (IA5) - مجموعات أحرف ويندوز" . WUtils.com - أداة مساعدة عبر الإنترنت . شركة موتوبيت للبرمجيات. مؤرشف من الأصل بتاريخ 20 يونيو 2016. تم الاطلاع عليه بتاريخ 20 يونيو 2016 .
- ↑ فولر، أنتونين (2014) [2011]. "ترميز US-ASCII - مجموعات أحرف ويندوز" . WUtils.com - أداة مساعدة عبر الإنترنت . شركة موتوبيت للبرمجيات. مؤرشف من الأصل بتاريخ 20 يونيو 2016. تم الاطلاع عليه بتاريخ 20 يونيو 2016 .
- 1 2 3 4 5 6 7 بول، ماتياس ر. (2002-09-05)، معلومات تقنية حول معلومات الدولة غير الموثقة لنظام DOS لسجلات LCASE وARAMODE وCCTORC ، قائمة تطوير FreeDOS fd-dev على Topica، مؤرشفة من الأصل في 2016-05-27 ، تم استرجاعها في 2016-05-26
- 1 2 3 4 5 6 7 8 براون، رالف د. (29-12-2002). قائمة المقاطعات x86 . 61.
- 1 2 3 4 5 6 7 8 بول، ماتياس ر. (1997/07/30). NWDOS-TIPs — نصائح وحيل لتشغيل Novell DOS 7، مع النقر على تفاصيل التفاصيل والأخطاء والحلول البديلة . MPDOSTIP (باللغة الألمانية) (3 ed.). مؤرشفة من الأصلي بتاريخ 22-05-2016 . تم الاسترجاع 2012/01/11 . (ملاحظة: يُعدّ ملف NWDOSTIP.TXT مرجعًا شاملًا حول نظامي التشغيل Novell DOS 7 و OpenDOS 7.01 ، ويتضمن وصفًا للعديد من الميزات والتفاصيل الداخلية غير الموثقة. وهو جزء من مجموعة MPDOSTIP.ZIP الأكبر حجمًا التي احتفظ بها المؤلف حتى عام 2001، والتي تم توزيعها على العديد من المواقع في ذلك الوقت. يشير الرابط المرفق إلى نسخة أقدم من ملف NWDOSTIP.TXT تم تحويلها إلى صيغة HTML.)
- 1 2 3 4 5 6 7 8 بول، ماتياس ر. (2001-04-09). NWDOS-TIPs — نصائح وحيل لتشغيل Novell DOS 7، مع النقر على تفاصيل التفاصيل والأخطاء والحلول البديلة . MPDOSTIP (باللغة الألمانية) (3 ed.).
- ↑ "770" . مؤرشف من الأصل بتاريخ 26-02-2017 . تم الاطلاع عليه بتاريخ 25-02-2017 .من شركة ليكا سوفتوير الليتوانية
- 1 2 3 4 5 6 7 8 "LIKIT" . www.likit.lt . مؤرشف من الأصل بتاريخ 19 أبريل 2017. تم الاطلاع عليه بتاريخ 25 فبراير 2017 .
- ↑ "771" . مؤرشف من الأصل بتاريخ 26-02-2017 . تم الاطلاع عليه بتاريخ 25-02-2017 .من شركة ليكا سوفتوير الليتوانية
- ↑ "772" . مؤرشف من الأصل بتاريخ 26-02-2017 . تم الاطلاع عليه بتاريخ 25-02-2017 .من شركة ليكا سوفتوير الليتوانية
- ↑ "774" . مؤرشف من الأصل بتاريخ 26-02-2017 . تم الاطلاع عليه بتاريخ 25-02-2017 .من شركة ليكا سوفتوير الليتوانية
- 1 2 3 "lietuvybė.lt - Rašmenų koduotės" [ lietuvybė.lt - ترميزات الأحرف ] (باللغة الليتوانية). مؤرشفة من الأصلي بتاريخ 2019-08-28 . تم الاسترجاع 2019-08-28 .
- ^ هوجان ، توم (1992). Die PC-Referenz für Programmierer (باللغة الألمانية) (2 ed.). سيستيما فيرلاج GmbH. رقم ISBN 3-89390-272-4.(ملاحظة: هذا الكتاب هو الترجمة الألمانية لكتاب "The Programmer's PC Sourcebook" الصادر عن دار نشر مايكروسوفت. ويذكر رقم صفحة الترميز 854 لإسبانيا. )
- ١ ٢ ٣ ٤ ٥ ٦ ٧ ٨ ٩ ١٠ ١١ ١٢ ١٣ ١٤ ١٥ ١٦ ١٧ ١٨ ١٩ ٢٠ ٢١ ٢٢ ٢٣ ٢٤ ٢٥ ٢٦ " دليل مستخدم Star LC 8021 " ( ملف PDF ) . مؤرشف ( PDF ) من الأصل بتاريخ ٢٠٢٠-٠٩-٢٩ . تم الاطلاع عليه بتاريخ ٢٠١٧-٠٢-٢٠ .
- ↑ شركة IBM. "وثيقة معلومات صفحة ترميز SBCS - CPGID 00437" . مؤرشفة من الأصل بتاريخ 2016-06-09 . تم الاطلاع عليها بتاريخ 2014-07-04 .
- ↑ "الترميز" . WHATWG . 27-01-2015. القسم 4.2 الأسماء والتسميات. مؤرشف من الأصل في 04-02-2015 . تم الاسترجاع في 04-02-2015 .
- ↑ "إحصائيات استخدام ترميز الأحرف للمواقع الإلكترونية (يتم تحديثها يوميًا)" . w3techs.com . تم الاطلاع عليه بتاريخ 2015-08-06 .
- ↑ "إحصائيات استخدام UTF-8" . trends.builtwith.com . مؤرشف من الأصل بتاريخ 24-03-2011 . تم الاطلاع عليه بتاريخ 28-03-2011 .
روابط خارجية
- مسرد مصطلحات IBM CDRA
- صفحات ترميز IBM في Wayback Machine (تمت أرشفة بتاريخ 2016-02-05)
- صفحات ترميز IBM حسب نظام الترميز في Wayback Machine (تمت أرشفته في 2009-09-06)
- معلومات مجموعة الأحرف IBM/ICU
- معرّفات صفحات الترميز من مايكروسوفت (تحتوي قائمة مايكروسوفت على صفحات الترميز المستخدمة فعليًا بواسطة التطبيقات العادية على نظام ويندوز فقط. راجع أيضًا قائمة تورستن مورين للاطلاع على القائمة الكاملة لصفحات الترميز المدعومة).
- قائمة مختصرة من مايكروسوفت تحتوي فقط على صفحات رموز ANSI و OEM ولكن مع روابط لمزيد من التفاصيل حول كل منها في Wayback Machine (تمت أرشفة بتاريخ 23-10-2012)
- مجموعات الأحرف وصفحات الترميز بضغطة زر
- أمر Microsoft Chcp: عرض وتعيين صفحة التعليمات البرمجية النشطة في وحدة التحكم
- ترميز الأحرف
