آيزو/آي إي سي 8859-1

| MIME / IANA |
ISO-8859-1 |
|---|---|
| أسماء أخرى |
ايزو-ir-100، csISOLatin1، latin1، l1، IBM819، CP819 |
| اللغات |
الإنجليزية، مختلف اللغات الأخرى |
| المعايير | |
| التصنيف |
ASCII الموسع، آيزو/آي إي سي 8859 |
| مأخوذ عن |
DEC MCS |
|---|---|
| امتداد لـ | |
| ترميزات مرتبطة |
|
أي اس او/ أي إي سي 8859-1:1998 ( بلانجليزيه : ISO/IEC 8859-1:1998 ) هي جزء من سلسلة معايير أي اس او/ أي إي سي 8859 لترميزات الأحرف المستندة إلى ASCII. هذه المواصفة، والتي تحمل الاسم الرسمي "تكنولوجيا المعلومات - مجموعات أحرف رسومية مشفرة أحادية البايتمكونة من 8 بتات - الجزء 1: النص اللاتيني رقم 1"، صدرت طبعتها الأولى عام 1987.يقوم المعيار أي اس او/ أي إي سي 8859-1 بترميز ما يُعرف بـ "الأبجدية اللاتينية رقم 1"، والتي تتكون من 191 حرفًا من النص اللاتيني. يُستخدم هذا المخطط لترميز الأحرف على نطاق واسع في الأمريكتين وأوروبا الغربية وأوقيانوسيا ، ومعظم أجزاء أفريقيا. كما أنه يُعد الأساس لبعض مجموعات الأحرف الشائعة المكونة من 8 بتات، ويشكل الكتلتين الأوليين من الأحرف في نظام الترميز الموحد (Unicode.)
اعتبارًا من أبريل 2025، تستخدم 1.1% من جميع المواقع الإلكترونية ISO/IEC 8859-1. ورغم أنه الترميز أحادي البايت الأكثر تصريحًا، إلا أن متصفحات الويب ومعيار HTML5 يفسرانه على أنه مجموعة أحرف [1]Windows-1252 الأوسع، مما يسمح لهذه المستندات بتضمين أحرف من تلك المجموعة. تُظهر بعض البلدان أو اللغات معدلات استخدام أعلى من المتوسط العالمي؛ ففي عام 2025، [2] يصل استخدام هذا الترميز في البرازيل إلى 2.9%، وفي ألمانيا إلى 2.3%، وذلك وفقًا لاستخدام المواقع الإلكترونية.[3][4]
كان ISO-8859-1 (وفقًا للمعيار على الأقل) هو الترميز الافتراضي للمستندات التي تُسلّم عبر HTTP بنوع MIME يبدأ بـ text/. كما كان الترميز الافتراضي لقيم رؤوس HTTP الوصفية المحددة، وحدد مجموعة الأحرف المسموح بها في مستندات HTML3.2. يتم تحديده بواسطة العديد من المعايير الأخرى. مثال على معيار آخر يعتمد على ISO-8859-1:
- RFC 2046 (MIME Part Two: Media Types): يُشير هذا المعيار إلى ISO-8859-1 كترميز أساسي لأنواع النصوص البسيطة.
من الناحية العملية، يُعدّ الترميز الفرعي Windows-1252 هو الإعداد الافتراضي الأكثر فعالية على الأرجح في الواقع العملي، وأصبح من الشائع بشكل متزايد أن يعمل UTF-8 بغض النظر عما إذا كان المعيار يحدد ذلك أم لا.[بحاجة لمصدر][بحاجة لمصدر]
ISO-8859-1: الأسماء البديلة والألقاب يُعدّ ISO-8859-1 الاسم المفضل لدى IANA لهذا المعيار، وذلك عند استكماله برموز التحكم C0 وC1 من ISO/IEC 6429 . توجد عدة أسماء مستعارة أخرى مسجلة لهذا المعيار، منها: iso-ir-100، csISOLatin1، latin1، وl1.تستخدم شركة IBM هذا المعيار تحت اسم Code page 819 أو CP819 (CCSID 819)، بينما تُطلق عليه شركة اوراكل اسم WE8ISO8859P1. في بيئة ويندوز،[5][6] يُعرف هذا الترميز باسم Code page 28591، أو ويندوز-28591.[7][8][9]
التغطية
يُرمّز كل حرف في هذا المعيار كقيمة رمزية واحدة مكونة من ثماني بتات. يمكن استخدام قيم التعليمات البرمجية هذه في أي نظام تقريبًا لتبادل البيانات بهدف التواصل باللغات التالية (مع الأخذ في الاعتبار أن علامات الاقتباس الصحيحة قد تُستبعد في العديد من اللغات، بما في ذلك الألمانية والأيسلندية):
اللغات الحديثة مع تغطية كاملة
- الأفريكانية
- الألبانية
- الباسكية
- البريتونية
- الكورسيكية
- الإنجليزية
- الفاروية
- الجاليكية
- الآيسلندية
- الإيدو
- الأيرلندية
- الإندونيسية
- الإيطالية
- الليونية
- اللوجبان
- اللوكسمبورغية[ا]
- الملايو[ب]
- المنكس
- النرويجية[ج]
- الأوكيتانية
- البرتغالية[د]
- الرايتو-رومانية
- الروتوكاس
- الغيلية الاسكتلندية
- الاسكتلنديين
- السامي الجنوبي
- الإسبانية
- السواحيلية
- السويدية
- التاغالوغية (نص لاتيني)
- توكي بونا
- الوالونية
اللغات ذات التغطية غير الكاملة
على الرغم من أن ISO-8859-1 لا يحتوي على جميع الأحرف المستخدمة في بعض اللغات، إلا أنه كان يُستخدم بشكل شائع لهذه اللغات.[بحاجة لمصدر] في معظم الحالات، يمكن استبدال الأحرف المفقودة أو نادرة الاستخدام بأحرف مشابهة متوفرة في ISO-8859-1، وذلك من خلال نوع من <b>التقريب المطبعي</b>. يوضح الجدول التالي (المفترض) هذه اللغات.
| اللغة | الأحرف المفقودة | الحلول الشائعة | مدعومة بواسطة |
| الكتالونية | Ŀ, ŀ (مهملة) | L·, l· | |
| الدنماركية | Ǿ, ǿ (اللكنة اختيارية وǿ نادرة جدًا) | Ø, ø أو øe | |
| الهولندية | IJ, ij (موضع نقاش)، j́ (في الكلمات المشددة مثل "blíj́f") | IJ, ij أو ÿ؛ blíjf | |
| الإستونية، الفنلندية | Š, š, Ž, ž (موجودة فقط في الكلمات الدخيلة) | Sh, sh, Zh, zh | ISO-8859-15, Windows-1252 |
| الفرنسية | Œ, œ، وŸ النادرة جدًا | OE, oe؛ Y أو Ý | ISO-8859-15, Windows-1252 |
| الألمانية | ẞ (حرف ß الكبير، يستخدم فقط في الكتابة الكبيرة بالكامل) | SS أو SZ | |
| المجرية | Ő, ő, Ű, ű | Ö, ö, Ü, ü<br>Õ, õ, Û, û (الأحرف التي تم استبدالها في 8859-2) | ISO-8859-2, Windows-1250 |
| الأيرلندية (الإملاء التقليدي) | Ḃ, ḃ, Ċ, ċ, Ḋ, ḋ, Ḟ, ḟ, Ġ, ġ, Ṁ, ṁ, Ṗ, ṗ, Ṡ, ṡ, Ṫ, ṫ | Bh, bh, Ch, ch, Dh, dh, Fh, fh, Gh, gh, Mh, mh, Ph, ph, Sh, sh, Th, th | ISO-8859-14 |
| المالطية | Ċ, ċ, Ġ, ġ, Ħ, ħ, Ż, ż | C, c, G, g, H, h, Z, z | ISO-8859-3 |
| الويلزية | Ẁ, ẁ, Ẃ, ẃ, Ŵ, ŵ, Ẅ, ẅ, Ỳ, ỳ, Ŷ, ŷ, Ÿ | W, w, Y, y, Ý, ý | ISO-8859-14 |
الحرف ÿ، الذي يظهر نادرًا في الفرنسية (خاصة في أسماء المدن مثل "هاى ليه روز" ولا يبدأ به أي كلمة)، يُدرج فقط كحرف صغير. في المقابل، تشغل الخانة المخصصة لحرفه الكبير الحرف ß الصغير من اللغة الألمانية، نظرًا لأن اللغة الألمانية لم يكن لديها حرف كبير مكافئ لـ ß عند وضع المعيار.
علامات الاقتباس
تفتقر هذه الأحرف إلى علامات الاقتباس الطباعية (المُمثلة عادةً بالشكلين 6 أو 9)، وكذلك علامات الاقتباس الأساسية المستخدمة في بعض اللغات المدعومة. تقتصر العلامات المتضمنة على « » و" " و' '. قد تعرض بعض الخطوط علامة التمييز (0x60) وعلامة الاقتباس العليا (0x27) كزوج متطابق من علامات الاقتباس المفردة الموجهة (راجع قسم "الآلات الكاتبة وأجهزة الكمبيوتر المبكرة" في مقال علامات الاقتباس)، لكن هذا لا يُعد جزءًا من المعيار الحديث.
الأرقام العلوية
تم ترميز ثلاثة أرقام علوية فقط: ² عند 0xB2، ³ عند 0xB3، و¹ عند 0xB9. هذا يعني أن الرقم العلوي ⁰ والأرقام من ⁴ إلى ⁹ غير موجودة. إضافة إلى ذلك، لم يتم ترميز أي من الأرقام السفلية. يمكن أن يكون الحل البديل لهذه المشكلة هو استخدام تنسيق النص الغني (Rich Text Format) للأرقام التي لا يغطيها هذا المعيار.
علامة اليورو
قدمت علامة اليورو للجمهور في 12 ديسمبر 1996.[10] ونظرًا لأن مجموعة الأحرف هذه (ISO/IEC 8859-1) صدرت في عام 1987، فإنها لا تتضمن علامة اليورو. مع ذلك، فإن مجموعات الأحرف اللاحقة المشابهة لـ أي اس او/ أي إي سي 8859-1، مثل Windows-1252 و أي اس او/ أي إي سي 8859-15، تتضمن علامة اليورو.
تاريخ
ا تم تطوير ISO 8859-1 بالاستناد إلى مجموعة الأحرف المتعددة الجنسيات (MCS) التي استخدمتها شركة شركة Digital Equipment Corporation (DEC) في محطة VT220 الشهيرة عام 1983. وقد جرى تطويره ضمن الرابطة الأوروبية لمصنعي أجهزة الكمبيوتر (ECMA)، ونُشر في مارس 1985 تحت اسم ECMA-94، وهو الاسم الذي يُعرف به أحيانًا حتى الآن. الطبعة الثانية من ECMA-94، الصادرة في يونيو 1986،[11] تضمنت أيضًا ISO 8859-2، ISO 8859-3، وISO 8859-4 كجزء من المواصفات.
على الرغم من أن المسودة الأصلية لمعيار ISO 8859-1 وضعت الحرفين الفرنسيين Œ وœ في نقاط كود محددة (0xD7 و 0xF7) كما في MCS، إلا أن اعتراضًا خاطئًا من المندوب الفرنسي، بدعم من شركة "Bull Publishing Company"، أدى إلى إزالتهما بحجة أنهما مجرد روابط لا أحرف مستقلة، ليتم استبدالهما لاحقًا بعلامتي الضرب والقسمة بناءً على اقتراح ألماني؛ كما أدت المزاعم الخاطئة المماثلة حول الحرف ÿ إلى استبعاد حرفه الكبير Ÿ،[12] رغم استخدامهما في الفرنسية، مما دفع لإضافة هذه الأحرف لاحقًا في <b>ISO/IEC<span typeof="mw:Entity" id="mwAVg"> </span>8859-15:1999</b> ، بينما توافق BraSCIIالمسودة الأصلية.
في عام 1985، تبنّت شركة Commodore بروتوكول ECMA-94 لنظام التشغيل الجديد AmigaOS. وقد شملت طابعة Seikosha MP-1300AI ذات التأثير النقطي،[13] التي كانت تُستخدم مع جهاز Amiga 1000، هذا الترميز..[بحاجة لمصدر]
في عام 1990، استخدمت النسخة الأولى من Unicode نقاط الترميز الخاصة بـ أي اس او-8859-1 كأول 256 نقطة ترميز Unicode.
في عام 1992، سجلت IANA خريطة الأحرف أي اس او_8859-1:1987 ، والمعروفة بشكل أكثر شيوعًا باسم MIME المفضل لها وهو أي اس او 8859-1 (لاحظ الواصلة الإضافية فوق أي اس او 8859-1)، مجموعة فرعية من أي اس او 8859-1، للاستخدام على الإنترنت . تقوم هذه الخريطة بتعيين رموز التحكم C0 وC1 لقيم الرموز غير المخصصة وبالتالي توفر 256 حرفًا عبر كل قيمة 8 بت ممكنة.
تخطيط صفحة التعليمات البرمجية
| ISO/IEC 8859-1 | ||||||||||||||||
| 0 | 1 | 2 | 3 | 4 | 5 | 6 | 7 | 8 | 9 | A | B | C | D | E | F | |
| 0x | ||||||||||||||||
| 1x | ||||||||||||||||
| 2x | SP | ! | " | # | $ | % | & | ' | ( | ) | * | + | , | - | . | / |
| 3x | 0 | 1 | 2 | 3 | 4 | 5 | 6 | 7 | 8 | 9 | : | ; | < | = | > | ? |
| 4x | @ | عبدالرحمان سلكة | B | C | D | E | F | G | H | I | J | K | L | M | N | O |
| 5x | P | Q | R | S | T | U | V | W | X | Y | Z | [ | \ | ] | ^ | _ |
| 6x | ` | عبدالرحمان سلكة | B | C | D | E | F | G | H | I | J | K | L | M | N | O |
| 7x | P | Q | R | S | T | U | V | W | X | Y | Z | { | | | } | ~ | |
| 8x | ||||||||||||||||
| 9x | ||||||||||||||||
| Ax | NBSP | ¡ | ¢ | £ | ¤ | ¥ | ¦ | § | ¨ | © | ª | « | ¬ | SHY | ® | ¯ |
| Bx | ° | ± | ² | ³ | ´ | µ | ¶ | · | ¸ | ¹ | º | » | ¼ | ½ | ¾ | ¿ |
| Cx | À | Á | Â | Ã | Ä | Å | Æ | Ç | È | É | Ê | Ë | Ì | Í | Î | Ï |
| Dx | Ð | Ñ | Ò | Ó | Ô | Õ | Ö | × | Ø | Ù | Ú | Û | Ü | Ý | Þ | ß |
| Ex | à | á | â | ã | ä | å | æ | ç | è | é | ê | ë | ì | í | î | ï |
| Fx | ð | ñ | ò | ó | ô | õ | ö | ÷ | ø | ù | ú | û | ü | ý | þ | ÿ |
| قالب:Chset-table-footer1 | ||||||||||||||||
مجموعات أحرف مماثلة
أي اس او/ أي إي سي 8859-15
المنظمة الدولية للتوحيد القياسي/اللجنة الكهروتقنية الدولية<span typeof="mw:Entity" id="mwAXs"> </span>تم تطوير 8859-15 في عام 1999، كتحديث لـ أي اس او/ أي إي سي 8859-1. إنه يوفر بعض الأحرف للنصوص الفرنسية والفنلندية وعلامة اليورو ، والتي هي مفقودة من أي اس او/ أي إي سي 8859-1. يتطلب هذا إزالة بعض الأحرف غير المستخدمة بشكل متكرر من أي اس او/ أي إي سي 8859-1، بما في ذلك رموز الكسور والعلامات الإعرابية الخالية من الحروف: ¤ ، ¦ ، ¨ ، ´ ، ¸ ، ¼ ، ½ ، ¾ . ومن المفارقات أن ثلاثة من الأحرف المضافة حديثًا ( Œ و œ و Ÿ ) كانت موجودة بالفعل في مجموعة الأحرف المتعددة الجنسيات (MCS) الخاصة بـ DEC لعام 1983، وهي السلف لمجموعة الأحرف الدولية أي اس او/ أي إي سي. 8859-1 (1987). نظرًا لأن نقاط الكود الأصلية الخاصة بهم تم إعادة استخدامها الآن لأغراض أخرى، فقد كان لا بد من إعادة تقديم الأحرف تحت نقاط كود مختلفة وأقل منطقية.
ISO-IR-204، وهو تعديل أكثر بساطة (يسمى صفحة الرموز) تم تسجيل أي اس او-8859-1 (رقم 61235 بواسطة FreeDOS)، [14] في عام 1998، مما أدى إلى تغيير أي اس او-8859-1 عن طريق استبدال علامة العملة العالمية (¤) بعلامة اليورو (نفس الاستبدال الذي تم إجراؤه بواسطة أي اس او-8859-15).
ويندوز-1252
تُضيف مجموعة أحرف <b>ويندوز -1252</b> الشائعة جميع الأحرف التي كانت مفقودة في <b>أي اس او/ أي إي سي 8859-15</b>، بالإضافة إلى عدد من الرموز الطباعية. يتم ذلك عن طريق استبدال عناصر التحكم C1 نادرة الاستخدام في النطاق من 128 إلى 159 (من 80 إلى 9F). من الشائع جدًا أن يُسمى نص ويندوز -1252 خطأً على أنه أي اس او-8859-1.
كانت النتيجة الشائعة لهذا الخلط هي استبدال جميع علامات الاقتباس والفواصل العليا (التي تنتجها "علامات الاقتباس الذكية" في برامج معالجة الكلمات) بعلامات استفهام أو مربعات على أنظمة التشغيل غير ويندوز ، مما جعل قراءة النص صعبة. تقوم العديد من متصفحات الويب وعملاء البريد الإلكتروني بتفسير أكواد التحكم أي اس او-8859-1 على أنها أحرف ويندوز -1252، وقد تم توحيد هذا السلوك لاحقًا في HTML5.[15]
ماك رومان
في عام 1984، قدم جهاز كمبيوتر Apple Macintosh ترميزًا للأحرف يُعرف باسم <b>Mac Roman</b> . كان الهدف منه أن يكون مناسبًا لبرامج للنشر المكتبي في أوروبا الغربية. يُعد Mac Roman مجموعة فرعية من ASCII، ويحتوي على معظم الأحرف الموجودة في ISO-8859-1 وجميع الأحرف الإضافية من Windows-1252، لكن بترتيب مختلف تمامًا.غالبًا ما كانت الأحرف القليلة القابلة للطباعة الموجودة في إصدارات أي اس او/ أي إي سي 8859-1، ولكنها غير موجودة في Mac Roman، مصدرًا للمشاكل عند تحرير النصوص على مواقع الويب باستخدام متصفحات Macintosh القديمة، بما في ذلك الإصدار الأخير من Internet Explorer لنظام التشغيل Mac.
آخر
يحتوي نظام التشغيل DOS على صفحة رموز 850 ، والتي تتضمن جميع الأحرف القابلة للطباعة الموجودة في أي اس اوO-8859-1، وإن كان بترتيب مختلف تمامًا، بالإضافة إلى الأحرف الرسومية الأكثر شيوعًا من صفحة الرموز<span typeof="mw:Entity" id="mwAbE"> </span>437.
بين عامي 1989 [16] و2015، استخدمت شركة(HP) Hewlett-Packard مجموعة فرعية أخرى من أي اس او -8859-1 في العديد من آلاتها الحاسبة.[16] حيث أُشير إلى مجموعة الأحرف الملكية هذه أحيانًا باسم "ECMA-94". بالإضافة إلى ذلك، لدى HP صفحة الكود 1053، ,وهي التي تضيف رمز التظليل المتوسط (▒، U+2592) عند القيمة 0x7F.[17]
صُممت العديد من صفحات رموز EBCDICعن قصد لتحتوي على نفس مجموعة الأحرف الموجودة في أي اس او -8859-1، وذلك لتسهيل عملية التحويل بينهما.
انظر أيضا
مراجع
- ↑ Cowan، John؛ Soltano، Sam (أغسطس 2014). "Source of character encoding statistics?". W3Techs. مؤرشف من الأصل في 2024-04-04.
- ↑ "Distribution of Character Encodings among websites that use Brazil". W3Techs. اطلع عليه بتاريخ 2024-12-16.
- ↑ "Distribution of Character Encodings among websites that use .de". W3Techs. اطلع عليه بتاريخ 2025-04-16.
- ↑ "Distribution of Character Encodings among websites that use German". W3Techs. مؤرشف من الأصل في 2024-04-04. اطلع عليه بتاريخ 2025-04-16.
- ↑ "Code Page Identifiers". Microsoft Corporation. مؤرشف من الأصل في 2017-11-09. اطلع عليه بتاريخ 2010-12-19.
- ↑ "Code page 819 information document". مؤرشف من الأصل في 2015-05-31.
- ↑ Code Page CPGID 00819 (txt)، IBM، مؤرشف من الأصل في 2025-04-23
- ↑ Code Page CPGID 00819 (pdf) (PDF)، IBM، مؤرشف من الأصل (PDF) في 2025-04-23
- ↑ "CCSID 819 information document". مؤرشف من الأصل في 2016-03-26.
- ↑ "Typographers discuss the euro". Evertype. ديسمبر 1996. مؤرشف من الأصل في 2024-12-11. اطلع عليه بتاريخ 2023-04-28.
- ↑ "Second edition of ECMA-94 (June 1986)" (PDF). مؤرشف من الأصل (PDF) في 2020-09-22.
- ↑ André, Jacques (1996). "ISO Latin-1, norme de codage des caractères européens? Trois caractères français en sont absents!" (PDF). Cahiers GUTenberg (بالفرنسية) (25): 65–77. DOI:10.5802/cg.205. Archived from the original (PDF) on 2025-01-23.
- ↑ Malyshev، Michael (10 يناير 2003). "Registration of new charset [Amiga-1251]". ATO-RU (Amiga Translation Organization - Russian Department). مؤرشف من الأصل في 2025-05-09. اطلع عليه بتاريخ 2016-12-05.
- ↑ "Cpi/CPIISO/Codepage.TXT at master · FDOS/Cpi". غيت هاب. مؤرشف من الأصل في 2024-05-22.
- ↑ van Kesteren، Anne (27 يناير 2015). "5.2 Names and labels". Encoding Standard. مجموعة عمل تكنولوجيا تطبيقات النص التشعبي على الويب . مؤرشف من الأصل في 2015-02-04. اطلع عليه بتاريخ 2015-02-04.
{{استشهاد ويب}}: صيانة الاستشهاد: علامات ترقيم زائدة (link) - 1 2 HP 82240B Infrared Printer (ط. 1). Corvallis, OR, USA: هيوليت-باكارد. أغسطس 1989. HP reorder number 82240-90014.
- ↑ "Code Page 1053" (PDF). مؤرشف من الأصل (PDF) في 2013-01-21.
روابط خارجية
- ISO/IEC 8859-1:1998
- ISO/IEC FDIS 8859-1:1998 نسخة محفوظة 2020-09-30 على موقع واي باك مشين. — مجموعات أحرف رسومية مشفرة أحادية البايت، مكونة من 8 بتات، الجزء الأول: الأبجدية اللاتينية رقم 1 (مسودة مؤرخة 12 فبراير 1998، نُشرت في 15 أبريل 1998)
- المعيار ECMA-94: مجموعات أحرف رسومية مشفرة ببايت واحد مكونة من 8 بتات — الأبجدية اللاتينية من رقم 1 إلى رقم 4 الطبعة الثانية (يونيو 1986)
- ISO-IR 100 الجزء الأيمن من الأبجدية اللاتينية رقم 1 (1 فبراير 1986)
- قاعدة بيانات الرسائل
<ref> موجودة لمجموعة اسمها "arabic-abajed"، ولكن لم يتم العثور على وسم <references group="arabic-abajed"/> أو هناك وسم </ref> ناقص