نافذة السياق
نافذة السياق في نموذج اللغة الكبير (LLM) هي الحد الأقصى لكمية النصوص أو المدخلات المُجزأة الأخرى المتاحة للنموذج في وقت واحد عند توليد المخرجات. تُقاس عادةً بالرموز ، وهي وحدات ينتجها مُجزئ النموذج وليست كلمات أو أحرفًا. عمليًا، نافذة السياق هي المادة التي يمكن للنموذج "رؤيتها" أثناء إنتاج الاستجابة؛ أي شيء خارج هذه النافذة غير متاح مباشرةً إلا إذا تم تلخيصه أو استرجاعه أو توفيره مرة أخرى. تتيح نافذة سياق أطول للنموذج العمل مع مطالبات أو محادثات أو مستندات أو قواعد بيانات أو مقاطع مسترجعة أطول دون الحاجة إلى ضغط أو حذف الكثير من المعلومات أولًا. [ 1 ]
ازداد حجم نوافذ السياق عمليًا بشكلٍ سريع مع تطور أنظمة التعلم طويل المدى. بعض النماذج محدودة بأطوال التسلسلات المستخدمة أثناء التدريب، بينما تسمح متغيرات الانتباه وطرق الترميز الموضعي للنماذج بالعمل على تسلسلات أطول من تلك التي شوهدت أثناء التدريب. [ 2 ] بحلول منتصف العقد الثالث من القرن الحادي والعشرين، أفادت أنظمة السياق الطويل بوجود نوافذ سياق تتراوح من مئات الآلاف إلى ملايين الرموز؛ وأفاد باحثو جوجل بتقييمات Gemini 1.5 على مهام الاسترجاع بما يصل إلى 10 ملايين رمز. [ 3 ]
لا يعني اتساع نطاق السياق بالضرورة قدرة النموذج على استخدام السياق بأكمله بكفاءة متساوية. ففي دراسة بعنوان "ضائع في المنتصف"، وجد ليو وزملاؤه أن الأداء في مهام السياق الطويل كان غالبًا أسوأ عندما ظهرت المعلومات ذات الصلة في منتصف المدخلات بدلًا من ظهورها قرب بدايتها أو نهايتها. [ 4 ] وقد قيّمت معايير أخرى قدرة السياق الطويل باستخدام مهام تتجاوز مجرد الاسترجاع، بما في ذلك الإجابة على أسئلة متعددة المستندات، وفهم الحوارات المطولة، وفهم مستودعات التعليمات البرمجية، والاستدلال على البيانات المهيكلة. [ 5 ] [ 6 ]
مراجع
- ↑ Nir Ratner et al., "Parallel Context Windows for Large Language Models", Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics , 2023, pp. 6383-6402, doi:10.18653/v1/2023.acl-long.352.
- ↑ Ofir Press et al., "Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation", arXiv:2108.12409, 2021.
- ↑ Machel Reid et al., "Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context", arXiv:2403.05530, 2024.
- ↑ نيلسون ف. ليو وآخرون، "ضائع في المنتصف: كيف تستخدم نماذج اللغة السياقات الطويلة"، معاملات رابطة اللغويات الحاسوبية ، 2024، المجلد 12، الصفحات 157-173، doi:10.1162/tacl_a_00638.
- ↑ Cheng-Ping Hsieh et al., “RULER: What's Real Context Size of Your Long- Context Language Models?”, arXiv:2404.06654, 2024.
- ↑ يوشي باي وآخرون، "LongBench v2: نحو فهم أعمق واستدلال على مهام متعددة واقعية طويلة السياق"، وقائع الاجتماع السنوي الثالث والستين لجمعية اللغويات الحاسوبية ، 2025، ص 3639-3664، doi:10.18653/v1/2025.acl-long.183.
- نماذج لغوية كبيرة
- نماذج أولية لمعالجة اللغة الطبيعية
