قائمة نماذج اللغة الكبيرة
نموذج اللغة الكبير (LLM) هو نوع من نماذج التعلم الآلي المصممة لمهام معالجة اللغة الطبيعية مثل توليد اللغة . نماذج اللغة الكبيرة هي نماذج لغوية ذات معلمات عديدة، ويتم تدريبها باستخدام التعلم الذاتي على كمية هائلة من النصوص.
قائمة
بالنسبة لعمود تكلفة التدريب، فإن 1 بيتافلوب-يوم يساوي 1 بيتافلوب/ثانية × 1 يوم، أو8.64 × 10^ 19 عملية حسابية للفاصلة العائمة ( FLOP ). يُعرض هنا تكلفة النموذج الأكبر فقط. يُقاس عدد المعاملات بالمليارات، [ أ ] وتُقاس تكلفة التدريب بالبيتا فلوب-يوم.
2018
| اسم | تاريخ الإصدار [ ب ] | مطور | من المعلمات | حجم الجسم | تكلفة التدريب | الترخيص [ ج ] | ملحوظات |
|---|---|---|---|---|---|---|---|
| GPT-1 | 11 يونيو | أوبن إيه آي | 0.117 مليار | مجهول | 1 [ 1 ] | معهد ماساتشوستس للتكنولوجيا [ 2 ] | أول نموذج GPT، وهو نموذج محول يعتمد على وحدة فك التشفير فقط. تم تدريبه لمدة 30 يومًا على 8 وحدات معالجة رسومية P600 . [ 3 ] |
| بيرت | أكتوبر 2018 | جوجل | 0.340B [ 4 ] | 3.3 مليار كلمة [ 4 ] | 9 [ 5 ] | أباتشي 2.0 [ 6 ] | نموذج لغوي مبكر ومؤثر. [ 7 ] يعتمد على المُشفِّر فقط، وبالتالي لم يُصمَّم ليكون مُوجَّهًا أو توليديًا. [ 8 ] استغرق التدريب 4 أيام على 64 شريحة TPUv2. [ 4 ] |
2019
| اسم | تاريخ الإصدار [ ب ] | مطور | من المعلمات | حجم الجسم | تكلفة التدريب | الترخيص [ ج ] | ملحوظات |
|---|---|---|---|---|---|---|---|
| T5 | أكتوبر 2019 | جوجل | 11ب [ 9 ] | 34 مليار رمز [ 9 ] | مجهول | أباتشي 2.0 [ 10 ] | النموذج الأساسي لمشاريع جوجل مثل Imagen. [ 11 ] |
| XLNet | يونيو ٢٠١٩ | جوجل | 0.340B [ 12 ] | 33 مليار كلمة | 330 | أباتشي 2.0 [ 13 ] | بديل لنموذج BERT؛ مصمم ليكون مُشفِّرًا فقط. تم تدريبه على 512 شريحة TPU v3 لمدة 5.5 أيام. [ 14 ] |
| GPT-2 | فبراير 2019 | أوبن إيه آي | 1.5 مليار [ 15 ] | 40 جيجابايت [ 16 ] (~ 10 مليارات رمز مميز) [ 17 ] | 28 [ 18 ] | معهد ماساتشوستس للتكنولوجيا [ 19 ] | تم تدريبها على 32 شريحة TPUv3 لمدة أسبوع واحد. [ 18 ] |
2020
2021
| اسم | تاريخ الإصدار [ ب ] | مطور | من المعلمات | حجم الجسم | تكلفة التدريب | الترخيص [ ج ] | ملحوظات |
|---|---|---|---|---|---|---|---|
| جي بي تي-نيو | مارس 2021 | إليوثي إيه آي | 2.7 ب [ 23 ] | 825 جيجابايت [ 24 ] | مجهول | معهد ماساتشوستس للتكنولوجيا [ 25 ] | أول بديل مجاني لنموذج GPT-3 تم إصداره بواسطة EleutherAI. تفوق GPT-Neo على نموذج GPT-3 ذي الحجم المكافئ في بعض المعايير، ولكنه كان أسوأ بكثير من أكبر نموذج GPT-3. [ 25 ] |
| هايبركلوفا | مايو 2021 [ 26 ] | نيفر | 204ب [ 27 ] 82ب [ 28 ] | 560B رمزًا [ 27 ] | مجهول | غير منشور | ويشير تقريرها الفني إلى أن النموذج هو "أول اكتشاف على نطاق يقارب 100 مليار لغة غير إنجليزية" من خلال "بناء مجموعة كبيرة من الكلمات الكورية التي يبلغ عددها 560 مليار كلمة". [ 28 ] |
| GPT-J | يونيو 2021 | إليوثي إيه آي | 6ب [ 29 ] | 825 جيجابايت [ 24 ] | 200 [ 30 ] | أباتشي 2.0 | |
| ميجاترون-تورينج NLG | أكتوبر 2021 [ 31 ] | مايكروسوفت وإنفيديا | 530ب [ 32 ] | 338.6 مليار رمز [ 32 ] | 38000 [ 33 ] | غير منشور | تم تدريبها لمدة 3 أشهر على أكثر من 2000 وحدة معالجة رسومية A100 على جهاز NVIDIA Selene Supercomputer ، لأكثر من 3 ملايين ساعة معالجة رسومية. [ 33 ] |
| إيرني 3.0 تيتان | ديسمبر 2021 | بايدو | 260ب [ 34 ] | 4 تيرابايت | مجهول | ملكية خاصة | |
| كلود [ 35 ] | ديسمبر 2021 | الأنثروبيك | 52ب [ 36 ] | 400B رمز [ 36 ] | مجهول | مُحسَّن بدقة لتحقيق السلوك المرغوب فيه في المحادثات. [ 37 ] | |
| نموذج اللغة العام (GLaM) | ديسمبر 2021 | جوجل | 1162ب [ 38 ] | 1.6 تريليون رمز [ 38 ] | 5600 [ 38 ] | ||
| غوفر | ديسمبر 2021 | جوجل ديب مايند | 280ب [ 39 ] | 300 مليار رمز [ 40 ] | 5833 [ 41 ] |
2022
| اسم | تاريخ الإصدار [ ب ] | مطور | من المعلمات | حجم الجسم | تكلفة التدريب | الترخيص [ ج ] | ملحوظات |
|---|---|---|---|---|---|---|---|
| LaMDA (نماذج اللغة لتطبيقات الحوار) | يناير 2022 | جوجل | 137ب [ 42 ] | 1.56 تريليون كلمة، [ 42 ] 168 مليار رمز [ 40 ] | 4110 [ 43 ] | ملكية خاصة | |
| GPT-NeoX | فبراير 2022 | إليوثي إيه آي | 20ب [ 44 ] | 825 جيجابايت [ 24 ] | 740 [ 30 ] | أباتشي 2.0 | |
| الشنشيلة | مارس 2022 | جوجل ديب مايند | 70ب [ 45 ] | 1.4 تريليون رمز [ 45 ] [ 40 ] | 6805 [ 41 ] | ملكية خاصة | |
| PaLM (نموذج لغة المسارات) | أبريل 2022 | جوجل | 540B [ 46 ] | 768B رمزًا [ 45 ] | 29,250 [ 41 ] | تم تدريبها لمدة 60 يومًا تقريبًا على حوالي 6000 شريحة TPU v4 . [ 41 ] | |
| OPT (المحول المفتوح المدرب مسبقًا) | مايو 2022 | ميتا | 175ب [ 47 ] | 180 مليار رمز [ 48 ] | 310 [ 30 ] | البحث غير التجاري [ د ] | تم تطوير بنية GPT-3 مع بعض التعديلات من ميجاترون. وقد نُشر سجل التدريب الذي كتبه الفريق. [ 49 ] |
| YaLM 100B | يونيو 2022 | ياندكس | 100B [ 50 ] | 1.7 تيرابايت [ 50 ] | مجهول | أباتشي 2.0 | |
| مينيرفا | يونيو 2022 | جوجل | 540B [ 51 ] | 38.5 مليار رمز من صفحات الويب التي تمت تصفيتها بحثًا عن المحتوى الرياضي ومن arXiv [ 51 ] | ملكية خاصة | لحل "المسائل الرياضية والعلمية باستخدام الاستدلال التدريجي". [ 52 ] | |
| يزدهر | يوليو 2022 | تعاون كبير بقيادة Hugging Face | 175ب [ 53 ] | 350 مليار رمز (1.6 تيرابايت) [ 54 ] | الذكاء الاصطناعي المسؤول | ||
| جالاكتيكا | نوفمبر 2022 | ميتا | 120B | 106 مليار رمز [ 55 ] | CC-BY-NC-4.0 | ||
| أليكسا™ (نماذج المعلمين) | نوفمبر 2022 | أمازون | 20ب [ 56 ] | 1.3T [ 57 ] | ملكية خاصة [ 58 ] |
2023
| اسم | تاريخ الإصدار [ ب ] | مطور | من المعلمات | حجم الجسم | تكلفة التدريب | الترخيص [ ج ] | ملحوظات |
|---|---|---|---|---|---|---|---|
| اللاما | فبراير 2023 | الذكاء الاصطناعي الفائق | 65ب [ 59 ] | 1.4T [ 59 ] | 6300 [ 60 ] | البحث غير التجاري [ هـ ] | |
| GPT-4 | مارس 2023 | أوبن إيه آي | غير معروف [ f ] | مجهول | مجهول | ملكية خاصة | |
| سيريبراس-جي بي تي | مارس 2023 | الأدمغة | 13ب [ 62 ] | 270 [ 30 ] | أباتشي 2.0 | ||
| فالكون | مارس 2023 | معهد ابتكار التكنولوجيا | 40ب [ 63 ] | 1 تيرابايت من الرموز، من RefinedWeb (مجموعة نصوص الويب المفلترة) [ 64 ] بالإضافة إلى بعض "المجموعات المنسقة". [ 65 ] | 2800 [ 60 ] | أباتشي 2.0 [ 66 ] | |
| بلومبيرغ جي بي تي | مارس 2023 | بلومبيرغ إل بي | 50ب | 363 مليار رمز من مصادر البيانات الخاصة ببلومبرج، بالإضافة إلى 345 مليار رمز من مجموعات البيانات ذات الأغراض العامة [ 67 ] | مجهول | غير منشور | مصمم للمهام المالية. [ 67 ] |
| بانجو-Σ | مارس 2023 | هواوي | 1085ب | 329 مليار رمز [ 68 ] | ملكية خاصة | ||
| OpenAssistant [ 69 ] | مارس 2023 | لايون | 17ب | 1.5 تريليون رمز | أباتشي 2.0 | ||
| العصر الجوراسي 2 [ 70 ] [ 71 ] | مارس 2023 | مختبرات AI21 | مجهول | مجهول | ملكية خاصة | ||
| PaLM 2 (نموذج لغة المسارات 2) | مايو 2023 | جوجل | 340B [ 72 ] | 3.6 تريليون رمز [ 72 ] | 85000 [ 60 ] | مستخدم في برنامج الدردشة الآلي Bard . [ 73 ] | |
| ياندكس جي بي تي | 17 مايو 2023 | ياندكس | مجهول | مجهول | مجهول | ||
| فاي-1 | 21 يونيو 2023 | مايكروسوفت | 1.3 مليار [ 74 ] | 7B رمزًا [ 74 ] | مجهول | معهد ماساتشوستس للتكنولوجيا | تم التدريب لمدة 4 أيام على 8 طائرات من طراز A100. [ 74 ] |
| لاما 2 | يوليو 2023 | الذكاء الاصطناعي الفائق | 70ب [ 75 ] | 2T رمز [ 75 ] | 21000 | لاما 2 | تم تدريبها على مدى 3.3 مليون ساعة باستخدام وحدة معالجة الرسومات (A100). [ 76 ] |
| كلود 2 | يوليو 2023 | الأنثروبيك | مجهول | مجهول | مجهول | ملكية خاصة | مستخدم في برنامج الدردشة الآلي كلود. [ 77 ] |
| جرانيت 13ب | يوليو 2023 | شركة آي بي إم | مجهول | مستخدم في IBM Watsonx . [ 78 ] | |||
| ميسترال 7ب | سبتمبر 2023 | ميسترال للذكاء الاصطناعي | 7.3ب [ 79 ] | أباتشي 2.0 | |||
| ياندكس جي بي تي 2 | 7 سبتمبر 2023 | ياندكس | مجهول | ملكية خاصة | |||
| كلود 2.1 | نوفمبر 2023 | الأنثروبيك | مجهول | يُستخدم في برنامج الدردشة الآلي "كلود". يحتوي على نافذة سياقية تضم 200,000 رمز، أو ما يقارب 500 صفحة. [ 80 ] | |||
| Grok-1 [ 81 ] | نوفمبر 2023 | xAI | 314ب | أباتشي 2.0 | |||
| جيميني 1.0 | ديسمبر 2023 | جوجل ديب مايند | مجهول | ملكية خاصة | نموذج متعدد الوسائط، متوفر بثلاثة أحجام. يُستخدم في برنامج الدردشة الآلي الذي يحمل نفس الاسم . [ 83 ] | ||
| ميكسترال 8x7B | ديسمبر 2023 | ميسترال للذكاء الاصطناعي | 46.7 ب | أباتشي 2.0 | يتفوق على GPT-3.5 و Llama 2 70B في العديد من المعايير. [ 84 ] نموذج مزيج من الخبراء ، مع 12.9 مليار مُعامل مُفعّل لكل رمز. [ 85 ] | ||
| ديب سيك - ماجستير في القانون | 29 نوفمبر 2023 | البحث العميق | 67ب | 2T رمزًا [ 86 ] : الجدول 2 | 12000 | البحث العميق | تم تدريبه على النصوص الإنجليزية والصينية. تم استخدامه 1024 عملية حسابية للتدريب لنموذج 67B، و10 عمليات حسابية لنموذج 7B. [ 86 ] : الشكل 5 |
| فاي-2 | ديسمبر 2023 | مايكروسوفت | 2.7 مليار | 1.4 تريليون رمز | 419 [ 87 ] | معهد ماساتشوستس للتكنولوجيا | تم تدريبها على بيانات حقيقية واصطناعية "بجودة الكتب الدراسية" على مدار 14 يومًا على 96 وحدة معالجة رسومية A100. [ 87 ] |
2024
| اسم | تاريخ الإصدار [ ب ] | مطور | من المعلمات | حجم الجسم | تكلفة التدريب | الترخيص [ ج ] | ملحوظات |
|---|---|---|---|---|---|---|---|
| الجوزاء 1.5 | فبراير 2024 | جوجل ديب مايند | مجهول | مجهول | مجهول | ملكية خاصة | نموذج متعدد الوسائط قائم على بنية MoE. نافذة السياق تتجاوز مليون رمز مميز. [ 88 ] |
| جيميني ألترا | فبراير 2024 | ||||||
| جيما | فبراير 2024 | 7ب | 6T رموز | شروط استخدام جيما [ 89 ] | |||
| أولمو | فبراير 2024 | معهد ألين للذكاء الاصطناعي | 7ب [ 90 ] | 2T رمز [ 91 ] | أباتشي 2.0 | ||
| كلود 3 | مارس 2024 | الأنثروبيك | مجهول | مجهول | ملكية خاصة | يتضمن ثلاثة نماذج: الهايكو، والسونيت، والأوبوس. [ 92 ] | |
| DBRX | مارس 2024 | داتابريكس وموزاييك إم إل | 136ب | 12T رمزًا | النموذج المفتوح لطوب البيانات [ 93 ] [ 94 ] | ||
| ياندكس جي بي تي 3 برو | 28 مارس 2024 | ياندكس | مجهول | مجهول | ملكية خاصة | ||
| فوغاكو-LLM [ 95 ] | مايو 2024 | فوجيتسو ، معهد طوكيو للتكنولوجيا ، جامعة توهوكو ، ريكين ، إلخ. | 13ب | 380B رمزًا | شروط الاستخدام Fugaku-LLM [ 96 ] | ||
| حرباء | مايو 2024 | الذكاء الاصطناعي الفائق | 34ب [ 98 ] | 4.4 تيرابايت | البحث غير التجاري [ 99 ] | ||
| Mixtral 8x22B [ 100 ] | 17 أبريل 2024 | ميسترال للذكاء الاصطناعي | 141ب | مجهول | أباتشي 2.0 | ||
| فاي-3 | 23 أبريل 2024 | مايكروسوفت | 14ب [ 101 ] | 4.8 تريليون رمز [ 102 ] | معهد ماساتشوستس للتكنولوجيا | سوّقتها مايكروسوفت على أنها "نموذج لغة صغير". [ 101 ] | |
| نماذج كود الجرانيت | مايو 2024 | شركة آي بي إم | مجهول | مجهول | أباتشي 2.0 | ||
| ياندكس جي بي تي 3 لايت | 28 مايو 2024 | ياندكس | مجهول | مجهول | ملكية خاصة | ||
| كوين 2 | يونيو 2024 | علي بابا كلاود | 72ب [ 103 ] | رموز 3T | متنوع | ||
| ديب سيك-الإصدار الثاني | يونيو 2024 | البحث العميق | 236ب | 8.1 تريليون رمز | 28000 | البحث العميق | 1.4 مليون ساعة على H800. [ 104 ] |
| نيموترون -4 | يونيو 2024 | إنفيديا | 340ب | 9T رموز | 200,000 | نموذج NVIDIA المفتوح [ 105 ] [ 106 ] | |
| كلود 3.5 | يونيو 2024 | الأنثروبيك | مجهول | مجهول | مجهول | ملكية خاصة | |
| لاما 3.1 | يوليو 2024 | الذكاء الاصطناعي الفائق | 405ب | 15.6 تريليون رمز | 440,000 | اللاما 3 | |
| جروك-2 | 14 أغسطس 2024 | xAI | مجهول | مجهول | مجهول | اتفاقية ترخيص مجتمع xAI [ 113 ] [ 114 ] | |
| OpenAI o1 | 12 سبتمبر 2024 | أوبن إيه آي | مجهول | مجهول | ملكية خاصة | ||
| سارفام-1 | 24 أكتوبر 2024 | سارفام للذكاء الاصطناعي | 2ب | حوالي 2 تريليون رمز | شركة سارفام لأبحاث الذكاء الاصطناعي | ||
| ياندكس جي بي تي 4 لايت وبرو | 24 أكتوبر 2024 | ياندكس | مجهول | مجهول | ملكية خاصة | ||
| ميسترال لارج | نوفمبر 2024 | ميسترال للذكاء الاصطناعي | 123ب | مجهول | أبحاث ميسترال | تم تحديثه بمرور الوقت. أحدث إصدار هو 24.11. [ 121 ] | |
| بيكسرال | متعدد الوسائط. يوجد أيضًا إصدار 12B مرخص بموجب رخصة أباتشي 2. [ 121 ] | ||||||
| OLMo 2 | نوفمبر 2024 | معهد ألين للذكاء الاصطناعي | 32ب [ 122 ] [ 123 ] | 6.6 تريليون رمز [ 123 ] | 15000 [ 123 ] | أباتشي 2.0 | |
| فاي-4 | 12 ديسمبر 2024 | مايكروسوفت | 14ب [ 124 ] | 9.8 تريليون رمز | مجهول | معهد ماساتشوستس للتكنولوجيا | سوّقتها مايكروسوفت على أنها "نموذج لغة صغير". [ 125 ] |
| ديب سيك-الإصدار 3 | ديسمبر 2024 | البحث العميق | 671ب | 14.8 تريليون رمز | 56000 | ||
| أمازون نوفا | ديسمبر 2024 | أمازون | مجهول | مجهول | مجهول | ملكية خاصة | يشمل ثلاثة نماذج: نوفا مايكرو، نوفا لايت، ونوفا برو. [ 128 ] |
2025
| اسم | تاريخ الإصدار [ ب ] | مطور | من المعلمات | حجم المدونة [ غ ] | الترخيص [ ج ] | ملحوظات |
|---|---|---|---|---|---|---|
| ديب سيك آر 1 | 20 يناير | البحث العميق | 671ب | مجهول | معهد ماساتشوستس للتكنولوجيا | |
| Qwen2.5 | 26 يناير | علي بابا | 72ب | 18T | متنوع | 7 نماذج كثيفة ذات عدد معلمات يتراوح من 0.5 مليار إلى 72 مليار. كما أصدرت شركة علي بابا نوعين مختلفين من MoE. [ 131 ] |
| MiniMax-Text-01 | 14 يناير | مينيمكس | 456ب | 4.7 طن | نموذج مينيمكس | |
| جيميني 2.0 | 5 فبراير | جوجل ديب مايند | مجهول | مجهول | ملكية خاصة | |
| جروك 3 | 19 فبراير | xAI | زُعم أن تكلفة التدريب "تزيد عشرة أضعاف عن تكلفة الحوسبة للنماذج السابقة المتطورة". [ 137 ] | |||
| كلود 3.7 | 24 فبراير | الأنثروبيك | أحد النماذج، سونيت 3.7. [ 138 ] | |||
| YandexGPT 5 Lite Pretrain و Pro | 25 فبراير | ياندكس | ||||
| GPT-4.5 | 27 فبراير | أوبن إيه آي | كان أكبر نموذج غير منطقي لدى OpenAI في ذلك الوقت. [ 139 ] | |||
| الجوزاء 2.5 | 25 مارس | جوجل ديب مايند | تم إصدار ثلاثة نماذج: فلاش، فلاش لايت، وبرو. [ 140 ] | |||
| تعليمات ياندكس جي بي تي 5 لايت | 31 مارس | ياندكس | ||||
| اللاما 4 | 5 أبريل | الذكاء الاصطناعي الفائق | 400B | 40 طن | اللاما 4 | |
| OpenAI o3 و o4-mini | 16 أبريل | أوبن إيه آي | مجهول | مجهول | ملكية خاصة | نماذج الاستدلال. [ 143 ] |
| كوين 3 | 28 أبريل | علي بابا كلاود | 235ب | 36T | أباتشي 2.0 | تتوفر بأحجام متعددة، أصغرها 0.6B. [ 144 ] |
| كلود 4 | 22 مايو | الأنثروبيك | مجهول | مجهول | ملكية خاصة | يتضمن نموذجين، سونيت وأوبوس. [ 145 ] |
| سارفام-م | 23 مايو | سارفام للذكاء الاصطناعي | 24ب | مجهول | أباتشي 2.0 | |
| جروك 4 | 9 يوليو | xAI | مجهول | مجهول | ملكية خاصة | |
| المعامل 1 | 21 يوليو | بهاراتجين | 2.9 مليار | 5T | أباتشي 2.0 | |
| GLM-4.5 | 29 يوليو | Z.ai | 355ب | 22T | معهد ماساتشوستس للتكنولوجيا | |
| GPT-OSS | 5 أغسطس | أوبن إيه آي | 117ب | مجهول | أباتشي 2.0 | صدرت بمقاسين 20B و 120B. [ 153 ] |
| كلود 4.1 | 5 أغسطس | الأنثروبيك | مجهول | مجهول | ملكية خاصة | يتضمن نموذجًا واحدًا، وهو Opus. [ 154 ] |
| GPT-5 | 7 أغسطس | أوبن إيه آي | مجهول | مجهول | ||
| DeepSeek-V3.1 | 21 أغسطس | البحث العميق | 671ب | 15.639 طن | معهد ماساتشوستس للتكنولوجيا | |
| ياندكس جي بي تي 5.1 برو | 28 أغسطس | ياندكس | مجهول | مجهول | ملكية خاصة | |
| أبيرتوس | 2 سبتمبر | المعهد الفدرالي السويسري للتكنولوجيا في زيورخ والمعهد الفدرالي السويسري للتكنولوجيا في لوزان | 70ب | 15 طن | أباتشي 2.0 | |
| كلود سونيت 4.5 | 29 سبتمبر | الأنثروبيك | مجهول | مجهول | ملكية خاصة | |
| GLM-4.6 | 30 سبتمبر | Z.ai | 357ب | أباتشي 2.0 | ||
| أليس إيه آي إل إل إم 1.0 | 28 أكتوبر | ياندكس | مجهول | ملكية خاصة | ||
| الجوزاء 3 | 18 نوفمبر | جوجل ديب مايند | مجهول | تم إصدار النماذج التالية: Deep Think و Pro. [ 165 ] | ||
| أولمو 3 [ 166 ] | 20 نوفمبر | معهد ألين للذكاء الاصطناعي | 32ب | 5.9 طن | أباتشي 2.0 | يتضمن إصدارات ذات معلمات 7B و 32B، إلى جانب نماذج الاستدلال ونماذج اتباع التعليمات. [ 167 ] |
| كلود أوبوس 4.5 | 24 نوفمبر | الأنثروبيك | مجهول | مجهول | ملكية خاصة | أكبر طراز في عائلة كلود. [ 168 ] |
| DeepSeek-V3.2 | 1 ديسمبر | البحث العميق | 685ب | معهد ماساتشوستس للتكنولوجيا | ||
| GPT 5.2 | 11 ديسمبر | أوبن إيه آي | مجهول | ملكية خاصة | لقد تمكن من حل مشكلة مفتوحة في نظرية التعلم الإحصائي ظلت دون حل من قبل الباحثين البشريين. [ 172 ] | |
| GLM-4.7 | 22 ديسمبر | Z.ai | 355ب | أباتشي 2.0 |
2026
| اسم | تاريخ الإصدار [ ب ] | مطور | من المعلمات | حجم المدونة [ غ ] | الترخيص [ ج ] | ملحوظات |
|---|---|---|---|---|---|---|
| كوين 3 - التفكير الأقصى | 26 يناير | علي بابا كلاود | مجهول | مجهول | ملكية خاصة | نموذج استدلال خاص مع استخدام أدوات تكيفي، وتوسيع نطاق وقت الاختبار، وتأمل ذاتي تكراري. [ 173 ] |
| كيمي كيه 2.5 | 27 يناير | مونشوت للذكاء الاصطناعي | 1T | 15 طن | MIT المعدل [ 174 ] | |
| الخطوة 3.5: فلاش | 12 فبراير | ستيب فن | 196ب | مجهول | أباتشي 2.0 | |
| كلود أوبوس 4.6 | 5 فبراير | الأنثروبيك | مجهول | ملكية خاصة | ||
| GPT-5.3-Codex | 5 فبراير | أوبن إيه آي | مجهول | |||
| GLM-5 | 12 فبراير | Z.ai | 744ب | 28.5 طن | معهد ماساتشوستس للتكنولوجيا | |
| كوين 3.5 | 15 فبراير | علي بابا كلاود | 397ب | مجهول | أباتشي 2.0 | |
| Qwen3.5-Plus | مجهول | ملكية خاصة | ||||
| كلود سونيت 4.6 | 17 فبراير | الأنثروبيك | ||||
| المعامل 2 | 17 فبراير | بهاراتجين | 17ب | 22T | بهاراتجين للأبحاث [ 186 ] | نموذج مزيج الخبراء، خليفة النموذج Param-1؛ يدعم العديد من اللغات الهندية الأخرى. تم تدريبه على وحدات معالجة الرسومات H100 لمدة 24 يومًا. [ 187 ] |
| سارفام-105ب | 18 فبراير [ ساعة ] | سارفام للذكاء الاصطناعي | 105ب | 12T | أباتشي 2.0 | أول نموذج تأسيسي مُدرَّب بشكل مستقل في الهند؛ يتوفر بإصدارين: 105 مليار و30 مليار. يعتمد على نموذج مزيج الخبراء، ويستخدم 10.3 مليار مُعامل نشط فقط في كل مرة. [ 189 ] يُفسِّر اللغات الهندية واللغة الهندية الإنجليزية . [ 190 ] [ 191 ] [ 192 ] |
| سارفام-30ب | 30ب | 16T | ||||
| GPT-5.4 | 5 مارس | أوبن إيه آي | مجهول | مجهول | ملكية خاصة | |
| ميسترال صغير 4 | 17 مارس | ميسترال للذكاء الاصطناعي | 119ب | أباتشي 2.0 | ||
| MiMo-V2-Pro | 18 مارس | شاومي | 1T | ملكية خاصة | نموذج مزيج الخبراء (MoE) بأكثر من تريليون مُعامل (43 مليار مُعامل نشط). مُصمم لسيناريوهات الوكلاء. كان مُتاحًا في البداية على منصة OpenRouter تحت الاسم الرمزي "Hunter Alpha" قبل إصداره الرسمي. [ 195 ] [ 196 ] | |
| Qwen3.6-Plus | 1 أبريل | علي بابا كلاود | مجهول | |||
| جيما 4 | 2 أبريل | جوجل ديب مايند | 31ب | أباتشي 2.0 | ||
| GLM-5.1 | 7 أبريل | Z.ai | 744ب | 28.5 طن | معهد ماساتشوستس للتكنولوجيا | |
| ميوز سبارك | 8 أبريل | ميتا | مجهول | مجهول | ملكية خاصة | |
| Qwen3.6 | 15 أبريل | علي بابا كلاود | 35ب | أباتشي 2.0 | ||
| كلود أوبوس 4.7 | 16 أبريل | الأنثروبيك | مجهول | ملكية خاصة | ||
| كيمي كيه 2.6 | 20 أبريل | مونشوت للذكاء الاصطناعي | 1T | MIT المعدل [ 206 ] | ||
| GPT-5.5 | 23 أبريل | أوبن إيه آي | مجهول | ملكية خاصة | ||
| ديب سيك-الإصدار 4-فلاش | 24 أبريل | البحث العميق | 284ب | 32T | معهد ماساتشوستس للتكنولوجيا | |
| ديب سيك-في4-برو | 1.6 تيرابايت | |||||
| MiMo-V2.5-Pro | 27 أبريل | شاومي | 1.02 طن | 48T | ||
| MiMo-V2.5 | 310ب | 27T | نموذج MoE متعدد الوسائط مع قدرات فاعلة وسياق مليون رمز. [ 214 ] | |||
| ميسترال متوسط 3.5 | 28 أبريل | ميسترال للذكاء الاصطناعي | 128ب | مجهول | معهد ماساتشوستس للتكنولوجيا المعدل | النموذج الرئيسي لشركة Mistral AI الذي يدمج اتباع التعليمات والاستدلال والترميز في نموذج كثيف واحد بحجم 128 بايت [ 215 ]. |
| Composer 2.5 | 18 مايو | المؤشر | 1T | ملكية خاصة | ||
| جيميني 3.5 فلاش | 19 مايو | جوجل ديب مايند | مجهول | |||
| Qwen3.7-Max | 20 مايو | علي بابا كلاود | مجهول | |||
| كلود أوبوس 4.8 | 28 مايو | الأنثروبيك | مجهول | |||
| الخطوة 3.7: الفلاش | 29 مايو | ستيب فن | 198ب | أباتشي 2.0 | ||
| MiniMax-M3 | 1 يونيو | ميني ماكس | 428ب | مجتمع ميني ماكس [ 222 ] | ||
| نيموترون 3 ألترا | 4 يونيو | إنفيديا | 550B | 20 طن | OpenMDW 1.1 [ 225 ] | |
| كلود فابل 5 | 9 يونيو | الأنثروبيك | مجهول | مجهول | ملكية خاصة | |
| رمز Kimi K2.7 | 16 يونيو | مونشوت للذكاء الاصطناعي | 1T | MIT المعدل [ 229 ] | ||
| GLM-5.2 | 16 يونيو | Z.ai | 744ب | 28.5 طن | معهد ماساتشوستس للتكنولوجيا | |
| LongCat-2.0 | 30 يونيو | ميتوان | 1.6 تيرابايت | 35 طن | ||
| Hy3 | 6 يوليو | تينسنت | 295ب | مجهول | أباتشي 2.0 | 21B المعلمات النشطة [ 237 ] |
| جروك 4.5 | 8 يوليو | SpaceXAI | مجهول | ملكية خاصة | ||
| SWE-1.7 | 8 يوليو | الذكاء الاصطناعي الإدراكي | مجهول | |||
| ميوز سبارك 1.1 | 9 يوليو | ميتا | مجهول | |||
| GPT-5.6 | 9 يوليو | أوبن إيه آي | مجهول | |||
| إنكلينغ | 15 يوليو | مختبر الآلات المفكرة | 975B | 45 طن | أباتشي 2.0 | |
| كيمي كيه 3 | 16 يوليو | مونشوت للذكاء الاصطناعي | 2.8 تيرابايت | مجهول | كيمي كيه 3 [ 244 ] | |
| Qwen3.8-Max | 19 يوليو | علي بابا كلاود | 2.4 تيرابايت | ملكية خاصة | إصدار تجريبي. أعلنت شركة علي بابا أن الأوزان ستصدر في وقت لاحق. [ 247 ] | |
| جيميني 3.6 فلاش | 21 يوليو | جوجل ديب مايند | مجهول | |||
| لاجونا إس 2.1 | 21 يوليو | نظام الذكاء الاصطناعي بجانب المسبح | 118ب | OpenMDW 1.1 [ 225 ] | ||
| Fugu-Ultra الإصدار 1.1 | 24 يوليو | سكنا آي | مجهول | ملكية خاصة | تم تحديث Fugu-Ultra بمعايير ترميز ووكلاء واستدلال أقوى مقارنةً بالإصدار 1.0. [ 251 ] | |
| كلود أوبوس 5 | 24 يوليو | الأنثروبيك | مجهول | |||
| إنكلينج صغير | 31 يوليو | مختبر الآلات المفكرة | 276ب | أباتشي 2.0 | 12B المعلمات النشطة [ 253 ] |
انظر أيضاً
ملحوظات
- ↑ في كثير من الحالات، ينشر الباحثون أو يقدمون تقارير عن نسخ متعددة من نموذج ما بأحجام مختلفة. في هذه الحالات، يُدرج هنا حجم أكبر نموذج.
- 1 2 3 4 5 6 7 8 9 هذا هو التاريخ الذي تم فيه إصدار الوثائق التي تصف بنية النموذج لأول مرة.
- ١ ٢ ٣ ٤ ٥ ٦ ٧ ٨ ٩ هذه رخصة أوزان النموذج المدرب مسبقًا. في معظم الحالات، يكون كود التدريب نفسه مفتوح المصدر أو يمكن نسخه بسهولة. قد تختلف تراخيص نماذج التعلم الآلي عن تراخيص برامج الدردشة الآلية التي تستخدمها؛ للاطلاع على تراخيص برامج الدردشة الآلية، راجع قائمة برامج الدردشة الآلية .
- ↑ تتوفر الطرازات الأصغر حجماً، بما في ذلك الطراز 66B، للجمهور، بينما يتوفر الطراز 175B عند الطلب.
- ↑ قيّد نظام الترخيص والتوزيع الخاص بفيسبوك الوصول إلى الباحثين المعتمدين، ولكن تم تسريب أوزان النموذج وأصبحت متاحة على نطاق واسع.
- ↑ كما ورد في التقرير الفني: "بالنظر إلى كل من المشهد التنافسي وآثار السلامة المترتبة على النماذج واسعة النطاق مثل GPT-4، فإن هذا التقرير لا يحتوي على مزيد من التفاصيل حول البنية (بما في ذلك حجم النموذج) والأجهزة وحوسبة التدريب وبناء مجموعة البيانات وطريقة التدريب ..." [ 61 ]
- 1 2 معبر عنها بعدد الرموز، ما لم يُنص على خلاف ذلك
- ↑ تم إصدار نسخة تجريبية مبكرة من النموذج في يناير. [ 188 ]
مراجع
- ↑ "تحسين فهم اللغة من خلال التعلم غير الخاضع للإشراف" . openai.com . ١١ يونيو ٢٠١٨. مؤرشف من الأصل في ١٨ مارس ٢٠٢٣. تم الاطلاع عليه في ١٨ مارس ٢٠٢٣ .
- ↑ "finetune-transformer-lm" . GitHub . مؤرشف من الأصل في 19 مايو 2023. تم الاطلاع عليه في 2 يناير 2024 .
- ↑ رادفورد، أليك (11 يونيو 2018). "تحسين فهم اللغة باستخدام التعلم غير الخاضع للإشراف" . OpenAI . تم الاطلاع عليه بتاريخ 18 نوفمبر 2025 .
- 1 2 3 ديفلين، جاكوب؛ تشانغ، مينغ-وي؛ لي، كينتون؛ توتانوفا، كريستينا (11 أكتوبر 2018). "BERT: التدريب المسبق للمحولات ثنائية الاتجاه العميقة لفهم اللغة". arXiv : 1810.04805v2 [ cs.CL ].
- ↑ بريكيت، نيكول هيمسوث (24 أغسطس 2021). "سيريبراس تُغيّر بنيتها لتلبية احتياجات نماذج الذكاء الاصطناعي/التعلم الآلي الضخمة" . المنصة التالية . مؤرشف من الأصل في 20 يونيو 2023. تم الاطلاع عليه في 20 يونيو 2023 .
- ↑ "بيرت" . ١٣ مارس ٢٠٢٣. مؤرشف من الأصل في ١٣ يناير ٢٠٢١. تم الاسترجاع في ١٣ مارس ٢٠٢٣ – عبر جيت هاب.
- ↑ مانينغ، كريستوفر د. ( 2022). "فهم اللغة البشرية والاستدلال" . ديدالوس . 151 (2): 127-138 . doi : 10.1162/daed_a_01905 . S2CID 248377870. مؤرشف من الأصل بتاريخ 17 نوفمبر 2023. تم الاطلاع عليه بتاريخ 9 مارس 2023 .
- ↑ باتيل، أجاي؛ لي، برايان؛ رسولي، محمد صادق؛ كونستانت، نوح؛ رافيل، كولين؛ كاليسون-بيرش، كريس (2022). "نماذج اللغة ثنائية الاتجاه هي أيضًا متعلمون بأمثلة قليلة". arXiv : 2209.14500 [ cs.LG ].
- 1 2 رافيل، كولين؛ شازير، نوام؛ روبرتس، آدم؛ لي، كاثرين؛ نارانج، شاران؛ ماتينا، مايكل؛ تشو، يانكي؛ لي، وي؛ ليو، بيتر جيه. (2020). "استكشاف حدود التعلم النقل باستخدام مُحوِّل نص-إلى-نص موحد" . مجلة أبحاث تعلم الآلة . 21 (140): 1-67 . arXiv : 1910.10683 . ISSN 1533-7928 .
- ↑ google-research/text-to-text-transfer-transformer ، بحث جوجل، 2024-04-02، مؤرشف من الأصل في 2024-03-29 ، تم استرجاعه في 2024-04-04
- ↑ "Imagen: نماذج انتشار النص إلى الصورة" . imagen.research.google . مؤرشف من الأصل بتاريخ 27-03-2024 . تم الاطلاع عليه بتاريخ 04-04-2024 .
- ↑ "النماذج المدربة مسبقًا - وثائق Transformers 2.0.0" . huggingface.co . مؤرشف من الأصل بتاريخ 2024-08-05 . تم الاطلاع عليه بتاريخ 2024-08-05 .
- ↑ "xlnet" . GitHub . مؤرشف من الأصل في 2 يناير 2024. تم الاسترجاع في 2 يناير 2024 .
- ^ يانغ ، تشيلين. داي، زيهانغ؛ يانغ، ييمينغ. كاربونيل، خايمي. صلاح الدينوف، رسلان؛ لو كووك ف. (2 يناير 2020). “XLNet: التدريب المسبق المعمم على الانحدار الذاتي لفهم اللغة”. أرخايف : 1906.08237 [ cs.CL ].
- ↑ "GPT-2: الإصدار 1.5 مليار" . OpenAI . 5 نوفمبر 2019. مؤرشف من الأصل في 14 نوفمبر 2019. تم الاطلاع عليه في 14 نوفمبر 2019 .
- ↑ "نماذج لغوية أفضل وآثارها" . openai.com . مؤرشف من الأصل بتاريخ 16-03-2023 . تم الاطلاع عليه بتاريخ 13-03-2023 .
- ١ ٢ "نموذج اللغة GPT-3 من OpenAI: نظرة عامة تقنية" . lambdalabs.com . ٣ يونيو ٢٠٢٠. مؤرشف من الأصل في ٢٧ مارس ٢٠٢٣. تم الاطلاع عليه في ١٣ مارس ٢٠٢٣ .
- 1 2 "openai-community/gpt2-xl · Hugging Face" . huggingface.co . 21 أكتوبر 2019. مؤرشف من الأصل في 24 يوليو 2024. تم الاسترجاع في 24 يوليو 2024 .
- ↑ "gpt-2" . جيت هاب . مؤرشف من الأصل في 11 مارس 2023. تم الاسترجاع في 13 مارس 2023 .
- ↑ ويغرز، كايل (28 أبريل 2022). "الأنواع الناشئة لنماذج اللغة وأهميتها" . تيك كرانش . مؤرشف من الأصل في 16 مارس 2023. تم الاطلاع عليه في 9 مارس 2023 .
- ↑ الجدول د.1 في: براون، توم ب.؛ مان، بنجامين؛ رايدر، نيك؛ سوبيا، ميلاني؛ كابلان، جاريد؛ داريوال، برافولا؛ نيلاكانتان، أرفيند؛ شيام، براناف؛ ساستري، جيريش؛ أسكيل، أماندا؛ أغاروال، سانديني؛ هيربرت-فوس، أرييل؛ كروجر، جريتشن؛ هينيغان، توم؛ تشايلد، ريون؛ راميش، أديتيا؛ زيغلر، دانيال م.؛ وو، جيفري؛ وينتر، كليمنس؛ هيس، كريستوفر؛ تشين، مارك؛ سيغلر، إريك؛ ليتوين، ماتيوس؛ غراي، سكوت؛ تشيس، بنجامين؛ كلارك، جاك؛ بيرنر، كريستوفر؛ ماكاندليش، سام؛ رادفورد، أليك؛ سوتسكيفر، إيليا؛ أمودي، داريو (28 مايو 2020). "نماذج اللغة هي متعلمون ذوو أمثلة قليلة". arXiv : 2005.14165v4 [ cs.CL ].
- ↑ "ChatGPT: تحسين نماذج اللغة للحوار" . OpenAI . 30 نوفمبر 2022. مؤرشف من الأصل في 30 نوفمبر 2022. تم الاطلاع عليه في 13 يناير 2023 .
- ↑ "GPT Neo" . ١٥ مارس ٢٠٢٣. مؤرشف من الأصل في ١٢ مارس ٢٠٢٣. تم الاسترجاع في ١٢ مارس ٢٠٢٣ – عبر GitHub.
- 1 2 3 غاو، ليو؛ بيدرمان، ستيلا؛ بلاك، سيد؛ غولدينغ، لورانس؛ هوب، ترافيس؛ فوستر، تشارلز؛ فانغ، جيسون؛ هي، هوراس؛ ثيت، أنيش؛ نابيشيما، نوا؛ بريسر، شون؛ ليهي، كونور (31 ديسمبر 2020). "الكومة: مجموعة بيانات بحجم 800 جيجابايت من النصوص المتنوعة لنمذجة اللغة". arXiv : 2101.00027 [ cs.CL ].
- 1 2 إيير، أبيشيك (15 مايو 2021). "بديل GPT-3 المجاني، GPT-Neo، أمرٌ يدعو للحماس" . فينشر بيت . مؤرشف من الأصل في 9 مارس 2023. تم الاطلاع عليه في 13 مارس 2023 .
- ↑ كيم، هان جو (25 مايو 2021). "نافر تكشف النقاب عن منصة الذكاء الاصطناعي العملاقة هايبركلوفا" . وكالة يونهاب للأنباء . تاريخ الاسترجاع: 15 يونيو 2026 .
- 1 2 ويغرز، كايل (1 يونيو 2021). "نافر درّبت نموذجًا للغة الكورية شبيهًا بـ GPT-3" . فينشر بيت | تغطية تقنية تحويلية ذات أهمية . مؤرشف من الأصل في 20 سبتمبر 2022. تم الاسترجاع في 15 يونيو 2026 .
- 1 2 كيم، بوسوب؛ كيم وهيونج سيوك؛ لي، سانغ وو؛ لي، جيتشانج؛ كواك، دونغهيون؛ دونغ هيون، جيون؛ بارك، سونغهيون؛ كيم، سونغجو؛ كيم، سيونهون؛ سيو، دونجبيل؛ لي، هيونجسوب؛ جيونج، مينيونج؛ لي، سونغجاي؛ كيم، مينسوب؛ كو، سوك هيون؛ كيم، سيوخون؛ بارك، تايونغ؛ كيم، جينوك؛ كانغ، سويونج؛ ريو، نا هيون؛ يو، كانغ مين؛ تشانغ، مينسوك؛ سوه، سوبين؛ في، سوكيو؛ بارك، جينسونغ؛ كيم، كيونغدوك؛ كيم، هيون؛ جيونج، جيسو؛ يو، يونغ جوو؛ هام، دونغهون؛ بارك، دونغجو؛ لي، مين يونغ؛ كانغ، جايووك؛ كانغ، إينهو؛ ها، جونغ وو؛ بارك، ووميونغ؛ سونغ، ناكو (نوفمبر 2021). "ما التغييرات التي يمكن أن تُحدثها نماذج اللغة واسعة النطاق؟ دراسة مُعمّقة حول HyperCLOVA: مُحوّلات توليدية كورية مُدرّبة مُسبقًا على نطاق مليارات" . في: موينز، ماري فرانسين؛ هوانغ، شوانجينغ؛ سبيسيا، لوسيا؛ ييه، سكوت وين تاو (محررون). وقائع مؤتمر 2021 حول الأساليب التجريبية في معالجة اللغة الطبيعية . منشور إلكترونيًا وفي بونتا كانا، جمهورية الدومينيكان: رابطة اللغويات الحاسوبية. الصفحات 3405-3424 . arXiv : 2109.04650 . doi : 10.18653/v1/2021.emnlp-main.274 .
- ↑ "GPT-J-6B: مقدمة لأكبر نموذج GPT مفتوح المصدر | فورفرونت" . www.forefront.ai . مؤرشف من الأصل بتاريخ 9 مارس 2023. تم الاطلاع عليه بتاريخ 28 فبراير 2023 .
- 1 2 3 4 داي، نولان؛ جوسال، جوربريت؛ تشيمينغ. تشين؛ خشان، هيمانت؛ مارشال، وليام. باتريا، ريبهو؛ توم مارفن. هيتنسس ، جويل (2023/04/01). “Cerebras-GPT: نماذج لغة مفتوحة للحساب الأمثل تم تدريبها على مجموعة Cerebras Wafer-Scale”. أرخايف : 2304.03208 [ cs.LG ].
- ↑ علوي، علي؛ خاريا، باريش (11 أكتوبر 2021). "استخدام DeepSpeed وMegatron لتدريب Megatron-Turing NLG 530B، وهو أكبر وأقوى نموذج توليدي للغة في العالم" . مايكروسوفت للأبحاث . مؤرشف من الأصل في 13 مارس 2023. تم الاسترجاع في 13 مارس 2023 .
- 1 2 سميث، شادن؛ باتواري، مصطفى؛ نوريك، براندون. ليغريسلي، باتريك؛ راجبهانداري، ساميام؛ كاسبر، جاريد. ليو، تشون؛ برابوموي، شريمي؛ زيرفيس، جورج؛ كورثيكانتي، فيجاي؛ تشانغ، التون. الطفل، ريون؛ أمين آبادي، رضا يزداني؛ بيرناور، جولي. سونغ شيا (2022/02/04). “استخدام DeepSpeed و Megatron لتدريب Megatron-Turing NLG 530B، نموذج لغة توليدي واسع النطاق”. أرخايف : 2201.11990 [ cs.CL ].
- 1 2 راجبهانداري، ساميام؛ لي، كونغلونغ؛ ياو، زهيوي؛ تشانغ، مينجيا؛ أمين آبادي، رضا يزداني؛ أوان، عمار أحمد؛ راسلي، جيف؛ هو، يوكسيونغ (21/07/2022)، DeepSpeed-MoE: تطوير استدلال مزيج من الخبراء والتدريب لتشغيل مقياس الذكاء الاصطناعي للجيل القادم ، أرخايف : 2201.05596
- ^ وانغ ، شوهوان. صن، يو؛ شيانغ، يانغ؛ وو، تشيهوا؛ دينغ، سيو؛ قونغ، ويباو؛ فنغ، شيكون. شانغ، جونيوان؛ تشاو، يانبين؛ بانغ، تشاو؛ ليو، جياشيانغ؛ تشن، شويى. لو، يوشيانغ؛ ليو، ويكسين؛ وانغ شي. باي، يانغفان؛ تشن، تشيوليانغ. تشاو، لي؛ لي شيونغ. صن، بنغ؛ يو، ديانهاي؛ ما، يانجون؛ تيان، هاو؛ وو، هوا؛ وو، تيان؛ تسنغ، وي. لي، قه. جاو ون؛ وانغ ، هايفنغ (23 ديسمبر 2021). “ERNIE 3.0 Titan: استكشاف المعرفة واسعة النطاق المعززة للتدريب المسبق لفهم اللغة وتوليدها”. أرخايف : 2112.12731 [ cs.CL ].
- ↑ "المنتج" . أنثروبيك . مؤرشف من الأصل في 16 مارس 2023. تم الاسترجاع في 14 مارس 2023 .
- 1 2 أسكل، أماندا؛ باي، يونتاو؛ تشن، آنا؛ وآخرون . (9 ديسمبر 2021). "مساعد لغة عامة كمختبر للمواءمة". أرخايف : 2112.00861 [ cs.CL ].
- ^ باي، يونتاو؛ كادافاث، سوراف؛ كوندو، سانديبان؛ وآخرون . (15 ديسمبر 2022). “الذكاء الاصطناعي الدستوري: عدم الضرر من ردود فعل الذكاء الاصطناعي”. أرخايف : 2212.08073 [ cs.CL ].
- 1 2 3 داي، أندرو م؛ دو، نان (9 ديسمبر 2021). "تعلم أكثر كفاءة في السياق باستخدام GLaM" . ai.googleblog.com . مؤرشف من الأصل في 12 مارس 2023. تم الاسترجاع في 9 مارس 2023 .
- ↑ "نمذجة اللغة على نطاق واسع: غوفر، الاعتبارات الأخلاقية، والاسترجاع" . www.deepmind.com . 8 ديسمبر 2021. مؤرشف من الأصل في 20 مارس 2023. تم الاطلاع عليه في 20 مارس 2023 .
- 1 2 3 هوفمان، جوردان؛ بورجود، سيباستيان؛ مينش، آرثر؛ وآخرون . (29 مارس 2022). "تدريب نماذج لغوية كبيرة مثالية حسابيًا". arXiv : 2203.15556 [ cs.CL ].
- ١ ٢ ٣ ٤ الجدول ٢٠ والصفحة ٦٦ من PaLM: توسيع نطاق نمذجة اللغة باستخدام المسارات، مؤرشف بتاريخ ٢٠٢٣-٠٦-١٠ في Wayback Machine
- 1 2 تشنغ، هينغ-تزي؛ ثوبيلان، رومال (21 يناير 2022). "لامدا: نحو نماذج حوار آمنة، وواقعية، وعالية الجودة لكل شيء" . ai.googleblog.com . مؤرشف من الأصل في 25 مارس 2022. تم الاطلاع عليه في 9 مارس 2023 .
- ^ توبيلان ، رومال. دي فريتاس، دانيال. هول، جيمي؛ شازير، نعوم؛ كولشرشتا، أبورف؛ تشنغ، هنغ تزي. جين، أليسيا؛ بوس، تايلور. بيكر، ليزلي. دو، يو؛ لي، ياجوانج؛ لي هونغراي. تشنغ، هوايشيو ستيفن؛ غفوري، أمين؛ مينيجالي ، مارسيلو (2022-01-01). “LaMDA: نماذج اللغة لتطبيقات الحوار”. أرخايف : 2201.08239 [ cs.CL ].
- ↑ بلاك، سيدني؛ بيدرمان، ستيلا؛ هالاهان، إريك؛ وآخرون . (2022-05-01). GPT-NeoX-20B: نموذج لغوي مفتوح المصدر للتراجع الذاتي . وقائع ندوة BigScience الحلقة رقم 5 - ورشة عمل حول التحديات والآفاق في إنشاء نماذج لغوية كبيرة. المجلد. وقائع ندوة BigScience الحلقة رقم 5 - ورشة عمل حول التحديات والآفاق في إنشاء نماذج لغوية كبيرة. الصفحات 95-136 . مؤرشف من الأصل في 2022-12-10 . تم الاسترجاع في 2022-12-19 .
- هوفمان ، جوردان؛ بورجو، سيباستيان؛ مينش، آرثر؛ سيفري، لوران (12 أبريل 2022). "تحليل تجريبي لتدريب نماذج اللغة الكبيرة الأمثل حسابيًا" . مدونة ديب مايند . مؤرشف من الأصل في 13 أبريل 2022. تم الاطلاع عليه في 9 مارس 2023 .
- ↑ نارانج، شاران؛ تشودري، أكانكشا (4 أبريل 2022). "نموذج لغة المسارات (PaLM): التوسع إلى 540 مليار مُعامل لتحقيق أداءٍ مُذهل" . ai.googleblog.com . مؤرشف من الأصل في 4 أبريل 2022. تم الاطلاع عليه في 9 مارس 2023 .
- ↑ سوزان تشانغ؛ منى دياب؛ لوك زيتلموير. "إتاحة الوصول إلى نماذج اللغة واسعة النطاق للجميع باستخدام OPT-175B" . ai.facebook.com . مؤرشف من الأصل بتاريخ 12 مارس 2023. تم الاطلاع عليه بتاريخ 12 مارس 2023 .
- ↑ تشانغ، سوزان؛ رولر، ستيفن؛ غويال، نامان؛ أرتيتكس، ميكيل؛ تشين، مويا؛ تشين، شوهوي؛ ديوان، كريستوفر؛ دياب، منى؛ لي، شيان؛ لين، شي فيكتوريا؛ ميخايلوف، تودور؛ أوت، مايل؛ شليفر، سام؛ شوستر، كورت؛ سيميج، دانيال؛ كورا، بونيت سينغ؛ سريدهار، أنجالي؛ وانغ، تيانلو؛ زيتلموير، لوك (21 يونيو 2022). "OPT: نماذج لغة المحولات المفتوحة المدربة مسبقًا". arXiv : 2205.01068 [ cs.CL ].
- ↑ "metaseq/projects/OPT/chronicles at main · facebookresearch/metaseq" . GitHub . تم الاطلاع عليه بتاريخ 18-10-2024 .
- 1 2 خروتشوف، ميخائيل؛ فاسيليف، رسلان؛ بتروف، أليكسي؛ زينوف، نيكولاي (22-06-2022)، YaLM 100B ، أرشفة من النسخة الأصلية بتاريخ 16-06-2023 ، استرجاعها 18-03-2023
- 1 2 ليفكوفيتش، أيتور؛ أندرياسن، أندرس؛ دوهان، ديفيد؛ داير، إيثان؛ ميشاليفسكي، هنريك؛ راماسيش، فيناي؛ سلون، أمبروز؛ أنيل، سيم؛ شلاغ، إيمانول؛ غوتمان-سولو، ثيو؛ وو، يوهواي؛ نيشابور، بهنام؛ غور-آري، غاي؛ ميسرا، فيدانت (30 يونيو 2022). "حل مسائل الاستدلال الكمي باستخدام نماذج اللغة". arXiv : 2206.14858 [ cs.CL ].
- ↑ "مينيرفا: حل مسائل الاستدلال الكمي باستخدام نماذج اللغة" . ai.googleblog.com . 30 يونيو 2022. تم الاطلاع عليه في 20 مارس 2023 .
- ↑ أنانثاسوامي، أنيل (8 مارس 2023). " في الذكاء الاصطناعي، هل الأكبر هو الأفضل دائمًا؟" . مجلة نيتشر . 615 (7951): 202-205 . Bibcode : 2023Natur.615..202A . doi : 10.1038/d41586-023-00641-w . PMID 36890378. S2CID 257380916. مؤرشف من الأصل في 16 مارس 2023. تم الاطلاع عليه في 9 مارس 2023 .
- ↑ "bigscience/bloom · Hugging Face" . huggingface.co . 9 نوفمبر 2022. مؤرشف من الأصل في 12 أبريل 2023. تم الاطلاع عليه في 13 مارس 2023 .
- ^ تايلور ، روس. كارداس، مارسين؛ كوكيورول، غيليم؛ سكيلوم، توماس. هارتشورن، أنتوني؛ سارافيا، الفيس؛ بولتون، أندرو؛ كيركيز، فيكتور؛ روبرت ستوينيك (16 نوفمبر 2022). “Galactica: نموذج لغة كبير للعلوم”. أرخايف : 2211.09085 [ cs.CL ].
- ↑ "نموذج أليكسا ذو 20 مليار مُعامل يُحقق أرقامًا قياسية جديدة في التعلّم باستخدام عدد قليل من الأمثلة" . أمازون ساينس . 2 أغسطس 2022. مؤرشف من الأصل في 15 مارس 2023. تم الاطلاع عليه في 12 مارس 2023 .
- ↑ سلطان، صالح؛ أنانثاكريشنان، شانكار؛ فيتزجيرالد، جاك؛ وآخرون . (3 أغسطس 2022). "AlexaTM 20B: التعلم باستخدام عدد قليل من الأمثلة من خلال نموذج Seq2Seq متعدد اللغات واسع النطاق". arXiv : 2208.01448 [ cs.CL ].
- ↑ "أصبح Alexa™ 20B متاحًا الآن في Amazon SageMaker JumpStart | مدونة AWS للتعلم الآلي" . aws.amazon.com . ١٧ نوفمبر ٢٠٢٢. مؤرشف من الأصل في ١٣ مارس ٢٠٢٣. تم الاطلاع عليه في ١٣ مارس ٢٠٢٣ .
- ١ ٢ "تقديم LLaMA: نموذج لغوي أساسي ضخم ذو ٦٥ مليار مُعامل" . Meta AI . ٢٤ فبراير ٢٠٢٣. مؤرشف من الأصل في ٣ مارس ٢٠٢٣. تم الاطلاع عليه في ٩ مارس ٢٠٢٣ .
- ١ ٢ ٣ "هبط الصقر في منظومة Hugging Face" . huggingface.co . ١٩ مايو ٢٠٢٣. مؤرشف من الأصل بتاريخ ٢٠٢٣-٠٦-٢٠ . تم الاطلاع عليه بتاريخ ٢٠٢٣-٠٦-٢٠ .
- ↑ "التقرير الفني لـ GPT-4" (ملف PDF) . OpenAI . 2023. مؤرشف (ملف PDF) من الأصل في 14 مارس 2023. تم الاطلاع عليه في 14 مارس 2023 .
- ↑ داي، نولان (28 مارس 2023). "Cerebras-GPT: عائلة من نماذج اللغة الكبيرة مفتوحة المصدر، ذات كفاءة حسابية عالية" . Cerebras . مؤرشف من الأصل في 28 مارس 2023. تم الاسترجاع في 28 مارس 2023 .
- ↑ «أطلقت هيئة السياحة والإعلام في أبوظبي نسختها الخاصة من تطبيق ChatGPT» . tii.ae. مؤرشف من الأصل بتاريخ 3 أبريل 2023. تم الاطلاع عليه بتاريخ 3 أبريل 2023 .
- ^ بينيدو ، جيلهيرم. مالارتيك، كوينتين؛ هيسلو، دانيال. كوجوكارو، روكساندرا؛ كابيلي، أليساندرو؛ العبيدلي، حمزة؛ بانيير، بابتيست؛ المزروعي، ابتسام؛ لوناي ، جوليان (2023/06/01). “مجموعة بيانات RefinedWeb لـ Falcon LLM: التفوق في الأداء على المجموعات المنسقة باستخدام بيانات الويب وبيانات الويب فقط”. أرخايف : 2306.01116 [ cs.CL ].
- ↑ "tiiuae/falcon-40b · Hugging Face" . huggingface.co . 2023-06-09 . تم الاطلاع عليه بتاريخ 2023-06-20 .
- ↑ أصبح نموذج الذكاء الاصطناعي "فالكون 40B" الإماراتي، المصنف الأول عالميًا من قبل معهد الابتكار التكنولوجي، متاحًا الآن للاستخدام مجانًا. ( مؤرشف بتاريخ 8 فبراير 2024 في أرشيف الإنترنت ، 31 مايو 2023)
- 1 2 وو، شيجي؛ إرسوي، أوزان؛ لو ستيفن. دابرافولسكي، فاديم؛ دريدزي، مارك؛ جيرمان، سيباستيان. كامبادور، برابهانجان؛ روزنبرغ، ديفيد. مان ، جدعون (30 مارس 2023). “BloombergGPT: نموذج لغة كبير للتمويل”. أرخايف : 2303.17564 [ cs.LG ].
- ^ رن، شياو تشه؛ تشو، بينغيي. منغ، شينفان. هوانغ، شينجينغ؛ وانغ، ياداو؛ وانغ، ويتشاو. لي، بنغفي؛ تشانغ، شياودا؛ بودولسكي، الكسندر؛ أرشينوف، غريغوري. بوت، أندريه؛ بيونتكوفسكايا، إيرينا؛ وي، جيان شنغ؛ جيانغ، شين؛ سو، تنغ؛ ليو، كون؛ ياو، يونيو (19 مارس 2023). “PanGu-Σ: نحو تريليون نموذج لغة معلمة مع حوسبة متفرقة غير متجانسة”. أرخايف : 2303.10845 [ cs.CL ].
- ^ كوبف، أندرياس. كيلشر، يانيك؛ فون روتي، ديمتري؛ أناجنوستيديس، سوتيريس؛ تام، تشي روي؛ ستيفنز، كيث. برهوم، عبد الله؛ دوك، نجوين مينه؛ ستانلي، أوليفر. ناجيفي، ريتشارد. إس، شاهول؛ سوري، سمير؛ غلوشكوف، ديفيد؛ دانتولوري، أرناف؛ ماغواير ، أندرو (2023/04/14). “محادثات OpenAssistant – إضفاء الطابع الديمقراطي على محاذاة نماذج اللغة الكبيرة”. أرخايف : 2304.07327 [ cs.CL ].
- ↑ وروبل، شارون. "شركة ناشئة في تل أبيب تُطلق نموذجًا لغويًا متطورًا جديدًا للذكاء الاصطناعي لمنافسة OpenAI" . صحيفة تايمز أوف إسرائيل . ISSN 0040-7909 . مؤرشف من الأصل بتاريخ 24 يوليو 2023. تم الاطلاع عليه بتاريخ 24 يوليو 2023 .
- ↑ ويغرز، كايل (13 أبريل 2023). "مع Bedrock، تدخل أمازون سباق الذكاء الاصطناعي التوليدي" . TechCrunch . مؤرشف من الأصل في 24 يوليو 2023. تم الاطلاع عليه في 24 يوليو 2023 .
- 1 2 إلياس، جينيفر (16 مايو 2023). "يستخدم أحدث نموذج للذكاء الاصطناعي من جوجل بيانات نصية للتدريب تفوق بخمسة أضعاف تقريبًا ما كان يستخدمه سابقه" . سي إن بي سي . مؤرشف من الأصل في 16 مايو 2023. تم الاطلاع عليه في 18 مايو 2023 .
- ↑ "تقديم PaLM 2" . جوجل . 10 مايو 2023. مؤرشف من الأصل في 18 مايو 2023. تم الاسترجاع في 18 مايو 2023 .
- 1 2 3 جوناسيكار، سوريا؛ تشانغ، يي؛ أنيجا، جيوتي؛ كايو سيزار تيودورو مينديز؛ ألي ديل جيورنو؛ جوبي، سيفاكانث؛ جواهريبي، موجان؛ كوفمان، بييرو؛ جوستافو دي روزا؛ ساريكيفي، أولي؛ سالم، عادل؛ شاه، شيتال؛ هاركيرات سينغ بيهل؛ وانغ، شين؛ بوبيك، سيباستيان؛ إلدان، رونين؛ آدم تومان كالاي؛ يين تات لي؛ لي ، يوانزي (2023). “الكتب المدرسية هي كل ما تحتاجه”. أرخايف : 2306.11644 [ cs.CL ].
- ١ ٢ "تقديم لاما ٢: الجيل التالي من نموذج اللغة الكبير مفتوح المصدر" . ميتا إيه آي . ٢٠٢٣. مؤرشف من الأصل في ٢٠٢٤-٠١-٠٥ . تم الاسترجاع في ٢٠٢٣-٠٧-١٩ .
- ↑ "llama/MODEL_CARD.md at main · meta-llama/llama" . GitHub . مؤرشف من الأصل بتاريخ 28-05-2024 . تم الاطلاع عليه بتاريخ 28-05-2024 .
- ↑ "كلود 2" . anthropic.com . مؤرشف من الأصل بتاريخ 15 ديسمبر 2023. تم الاطلاع عليه بتاريخ 12 ديسمبر 2023 .
- ↑ نيرمال، دينيش (2023-09-07). "بناء الذكاء الاصطناعي للأعمال: نماذج أساس Granite من IBM" . مدونة IBM . مؤرشف من الأصل في 2024-07-22 . تم الاطلاع عليه في 2024-08-11 .
- ↑ "الإعلان عن ميسترال 7B" . ميسترال . 2023. مؤرشف من الأصل بتاريخ 2024-01-06 . تم الاطلاع عليه بتاريخ 2023-10-06 .
- ↑ "تقديم كلود 2.1" . anthropic.com . مؤرشف من الأصل بتاريخ 15 ديسمبر 2023. تم الاطلاع عليه بتاريخ 12 ديسمبر 2023 .
- ↑ xai-org/grok-1 ، xai-org، 19-03-2024، مؤرشف من الأصل في 28-05-2024 ، تم استرجاعه في 19-03-2024
- ↑ "بطاقة نموذج Grok-1" . x.ai. تم الاطلاع عليها بتاريخ 12 ديسمبر 2023 .
- ↑ "جيميني - جوجل ديب مايند" . deepmind.google . مؤرشف من الأصل بتاريخ 8 ديسمبر 2023. تم الاطلاع عليه بتاريخ 12 ديسمبر 2023 .
- ↑ فرانزن، كارل (11 ديسمبر 2023). "ميسترال تُثير دهشة مجتمع الذكاء الاصطناعي مع تفوق أحدث نموذج مفتوح المصدر على أداء GPT-3.5" . فينشر بيت . مؤرشف من الأصل في 11 ديسمبر 2023. تم الاطلاع عليه في 12 ديسمبر 2023 .
- ↑ "مزيج من الخبراء" . mistral.ai . ١١ ديسمبر ٢٠٢٣. مؤرشف من الأصل في ١٣ فبراير ٢٠٢٤. تم الاطلاع عليه في ١٢ ديسمبر ٢٠٢٣ .
- 1 2 ديب سيك-AI؛ بي شياو. تشن، ديلي؛ تشن، غوانتينغ. تشن، شانهوانغ؛ داي، داماي؛ دينغ، تشنغكي. دينغ، هونغوي؛ دونغ ، كاي (2024/01/05). “DeepSeek LLM: توسيع نطاق نماذج اللغات مفتوحة المصدر مع المدى الطويل”. أرخايف : 2401.02954 [ cs.CL ].
- 1 2 هيوز، أليسا (12 ديسمبر 2023). "Phi-2: القوة المذهلة لنماذج اللغة الصغيرة" . مايكروسوفت للأبحاث . مؤرشف من الأصل في 12 ديسمبر 2023. تم الاسترجاع في 13 ديسمبر 2023 .
- ↑ " نموذجنا من الجيل التالي: Gemini 1.5" . جوجل . 15 فبراير 2024. مؤرشف من الأصل في 16 فبراير 2024. تم الاسترجاع في 16 فبراير 2024.
هذا يعني أن الإصدار 1.5 Pro قادر على معالجة كميات هائلة من المعلومات دفعة واحدة، بما في ذلك ساعة واحدة من الفيديو، و11 ساعة من الصوت، وقواعد بيانات تحتوي على أكثر من 30,000 سطر برمجي، أو أكثر من 700,000 كلمة. في بحثنا، اختبرنا بنجاح ما يصل إلى 10 ملايين رمز مميز.
- ↑ "Gemma" – عبر GitHub.
- ↑ "OLMo: نموذج اللغة المفتوح | Ai2" . allenai.org . تم الاطلاع عليه بتاريخ 17-03-2026 .
- ↑ غرونيفيلد، ديرك؛ بلتاغي، إيز؛ والش، بيت؛ بهاجيا، أكشيتا؛ كيني، رودني؛ تافجورد، أويفيند؛ جها، أنانيا هارش؛ إيفيسون، هاميش؛ ماغنوسون، إيان (2024-06-07). "OLMo: تسريع علم نماذج اللغة". arXiv : 2402.00838 [ cs.CL ].
- ↑ "تقديم الجيل القادم من كلود" . أنثروبيك . مؤرشف من الأصل بتاريخ 2024-03-04 . تم الاسترجاع بتاريخ 2024-03-04 .
- ^ "ترخيص نموذج مفتوح لـ Databricks" . طوب البيانات . 27 مارس 2024 . تم الاسترجاع في 6 أغسطس 2025 .
- ↑ "سياسة الاستخدام المقبول لنموذج Databricks المفتوح" . Databricks . 27 مارس 2024. تم الاطلاع عليه بتاريخ 6 أغسطس 2025 .
- 1 2 "إصدار "Fugaku-LLM" - نموذج لغوي كبير تم تدريبه على الحاسوب العملاق "Fugaku"" . فوجيتسو . 10 مايو 2024. تم الاطلاع عليه في 20 أبريل 2026. "
- ↑ "شروط استخدام برنامج فوغاكو-LLM" . 23 أبريل 2024. تم الاطلاع عليه في 6 أغسطس 2025 – عبر موقع Hugging Face .
- ↑ "Fugaku-LLM/Fugaku-LLM-13B · Hugging Face" . huggingface.co . مؤرشف من الأصل بتاريخ 17-05-2024 . تم الاطلاع عليه بتاريخ 17-05-2024 .
- ↑ ديكسون، بن (22 مايو 2024). "ميتا تقدم كاميليون، نموذج متعدد الوسائط متطور" . فينشر بيت .
- ↑ "chameleon/LICENSE at e3b711ef63b0bb3a129cf0cf0918e36a32f26e2c · facebookresearch/chameleon" . Meta Research . تم الاطلاع عليه بتاريخ 6 أغسطس 2025 – عبر GitHub .
- ↑ الذكاء الاصطناعي، ميسترال (17 أبريل 2024). "أرخص، أفضل، أسرع، أقوى" . mistral.ai . مؤرشف من الأصل بتاريخ 5 مايو 2024. تم الاطلاع عليه بتاريخ 5 مايو 2024 .
- 1 2 بيلينكو، ميشا (23 أبريل 2024). "تقديم Phi-3: إعادة تعريف ما هو ممكن مع SLMs" . azure.microsoft.com . مؤرشف من الأصل في 8 مايو 2026. تم الاسترجاع في 8 مايو 2026 .
- ↑ عبدين، ماراه؛ وآخرون (2024). "تقرير فني عن Phi-3: نموذج لغوي عالي الكفاءة محليًا على هاتفك". arXiv : 2404.14219 [ cs.CL ].
- ↑ "Qwen2" . GitHub . مؤرشف من الأصل بتاريخ 17-06-2024 . تم الاطلاع عليه بتاريخ 17-06-2024 .
- ^ ديب سيك-AI؛ ليو، أيشين. فنغ، باي. وانغ بن. وانغ، بينجكسوان؛ ليو، بو؛ تشاو، تشنغ قانغ؛ دينجر، تشنغكي؛ روان ، تشونغ (2024/06/19). “DeepSeek-V2: نموذج لغة قوي واقتصادي وفعال لمزيج من الخبراء”. أرخايف : 2405.04434 [ cs.CL ].
- ↑ "رخصة نماذج NVIDIA المفتوحة" . NVIDIA . 16 يونيو 2025. تم الاطلاع عليه بتاريخ 6 أغسطس 2025 .
- ↑ "الذكاء الاصطناعي الجدير بالثقة" . إنفيديا . 27 يونيو 2024. تم الاطلاع عليه في 6 أغسطس 2025 .
- ↑ "nvidia/Nemotron-4-340B-Base · Hugging Face" . huggingface.co . 2024-06-14. مؤرشف من الأصل في 2024-06-15 . تم الاسترجاع في 2024-06-15 .
- ↑ "Nemotron-4 340B | بحث" . research.nvidia.com . مؤرشف من الأصل بتاريخ 15-06-2024 . تم الاطلاع عليه بتاريخ 15-06-2024 .
- ↑ "تقديم سونيتة كلود 3.5" . أنثروبيك . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
- ↑ "تقديم استخدام الحاسوب، وقصيدة سونيت جديدة من نوع كلود 3.5، وقصيدة هايكو من نوع كلود 3.5" . أنثروبيك . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
- ↑ "مجموعة نماذج لاما 3" (23 يوليو 2024) فريق لاما، الذكاء الاصطناعي في ميتا
- ↑ "llama-models/models/llama3_1/MODEL_CARD.md at main · meta-llama/llama-models" . GitHub . مؤرشف من الأصل بتاريخ 23-07-2024 . تم الاطلاع عليه بتاريخ 23-07-2024 .
- ↑ "LICENSE · xai-org/grok-2 at main" . 5 نوفمبر 2025. تم الاطلاع عليه في 18 نوفمبر 2025 – عبر Hugging Face .
- ↑ "سياسة الاستخدام المقبول لـ xAI" . xAI . 2 يناير 2025. تم الاطلاع عليه بتاريخ 18 نوفمبر 2025 .
- ↑ ويذربيد، جيس (14 أغسطس 2024). "روبوتات الدردشة الجديدة Grok-2 من xAI تُدخل توليد الصور بالذكاء الاصطناعي إلى X" . ذا فيرج . تم الاسترجاع في 18 نوفمبر 2025 .
- ↑ ها، أنتوني (24 أغسطس 2025). "إيلون ماسك يقول إن xAI قد أتاحت Grok 2.5 كمصدر مفتوح" . TechCrunch . تم الاطلاع عليه في 18 نوفمبر 2025 .
- ↑ "تقديم OpenAI o1" . openai.com . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
- ↑ بول، كاتي؛ تونغ، آنا (13 سبتمبر 2024). "أوبن إيه آي تطلق سلسلة جديدة من نماذج الذكاء الاصطناعي ذات قدرات "الاستدلال" . رويترز .
- ^ جندال، سيدارت (24 أكتوبر 2024). "Sarvam AI يطلق Sarvam-1، ويتفوق على Gemma-2 وLlama-3.2" . مجلة التحليلات الهندية . مؤرشفة من الأصلي في 25 يوليو 2025 . تم الاسترجاع 20 أبريل 2026 .
- ^ "LICENSE.md · sarvamai/sarvam-1" . 23 أكتوبر 2024 . تم الاسترجاع في 20 أبريل 2026 – عبر Hugging Face .
- 1 2 "نظرة عامة على النماذج" . mistral.ai . تم الاطلاع عليه بتاريخ 2025-03-03 .
- ↑ "OLMo 2: أفضل نموذج لغوي مفتوح بالكامل حتى الآن | Ai2" . allenai.org . تم الاطلاع عليه بتاريخ 17-03-2026 .
- 1 2 3 فريق أولمو؛ والش، بيت. سولديني، لوكا؛ جرونيفيلد ، ديرك. لو كايل. أرورا، شين؛ باجيا، أكشيتا؛ قو، يولينج؛ هوانغ ، شنغي (2025/10/08). "2 أولمو 2 غاضب". أرخايف : 2501.00656 [ cs.CL ].
- ↑ "بطاقة نموذج Phi-4" . huggingface.co . 10 يوليو 2025. تم الاطلاع عليه بتاريخ 11 نوفمبر 2025 .
- ↑ "تقديم Phi-4: أحدث نموذج لغوي صغير من مايكروسوفت متخصص في الاستدلال المعقد" . techcommunity.microsoft.com . تم الاطلاع عليه بتاريخ 11 نوفمبر 2025 .
- ↑ deepseek-ai/DeepSeek-V3 ، DeepSeek، 26-12-2024 ، تم الاطلاع عليه بتاريخ 26-12-2024
- ↑ فينغ، كوكو (25 مارس 2025). "ديب سيك تُبهر المبرمجين بنموذج V3 مفتوح المصدر أكثر قوة" . صحيفة ساوث تشاينا مورنينغ بوست . تاريخ الاسترجاع: 6 أبريل 2025 .
- ↑ بطاقات خدمة الذكاء الاصطناعي من أمازون نوفا مايكرو، لايت، وبرو - AWS3 ، أمازون، 27-12-2024 ، تاريخ الاطلاع : 27-12-2024
- ↑ deepseek-ai/DeepSeek-R1 ، DeepSeek، 21-01-2025 ، تم الاطلاع عليه بتاريخ 21-01-2025
- ^ ديب سيك-AI؛ قوه دايا. يانغ، ديجيان؛ تشانغ، هاوي؛ سونغ، جونشياو؛ تشانغ، رويو؛ شو، رونكسين؛ تشو، تشيهاو؛ Ma، Shirong (2025-01-22)، “DeepSeek-R1 يحفز التفكير في LLMS من خلال التعلم المعزز”، طبيعة ، 645 (8081): 633–638 ، أرخايف : 2501.12948 ، بيب كود : 2025Natur.645..633G ، دوى : 10.1038/s41586-025-09422-z ، بمك 12443585 ، بميد 40962978
- ↑ كوين؛ يانغ، آن؛ يانغ، باوسونغ؛ تشانغ، بيتشن؛ هوي، بينيوان؛ تشنغ، بو؛ يو، بوين؛ لي، تشنغيوان؛ ليو ، دايهينج (2025/01/03). “التقرير الفني Qwen2.5”. أرخايف : 2412.15115 [ cs.CL ].
- ↑ MiniMax-AI/MiniMax-01 ، MiniMax، 26-01-2025 ، تم الاطلاع عليه بتاريخ 26-01-2025
- ↑ ميني ماكس؛ لي، أونيان؛ قونغ، بانغوي؛ يانغ، بو؛ شان، بوجي؛ ليو، تشانغ؛ تشو، تشنغ؛ تشانغ، تشونهاو؛ قوه كونغشاو (14/01/2025). “MiniMax-01: قياس نماذج الأساس بانتباه شديد”. أرخايف : 2501.08313 [ cs.CL ].
- ↑ كافوكجوغلو، كوراي (5 فبراير 2025). "جيميني 2.0 متاح الآن للجميع" . جوجل . تم الاطلاع عليه في 6 فبراير 2025 .
- ↑ "Gemini 2.0: Flash, Flash-Lite and Pro" . Google for Developers . تم الاطلاع عليه بتاريخ 6 فبراير 2025 .
- ↑ فرانزن، كارل (5 فبراير 2025). "جوجل تطلق Gemini 2.0 Pro وFlash-Lite وتربط نموذج التفكير Flash Thinking بخدمات يوتيوب والخرائط والبحث" . VentureBeat . تاريخ الاسترجاع: 6 فبراير 2025 .
- ↑ "Grok 3 Beta — عصر وكلاء الاستدلال" . x.ai. تم الاطلاع عليه بتاريخ 22-02-2025 .
- ↑ "قصيدة كلود 3.7 سونيت وقانون كلود" . أنثروبيك . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
- ↑ "تقديم GPT-4.5" . openai.com . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
- ↑ كافوكجوغلو، كوراي (25 مارس 2025). "جيميني 2.5: نموذج الذكاء الاصطناعي الأكثر ذكاءً لدينا" . جوجل . تم الاطلاع عليه بتاريخ 23 سبتمبر 2025 .
- ↑ "meta-llama/Llama-4-Maverick-17B-128E · Hugging Face" . huggingface.co . 2025-04-05 . تم الاطلاع عليه بتاريخ 2025-04-06 .
- ↑ "قطيع لاما 4: بداية حقبة جديدة من ابتكار الذكاء الاصطناعي متعدد الوسائط بطبيعته" . ai.meta.com . مؤرشف من الأصل بتاريخ 2025-04-05 . تم الاطلاع عليه بتاريخ 2025-04-05 .
- ↑ "تقديم OpenAI o3 و o4-mini" . openai.com . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
- ↑ فريق كوين (29 أبريل 2025). "كوين 3: فكّر بعمق، وتصرّف بسرعة" . كوين . تم الاسترجاع في 29 أبريل 2025 .
- ↑ "تقديم كلود 4" . أنثروبيك . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
- ↑ ياداف، نانديني (26 مايو 2025). "شركة هندية ناشئة في مجال الذكاء الاصطناعي تطلق نموذج سارفام-إم: ما هو، ولماذا يتحدث عنه الجميع؟" . إنديا توداي . تاريخ الاسترجاع: 18 مارس 2026 .
- ^ "Sarvam-M: Open Source Hybrid Indic LLM | Sarvam AI" . سارفام آي . 2025-05-23 . تم الاسترجاع 2026-03-18 .
- ↑ "Grok 4" . x.ai. 9 يوليو 2025. مؤرشف من الأصل في 9 مايو 2026. تم الاسترجاع في 9 مايو 2026 .
- ^ بنداليك، كونديشوار؛ سواركار، بيوش؛ ساهو، نيهار؛ شيندي، ابهيشيك. تشاندا، براتيك؛ جوسوامي، فيدانت؛ ناجبال، أجاي. سينغ، أتول. ثاكور ، فيراج (2025/07/16). "نموذج PARAM-1 BharatGen 2.9B". أرخايف : 2507.13390 [ cs.CL ].
- ↑ "README.md · bharatgenai/Param-1" . 24 فبراير 2026. تم الاطلاع عليه في 12 أبريل 2026 – عبر Hugging Face .
- ↑ "zai-org/GLM-4.5 · Hugging Face" . huggingface.co . 2025-08-04 . تم الاطلاع عليه بتاريخ 2025-08-06 .
- ↑ "GLM-4.5: الاستدلال، والترميز، والقدرات الفاعلة" . z.ai. تم الاطلاع عليه بتاريخ 2025-08-06 .
- ↑ ويتوام، رايان (5 أغسطس 2025). "OpenAI تعلن عن نموذجين مفتوحين للذكاء الاصطناعي "gpt-oss"، ويمكنك تحميلهما اليوم" . آرس تكنيكا . تم الاطلاع عليه في 6 أغسطس 2025 .
- ↑ "Claude Opus 4.1" . Anthropic . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
- ↑ "تقديم GPT-5" . openai.com . 7 أغسطس 2025. تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
- ↑ "منصة OpenAI: توثيق نموذج GPT-5" . openai.com . تم الاطلاع عليه بتاريخ 18 أغسطس 2025 .
- ↑ "deepseek-ai/DeepSeek-V3.1 · Hugging Face" . huggingface.co . 2025-08-21 . تم الاطلاع عليه بتاريخ 2025-08-25 .
- ↑ "إصدار DeepSeek-V3.1 | وثائق واجهة برمجة تطبيقات DeepSeek" . api-docs.deepseek.com . تم الاطلاع عليه بتاريخ 25-08-2025 .
- ^ كيرشنر ، مالطا (2025/09/02). "Apertus: Stellt stellt erstes erstes und mehrsprachiges KI-Modell vor" . heise على الانترنت (باللغة الألمانية) . تم الاسترجاع 2025/11/07 .
- ↑ "Apertus: Ein vollständig offenes,transparentes und mehrsprachiges Sprachmodell" (في المانيا). زيورخ: ETH زيورخ. 2025-09-02 . تم الاسترجاع 2025/11/07 .
- ↑ "تقديم سونيت كلود 4.5" . أنثروبيك . تم الاطلاع عليه بتاريخ 29 سبتمبر 2025 .
- ↑ "GLM-4.6: قدرات متقدمة في مجال الوكلاء والاستدلال والترميز" . z.ai. تم الاطلاع عليه بتاريخ 1 أكتوبر 2025 .
- ↑ "zai-org/GLM-4.6 · Hugging Face" . huggingface.co . 2025-09-30 . تم الاطلاع عليه بتاريخ 2025-10-01 .
- ↑ "GLM-4.6" . modelscope.cn . تم الاطلاع عليه بتاريخ 2025-10-01 .
- ↑ "عصر جديد من الذكاء مع جيميني 3" . جوجل . 18 نوفمبر 2025. تم الاطلاع عليه في 5 يناير 2026 .
- ↑ "أولمو 3: رسم مسار عبر تدفق النموذج لقيادة الذكاء الاصطناعي مفتوح المصدر" . Ai2 . 20 نوفمبر 2025.
- ↑ فريق أولمو؛ إيتينجر، أليسون؛ بيرتش، أماندا؛ كويل، بيلي. جراهام، ديفيد؛ هاينمان، ديفيد. جرونيفيلد ، ديرك. براهمان، فايز. تيمبرز ، فينبار (2025/12/15). "أولمو 3". أرخايف : 2512.13961 [ cs.CL ].
- ↑ "تقديم كلود أوبوس 4.5" . أنثروبيك . تم الاطلاع عليه بتاريخ 8 يناير 2026 .
- ↑ بايندر، مات (3 ديسمبر 2025). "DeepSeek v3.2: ما هو، وكيف يقارن بـ ChatGPT، وكيفية تجربته" . ماشابل . تم الاطلاع عليه في 12 أبريل 2026 .
- ↑ "إصدار DeepSeek-V3.2" . وثائق واجهة برمجة تطبيقات DeepSeek . 1 ديسمبر 2025. تم الاطلاع عليه بتاريخ 12 أبريل 2026 .
- ↑ "DeepSeek-V3.2: استدلال فعال وذكاء اصطناعي فاعل" . Hugging Face . 1 ديسمبر 2025. تم الاطلاع عليه بتاريخ 12 أبريل 2026 .
- ↑ "تطوير العلوم والرياضيات باستخدام GPT-5.2" . openai.com . تم الاطلاع عليه بتاريخ 4 يناير 2026 .
- ↑ "تجاوز حدود التفكير الأمثل في Qwen3" . Qwen . 25 يناير 2026. مؤرشف من الأصل في 6 فبراير 2026. تم الاسترجاع في 6 فبراير 2026.
نُعزز التفكير الأمثل في Qwen3 بابتكارين رئيسيين: (1) إمكانيات استخدام الأدوات التكيفية [...]؛ و(2) تقنيات متقدمة لتوسيع نطاق وقت الاختبار [...]. [...] نُقيد [المسارات المتوازية] ونُعيد توجيه العمليات الحسابية المُوفرة إلى تأمل ذاتي تكراري مُوجه بآلية "اكتساب الخبرة".
- ↑ "الترخيص · moonshotai/Kimi-K2.5" . 1 يناير 2026. تم الاطلاع عليه في 1 أغسطس 2026 – عبر Hugging Face .
- ↑ فريق كيمي؛ باي، ييفان؛ باو، ييبينغ؛ تشارلز، Y.؛ تشن تشنغ. تشن، جواندو؛ تشن، هايتينج؛ تشن، هوارونج؛ تشين ، جياهاو (2026/02/03). “كيمي K2: المخابرات المفتوحة”. أرخايف : 2507.20534 [ cs.LG ].
- ↑ فريق كيمي؛ باي، تونجتونج؛ باي، ييفان؛ باو، ييبينغ؛ كاي، ش. تساو، يوان؛ تشارلز، Y.؛ تشي، HS؛ تشين ، تشنغ (2026/02/02). “كيمي K2.5: ذكاء الوكيل المرئي”. أرخايف : 2602.02276 [ cs.CL ].
- ↑ "Kimi K2.5: دردش مع Kimi K2.5 مجاناً" . Kimi K2.5 . تم الاطلاع عليه بتاريخ 18-03-2026 .
- ↑ جيانغ، بن (3 فبراير 2026). "نموذج ذكاء اصطناعي مُدمج من شركة StepFun الصينية يتفوق على منافسيه من شركتي DeepSeek وMoonshot" . صحيفة ساوث تشاينا مورنينغ بوست . مؤرشف من الأصل في 4 فبراير 2026. تم الاطلاع عليه في 14 أبريل 2026 .
- ↑ "الخطوة 3.5 فلاش: سريع بما يكفي للتفكير، موثوق بما يكفي للتصرف" . ستيب فن . 12 فبراير 2026. تم الاطلاع عليه في 20 أبريل 2026 .
- ↑ "stepfun-ai/Step-3.5-Flash" . 14 مارس 2026. تم الاطلاع عليه في 14 أبريل 2026 – عبر Hugging Face .
- ^ مو ليام. جوه، بريندا. تشين ، لوري (11 فبراير 2026). دي سيلفا، أنيل (محرر). "شركة Zhipu الصينية الناشئة في مجال الذكاء الاصطناعي تُطلق الطراز الرئيسي الجديد GLM-5" . رويترز . تم الاسترجاع 17 فبراير 2026 .
- 1 2 "GLM-5 / README.md" . 16 يونيو 2026. تم الاطلاع عليه في 17 يونيو 2026 – عبر GitHub .
- 1 2 بوتس، ديلان (16 فبراير 2026). "علي بابا تكشف النقاب عن Qwen3.5 مع تحول سباق روبوتات الدردشة في الصين إلى وكلاء الذكاء الاصطناعي" . سي إن بي سي . تم الاسترجاع في 26 فبراير 2026 .
- 1 2 "Qwen3.5: نحو وكلاء متعددي الوسائط أصليين" . Qwen . 15 فبراير 2026. تم الاسترجاع في 18 يوليو 2026 .
- ↑ "الترخيص · Qwen/Qwen3.5-397B-A17B" . 16 فبراير 2026. تم الاطلاع عليه في 10 أبريل 2026 – عبر Hugging Face .
- ↑ "الترخيص · bharatgenai/Param2-17B-A2.4B-Thinking" . 16 فبراير 2026. تم الاطلاع عليه في 12 أبريل 2026 – عبر Hugging Face .
- ↑ "bharatgenai/Param2-17B-A2.4B-Thinking" . تم الاطلاع عليه بتاريخ 2026-03-08 – عبر Hugging Face .
- ^ "sarvamai/sarvam-1-v0.5 · وجه معانق" . Huggingface.co . تم الاسترجاع بتاريخ 2026-03-08 .
- ↑ "sarvamai/sarvam-105b · وجه معانق" . Huggingface.co . تم الاسترجاع بتاريخ 2026-03-08 .
- ↑ كومار، أبهيجيت (19 فبراير 2026). "لماذا يمثل نموذج 105B الجديد لشركة سارفام تحولاً في طموحات الهند السيادية في مجال الذكاء الاصطناعي؟" . بزنس ستاندرد .
- ↑ سينغ، جاغميت (18 فبراير 2026). "نماذج مختبر الذكاء الاصطناعي الهندي "سارفام" الجديدة رهانٌ كبير على جدوى الذكاء الاصطناعي مفتوح المصدر" . تيك كرانش . تاريخ الاسترجاع: 18 مارس 2026 .
- ↑ "إتاحة برنامجي Sarvam 30B و105B كمصدر مفتوح" . Sarvam AI . 6 مارس 2026. مؤرشف من الأصل في 8 مايو 2026. تم الاطلاع عليه في 8 مايو 2026 .
- ^ خافيير ماركيز (17 مارس 2026). "Una IA لإعادة توحيد جميع الوظائف الممكنة: la apuesta de Mistral مع Small 4 es hacer más مع أقل الأشياء" [ ذكاء اصطناعي يجمع كل الوظائف الممكنة: رهان Mistral مع Small 4 هو القيام بالمزيد بموارد أقل ] . شاتاكا (بالإسبانية) . تم الاسترجاع 20 أبريل 2026 .
- ↑ "تقديم ميسترال سمول 4" . ميسترال للذكاء الاصطناعي . تم الاطلاع عليه بتاريخ 20 أبريل 2026 .
- ↑ «كشف النقاب عن نموذج الذكاء الاصطناعي الغامض، وتبين أنه من إنتاج شركة شاومي، بعد شكوكٍ حول كونه من إنتاج شركة ديب سيك» . رويترز . ١٨ مارس ٢٠٢٦. تاريخ الاطلاع: ٣ أبريل ٢٠٢٦ .
- ↑ "أطلقت شاومي نموذج الذكاء الاصطناعي القوي MiMo-V2 Pro بتريليون مُعامل، ونافذة سياقية لمليون رمز" . NDTV Profit . 19 مارس 2026.
- ↑ «تم إصدار Qwen 3.6-Plus، والذي يتضمن وظيفة وكيل تؤدي المهام بشكل مستقل» . Gigazine . 3 أبريل 2026. تم الاطلاع عليه بتاريخ 18 يوليو 2026 .
- ↑ "Qwen3.6-Plus: نحو وكلاء العالم الحقيقي" . Qwen . 1 أبريل 2026. تم الاطلاع عليه في 18 يوليو 2026 .
- ↑ ويتوام، رايان (2 أبريل 2026). "جوجل تعلن عن نماذج الذكاء الاصطناعي المفتوحة Gemma 4، وتتحول إلى ترخيص Apache 2.0" . آرس تكنيكا . تم الاطلاع عليه في 3 أبريل 2026 .
- ↑ مان، توبياس (2 أبريل 2026). "جوجل تُنافس نماذج الأوزان المفتوحة الصينية بـ Gemma 4" . تم الاطلاع عليه في 3 أبريل 2026 .
- ↑ فرانزن، كارل (7 أبريل 2026). "الذكاء الاصطناعي ينضم إلى يوم العمل ذي الثماني ساعات مع إطلاق GLM الإصدار 5.1 من نموذج التعلم الآلي مفتوح المصدر، متفوقًا على Opus 4.6 وGPT-5.4 على SWE-Bench Pro" . فينشر بيت . تم الاطلاع عليه في 12 أبريل 2026 .
- ↑ "GLM-5.1: نحو مهام طويلة المدى" . Z.ai. تم الاطلاع عليه بتاريخ 12 أبريل 2026 .
- ↑ "تقديم ميوز سبارك: التوسع نحو الذكاء الخارق الشخصي" . ai.meta.com . 8 أبريل 2026. مؤرشف من الأصل في 9 مايو 2026. تم الاطلاع عليه في 9 مايو 2026 .
- ↑ «تم إطلاق نموذج مفتوح المصدر لذكاء اصطناعي صيني يُدعى "Qwen3.6-35B-A3B"، وهو أقوى من "Gemma4" .» Gigazine . ١٧ أبريل ٢٠٢٦. تاريخ الاطلاع: ١٧ أبريل ٢٠٢٦ .
- ↑ "README.md · Qwen/Qwen3.6-35B-A3B" . 15 أبريل 2026. تم الاطلاع عليه في 17 أبريل 2026 – عبر Hugging Face .
- ↑ "الترخيص · moonshotai/Kimi-K2.6" . 14 أبريل 2026. تم الاطلاع عليه في 1 أغسطس 2026 – عبر Hugging Face .
- ↑ جيرتز، ديفيد (21 أبريل 2026). "يُغطي برنامج Kimi K2.6 الجديد من Moonshot AI مهامك المعقدة بألف وكيل متعاون" . ZDNET . تم الاطلاع عليه في 17 يونيو 2026 .
- ^ لي ، يوتونغ (22 أبريل 2026). دو ، يو (محرر).13小时编码、5天自主运行!Kimi K2.6开源“硬刚”闭源巨头،长程战力能否撕开AGI工业化新赛道?[ ١٣ ساعة من البرمجة، ٥ أيام من التشغيل الذاتي! نظام Kimi K2.6 مفتوح المصدر "يتحدى" عمالقة البرمجيات المغلقة المصدر. هل يمكن لقدراته طويلة الأمد أن ترسم مسارًا جديدًا لتصنيع الذكاء الاصطناعي العام؟ ] . صحيفة الأعمال الوطنية اليومية (باللغة الصينية) . تاريخ الاطلاع: ١٧ يونيو ٢٠٢٦ .
- ↑ "README.md · moonshotai/Kimi-K2.6" . 23 أبريل 2026. تم الاطلاع عليه في 17 يونيو 2026 – عبر Hugging Face .
- ↑ بوتس، ديلان (24 أبريل 2026). "شركة DeepSeek الصينية تُصدر معاينةً لنموذج V4 الذي طال انتظاره مع اشتداد سباق الذكاء الاصطناعي" . سي إن بي سي .
- ↑ تشو، سيسي (31 يوليو 2026). "ديب سيك تُصدر نسخة تجريبية من نماذج V4 مع احتدام حرب أسعار الذكاء الاصطناعي" . نيكاي آسيا . تم الاطلاع عليه في 1 أغسطس 2026 .
- ↑ "MiMo-V2.5-Pro | Xiaomi" . mimo.xiaomi.com . تم الاطلاع عليه بتاريخ 2026-05-03 .
- ↑ توماس، براسانث آبي (28 أبريل 2026). "شركة شاومي تُصدر نماذج MiMo مرخصة من معهد ماساتشوستس للتكنولوجيا لوكلاء الذكاء الاصطناعي طويلي التشغيل" . مجلة Computerworld . تاريخ الاسترجاع: 6 مايو 2026 .
- ↑ "XiaomiMiMo/MiMo-V2.5" . تطبيق Hugging Face . XiaomiMiMo. 27 أبريل 2026. تاريخ الاسترجاع: 3 مايو 2026 .
- ↑ "Mistral Medium 3.5 - Mistral AI" . docs.mistral.ai .
- ↑ "Composer 2.5" . Cursor . 18 مايو 2026. تم الاطلاع عليه بتاريخ 24 يوليو 2026 .
- ↑ "جيميني 3.5: استخبارات رائدة مع العمل" . جوجل . 19 مايو 2026.
- ↑ بهاتي، ديفيا (28 مايو 2026). "أحدث نموذج من برنامج الذكاء الاصطناعي Qwen التابع لشركة علي بابا يتفوق على Google Gemini وChatGPT في البرمجة" . إنديا توداي . تم الاطلاع عليه في 18 يوليو 2026 .
- ↑ "Qwen3.7: The Agent Frontier" . Qwen . 20 مايو 2026. تم الاطلاع عليه بتاريخ 18 يوليو 2026 .
- ↑ "تقديم كلود أوبوس 4.8" . أنثروبيك . 28 مايو 2026. مؤرشف من الأصل في 30 مايو 2026. تم الاسترجاع في 30 مايو 2026 .
- ↑ "الخطوة 3.7 فلاش" . ستيب فن . 29 مايو 2026. مؤرشف من الأصل في 30 مايو 2026. تم الاسترجاع في 30 مايو 2026 .
- ↑ "الترخيص · MiniMaxAI/MiniMax-M3" . 12 يونيو 2026. تم الاطلاع عليه في 19 يوليو 2026 – عبر Hugging Face .
- ↑ تشانغ، مينشياو (1 يونيو 2026). "ميني ماكس تطلق نموذج ذكاء اصطناعي مصمم لمهام البرمجة الطويلة والمعقدة" . صحيفة ساوث تشاينا مورنينغ بوست . تاريخ الاسترجاع: 19 يوليو 2026 .
- ↑ "README.md · MiniMaxAI/MiniMax-M3" . ١٢ يونيو ٢٠٢٦. تم الاطلاع عليه في ١٩ يوليو ٢٠٢٦ – عبر Hugging Face .
- 1 2 "OpenMDW-1.1" . OpenMDW . تم الاسترجاع في 19 يوليو 2026 .
- ↑ أعلنت شركة NVIDIA عن أقوى نموذج مفتوح المصدر لها في الولايات المتحدة، وهو "Nemotron 3 Ultra"، وأعلنت عن بدء الإنتاج الضخم لخادم الذكاء الاصطناعي الخاص بها، "Vera Rubin"." . Gigazine . 1 يونيو 2026. تم الاطلاع عليه في 16 يوليو 2026 .
- ↑ "README.md · nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4" . 24 يونيو 2026. تم الاطلاع عليه في 16 يوليو 2026 – عبر Hugging Face .
- ↑ "Claude Fable 5 and Claude Mythos 5" . Anthropic . 9 يونيو 2026. مؤرشف من الأصل في 10 يونيو 2026. تم الاطلاع عليه في 11 يونيو 2026 .
- ↑ "الترخيص · moonshotai/Kimi-K2.7-Code" . 11 يونيو 2026. تم الاطلاع عليه في 1 أغسطس 2026 – عبر Hugging Face .
- ↑ «تم إطلاق نموذج الذكاء الاصطناعي الصيني الصنع "Kimi K2.7 Code" كنموذج مفتوح المصدر، ويتميز بأفضل أداء برمجي في سلسلة Kimi واستهلاك منخفض للرموز . » Gigazine . ١٥ يونيو ٢٠٢٦. تاريخ الاطلاع: ١٧ يونيو ٢٠٢٦ .
- ↑ "README.md · moonshotai/Kimi-K2.7-Code" . ١٢ يونيو ٢٠٢٦. تم الاطلاع عليه في ١٧ يونيو ٢٠٢٦ – عبر Hugging Face .
- ↑ تشانغ، مينشياو (15 يونيو 2026). "ارتفاع أسهم شركة زيبو للذكاء الاصطناعي بشكل صاروخي بعد إطلاق الشركة الصينية نموذج GLM-5.2" . صحيفة ساوث تشاينا مورنينغ بوست . تاريخ الاسترجاع: 17 يونيو 2026 .
- ↑ «نموذج Z.ai GLM-5.2 الصيني يتفوق على نموذج GPT 5.5 من OpenAI في المعايير الرئيسية» . صحيفة إيكونوميك تايمز . ١٧ يونيو ٢٠٢٦. تاريخ الاطلاع: ١٧ يونيو ٢٠٢٦ .
- ↑ "GLM-5.2: مصمم لمهام طويلة المدى" . Z.ai. تم الاطلاع عليه بتاريخ 16-06-2026 .
- ↑ فرانزن، كارل (29 يونيو 2026). "ميتوان تُعلن عن LongCat-2.0، نموذج الترميز الوكيلي الرائد الذي تبلغ سعته 1.6 تيرابايت والذي يقود مشروع OpenRouter - تم تدريبه بالكامل على رقائق صينية" . فينشر بيت . تم الاطلاع عليه في 16 يوليو 2026 .
- ↑ "تقديم LongCat-2.0" . LongCat . 30 يونيو 2026. تم الاطلاع عليه بتاريخ 16 يوليو 2026 .
- ↑ ويتفين، سام (6 يوليو 2026). "برنامج Hy3 من شركة Tencent، المرخص بموجب رخصة Apache، ينافس GLM-5.2 بنصف الحجم - ويتفوق عليه في كل شيء باستثناء البرمجة" . VentureBeat . تم الاطلاع عليه في 15 يوليو 2026 .
- ↑ "تقديم Grok 4.5" . x.ai. تم الاطلاع عليه بتاريخ 24 يوليو 2026 .
- ↑ "أصدرت شركة SpaceXAI برنامج Grok 4.5، والذي وصفه إيلون بأنه "نموذج من فئة Opus"" . TechCrunch . 8 يوليو 2026. تم الاطلاع عليه بتاريخ 24 يوليو 2026. "
- ↑ "SWE-1.7" . الإدراك . 8 يوليو 2026. تم الاسترجاع في 24 يوليو 2026 .
- ↑ فارغيز، هارشيتا (9 يوليو 2026). "ميتا تُطلق نموذج Muse Spark 1.1 مع معاينة متاحة للمطورين" . رويترز . تم الاطلاع عليه في 9 يوليو 2026 .
- ↑ لويزوس، كوني (15 يوليو 2026). "شركة Thinking Machines تُعزز رهانها ضد الذكاء الاصطناعي ذي المقاس الواحد الذي يناسب الجميع، وذلك من خلال أول نموذج مفتوح المصدر لها، Inkling" . TechCrunch . تم الاطلاع عليه بتاريخ 15 يوليو 2026 .
- ↑ فرانزن، كارل (15 يوليو 2026). "شركة Thinking Machines تُطلق أول نموذج لغوي متعدد الوسائط مفتوح المصدر، وهو Inkling، ويركز على التكلفة المنخفضة و"مقاومة الرقابة"" . VentureBeat . تم الاطلاع عليه في 15 يوليو 2026 .
- ↑ فرانزن، كارل (27 يوليو 2026). "الأوزان الكاملة لـ Kimi K3 متوفرة الآن، لكنها "مفتوحة" مع تحذير: ما يجب على الشركات معرفته" . VentureBeat . تم الاطلاع عليه في 1 أغسطس 2026 .
- ↑ "مونشوت إيه آي تُصدر أوزان نموذج كيمي كي 3 بموجب ترخيص مخصص: ما يعنيه ذلك للمؤسسات" . صحيفة إنديان إكسبريس . 28 يوليو 2026. تاريخ الاطلاع: 1 أغسطس 2026 .
- ↑ يلدريم، إيجي (16 يوليو 2026). "الصين تُلقي قنبلة أخرى على شركات الذكاء الاصطناعي الأمريكية الرائدة" . جيزمودو . تاريخ الاسترجاع: 16 يوليو 2026 .
- ↑ "كوين من علي بابا تكشف عن معاينة نموذج الذكاء الاصطناعي الرائد" . بلومبيرغ نيوز . 19 يوليو 2026. تم الاطلاع عليه بتاريخ 19 يوليو 2026 .
- ↑ "تقديم Gemini 3.6 Flash و3.5 Flash-Lite و3.5 Flash Cyber" . جوجل . 21 يوليو 2026. تاريخ الاسترجاع: 22 يوليو 2026 .
- ↑ مارتن، إيان (21 يوليو 2026). "مختبرات المصادر المفتوحة الأمريكية تعتقد أنها قادرة على التفوق على أفضل الشركات الناشئة الصينية في مجال الذكاء الاصطناعي" . فوربس . تم الاطلاع عليه في 23 يوليو 2026 .
- ↑ نونيز، مايكل (21 يوليو 2026). "بولسايد تُطلق لاجونا إس 2.1، نموذج ترميز مفتوح الوزن يتفوق على منافسيه الذين يفوقونه حجمًا بعشرة أضعاف" . فينشر بيت . تم الاطلاع عليه في 23 يوليو 2026 .
- ^ "فوجو" . سكنا آي . تم الاسترجاع 24 يوليو 2026 .
- ↑ براندوم، راسل (24 يوليو 2026). "أنثروبيك تطلق أوبوس 5" . تك كرانش .
- ↑ فرانزن، كارل (30 يوليو 2026). "شركة Thinking Machines تُطلق نموذج Inkling Small مفتوح المصدر للذكاء الاصطناعي، والذي يقترب من أداء سابقه بحجم ربع حجمه تقريبًا" . VentureBeat . تاريخ الاسترجاع: 1 أغسطس 2026 .
فئات :
- مقارنات البرامج
- نماذج لغوية كبيرة
