قائمة نماذج اللغة الكبيرة

نموذج اللغة الكبير (LLM) هو نوع من نماذج التعلم الآلي المصممة لمهام معالجة اللغة الطبيعية مثل توليد اللغة . نماذج اللغة الكبيرة هي نماذج لغوية ذات معلمات عديدة، ويتم تدريبها باستخدام التعلم الذاتي على كمية هائلة من النصوص.

قائمة

بالنسبة لعمود تكلفة التدريب، فإن 1 بيتافلوب-يوم يساوي 1 بيتافلوب/ثانية × 1 يوم، أو8.64 × 10^ 19  عملية حسابية للفاصلة العائمة ( FLOP ). يُعرض هنا تكلفة النموذج الأكبر فقط. يُقاس عدد المعاملات بالمليارات، [ أ ] وتُقاس تكلفة التدريب بالبيتا فلوب-يوم.

2018

اسمتاريخ الإصدار [ ب ]مطورمن المعلماتحجم الجسمتكلفة التدريبالترخيص [ ج ]ملحوظات
GPT-111 يونيوأوبن إيه آي0.117 مليارمجهول1 [ 1 ]معهد ماساتشوستس للتكنولوجيا [ 2 ]
أول نموذج GPT، وهو نموذج محول يعتمد على وحدة فك التشفير فقط. تم تدريبه لمدة 30 يومًا على 8 وحدات معالجة رسومية P600 . [ 3 ]
بيرتأكتوبر 2018جوجل0.340B [ 4 ]3.3 مليار كلمة [ 4 ]9 [ 5 ]أباتشي 2.0 [ 6 ]
نموذج لغوي مبكر ومؤثر. [ 7 ] يعتمد على المُشفِّر فقط، وبالتالي لم يُصمَّم ليكون مُوجَّهًا أو توليديًا. [ 8 ] استغرق التدريب 4 أيام على 64 شريحة TPUv2. [ 4 ]

2019

اسمتاريخ الإصدار [ ب ]مطورمن المعلماتحجم الجسمتكلفة التدريبالترخيص [ ج ]ملحوظات
T5أكتوبر 2019جوجل11ب [ 9 ]34 مليار رمز [ 9 ]مجهولأباتشي 2.0 [ 10 ]
النموذج الأساسي لمشاريع جوجل مثل Imagen. [ 11 ]
XLNetيونيو ٢٠١٩جوجل0.340B [ 12 ]33 مليار كلمة330أباتشي 2.0 [ 13 ]
بديل لنموذج BERT؛ مصمم ليكون مُشفِّرًا فقط. تم تدريبه على 512 شريحة TPU v3 لمدة 5.5 أيام. [ 14 ]
GPT-2فبراير 2019أوبن إيه آي1.5 مليار [ 15 ]40 جيجابايت [ 16 ] (~ 10 مليارات رمز مميز) [ 17 ]28 [ 18 ]معهد ماساتشوستس للتكنولوجيا [ 19 ]
تم تدريبها على 32 شريحة TPUv3 لمدة أسبوع واحد. [ 18 ]

2020

اسمتاريخ الإصدار [ ب ]مطورمن المعلماتحجم الجسمتكلفة التدريبالترخيص [ ج ]ملحوظات
GPT-3مايو 2020أوبن إيه آي175ب [ 20 ]300 مليار رمز [ 17 ]3640 [ 21 ]ملكية خاصة
تم إتاحة نسخة محسنة من GPT-3، تسمى GPT-3.5، للجمهور من خلال ChatGPT في عام 2022. [ 22 ]

2021

اسمتاريخ الإصدار [ ب ]مطورمن المعلماتحجم الجسمتكلفة التدريبالترخيص [ ج ]ملحوظات
جي بي تي-نيومارس 2021إليوثي إيه آي2.7 ب [ 23 ]825 جيجابايت [ 24 ]مجهولمعهد ماساتشوستس للتكنولوجيا [ 25 ]
أول بديل مجاني لنموذج GPT-3 تم إصداره بواسطة EleutherAI. تفوق GPT-Neo على نموذج GPT-3 ذي الحجم المكافئ في بعض المعايير، ولكنه كان أسوأ بكثير من أكبر نموذج GPT-3. [ 25 ]
هايبركلوفامايو 2021 [ 26 ]نيفر204ب [ 27 ] 82ب [ 28 ]560B رمزًا [ 27 ]مجهولغير منشور
ويشير تقريرها الفني إلى أن النموذج هو "أول اكتشاف على نطاق يقارب 100 مليار لغة غير إنجليزية" من خلال "بناء مجموعة كبيرة من الكلمات الكورية التي يبلغ عددها 560 مليار كلمة". [ 28 ]
GPT-Jيونيو 2021إليوثي إيه آي[ 29 ]825 جيجابايت [ 24 ]200 [ 30 ]أباتشي 2.0
ميجاترون-تورينج NLGأكتوبر 2021 [ 31 ]مايكروسوفت وإنفيديا530ب [ 32 ]338.6 مليار رمز [ 32 ]38000 [ 33 ]غير منشور
تم تدريبها لمدة 3 أشهر على أكثر من 2000 وحدة معالجة رسومية A100 على جهاز NVIDIA Selene Supercomputer ، لأكثر من 3 ملايين ساعة معالجة رسومية. [ 33 ]
إيرني 3.0 تيتانديسمبر 2021بايدو260ب [ 34 ]4 تيرابايتمجهولملكية خاصة
كلود [ 35 ]ديسمبر 2021الأنثروبيك52ب [ 36 ]400B رمز [ 36 ]مجهول
مُحسَّن بدقة لتحقيق السلوك المرغوب فيه في المحادثات. [ 37 ]
نموذج اللغة العام (GLaM)ديسمبر 2021جوجل1162ب [ 38 ]1.6 تريليون رمز [ 38 ]5600 [ 38 ]
غوفرديسمبر 2021جوجل ديب مايند280ب [ 39 ]300 مليار رمز [ 40 ]5833 [ 41 ]

2022

اسمتاريخ الإصدار [ ب ]مطورمن المعلماتحجم الجسمتكلفة التدريبالترخيص [ ج ]ملحوظات
LaMDA (نماذج اللغة لتطبيقات الحوار)يناير 2022جوجل137ب [ 42 ]1.56 تريليون كلمة، [ 42 ] 168 مليار رمز [ 40 ]4110 [ 43 ]ملكية خاصة
GPT-NeoXفبراير 2022إليوثي إيه آي20ب [ 44 ]825 جيجابايت [ 24 ]740 [ 30 ]أباتشي 2.0
الشنشيلةمارس 2022جوجل ديب مايند70ب [ 45 ]1.4 تريليون رمز [ 45 ] [ 40 ]6805 [ 41 ]ملكية خاصة
PaLM (نموذج لغة المسارات)أبريل 2022جوجل540B [ 46 ]768B رمزًا [ 45 ]29,250 [ 41 ]
تم تدريبها لمدة 60 يومًا تقريبًا على حوالي 6000 شريحة TPU v4 . [ 41 ]
OPT (المحول المفتوح المدرب مسبقًا)مايو 2022ميتا175ب [ 47 ]180 مليار رمز [ 48 ]310 [ 30 ]البحث غير التجاري [ د ]
تم تطوير بنية GPT-3 مع بعض التعديلات من ميجاترون. وقد نُشر سجل التدريب الذي كتبه الفريق. [ 49 ]
YaLM 100Bيونيو 2022ياندكس100B [ 50 ]1.7 تيرابايت [ 50 ]مجهولأباتشي 2.0
مينيرفايونيو 2022جوجل540B [ 51 ]38.5 مليار رمز من صفحات الويب التي تمت تصفيتها بحثًا عن المحتوى الرياضي ومن arXiv [ 51 ]ملكية خاصة
لحل "المسائل الرياضية والعلمية باستخدام الاستدلال التدريجي". [ 52 ]
يزدهريوليو 2022تعاون كبير بقيادة Hugging Face175ب [ 53 ]350 مليار رمز (1.6 تيرابايت) [ 54 ]الذكاء الاصطناعي المسؤول
جالاكتيكانوفمبر 2022ميتا120B106 مليار رمز [ 55 ]CC-BY-NC-4.0
أليكسا™ (نماذج المعلمين)نوفمبر 2022أمازون20ب [ 56 ]1.3T [ 57 ]ملكية خاصة [ 58 ]

2023

اسمتاريخ الإصدار [ ب ]مطورمن المعلماتحجم الجسمتكلفة التدريبالترخيص [ ج ]ملحوظات
اللامافبراير 2023الذكاء الاصطناعي الفائق65ب [ 59 ]1.4T [ 59 ]6300 [ 60 ]البحث غير التجاري [ هـ ]
GPT-4مارس 2023أوبن إيه آيغير معروف [ f ]مجهولمجهولملكية خاصة
سيريبراس-جي بي تيمارس 2023الأدمغة13ب [ 62 ]270 [ 30 ]أباتشي 2.0
فالكونمارس 2023معهد ابتكار التكنولوجيا40ب [ 63 ]1 تيرابايت من الرموز، من RefinedWeb (مجموعة نصوص الويب المفلترة) [ 64 ] بالإضافة إلى بعض "المجموعات المنسقة". [ 65 ]2800 [ 60 ]أباتشي 2.0 [ 66 ]
بلومبيرغ جي بي تيمارس 2023بلومبيرغ إل بي50ب363 مليار رمز من مصادر البيانات الخاصة ببلومبرج، بالإضافة إلى 345 مليار رمز من مجموعات البيانات ذات الأغراض العامة [ 67 ]مجهولغير منشور
مصمم للمهام المالية. [ 67 ]
بانجو-Σمارس 2023هواوي1085ب329 مليار رمز [ 68 ]ملكية خاصة
OpenAssistant [ 69 ]مارس 2023لايون17ب1.5 تريليون رمزأباتشي 2.0
العصر الجوراسي 2 [ 70 ] [ 71 ]مارس 2023مختبرات AI21مجهولمجهولملكية خاصة
PaLM 2 (نموذج لغة المسارات 2)مايو 2023جوجل340B [ 72 ]3.6 تريليون رمز [ 72 ]85000 [ 60 ]
مستخدم في برنامج الدردشة الآلي Bard . [ 73 ]
ياندكس جي بي تي17 مايو 2023ياندكسمجهولمجهولمجهول
فاي-121 يونيو 2023مايكروسوفت1.3 مليار [ 74 ]7B رمزًا [ 74 ]مجهولمعهد ماساتشوستس للتكنولوجيا
تم التدريب لمدة 4 أيام على 8 طائرات من طراز A100. [ 74 ]
لاما 2يوليو 2023الذكاء الاصطناعي الفائق70ب [ 75 ]2T رمز [ 75 ]21000لاما 2
تم تدريبها على مدى 3.3 مليون ساعة باستخدام وحدة معالجة الرسومات (A100). [ 76 ]
كلود 2يوليو 2023الأنثروبيكمجهولمجهولمجهولملكية خاصة
مستخدم في برنامج الدردشة الآلي كلود. [ 77 ]
جرانيت 13بيوليو 2023شركة آي بي إممجهول
مستخدم في IBM Watsonx . [ 78 ]
ميسترال 7بسبتمبر 2023ميسترال للذكاء الاصطناعي7.3ب [ 79 ]أباتشي 2.0
ياندكس جي بي تي 27 سبتمبر 2023ياندكسمجهولملكية خاصة
كلود 2.1نوفمبر 2023الأنثروبيكمجهول
يُستخدم في برنامج الدردشة الآلي "كلود". يحتوي على نافذة سياقية تضم 200,000 رمز، أو ما يقارب 500 صفحة. [ 80 ]
Grok-1 [ 81 ]نوفمبر 2023xAI314بأباتشي 2.0
يُستخدم في روبوت الدردشة Grok . يبلغ طول سياق Grok 1 8192 رمزًا، ويتمتع بإمكانية الوصول إلى X (تويتر). [ 82 ]
جيميني 1.0ديسمبر 2023جوجل ديب مايندمجهولملكية خاصة
نموذج متعدد الوسائط، متوفر بثلاثة أحجام. يُستخدم في برنامج الدردشة الآلي الذي يحمل نفس الاسم . [ 83 ]
ميكسترال 8x7Bديسمبر 2023ميسترال للذكاء الاصطناعي46.7 بأباتشي 2.0
يتفوق على GPT-3.5 و Llama 2 70B في العديد من المعايير. [ 84 ] نموذج مزيج من الخبراء ، مع 12.9 مليار مُعامل مُفعّل لكل رمز. [ 85 ]
ديب سيك - ماجستير في القانون29 نوفمبر 2023البحث العميق67ب2T رمزًا [ 86 ] : الجدول 212000البحث العميق
تم تدريبه على النصوص الإنجليزية والصينية. تم استخدامه 1024 عملية حسابية للتدريب لنموذج 67B، و10 عمليات حسابية لنموذج 7B. [ 86 ] : الشكل 5
فاي-2ديسمبر 2023مايكروسوفت2.7 مليار1.4 تريليون رمز419 [ 87 ]معهد ماساتشوستس للتكنولوجيا
تم تدريبها على بيانات حقيقية واصطناعية "بجودة الكتب الدراسية" على مدار 14 يومًا على 96 وحدة معالجة رسومية A100. [ 87 ]

2024

اسمتاريخ الإصدار [ ب ]مطورمن المعلماتحجم الجسمتكلفة التدريبالترخيص [ ج ]ملحوظات
الجوزاء 1.5فبراير 2024جوجل ديب مايندمجهولمجهولمجهولملكية خاصة
نموذج متعدد الوسائط قائم على بنية MoE. نافذة السياق تتجاوز مليون رمز مميز. [ 88 ]
جيميني ألترافبراير 2024
جيمافبراير 20246T رموزشروط استخدام جيما [ 89 ]
أولموفبراير 2024معهد ألين للذكاء الاصطناعي[ 90 ]2T رمز [ 91 ]أباتشي 2.0
كلود 3مارس 2024الأنثروبيكمجهولمجهولملكية خاصة
يتضمن ثلاثة نماذج: الهايكو، والسونيت، والأوبوس. [ 92 ]
DBRXمارس 2024داتابريكس وموزاييك إم إل136ب12T رمزًاالنموذج المفتوح لطوب البيانات [ 93 ] [ 94 ]
ياندكس جي بي تي 3 برو28 مارس 2024ياندكسمجهولمجهولملكية خاصة
فوغاكو-LLM [ 95 ]مايو 2024فوجيتسو ، معهد طوكيو للتكنولوجيا ، جامعة توهوكو ، ريكين ، إلخ.13ب380B رمزًاشروط الاستخدام Fugaku-LLM [ 96 ]
أكبر نموذج تم تدريبه على وحدة المعالجة المركزية فقط، على حاسوب فوغاكو العملاق؛ تم تدريب النموذج من الصفر على 380 مليار رمز باستخدام 13824 عقدة فوغاكو. [ 95 ] [ 97 ]
حرباءمايو 2024الذكاء الاصطناعي الفائق34ب [ 98 ]4.4 تيرابايتالبحث غير التجاري [ 99 ]
Mixtral 8x22B [ 100 ]17 أبريل 2024ميسترال للذكاء الاصطناعي141بمجهولأباتشي 2.0
فاي-323 أبريل 2024مايكروسوفت14ب [ 101 ]4.8 تريليون رمز [ 102 ]معهد ماساتشوستس للتكنولوجيا
سوّقتها مايكروسوفت على أنها "نموذج لغة صغير". [ 101 ]
نماذج كود الجرانيتمايو 2024شركة آي بي إممجهولمجهولأباتشي 2.0
ياندكس جي بي تي 3 لايت28 مايو 2024ياندكسمجهولمجهولملكية خاصة
كوين 2يونيو 2024علي بابا كلاود72ب [ 103 ]رموز 3Tمتنوع
ديب سيك-الإصدار الثانييونيو 2024البحث العميق236ب8.1 تريليون رمز28000البحث العميق
1.4 مليون ساعة على H800. [ 104 ]
نيموترون -4يونيو 2024إنفيديا340ب9T رموز200,000نموذج NVIDIA المفتوح [ 105 ] [ 106 ]
تم تدريب النموذج لمدة دورة واحدة. تم تدريبه على 6144 وحدة معالجة رسومية من نوع H100 بين ديسمبر 2023 ومايو 2024. [ 107 ] [ 108 ]
كلود 3.5يونيو 2024الأنثروبيكمجهولمجهولمجهولملكية خاصة
في البداية، تم إصدار نموذج واحد فقط، وهو سونيت. [ 109 ] في أكتوبر 2024، تم تحديث سونيت إلى الإصدار 3.5، وأصبح هايكو 3.5 متاحًا. [ 110 ]
لاما 3.1يوليو 2024الذكاء الاصطناعي الفائق405ب15.6 تريليون رمز440,000اللاما 3
استغرقت النسخة 405B مدة 31 مليون ساعة على جهاز H100 بسعة 80 جيجابايت، بمعدل 3.8E25 عملية حسابية. [ 111 ] [ 112 ]
جروك-214 أغسطس 2024xAIمجهولمجهولمجهولاتفاقية ترخيص مجتمع xAI [ 113 ] [ 114 ]
كان في الأصل مغلق المصدر، ثم أعيد إصداره باسم "Grok 2.5" بموجب ترخيص متاح المصدر في أغسطس 2025. [ 115 ] [ 116 ]
OpenAI o112 سبتمبر 2024أوبن إيه آيمجهولمجهولملكية خاصة
تم وصف نموذج LLM لأول مرة بأنه " نموذج استدلالي ". [ 117 ] [ 118 ]
سارفام-124 أكتوبر 2024سارفام للذكاء الاصطناعيحوالي 2 تريليون رمزشركة سارفام لأبحاث الذكاء الاصطناعي
يدعم 10 لغات هندية والإنجليزية [ 119 ] [ 120 ]
ياندكس جي بي تي 4 لايت وبرو24 أكتوبر 2024ياندكسمجهولمجهولملكية خاصة
ميسترال لارجنوفمبر 2024ميسترال للذكاء الاصطناعي123بمجهولأبحاث ميسترال
تم تحديثه بمرور الوقت. أحدث إصدار هو 24.11. [ 121 ]
بيكسرال
متعدد الوسائط. يوجد أيضًا إصدار 12B مرخص بموجب رخصة أباتشي 2. [ 121 ]
OLMo 2نوفمبر 2024معهد ألين للذكاء الاصطناعي32ب [ 122 ] [ 123 ]6.6 تريليون رمز [ 123 ]15000 [ 123 ]أباتشي 2.0
فاي-412 ديسمبر 2024مايكروسوفت14ب [ 124 ]9.8 تريليون رمزمجهولمعهد ماساتشوستس للتكنولوجيا
سوّقتها مايكروسوفت على أنها "نموذج لغة صغير". [ 125 ]
ديب سيك-الإصدار 3ديسمبر 2024البحث العميق671ب14.8 تريليون رمز56000
استُخدمت 2.788 مليون ساعة تدريب على وحدات معالجة الرسومات H800. [ 126 ] أُصدرت في الأصل بموجب ترخيص DeepSeek، ثم أُعيد إصدارها بموجب ترخيص MIT باسم "DeepSeek-V3-0324" في مارس 2025. [ 127 ]
أمازون نوفاديسمبر 2024أمازونمجهولمجهولمجهولملكية خاصة
يشمل ثلاثة نماذج: نوفا مايكرو، نوفا لايت، ونوفا برو. [ 128 ]

2025

اسمتاريخ الإصدار [ ب ]مطورمن المعلماتحجم المدونة [ غ ]الترخيص [ ج ]ملحوظات
ديب سيك آر 120 ينايرالبحث العميق671بمجهولمعهد ماساتشوستس للتكنولوجيا
لا يوجد تدريب مسبق؛ يتم التعلم بالتعزيز على V3-Base. [ 129 ] [ 130 ]
Qwen2.526 ينايرعلي بابا72ب18Tمتنوع
7 نماذج كثيفة ذات عدد معلمات يتراوح من 0.5 مليار إلى 72 مليار. كما أصدرت شركة علي بابا نوعين مختلفين من MoE. [ 131 ]
MiniMax-Text-0114 ينايرمينيمكس456ب4.7 طننموذج مينيمكس
جيميني 2.05 فبرايرجوجل ديب مايندمجهولمجهولملكية خاصة
تم إصدار ثلاثة نماذج: فلاش، فلاش لايت، وبرو. [ 134 ] [ 135 ] [ 136 ]
جروك 319 فبرايرxAI
زُعم أن تكلفة التدريب "تزيد عشرة أضعاف عن تكلفة الحوسبة للنماذج السابقة المتطورة". [ 137 ]
كلود 3.724 فبرايرالأنثروبيك
أحد النماذج، سونيت 3.7. [ 138 ]
YandexGPT 5 Lite Pretrain و Pro25 فبرايرياندكس
GPT-4.527 فبرايرأوبن إيه آي
كان أكبر نموذج غير منطقي لدى OpenAI في ذلك الوقت. [ 139 ]
الجوزاء 2.525 مارسجوجل ديب مايند
تم إصدار ثلاثة نماذج: فلاش، فلاش لايت، وبرو. [ 140 ]
تعليمات ياندكس جي بي تي 5 لايت31 مارسياندكس
اللاما 45 أبريلالذكاء الاصطناعي الفائق400B40 طناللاما 4
OpenAI o3 و o4-mini16 أبريلأوبن إيه آيمجهولمجهولملكية خاصة
نماذج الاستدلال. [ 143 ]
كوين 328 أبريلعلي بابا كلاود235ب36Tأباتشي 2.0
تتوفر بأحجام متعددة، أصغرها 0.6B. [ 144 ]
كلود 422 مايوالأنثروبيكمجهولمجهولملكية خاصة
يتضمن نموذجين، سونيت وأوبوس. [ 145 ]
سارفام-م23 مايوسارفام للذكاء الاصطناعي24بمجهولأباتشي 2.0
نموذج استدلال هجين مُحسَّن على قاعدة بيانات ميسترال الصغيرة؛ مُحسَّن للرياضيات والبرمجة واللغات الهندية. [ 146 ] [ 147 ]
جروك 49 يوليوxAIمجهولمجهولملكية خاصة
المعامل 121 يوليوبهاراتجين2.9 مليار5Tأباتشي 2.0
يركز مشروع "Corpus" على المشهد اللغوي في الهند. [ 149 ] [ 150 ]
GLM-4.529 يوليوZ.ai355ب22Tمعهد ماساتشوستس للتكنولوجيا
صدرت بحجمين: 355 مليار و106 مليار. [ 151 ] تم حساب حجم المجموعة بدمج 15 تريليون رمز و7 تريليونات رمز من مزيج التدريب المسبق. [ 152 ]
GPT-OSS5 أغسطسأوبن إيه آي117بمجهولأباتشي 2.0
صدرت بمقاسين 20B و 120B. [ 153 ]
كلود 4.15 أغسطسالأنثروبيكمجهولمجهولملكية خاصة
يتضمن نموذجًا واحدًا، وهو Opus. [ 154 ]
GPT-57 أغسطسأوبن إيه آيمجهولمجهول
يتضمن ثلاثة نماذج: GPT-5، وGPT-5 mini، وGPT-5 nano. يتوفر GPT-5 في ChatGPT وواجهة برمجة التطبيقات (API). وهو يتمتع بقدرات استدلالية. [ 155 ] [ 156 ]
DeepSeek-V3.121 أغسطسالبحث العميق671ب15.639 طنمعهد ماساتشوستس للتكنولوجيا
حجم المجموعة النصية مبني على DeepSeek V3 (تم تدريبه على 14.8 تريليون رمز)؛ وتم تدريبه لاحقًا على 839 مليار رمز من مراحل التوسيع (630 مليار + 209 مليار). [ 157 ] نموذج هجين قادر على التبديل بين نمطي التفكير وعدم التفكير. [ 158 ]
ياندكس جي بي تي 5.1 برو28 أغسطسياندكسمجهولمجهولملكية خاصة
أبيرتوس2 سبتمبرالمعهد الفدرالي السويسري للتكنولوجيا في زيورخ والمعهد الفدرالي السويسري للتكنولوجيا في لوزان70ب15 طنأباتشي 2.0
أول برنامج ماجستير في القانون يتوافق مع قانون الذكاء الاصطناعي للاتحاد الأوروبي . [ 159 ] [ 160 ]
كلود سونيت 4.529 سبتمبرالأنثروبيكمجهولمجهولملكية خاصة
GLM-4.630 سبتمبرZ.ai357بأباتشي 2.0
أليس إيه آي إل إل إم 1.028 أكتوبرياندكسمجهولملكية خاصة
الجوزاء 318 نوفمبرجوجل ديب مايندمجهول
تم إصدار النماذج التالية: Deep Think و Pro. [ 165 ]
أولمو 3 [ 166 ]20 نوفمبرمعهد ألين للذكاء الاصطناعي32ب5.9 طنأباتشي 2.0
يتضمن إصدارات ذات معلمات 7B و 32B، إلى جانب نماذج الاستدلال ونماذج اتباع التعليمات. [ 167 ]
كلود أوبوس 4.524 نوفمبرالأنثروبيكمجهولمجهولملكية خاصة
أكبر طراز في عائلة كلود. [ 168 ]
DeepSeek-V3.21 ديسمبرالبحث العميق685بمعهد ماساتشوستس للتكنولوجيا
يستخدم آلية DeepSeek Sparse Attention (DSA) مخصصة [ 169 ] [ 170 ] [ 171 ]
GPT 5.211 ديسمبرأوبن إيه آيمجهولملكية خاصة
لقد تمكن من حل مشكلة مفتوحة في نظرية التعلم الإحصائي ظلت دون حل من قبل الباحثين البشريين. [ 172 ]
GLM-4.722 ديسمبرZ.ai355بأباتشي 2.0

2026

اسمتاريخ الإصدار [ ب ]مطورمن المعلماتحجم المدونة [ غ ]الترخيص [ ج ]ملحوظات
كوين 3 - التفكير الأقصى26 ينايرعلي بابا كلاودمجهولمجهولملكية خاصة
نموذج استدلال خاص مع استخدام أدوات تكيفي، وتوسيع نطاق وقت الاختبار، وتأمل ذاتي تكراري. [ 173 ]
كيمي كيه 2.527 ينايرمونشوت للذكاء الاصطناعي1T15 طنMIT المعدل [ 174 ]
نموذج متعدد الأنماط ذو 32 مليار مُعامل نشط، مُشتق من كيمي كي 2. [ 175 ] يمكنه استخدام تقنية "سرب الوكلاء" لتنسيق ما يصل إلى 100 وكيل فرعي متوازي. [ 176 ] [ 177 ]
الخطوة 3.5: فلاش12 فبرايرستيب فن196بمجهولأباتشي 2.0
نموذج MoE مع 11 مليار معلمة نشطة من أصل 196 مليار معلمة إجمالية [ 178 ] [ 179 ] [ 180 ]
كلود أوبوس 4.65 فبرايرالأنثروبيكمجهولملكية خاصة
GPT-5.3-Codex5 فبرايرأوبن إيه آيمجهول
GLM-512 فبرايرZ.ai744ب28.5 طنمعهد ماساتشوستس للتكنولوجيا
المعلمات النشطة 40B [ 181 ] [ 182 ]
كوين 3.515 فبرايرعلي بابا كلاود397بمجهولأباتشي 2.0
17B المعلمات النشطة [ 183 ] [ 184 ] [ 185 ]
Qwen3.5-Plusمجهولملكية خاصة
كلود سونيت 4.617 فبرايرالأنثروبيك
المعامل 217 فبرايربهاراتجين17ب22Tبهاراتجين للأبحاث [ 186 ]
نموذج مزيج الخبراء، خليفة النموذج Param-1؛ يدعم العديد من اللغات الهندية الأخرى. تم تدريبه على وحدات معالجة الرسومات H100 لمدة 24 يومًا. [ 187 ]
سارفام-105ب18 فبراير [ ساعة ]سارفام للذكاء الاصطناعي105ب12Tأباتشي 2.0
أول نموذج تأسيسي مُدرَّب بشكل مستقل في الهند؛ يتوفر بإصدارين: 105 مليار و30 مليار. يعتمد على نموذج مزيج الخبراء، ويستخدم 10.3 مليار مُعامل نشط فقط في كل مرة. [ 189 ] يُفسِّر اللغات الهندية واللغة الهندية الإنجليزية . [ 190 ] [ 191 ] [ 192 ]
سارفام-30ب30ب16T
GPT-5.45 مارسأوبن إيه آيمجهولمجهولملكية خاصة
ميسترال صغير 417 مارسميسترال للذكاء الاصطناعي119بأباتشي 2.0
نموذج MoE مع 6B معلمات نشطة من أصل 119B إجمالي [ 193 ] [ 194 ]
MiMo-V2-Pro18 مارسشاومي1Tملكية خاصة
نموذج مزيج الخبراء (MoE) بأكثر من تريليون مُعامل (43 مليار مُعامل نشط). مُصمم لسيناريوهات الوكلاء. كان مُتاحًا في البداية على منصة OpenRouter تحت الاسم الرمزي "Hunter Alpha" قبل إصداره الرسمي. [ 195 ] [ 196 ]
Qwen3.6-Plus1 أبريلعلي بابا كلاودمجهول
جيما 42 أبريلجوجل ديب مايند31بأباتشي 2.0
تم إصداره في 31B و 26B A4B (3.8B معلمات نشطة) و E4B (4B معلمات فعالة) ومتغيرات E2B [ 199 ] [ 200 ]
GLM-5.17 أبريلZ.ai744ب28.5 طنمعهد ماساتشوستس للتكنولوجيا
المعلمات النشطة 40B [ 201 ] [ 202 ] [ 182 ]
ميوز سبارك8 أبريلميتامجهولمجهولملكية خاصة
Qwen3.615 أبريلعلي بابا كلاود35بأباتشي 2.0
نموذج MoE مع 3B معلمات نشطة من أصل 35B إجمالي [ 204 ] [ 205 ]
كلود أوبوس 4.716 أبريلالأنثروبيكمجهولملكية خاصة
كيمي كيه 2.620 أبريلمونشوت للذكاء الاصطناعي1TMIT المعدل [ 206 ]
المعلمات النشطة 32B [ 207 ] [ 208 ] [ 209 ]
GPT-5.523 أبريلأوبن إيه آيمجهولملكية خاصة
ديب سيك-الإصدار 4-فلاش24 أبريلالبحث العميق284ب32Tمعهد ماساتشوستس للتكنولوجيا
تم إصدار نسخة تجريبية في 24 أبريل. [ 210 ] تم إصدار النسخة التجريبية من V4-Flash في 31 يوليو. [ 211 ]
ديب سيك-في4-برو1.6 تيرابايت
MiMo-V2.5-Pro27 أبريلشاومي1.02 طن48T
نموذج MoE مصمم للبرمجة الوكيلة ومهام هندسة البرمجيات طويلة المدى. [ 212 ] [ 213 ]
MiMo-V2.5310ب27T
نموذج MoE متعدد الوسائط مع قدرات فاعلة وسياق مليون رمز. [ 214 ]
ميسترال متوسط ​​3.528 أبريلميسترال للذكاء الاصطناعي128بمجهولمعهد ماساتشوستس للتكنولوجيا المعدل
النموذج الرئيسي لشركة Mistral AI الذي يدمج اتباع التعليمات والاستدلال والترميز في نموذج كثيف واحد بحجم 128 بايت [ 215 ].
Composer 2.518 مايوالمؤشر1Tملكية خاصة
نموذج ترميز فاعلي متوفر في بيئة تطوير Cursor المتكاملة. مبني على Kimi K2.5 مع إضافة التعلم المعزز؛ تم الإبلاغ عن 1 تيرابايت إجمالي / 32 بايت معلمات نشطة. [ 216 ]
جيميني 3.5 فلاش19 مايوجوجل ديب مايندمجهول
Qwen3.7-Max20 مايوعلي بابا كلاودمجهول
كلود أوبوس 4.828 مايوالأنثروبيكمجهول
الخطوة 3.7: الفلاش29 مايوستيب فن198بأباتشي 2.0
عدد المعاملات هو 196 مليار (أساسي) + 1.8 مليار ( ViT ). [ 221 ]
MiniMax-M31 يونيوميني ماكس428بمجتمع ميني ماكس [ 222 ]
23B المعلمات النشطة [ 223 ] [ 224 ]
نيموترون 3 ألترا4 يونيوإنفيديا550B20 طنOpenMDW 1.1 [ 225 ]
55B المعلمات النشطة [ 226 ] [ 227 ]
كلود فابل 59 يونيوالأنثروبيكمجهولمجهولملكية خاصة
رمز Kimi K2.716 يونيومونشوت للذكاء الاصطناعي1TMIT المعدل [ 229 ]
المعلمات النشطة 32B [ 230 ] [ 231 ]
GLM-5.216 يونيوZ.ai744ب28.5 طنمعهد ماساتشوستس للتكنولوجيا
المعلمات النشطة 40B [ 232 ] [ 233 ] [ 234 ]
LongCat-2.030 يونيوميتوان1.6 تيرابايت35 طن
48B معلمات نشطة. تم إصدار نسخة تجريبية سابقًا باسم "Owl Alpha" على OpenRouter. [ 235 ] [ 236 ]
Hy36 يوليوتينسنت295بمجهولأباتشي 2.0
21B المعلمات النشطة [ 237 ]
جروك 4.58 يوليوSpaceXAIمجهولملكية خاصة
نموذج رائد للبرمجة، والمهام الوكيلة، والعمل المعرفي؛ تم تدريبه جنبًا إلى جنب مع Cursor. أُتيح للجمهور في 9 يوليو 2026. [ 238 ] [ 239 ]
SWE-1.78 يوليوالذكاء الاصطناعي الإدراكيمجهول
نموذج ترميز لوكيل ديفين ؛ تم تدريبه باستخدام قاعدة بيانات كيمي K2.7 مع خط أنابيب التعلم المعزز من كوجنيشن. متوفر عبر ديفين (وليس كأوزان مفتوحة). [ 240 ]
ميوز سبارك 1.19 يوليوميتامجهول
GPT-5.69 يوليوأوبن إيه آيمجهول
إنكلينغ15 يوليومختبر الآلات المفكرة975B45 طنأباتشي 2.0
41B المعلمات النشطة [ 242 ] [ 243 ]
كيمي كيه 316 يوليومونشوت للذكاء الاصطناعي2.8 تيرابايتمجهولكيمي كيه 3 [ 244 ]
104B معلمات نشطة. تم إصدار الأوزان في 27 يوليو. [ 245 ] [ 246 ]
Qwen3.8-Max19 يوليوعلي بابا كلاود2.4 تيرابايتملكية خاصة

إصدار تجريبي. أعلنت شركة علي بابا أن الأوزان ستصدر في وقت لاحق. [ 247 ]

جيميني 3.6 فلاش21 يوليوجوجل ديب مايندمجهول
لاجونا إس 2.121 يوليونظام الذكاء الاصطناعي بجانب المسبح118بOpenMDW 1.1 [ 225 ]
8B المعلمات النشطة [ 249 ] [ 250 ]
Fugu-Ultra الإصدار 1.124 يوليوسكنا آيمجهولملكية خاصة
تم تحديث Fugu-Ultra بمعايير ترميز ووكلاء واستدلال أقوى مقارنةً بالإصدار 1.0. [ 251 ]
كلود أوبوس 524 يوليوالأنثروبيكمجهول
إنكلينج صغير31 يوليومختبر الآلات المفكرة276بأباتشي 2.0
12B المعلمات النشطة [ 253 ]

انظر أيضاً

ملحوظات

  1. في كثير من الحالات، ينشر الباحثون أو يقدمون تقارير عن نسخ متعددة من نموذج ما بأحجام مختلفة. في هذه الحالات، يُدرج هنا حجم أكبر نموذج.
  2. 1 2 3 4 5 6 7 8 9 هذا هو التاريخ الذي تم فيه إصدار الوثائق التي تصف بنية النموذج لأول مرة.
  3. ١ ٢ ٣ ٤ ٥ ٦ ٧ ٨ ٩ هذه رخصة أوزان النموذج المدرب مسبقًا. في معظم الحالات، يكون كود التدريب نفسه مفتوح المصدر أو يمكن نسخه بسهولة. قد تختلف تراخيص نماذج التعلم الآلي عن تراخيص برامج الدردشة الآلية التي تستخدمها؛ للاطلاع على تراخيص برامج الدردشة الآلية، راجع قائمة برامج الدردشة الآلية .
  4. تتوفر الطرازات الأصغر حجماً، بما في ذلك الطراز 66B، للجمهور، بينما يتوفر الطراز 175B عند الطلب.
  5. قيّد نظام الترخيص والتوزيع الخاص بفيسبوك الوصول إلى الباحثين المعتمدين، ولكن تم تسريب أوزان النموذج وأصبحت متاحة على نطاق واسع.
  6. كما ورد في التقرير الفني: "بالنظر إلى كل من المشهد التنافسي وآثار السلامة المترتبة على النماذج واسعة النطاق مثل GPT-4، فإن هذا التقرير لا يحتوي على مزيد من التفاصيل حول البنية (بما في ذلك حجم النموذج) والأجهزة وحوسبة التدريب وبناء مجموعة البيانات وطريقة التدريب ..." [ 61 ]
  7. 1 2 معبر عنها بعدد الرموز، ما لم يُنص على خلاف ذلك
  8. تم إصدار نسخة تجريبية مبكرة من النموذج في يناير. [ 188 ]

مراجع

  1. "تحسين فهم اللغة من خلال التعلم غير الخاضع للإشراف" . openai.com . ١١ يونيو ٢٠١٨. مؤرشف من الأصل في ١٨ مارس ٢٠٢٣. تم الاطلاع عليه في ١٨ مارس ٢٠٢٣ .
  2. "finetune-transformer-lm" . GitHub . مؤرشف من الأصل في 19 مايو 2023. تم الاطلاع عليه في 2 يناير 2024 .
  3. رادفورد، أليك (11 يونيو 2018). "تحسين فهم اللغة باستخدام التعلم غير الخاضع للإشراف" . OpenAI . تم الاطلاع عليه بتاريخ 18 نوفمبر 2025 .
  4. 1 2 3 ديفلين، جاكوب؛ تشانغ، مينغ-وي؛ لي، كينتون؛ توتانوفا، كريستينا (11 أكتوبر 2018). "BERT: التدريب المسبق للمحولات ثنائية الاتجاه العميقة لفهم اللغة". arXiv : 1810.04805v2 [ cs.CL ].
  5. بريكيت، نيكول هيمسوث (24 أغسطس 2021). "سيريبراس تُغيّر بنيتها لتلبية احتياجات نماذج الذكاء الاصطناعي/التعلم الآلي الضخمة" . المنصة التالية . مؤرشف من الأصل في 20 يونيو 2023. تم الاطلاع عليه في 20 يونيو 2023 .
  6. "بيرت" . ١٣ مارس ٢٠٢٣. مؤرشف من الأصل في ١٣ يناير ٢٠٢١. تم الاسترجاع في ١٣ مارس ٢٠٢٣ عبر جيت هاب.
  7. مانينغ، كريستوفر د. ( 2022). "فهم اللغة البشرية والاستدلال" . ديدالوس . 151 (2): 127-138 . doi : 10.1162/daed_a_01905 . S2CID 248377870. مؤرشف من الأصل بتاريخ 17 نوفمبر 2023. تم الاطلاع عليه بتاريخ 9 مارس 2023 . 
  8. باتيل، أجاي؛ لي، برايان؛ رسولي، محمد صادق؛ كونستانت، نوح؛ رافيل، كولين؛ كاليسون-بيرش، كريس (2022). "نماذج اللغة ثنائية الاتجاه هي أيضًا متعلمون بأمثلة قليلة". arXiv : 2209.14500 [ cs.LG ].
  9. 1 2 رافيل، كولين؛ شازير، نوام؛ روبرتس، آدم؛ لي، كاثرين؛ نارانج، شاران؛ ماتينا، مايكل؛ تشو، يانكي؛ لي، وي؛ ليو، بيتر جيه. (2020). "استكشاف حدود التعلم النقل باستخدام مُحوِّل نص-إلى-نص موحد" . مجلة أبحاث تعلم الآلة . 21 (140): 1-67 . arXiv : 1910.10683 . ISSN 1533-7928 . 
  10. google-research/text-to-text-transfer-transformer ، بحث جوجل، 2024-04-02، مؤرشف من الأصل في 2024-03-29 ، تم استرجاعه في 2024-04-04
  11. "Imagen: نماذج انتشار النص إلى الصورة" . imagen.research.google . مؤرشف من الأصل بتاريخ 27-03-2024 . تم الاطلاع عليه بتاريخ 04-04-2024 .
  12. "النماذج المدربة مسبقًا - وثائق Transformers 2.0.0" . huggingface.co . مؤرشف من الأصل بتاريخ 2024-08-05 . تم الاطلاع عليه بتاريخ 2024-08-05 .
  13. "xlnet" . GitHub . مؤرشف من الأصل في 2 يناير 2024. تم الاسترجاع في 2 يناير 2024 .
  14. ^ يانغ ، تشيلين. داي، زيهانغ؛ يانغ، ييمينغ. كاربونيل، خايمي. صلاح الدينوف، رسلان؛ لو كووك ف. (2 يناير 2020). “XLNet: التدريب المسبق المعمم على الانحدار الذاتي لفهم اللغة”. أرخايف : 1906.08237 [ cs.CL ].
  15. "GPT-2: الإصدار 1.5 مليار" . OpenAI . 5 نوفمبر 2019. مؤرشف من الأصل في 14 نوفمبر 2019. تم الاطلاع عليه في 14 نوفمبر 2019 .
  16. "نماذج لغوية أفضل وآثارها" . openai.com . مؤرشف من الأصل بتاريخ 16-03-2023 . تم الاطلاع عليه بتاريخ 13-03-2023 .
  17. ١ ٢ "نموذج اللغة GPT-3 من OpenAI: نظرة عامة تقنية" . lambdalabs.com . ٣ يونيو ٢٠٢٠. مؤرشف من الأصل في ٢٧ مارس ٢٠٢٣. تم الاطلاع عليه في ١٣ مارس ٢٠٢٣ .
  18. 1 2 "openai-community/gpt2-xl · Hugging Face" . huggingface.co . 21 أكتوبر 2019. مؤرشف من الأصل في 24 يوليو 2024. تم الاسترجاع في 24 يوليو 2024 .
  19. "gpt-2" . جيت هاب . مؤرشف من الأصل في 11 مارس 2023. تم الاسترجاع في 13 مارس 2023 .
  20. ويغرز، كايل (28 أبريل 2022). "الأنواع الناشئة لنماذج اللغة وأهميتها" . تيك كرانش . مؤرشف من الأصل في 16 مارس 2023. تم الاطلاع عليه في 9 مارس 2023 .
  21. الجدول د.1 في: براون، توم ب.؛ مان، بنجامين؛ رايدر، نيك؛ سوبيا، ميلاني؛ كابلان، جاريد؛ داريوال، برافولا؛ نيلاكانتان، أرفيند؛ شيام، براناف؛ ساستري، جيريش؛ أسكيل، أماندا؛ أغاروال، سانديني؛ هيربرت-فوس، أرييل؛ كروجر، جريتشن؛ هينيغان، توم؛ تشايلد، ريون؛ راميش، أديتيا؛ زيغلر، دانيال م.؛ وو، جيفري؛ وينتر، كليمنس؛ هيس، كريستوفر؛ تشين، مارك؛ سيغلر، إريك؛ ليتوين، ماتيوس؛ غراي، سكوت؛ تشيس، بنجامين؛ كلارك، جاك؛ بيرنر، كريستوفر؛ ماكاندليش، سام؛ رادفورد، أليك؛ سوتسكيفر، إيليا؛ أمودي، داريو (28 مايو 2020). "نماذج اللغة هي متعلمون ذوو أمثلة قليلة". arXiv : 2005.14165v4 [ cs.CL ].
  22. "ChatGPT: تحسين نماذج اللغة للحوار" . OpenAI . 30 نوفمبر 2022. مؤرشف من الأصل في 30 نوفمبر 2022. تم الاطلاع عليه في 13 يناير 2023 .
  23. "GPT Neo" . ١٥ مارس ٢٠٢٣. مؤرشف من الأصل في ١٢ مارس ٢٠٢٣. تم الاسترجاع في ١٢ مارس ٢٠٢٣ عبر GitHub.
  24. 1 2 3 غاو، ليو؛ بيدرمان، ستيلا؛ بلاك، سيد؛ غولدينغ، لورانس؛ هوب، ترافيس؛ فوستر، تشارلز؛ فانغ، جيسون؛ هي، هوراس؛ ثيت، أنيش؛ نابيشيما، نوا؛ بريسر، شون؛ ليهي، كونور (31 ديسمبر 2020). "الكومة: مجموعة بيانات بحجم 800 جيجابايت من النصوص المتنوعة لنمذجة اللغة". arXiv : 2101.00027 [ cs.CL ].
  25. 1 2 إيير، أبيشيك (15 مايو 2021). "بديل GPT-3 المجاني، GPT-Neo، أمرٌ يدعو للحماس" . فينشر بيت . مؤرشف من الأصل في 9 مارس 2023. تم الاطلاع عليه في 13 مارس 2023 .
  26. كيم، هان جو (25 مايو 2021). "نافر تكشف النقاب عن منصة الذكاء الاصطناعي العملاقة هايبركلوفا" . وكالة يونهاب للأنباء . تاريخ الاسترجاع: 15 يونيو 2026 .
  27. 1 2 ويغرز، كايل (1 يونيو 2021). "نافر درّبت نموذجًا للغة الكورية شبيهًا بـ GPT-3" . فينشر بيت | تغطية تقنية تحويلية ذات أهمية . مؤرشف من الأصل في 20 سبتمبر 2022. تم الاسترجاع في 15 يونيو 2026 .
  28. 1 2 كيم، بوسوب؛ كيم وهيونج سيوك؛ لي، سانغ وو؛ لي، جيتشانج؛ كواك، دونغهيون؛ دونغ هيون، جيون؛ بارك، سونغهيون؛ كيم، سونغجو؛ كيم، سيونهون؛ سيو، دونجبيل؛ لي، هيونجسوب؛ جيونج، مينيونج؛ لي، سونغجاي؛ كيم، مينسوب؛ كو، سوك هيون؛ كيم، سيوخون؛ بارك، تايونغ؛ كيم، جينوك؛ كانغ، سويونج؛ ريو، نا هيون؛ يو، كانغ مين؛ تشانغ، مينسوك؛ سوه، سوبين؛ في، سوكيو؛ بارك، جينسونغ؛ كيم، كيونغدوك؛ كيم، هيون؛ جيونج، جيسو؛ يو، يونغ جوو؛ هام، دونغهون؛ بارك، دونغجو؛ لي، مين يونغ؛ كانغ، جايووك؛ كانغ، إينهو؛ ها، جونغ وو؛ بارك، ووميونغ؛ سونغ، ناكو (نوفمبر 2021). "ما التغييرات التي يمكن أن تُحدثها نماذج اللغة واسعة النطاق؟ دراسة مُعمّقة حول HyperCLOVA: مُحوّلات توليدية كورية مُدرّبة مُسبقًا على نطاق مليارات" . في: موينز، ماري فرانسين؛ هوانغ، شوانجينغ؛ سبيسيا، لوسيا؛ ييه، سكوت وين تاو (محررون). وقائع مؤتمر 2021 حول الأساليب التجريبية في معالجة اللغة الطبيعية . منشور إلكترونيًا وفي بونتا كانا، جمهورية الدومينيكان: رابطة اللغويات الحاسوبية. الصفحات 3405-3424 . arXiv : 2109.04650 . doi : 10.18653/v1/2021.emnlp-main.274 . 
  29. "GPT-J-6B: مقدمة لأكبر نموذج GPT مفتوح المصدر | فورفرونت" . www.forefront.ai . مؤرشف من الأصل بتاريخ 9 مارس 2023. تم الاطلاع عليه بتاريخ 28 فبراير 2023 .
  30. 1 2 3 4 داي، نولان؛ جوسال، جوربريت؛ تشيمينغ. تشين؛ خشان، هيمانت؛ مارشال، وليام. باتريا، ريبهو؛ توم مارفن. هيتنسس ، جويل (2023/04/01). “Cerebras-GPT: نماذج لغة مفتوحة للحساب الأمثل تم تدريبها على مجموعة Cerebras Wafer-Scale”. أرخايف : 2304.03208 [ cs.LG ].
  31. علوي، علي؛ خاريا، باريش (11 أكتوبر 2021). "استخدام DeepSpeed ​​وMegatron لتدريب Megatron-Turing NLG 530B، وهو أكبر وأقوى نموذج توليدي للغة في العالم" . مايكروسوفت للأبحاث . مؤرشف من الأصل في 13 مارس 2023. تم الاسترجاع في 13 مارس 2023 .
  32. 1 2 سميث، شادن؛ باتواري، مصطفى؛ نوريك، براندون. ليغريسلي، باتريك؛ راجبهانداري، ساميام؛ كاسبر، جاريد. ليو، تشون؛ برابوموي، شريمي؛ زيرفيس، جورج؛ كورثيكانتي، فيجاي؛ تشانغ، التون. الطفل، ريون؛ أمين آبادي، رضا يزداني؛ بيرناور، جولي. سونغ شيا (2022/02/04). “استخدام DeepSpeed ​​و Megatron لتدريب Megatron-Turing NLG 530B، نموذج لغة توليدي واسع النطاق”. أرخايف : 2201.11990 [ cs.CL ].
  33. 1 2 راجبهانداري، ساميام؛ لي، كونغلونغ؛ ياو، زهيوي؛ تشانغ، مينجيا؛ أمين آبادي، رضا يزداني؛ أوان، عمار أحمد؛ راسلي، جيف؛ هو، يوكسيونغ (21/07/2022)، DeepSpeed-MoE: تطوير استدلال مزيج من الخبراء والتدريب لتشغيل مقياس الذكاء الاصطناعي للجيل القادم ، أرخايف : 2201.05596
  34. ^ وانغ ، شوهوان. صن، يو؛ شيانغ، يانغ؛ وو، تشيهوا؛ دينغ، سيو؛ قونغ، ويباو؛ فنغ، شيكون. شانغ، جونيوان؛ تشاو، يانبين؛ بانغ، تشاو؛ ليو، جياشيانغ؛ تشن، شويى. لو، يوشيانغ؛ ليو، ويكسين؛ وانغ شي. باي، يانغفان؛ تشن، تشيوليانغ. تشاو، لي؛ لي شيونغ. صن، بنغ؛ يو، ديانهاي؛ ما، يانجون؛ تيان، هاو؛ وو، هوا؛ وو، تيان؛ تسنغ، وي. لي، قه. جاو ون؛ وانغ ، هايفنغ (23 ديسمبر 2021). “ERNIE 3.0 Titan: استكشاف المعرفة واسعة النطاق المعززة للتدريب المسبق لفهم اللغة وتوليدها”. أرخايف : 2112.12731 [ cs.CL ].
  35. "المنتج" . أنثروبيك . مؤرشف من الأصل في 16 مارس 2023. تم الاسترجاع في 14 مارس 2023 .
  36. 1 2 أسكل، أماندا؛ باي، يونتاو؛ تشن، آنا؛ وآخرون . (9 ديسمبر 2021). "مساعد لغة عامة كمختبر للمواءمة". أرخايف : 2112.00861 [ cs.CL ]. 
  37. ^ باي، يونتاو؛ كادافاث، سوراف؛ كوندو، سانديبان؛ وآخرون . (15 ديسمبر 2022). “الذكاء الاصطناعي الدستوري: عدم الضرر من ردود فعل الذكاء الاصطناعي”. أرخايف : 2212.08073 [ cs.CL ]. 
  38. 1 2 3 داي، أندرو م؛ دو، نان (9 ديسمبر 2021). "تعلم أكثر كفاءة في السياق باستخدام GLaM" . ai.googleblog.com . مؤرشف من الأصل في 12 مارس 2023. تم الاسترجاع في 9 مارس 2023 .
  39. "نمذجة اللغة على نطاق واسع: غوفر، الاعتبارات الأخلاقية، والاسترجاع" . www.deepmind.com . 8 ديسمبر 2021. مؤرشف من الأصل في 20 مارس 2023. تم الاطلاع عليه في 20 مارس 2023 .
  40. 1 2 3 هوفمان، جوردان؛ بورجود، سيباستيان؛ مينش، آرثر؛ وآخرون . (29 مارس 2022). "تدريب نماذج لغوية كبيرة مثالية حسابيًا". arXiv : 2203.15556 [ cs.CL ]. 
  41. ١ ٢ ٣ ٤ الجدول ٢٠ والصفحة ٦٦ من PaLM: توسيع نطاق نمذجة اللغة باستخدام المسارات، مؤرشف بتاريخ ٢٠٢٣-٠٦-١٠ في Wayback Machine
  42. 1 2 تشنغ، هينغ-تزي؛ ثوبيلان، رومال (21 يناير 2022). "لامدا: نحو نماذج حوار آمنة، وواقعية، وعالية الجودة لكل شيء" . ai.googleblog.com . مؤرشف من الأصل في 25 مارس 2022. تم الاطلاع عليه في 9 مارس 2023 .
  43. ^ توبيلان ، رومال. دي فريتاس، دانيال. هول، جيمي؛ شازير، نعوم؛ كولشرشتا، أبورف؛ تشنغ، هنغ تزي. جين، أليسيا؛ بوس، تايلور. بيكر، ليزلي. دو، يو؛ لي، ياجوانج؛ لي هونغراي. تشنغ، هوايشيو ستيفن؛ غفوري، أمين؛ مينيجالي ، مارسيلو (2022-01-01). “LaMDA: نماذج اللغة لتطبيقات الحوار”. أرخايف : 2201.08239 [ cs.CL ].
  44. بلاك، سيدني؛ بيدرمان، ستيلا؛ هالاهان، إريك؛ وآخرون . (2022-05-01). GPT-NeoX-20B: نموذج لغوي مفتوح المصدر للتراجع الذاتي . وقائع ندوة BigScience الحلقة رقم 5 - ورشة عمل حول التحديات والآفاق في إنشاء نماذج لغوية كبيرة. المجلد. وقائع ندوة BigScience الحلقة رقم 5 - ورشة عمل حول التحديات والآفاق في إنشاء نماذج لغوية كبيرة. الصفحات 95-136 . مؤرشف من الأصل في 2022-12-10 . تم الاسترجاع في 2022-12-19 .   
  45. هوفمان ، جوردان؛ بورجو، سيباستيان؛ مينش، آرثر؛ سيفري، لوران (12 أبريل 2022). "تحليل تجريبي لتدريب نماذج اللغة الكبيرة الأمثل حسابيًا" . مدونة ديب مايند . مؤرشف من الأصل في 13 أبريل 2022. تم الاطلاع عليه في 9 مارس 2023 .
  46. نارانج، شاران؛ تشودري، أكانكشا (4 أبريل 2022). "نموذج لغة المسارات (PaLM): التوسع إلى 540 مليار مُعامل لتحقيق أداءٍ مُذهل" . ai.googleblog.com . مؤرشف من الأصل في 4 أبريل 2022. تم الاطلاع عليه في 9 مارس 2023 .
  47. سوزان تشانغ؛ منى دياب؛ لوك زيتلموير. "إتاحة الوصول إلى نماذج اللغة واسعة النطاق للجميع باستخدام OPT-175B" . ai.facebook.com . مؤرشف من الأصل بتاريخ 12 مارس 2023. تم الاطلاع عليه بتاريخ 12 مارس 2023 .
  48. تشانغ، سوزان؛ رولر، ستيفن؛ غويال، نامان؛ أرتيتكس، ميكيل؛ تشين، مويا؛ تشين، شوهوي؛ ديوان، كريستوفر؛ دياب، منى؛ لي، شيان؛ لين، شي فيكتوريا؛ ميخايلوف، تودور؛ أوت، مايل؛ شليفر، سام؛ شوستر، كورت؛ سيميج، دانيال؛ كورا، بونيت سينغ؛ سريدهار، أنجالي؛ وانغ، تيانلو؛ زيتلموير، لوك (21 يونيو 2022). "OPT: نماذج لغة المحولات المفتوحة المدربة مسبقًا". arXiv : 2205.01068 [ cs.CL ].
  49. "metaseq/projects/OPT/chronicles at main · facebookresearch/metaseq" . GitHub . تم الاطلاع عليه بتاريخ 18-10-2024 .
  50. 1 2 خروتشوف، ميخائيل؛ فاسيليف، رسلان؛ بتروف، أليكسي؛ زينوف، نيكولاي (22-06-2022)، YaLM 100B ، أرشفة من النسخة الأصلية بتاريخ 16-06-2023 ، استرجاعها 18-03-2023
  51. 1 2 ليفكوفيتش، أيتور؛ أندرياسن، أندرس؛ دوهان، ديفيد؛ داير، إيثان؛ ميشاليفسكي، هنريك؛ راماسيش، فيناي؛ سلون، أمبروز؛ أنيل، سيم؛ شلاغ، إيمانول؛ غوتمان-سولو، ثيو؛ وو، يوهواي؛ نيشابور، بهنام؛ غور-آري، غاي؛ ميسرا، فيدانت (30 يونيو 2022). "حل مسائل الاستدلال الكمي باستخدام نماذج اللغة". arXiv : 2206.14858 [ cs.CL ].
  52. "مينيرفا: حل مسائل الاستدلال الكمي باستخدام نماذج اللغة" . ai.googleblog.com . 30 يونيو 2022. تم الاطلاع عليه في 20 مارس 2023 .
  53. أنانثاسوامي، أنيل (8 مارس 2023). " في الذكاء الاصطناعي، هل الأكبر هو الأفضل دائمًا؟" . مجلة نيتشر . 615 (7951): 202-205 . Bibcode : 2023Natur.615..202A . doi : 10.1038/d41586-023-00641-w . PMID 36890378. S2CID 257380916. مؤرشف من الأصل في 16 مارس 2023. تم الاطلاع عليه في 9 مارس 2023 .  
  54. "bigscience/bloom · Hugging Face" . huggingface.co . 9 نوفمبر 2022. مؤرشف من الأصل في 12 أبريل 2023. تم الاطلاع عليه في 13 مارس 2023 .
  55. ^ تايلور ، روس. كارداس، مارسين؛ كوكيورول، غيليم؛ سكيلوم، توماس. هارتشورن، أنتوني؛ سارافيا، الفيس؛ بولتون، أندرو؛ كيركيز، فيكتور؛ روبرت ستوينيك (16 نوفمبر 2022). “Galactica: نموذج لغة كبير للعلوم”. أرخايف : 2211.09085 [ cs.CL ].
  56. "نموذج أليكسا ذو 20 مليار مُعامل يُحقق أرقامًا قياسية جديدة في التعلّم باستخدام عدد قليل من الأمثلة" . أمازون ساينس . 2 أغسطس 2022. مؤرشف من الأصل في 15 مارس 2023. تم الاطلاع عليه في 12 مارس 2023 .
  57. سلطان، صالح؛ أنانثاكريشنان، شانكار؛ فيتزجيرالد، جاك؛ وآخرون . (3 أغسطس 2022). "AlexaTM 20B: التعلم باستخدام عدد قليل من الأمثلة من خلال نموذج Seq2Seq متعدد اللغات واسع النطاق". arXiv : 2208.01448 [ cs.CL ]. 
  58. "أصبح Alexa™ 20B متاحًا الآن في Amazon SageMaker JumpStart | مدونة AWS للتعلم الآلي" . aws.amazon.com . ١٧ نوفمبر ٢٠٢٢. مؤرشف من الأصل في ١٣ مارس ٢٠٢٣. تم الاطلاع عليه في ١٣ مارس ٢٠٢٣ .
  59. ١ ٢ "تقديم LLaMA: نموذج لغوي أساسي ضخم ذو ٦٥ مليار مُعامل" . Meta AI . ٢٤ فبراير ٢٠٢٣. مؤرشف من الأصل في ٣ مارس ٢٠٢٣. تم الاطلاع عليه في ٩ مارس ٢٠٢٣ .
  60. ١ ٢ ٣ "هبط الصقر في منظومة Hugging Face" . huggingface.co . ١٩ مايو ٢٠٢٣. مؤرشف من الأصل بتاريخ ٢٠٢٣-٠٦-٢٠ . تم الاطلاع عليه بتاريخ ٢٠٢٣-٠٦-٢٠ .
  61. "التقرير الفني لـ GPT-4" (ملف PDF) . OpenAI . 2023. مؤرشف (ملف PDF) من الأصل في 14 مارس 2023. تم الاطلاع عليه في 14 مارس 2023 .
  62. داي، نولان (28 مارس 2023). "Cerebras-GPT: عائلة من نماذج اللغة الكبيرة مفتوحة المصدر، ذات كفاءة حسابية عالية" . Cerebras . مؤرشف من الأصل في 28 مارس 2023. تم الاسترجاع في 28 مارس 2023 .
  63. «أطلقت هيئة السياحة والإعلام في أبوظبي نسختها الخاصة من تطبيق ChatGPT» . tii.ae. مؤرشف من الأصل بتاريخ 3 أبريل 2023. تم الاطلاع عليه بتاريخ 3 أبريل 2023 .
  64. ^ بينيدو ، جيلهيرم. مالارتيك، كوينتين؛ هيسلو، دانيال. كوجوكارو، روكساندرا؛ كابيلي، أليساندرو؛ العبيدلي، حمزة؛ بانيير، بابتيست؛ المزروعي، ابتسام؛ لوناي ، جوليان (2023/06/01). “مجموعة بيانات RefinedWeb لـ Falcon LLM: التفوق في الأداء على المجموعات المنسقة باستخدام بيانات الويب وبيانات الويب فقط”. أرخايف : 2306.01116 [ cs.CL ].
  65. "tiiuae/falcon-40b · Hugging Face" . huggingface.co . 2023-06-09 . تم الاطلاع عليه بتاريخ 2023-06-20 .
  66. أصبح نموذج الذكاء الاصطناعي "فالكون 40B" الإماراتي، المصنف الأول عالميًا من قبل معهد الابتكار التكنولوجي، متاحًا الآن للاستخدام مجانًا. ( مؤرشف بتاريخ 8 فبراير 2024 في أرشيف الإنترنت ، 31 مايو 2023)
  67. 1 2 وو، شيجي؛ إرسوي، أوزان؛ لو ستيفن. دابرافولسكي، فاديم؛ دريدزي، مارك؛ جيرمان، سيباستيان. كامبادور، برابهانجان؛ روزنبرغ، ديفيد. مان ، جدعون (30 مارس 2023). “BloombergGPT: نموذج لغة كبير للتمويل”. أرخايف : 2303.17564 [ cs.LG ].
  68. ^ رن، شياو تشه؛ تشو، بينغيي. منغ، شينفان. هوانغ، شينجينغ؛ وانغ، ياداو؛ وانغ، ويتشاو. لي، بنغفي؛ تشانغ، شياودا؛ بودولسكي، الكسندر؛ أرشينوف، غريغوري. بوت، أندريه؛ بيونتكوفسكايا، إيرينا؛ وي، جيان شنغ؛ جيانغ، شين؛ سو، تنغ؛ ليو، كون؛ ياو، يونيو (19 مارس 2023). “PanGu-Σ: نحو تريليون نموذج لغة معلمة مع حوسبة متفرقة غير متجانسة”. أرخايف : 2303.10845 [ cs.CL ].
  69. ^ كوبف، أندرياس. كيلشر، يانيك؛ فون روتي، ديمتري؛ أناجنوستيديس، سوتيريس؛ تام، تشي روي؛ ستيفنز، كيث. برهوم، عبد الله؛ دوك، نجوين مينه؛ ستانلي، أوليفر. ناجيفي، ريتشارد. إس، شاهول؛ سوري، سمير؛ غلوشكوف، ديفيد؛ دانتولوري، أرناف؛ ماغواير ، أندرو (2023/04/14). “محادثات OpenAssistant – إضفاء الطابع الديمقراطي على محاذاة نماذج اللغة الكبيرة”. أرخايف : 2304.07327 [ cs.CL ].
  70. وروبل، شارون. "شركة ناشئة في تل أبيب تُطلق نموذجًا لغويًا متطورًا جديدًا للذكاء الاصطناعي لمنافسة OpenAI" . صحيفة تايمز أوف إسرائيل . ISSN 0040-7909 . مؤرشف من الأصل بتاريخ 24 يوليو 2023. تم الاطلاع عليه بتاريخ 24 يوليو 2023 . 
  71. ويغرز، كايل (13 أبريل 2023). "مع Bedrock، تدخل أمازون سباق الذكاء الاصطناعي التوليدي" . TechCrunch . مؤرشف من الأصل في 24 يوليو 2023. تم الاطلاع عليه في 24 يوليو 2023 .
  72. 1 2 إلياس، جينيفر (16 مايو 2023). "يستخدم أحدث نموذج للذكاء الاصطناعي من جوجل بيانات نصية للتدريب تفوق بخمسة أضعاف تقريبًا ما كان يستخدمه سابقه" . سي إن بي سي . مؤرشف من الأصل في 16 مايو 2023. تم الاطلاع عليه في 18 مايو 2023 .
  73. "تقديم PaLM 2" . جوجل . 10 مايو 2023. مؤرشف من الأصل في 18 مايو 2023. تم الاسترجاع في 18 مايو 2023 .
  74. 1 2 3 جوناسيكار، سوريا؛ تشانغ، يي؛ أنيجا، جيوتي؛ كايو سيزار تيودورو مينديز؛ ألي ديل جيورنو؛ جوبي، سيفاكانث؛ جواهريبي، موجان؛ كوفمان، بييرو؛ جوستافو دي روزا؛ ساريكيفي، أولي؛ سالم، عادل؛ شاه، شيتال؛ هاركيرات سينغ بيهل؛ وانغ، شين؛ بوبيك، سيباستيان؛ إلدان، رونين؛ آدم تومان كالاي؛ يين تات لي؛ لي ، يوانزي (2023). “الكتب المدرسية هي كل ما تحتاجه”. أرخايف : 2306.11644 [ cs.CL ].
  75. ١ ٢ "تقديم لاما ٢: الجيل التالي من نموذج اللغة الكبير مفتوح المصدر" . ميتا إيه آي . ٢٠٢٣. مؤرشف من الأصل في ٢٠٢٤-٠١-٠٥ . تم الاسترجاع في ٢٠٢٣-٠٧-١٩ .
  76. "llama/MODEL_CARD.md at main · meta-llama/llama" . GitHub . مؤرشف من الأصل بتاريخ 28-05-2024 . تم الاطلاع عليه بتاريخ 28-05-2024 .
  77. "كلود 2" . anthropic.com . مؤرشف من الأصل بتاريخ 15 ديسمبر 2023. تم الاطلاع عليه بتاريخ 12 ديسمبر 2023 .
  78. نيرمال، دينيش (2023-09-07). "بناء الذكاء الاصطناعي للأعمال: نماذج أساس Granite من IBM" . مدونة IBM . مؤرشف من الأصل في 2024-07-22 . تم الاطلاع عليه في 2024-08-11 .
  79. "الإعلان عن ميسترال 7B" . ميسترال . 2023. مؤرشف من الأصل بتاريخ 2024-01-06 . تم الاطلاع عليه بتاريخ 2023-10-06 .
  80. "تقديم كلود 2.1" . anthropic.com . مؤرشف من الأصل بتاريخ 15 ديسمبر 2023. تم الاطلاع عليه بتاريخ 12 ديسمبر 2023 .
  81. xai-org/grok-1 ، xai-org، 19-03-2024، مؤرشف من الأصل في 28-05-2024 ، تم استرجاعه في 19-03-2024
  82. "بطاقة نموذج Grok-1" . x.ai. تم الاطلاع عليها بتاريخ 12 ديسمبر 2023 .
  83. "جيميني - جوجل ديب مايند" . deepmind.google . مؤرشف من الأصل بتاريخ 8 ديسمبر 2023. تم الاطلاع عليه بتاريخ 12 ديسمبر 2023 .
  84. فرانزن، كارل (11 ديسمبر 2023). "ميسترال تُثير دهشة مجتمع الذكاء الاصطناعي مع تفوق أحدث نموذج مفتوح المصدر على أداء GPT-3.5" . فينشر بيت . مؤرشف من الأصل في 11 ديسمبر 2023. تم الاطلاع عليه في 12 ديسمبر 2023 .
  85. "مزيج من الخبراء" . mistral.ai . ١١ ديسمبر ٢٠٢٣. مؤرشف من الأصل في ١٣ فبراير ٢٠٢٤. تم الاطلاع عليه في ١٢ ديسمبر ٢٠٢٣ .
  86. 1 2 ديب سيك-AI؛ بي شياو. تشن، ديلي؛ تشن، غوانتينغ. تشن، شانهوانغ؛ داي، داماي؛ دينغ، تشنغكي. دينغ، هونغوي؛ دونغ ، كاي (2024/01/05). “DeepSeek LLM: توسيع نطاق نماذج اللغات مفتوحة المصدر مع المدى الطويل”. أرخايف : 2401.02954 [ cs.CL ].
  87. 1 2 هيوز، أليسا (12 ديسمبر 2023). "Phi-2: القوة المذهلة لنماذج اللغة الصغيرة" . مايكروسوفت للأبحاث . مؤرشف من الأصل في 12 ديسمبر 2023. تم الاسترجاع في 13 ديسمبر 2023 .
  88. " نموذجنا من الجيل التالي: Gemini 1.5" . جوجل . 15 فبراير 2024. مؤرشف من الأصل في 16 فبراير 2024. تم الاسترجاع في 16 فبراير 2024. هذا يعني أن الإصدار 1.5 Pro قادر على معالجة كميات هائلة من المعلومات دفعة واحدة، بما في ذلك ساعة واحدة من الفيديو، و11 ساعة من الصوت، وقواعد بيانات تحتوي على أكثر من 30,000 سطر برمجي، أو أكثر من 700,000 كلمة. في بحثنا، اختبرنا بنجاح ما يصل إلى 10 ملايين رمز مميز.
  89. "Gemma" عبر GitHub.
  90. "OLMo: نموذج اللغة المفتوح | Ai2" . allenai.org . تم الاطلاع عليه بتاريخ 17-03-2026 .
  91. غرونيفيلد، ديرك؛ بلتاغي، إيز؛ والش، بيت؛ بهاجيا، أكشيتا؛ كيني، رودني؛ تافجورد، أويفيند؛ جها، أنانيا هارش؛ إيفيسون، هاميش؛ ماغنوسون، إيان (2024-06-07). "OLMo: تسريع علم نماذج اللغة". arXiv : 2402.00838 [ cs.CL ].
  92. "تقديم الجيل القادم من كلود" . أنثروبيك . مؤرشف من الأصل بتاريخ 2024-03-04 . تم الاسترجاع بتاريخ 2024-03-04 .
  93. ^ "ترخيص نموذج مفتوح لـ Databricks" . طوب البيانات . 27 مارس 2024 . تم الاسترجاع في 6 أغسطس 2025 .
  94. "سياسة الاستخدام المقبول لنموذج Databricks المفتوح" . Databricks . 27 مارس 2024. تم الاطلاع عليه بتاريخ 6 أغسطس 2025 .
  95. 1 2 "إصدار "Fugaku-LLM" - نموذج لغوي كبير تم تدريبه على الحاسوب العملاق "Fugaku"" . فوجيتسو . 10 مايو 2024. تم الاطلاع عليه في 20 أبريل 2026. "
  96. "شروط استخدام برنامج فوغاكو-LLM" . 23 أبريل 2024. تم الاطلاع عليه في 6 أغسطس 2025 عبر موقع Hugging Face .
  97. "Fugaku-LLM/Fugaku-LLM-13B · Hugging Face" . huggingface.co . مؤرشف من الأصل بتاريخ 17-05-2024 . تم الاطلاع عليه بتاريخ 17-05-2024 .
  98. ديكسون، بن (22 مايو 2024). "ميتا تقدم كاميليون، نموذج متعدد الوسائط متطور" . فينشر بيت .
  99. "chameleon/LICENSE at e3b711ef63b0bb3a129cf0cf0918e36a32f26e2c · facebookresearch/chameleon" . Meta Research . تم الاطلاع عليه بتاريخ 6 أغسطس 2025 عبر GitHub .
  100. الذكاء الاصطناعي، ميسترال (17 أبريل 2024). "أرخص، أفضل، أسرع، أقوى" . mistral.ai . مؤرشف من الأصل بتاريخ 5 مايو 2024. تم الاطلاع عليه بتاريخ 5 مايو 2024 .
  101. 1 2 بيلينكو، ميشا (23 أبريل 2024). "تقديم Phi-3: إعادة تعريف ما هو ممكن مع SLMs" . azure.microsoft.com . مؤرشف من الأصل في 8 مايو 2026. تم الاسترجاع في 8 مايو 2026 .
  102. عبدين، ماراه؛ وآخرون (2024). "تقرير فني عن Phi-3: نموذج لغوي عالي الكفاءة محليًا على هاتفك". arXiv : 2404.14219 [ cs.CL ]. 
  103. "Qwen2" . GitHub . مؤرشف من الأصل بتاريخ 17-06-2024 . تم الاطلاع عليه بتاريخ 17-06-2024 .
  104. ^ ديب سيك-AI؛ ليو، أيشين. فنغ، باي. وانغ بن. وانغ، بينجكسوان؛ ليو، بو؛ تشاو، تشنغ قانغ؛ دينجر، تشنغكي؛ روان ، تشونغ (2024/06/19). “DeepSeek-V2: نموذج لغة قوي واقتصادي وفعال لمزيج من الخبراء”. أرخايف : 2405.04434 [ cs.CL ].
  105. "رخصة نماذج NVIDIA المفتوحة" . NVIDIA . 16 يونيو 2025. تم الاطلاع عليه بتاريخ 6 أغسطس 2025 .
  106. "الذكاء الاصطناعي الجدير بالثقة" . إنفيديا . 27 يونيو 2024. تم الاطلاع عليه في 6 أغسطس 2025 .
  107. "nvidia/Nemotron-4-340B-Base · Hugging Face" . huggingface.co . 2024-06-14. مؤرشف من الأصل في 2024-06-15 . تم الاسترجاع في 2024-06-15 .
  108. "Nemotron-4 340B | بحث" . research.nvidia.com . مؤرشف من الأصل بتاريخ 15-06-2024 . تم الاطلاع عليه بتاريخ 15-06-2024 .
  109. "تقديم سونيتة كلود 3.5" . أنثروبيك . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
  110. "تقديم استخدام الحاسوب، وقصيدة سونيت جديدة من نوع كلود 3.5، وقصيدة هايكو من نوع كلود 3.5" . أنثروبيك . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
  111. "مجموعة نماذج لاما 3" (23 يوليو 2024) فريق لاما، الذكاء الاصطناعي في ميتا
  112. "llama-models/models/llama3_1/MODEL_CARD.md at main · meta-llama/llama-models" . GitHub . مؤرشف من الأصل بتاريخ 23-07-2024 . تم الاطلاع عليه بتاريخ 23-07-2024 .
  113. "LICENSE · xai-org/grok-2 at main" . 5 نوفمبر 2025. تم الاطلاع عليه في 18 نوفمبر 2025 عبر Hugging Face .
  114. "سياسة الاستخدام المقبول لـ xAI" . xAI . 2 يناير 2025. تم الاطلاع عليه بتاريخ 18 نوفمبر 2025 .
  115. ويذربيد، جيس (14 أغسطس 2024). "روبوتات الدردشة الجديدة Grok-2 من xAI تُدخل توليد الصور بالذكاء الاصطناعي إلى X" . ذا فيرج . تم الاسترجاع في 18 نوفمبر 2025 .
  116. ها، أنتوني (24 أغسطس 2025). "إيلون ماسك يقول إن xAI قد أتاحت Grok 2.5 كمصدر مفتوح" . TechCrunch . تم الاطلاع عليه في 18 نوفمبر 2025 .
  117. "تقديم OpenAI o1" . openai.com . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
  118. بول، كاتي؛ تونغ، آنا (13 سبتمبر 2024). "أوبن إيه آي تطلق سلسلة جديدة من نماذج الذكاء الاصطناعي ذات قدرات "الاستدلال" . رويترز .
  119. ^ جندال، سيدارت (24 أكتوبر 2024). "Sarvam AI يطلق Sarvam-1، ويتفوق على Gemma-2 وLlama-3.2" . مجلة التحليلات الهندية . مؤرشفة من الأصلي في 25 يوليو 2025 . تم الاسترجاع 20 أبريل 2026 .
  120. ^ "LICENSE.md · sarvamai/sarvam-1" . 23 أكتوبر 2024 . تم الاسترجاع في 20 أبريل 2026 عبر Hugging Face .
  121. 1 2 "نظرة عامة على النماذج" . mistral.ai . تم الاطلاع عليه بتاريخ 2025-03-03 .
  122. "OLMo 2: أفضل نموذج لغوي مفتوح بالكامل حتى الآن | Ai2" . allenai.org . تم الاطلاع عليه بتاريخ 17-03-2026 .
  123. 1 2 3 فريق أولمو؛ والش، بيت. سولديني، لوكا؛ جرونيفيلد ، ديرك. لو كايل. أرورا، شين؛ باجيا، أكشيتا؛ قو، يولينج؛ هوانغ ، شنغي (2025/10/08). "2 أولمو 2 غاضب". أرخايف : 2501.00656 [ cs.CL ].
  124. "بطاقة نموذج Phi-4" . huggingface.co . 10 يوليو 2025. تم الاطلاع عليه بتاريخ 11 نوفمبر 2025 .
  125. "تقديم Phi-4: أحدث نموذج لغوي صغير من مايكروسوفت متخصص في الاستدلال المعقد" . techcommunity.microsoft.com . تم الاطلاع عليه بتاريخ 11 نوفمبر 2025 .
  126. deepseek-ai/DeepSeek-V3 ، DeepSeek، 26-12-2024 ، تم الاطلاع عليه بتاريخ 26-12-2024
  127. فينغ، كوكو (25 مارس 2025). "ديب سيك تُبهر المبرمجين بنموذج V3 مفتوح المصدر أكثر قوة" . صحيفة ساوث تشاينا مورنينغ بوست . تاريخ الاسترجاع: 6 أبريل 2025 .
  128. بطاقات خدمة الذكاء الاصطناعي من أمازون نوفا مايكرو، لايت، وبرو - AWS3 ، أمازون، 27-12-2024 ، تاريخ الاطلاع : 27-12-2024
  129. deepseek-ai/DeepSeek-R1 ، DeepSeek، 21-01-2025 ، تم الاطلاع عليه بتاريخ 21-01-2025
  130. ^ ديب سيك-AI؛ قوه دايا. يانغ، ديجيان؛ تشانغ، هاوي؛ سونغ، جونشياو؛ تشانغ، رويو؛ شو، رونكسين؛ تشو، تشيهاو؛ Ma، Shirong (2025-01-22)، “DeepSeek-R1 يحفز التفكير في LLMS من خلال التعلم المعزز”، طبيعة ، 645 (8081): 633–638 ، أرخايف : 2501.12948 ، بيب كود : 2025Natur.645..633G ، دوى : 10.1038/s41586-025-09422-z ، بمك 12443585 ، بميد 40962978  
  131. كوين؛ يانغ، آن؛ يانغ، باوسونغ؛ تشانغ، بيتشن؛ هوي، بينيوان؛ تشنغ، بو؛ يو، بوين؛ لي، تشنغيوان؛ ليو ، دايهينج (2025/01/03). “التقرير الفني Qwen2.5”. أرخايف : 2412.15115 [ cs.CL ].
  132. MiniMax-AI/MiniMax-01 ، MiniMax، 26-01-2025 ، تم الاطلاع عليه بتاريخ 26-01-2025
  133. ميني ماكس؛ لي، أونيان؛ قونغ، بانغوي؛ يانغ، بو؛ شان، بوجي؛ ليو، تشانغ؛ تشو، تشنغ؛ تشانغ، تشونهاو؛ قوه كونغشاو (14/01/2025). “MiniMax-01: قياس نماذج الأساس بانتباه شديد”. أرخايف : 2501.08313 [ cs.CL ].
  134. كافوكجوغلو، كوراي (5 فبراير 2025). "جيميني 2.0 متاح الآن للجميع" . جوجل . تم الاطلاع عليه في 6 فبراير 2025 .
  135. "Gemini 2.0: Flash, Flash-Lite and Pro" . Google for Developers . تم الاطلاع عليه بتاريخ 6 فبراير 2025 .
  136. فرانزن، كارل (5 فبراير 2025). "جوجل تطلق Gemini 2.0 Pro وFlash-Lite وتربط نموذج التفكير Flash Thinking بخدمات يوتيوب والخرائط والبحث" . VentureBeat . تاريخ الاسترجاع: 6 فبراير 2025 .
  137. "Grok 3 Beta — عصر وكلاء الاستدلال" . x.ai. تم الاطلاع عليه بتاريخ 22-02-2025 .
  138. "قصيدة كلود 3.7 سونيت وقانون كلود" . أنثروبيك . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
  139. "تقديم GPT-4.5" . openai.com . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
  140. كافوكجوغلو، كوراي (25 مارس 2025). "جيميني 2.5: نموذج الذكاء الاصطناعي الأكثر ذكاءً لدينا" . جوجل . تم الاطلاع عليه بتاريخ 23 سبتمبر 2025 .
  141. "meta-llama/Llama-4-Maverick-17B-128E · Hugging Face" . huggingface.co . 2025-04-05 . تم الاطلاع عليه بتاريخ 2025-04-06 .
  142. "قطيع لاما 4: بداية حقبة جديدة من ابتكار الذكاء الاصطناعي متعدد الوسائط بطبيعته" . ai.meta.com . مؤرشف من الأصل بتاريخ 2025-04-05 . تم الاطلاع عليه بتاريخ 2025-04-05 .
  143. "تقديم OpenAI o3 و o4-mini" . openai.com . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
  144. فريق كوين (29 أبريل 2025). "كوين 3: فكّر بعمق، وتصرّف بسرعة" . كوين . تم الاسترجاع في 29 أبريل 2025 .
  145. "تقديم كلود 4" . أنثروبيك . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
  146. ياداف، نانديني (26 مايو 2025). "شركة هندية ناشئة في مجال الذكاء الاصطناعي تطلق نموذج سارفام-إم: ما هو، ولماذا يتحدث عنه الجميع؟" . إنديا توداي . تاريخ الاسترجاع: 18 مارس 2026 .
  147. ^ "Sarvam-M: Open Source Hybrid Indic LLM | Sarvam AI" . سارفام آي . 2025-05-23 . تم الاسترجاع 2026-03-18 .
  148. "Grok 4" . x.ai. 9 يوليو 2025. مؤرشف من الأصل في 9 مايو 2026. تم الاسترجاع في 9 مايو 2026 .
  149. ^ بنداليك، كونديشوار؛ سواركار، بيوش؛ ساهو، نيهار؛ شيندي، ابهيشيك. تشاندا، براتيك؛ جوسوامي، فيدانت؛ ناجبال، أجاي. سينغ، أتول. ثاكور ، فيراج (2025/07/16). "نموذج PARAM-1 BharatGen 2.9B". أرخايف : 2507.13390 [ cs.CL ].
  150. "README.md · bharatgenai/Param-1" . 24 فبراير 2026. تم الاطلاع عليه في 12 أبريل 2026 عبر Hugging Face .
  151. "zai-org/GLM-4.5 · Hugging Face" . huggingface.co . 2025-08-04 . تم الاطلاع عليه بتاريخ 2025-08-06 .
  152. "GLM-4.5: الاستدلال، والترميز، والقدرات الفاعلة" . z.ai. تم الاطلاع عليه بتاريخ 2025-08-06 .
  153. ويتوام، رايان (5 أغسطس 2025). "OpenAI تعلن عن نموذجين مفتوحين للذكاء الاصطناعي "gpt-oss"، ويمكنك تحميلهما اليوم" . آرس تكنيكا . تم الاطلاع عليه في 6 أغسطس 2025 .
  154. "Claude Opus 4.1" . Anthropic . تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
  155. "تقديم GPT-5" . openai.com . 7 أغسطس 2025. تم الاطلاع عليه بتاريخ 8 أغسطس 2025 .
  156. "منصة OpenAI: توثيق نموذج GPT-5" . openai.com . تم الاطلاع عليه بتاريخ 18 أغسطس 2025 .
  157. "deepseek-ai/DeepSeek-V3.1 · Hugging Face" . huggingface.co . 2025-08-21 . تم الاطلاع عليه بتاريخ 2025-08-25 .
  158. "إصدار DeepSeek-V3.1 | وثائق واجهة برمجة تطبيقات DeepSeek" . api-docs.deepseek.com . تم الاطلاع عليه بتاريخ 25-08-2025 .
  159. ^ كيرشنر ، مالطا (2025/09/02). "Apertus: Stellt stellt erstes erstes und mehrsprachiges KI-Modell vor" . heise على الانترنت (باللغة الألمانية) . تم الاسترجاع 2025/11/07 .
  160. "Apertus: Ein vollständig offenes,transparentes und mehrsprachiges Sprachmodell" (في المانيا). زيورخ: ETH زيورخ. 2025-09-02 . تم الاسترجاع 2025/11/07 .
  161. "تقديم سونيت كلود 4.5" . أنثروبيك . تم الاطلاع عليه بتاريخ 29 سبتمبر 2025 .
  162. "GLM-4.6: قدرات متقدمة في مجال الوكلاء والاستدلال والترميز" . z.ai. تم الاطلاع عليه بتاريخ 1 أكتوبر 2025 .
  163. "zai-org/GLM-4.6 · Hugging Face" . huggingface.co . 2025-09-30 . تم الاطلاع عليه بتاريخ 2025-10-01 .
  164. "GLM-4.6" . modelscope.cn . تم الاطلاع عليه بتاريخ 2025-10-01 .
  165. "عصر جديد من الذكاء مع جيميني 3" . جوجل . 18 نوفمبر 2025. تم الاطلاع عليه في 5 يناير 2026 .
  166. "أولمو 3: رسم مسار عبر تدفق النموذج لقيادة الذكاء الاصطناعي مفتوح المصدر" . Ai2 . 20 نوفمبر 2025.
  167. فريق أولمو؛ إيتينجر، أليسون؛ بيرتش، أماندا؛ كويل، بيلي. جراهام، ديفيد؛ هاينمان، ديفيد. جرونيفيلد ، ديرك. براهمان، فايز. تيمبرز ، فينبار (2025/12/15). "أولمو 3". أرخايف : 2512.13961 [ cs.CL ].
  168. "تقديم كلود أوبوس 4.5" . أنثروبيك . تم الاطلاع عليه بتاريخ 8 يناير 2026 .
  169. بايندر، مات (3 ديسمبر 2025). "DeepSeek v3.2: ما هو، وكيف يقارن بـ ChatGPT، وكيفية تجربته" . ماشابل . تم الاطلاع عليه في 12 أبريل 2026 .
  170. "إصدار DeepSeek-V3.2" . وثائق واجهة برمجة تطبيقات DeepSeek . 1 ديسمبر 2025. تم الاطلاع عليه بتاريخ 12 أبريل 2026 .
  171. "DeepSeek-V3.2: استدلال فعال وذكاء اصطناعي فاعل" . Hugging Face . 1 ديسمبر 2025. تم الاطلاع عليه بتاريخ 12 أبريل 2026 .
  172. "تطوير العلوم والرياضيات باستخدام GPT-5.2" . openai.com . تم الاطلاع عليه بتاريخ 4 يناير 2026 .
  173. "تجاوز حدود التفكير الأمثل في Qwen3" . Qwen . 25 يناير 2026. مؤرشف من الأصل في 6 فبراير 2026. تم الاسترجاع في 6 فبراير 2026. نُعزز التفكير الأمثل في Qwen3 بابتكارين رئيسيين: (1) إمكانيات استخدام الأدوات التكيفية [...]؛ و(2) تقنيات متقدمة لتوسيع نطاق وقت الاختبار [...]. [...] نُقيد [المسارات المتوازية] ونُعيد توجيه العمليات الحسابية المُوفرة إلى تأمل ذاتي تكراري مُوجه بآلية "اكتساب الخبرة".
  174. "الترخيص · moonshotai/Kimi-K2.5" . 1 يناير 2026. تم الاطلاع عليه في 1 أغسطس 2026 عبر Hugging Face .
  175. فريق كيمي؛ باي، ييفان؛ باو، ييبينغ؛ تشارلز، Y.؛ تشن تشنغ. تشن، جواندو؛ تشن، هايتينج؛ تشن، هوارونج؛ تشين ، جياهاو (2026/02/03). “كيمي K2: المخابرات المفتوحة”. أرخايف : 2507.20534 [ cs.LG ].
  176. فريق كيمي؛ باي، تونجتونج؛ باي، ييفان؛ باو، ييبينغ؛ كاي، ش. تساو، يوان؛ تشارلز، Y.؛ تشي، HS؛ تشين ، تشنغ (2026/02/02). “كيمي K2.5: ذكاء الوكيل المرئي”. أرخايف : 2602.02276 [ cs.CL ].
  177. "Kimi K2.5: دردش مع Kimi K2.5 مجاناً" . Kimi K2.5 . تم الاطلاع عليه بتاريخ 18-03-2026 .
  178. جيانغ، بن (3 فبراير 2026). "نموذج ذكاء اصطناعي مُدمج من شركة StepFun الصينية يتفوق على منافسيه من شركتي DeepSeek وMoonshot" . صحيفة ساوث تشاينا مورنينغ بوست . مؤرشف من الأصل في 4 فبراير 2026. تم الاطلاع عليه في 14 أبريل 2026 .
  179. "الخطوة 3.5 فلاش: سريع بما يكفي للتفكير، موثوق بما يكفي للتصرف" . ستيب فن . 12 فبراير 2026. تم الاطلاع عليه في 20 أبريل 2026 .
  180. "stepfun-ai/Step-3.5-Flash" . 14 مارس 2026. تم الاطلاع عليه في 14 أبريل 2026 عبر Hugging Face .
  181. ^ مو ليام. جوه، بريندا. تشين ، لوري (11 فبراير 2026). دي سيلفا، أنيل (محرر). "شركة Zhipu الصينية الناشئة في مجال الذكاء الاصطناعي تُطلق الطراز الرئيسي الجديد GLM-5" . رويترز . تم الاسترجاع 17 فبراير 2026 .
  182. 1 2 "GLM-5 / README.md" . 16 يونيو 2026. تم الاطلاع عليه في 17 يونيو 2026 عبر GitHub .
  183. 1 2 بوتس، ديلان (16 فبراير 2026). "علي بابا تكشف النقاب عن Qwen3.5 مع تحول سباق روبوتات الدردشة في الصين إلى وكلاء الذكاء الاصطناعي" . سي إن بي سي . تم الاسترجاع في 26 فبراير 2026 .
  184. 1 2 "Qwen3.5: نحو وكلاء متعددي الوسائط أصليين" . Qwen . 15 فبراير 2026. تم الاسترجاع في 18 يوليو 2026 .
  185. "الترخيص · Qwen/Qwen3.5-397B-A17B" . 16 فبراير 2026. تم الاطلاع عليه في 10 أبريل 2026 عبر Hugging Face .
  186. "الترخيص · bharatgenai/Param2-17B-A2.4B-Thinking" . 16 فبراير 2026. تم الاطلاع عليه في 12 أبريل 2026 عبر Hugging Face .
  187. "bharatgenai/Param2-17B-A2.4B-Thinking" . تم الاطلاع عليه بتاريخ 2026-03-08 عبر Hugging Face .
  188. ^ "sarvamai/sarvam-1-v0.5 · وجه معانق" . Huggingface.co . تم الاسترجاع بتاريخ 2026-03-08 .
  189. "sarvamai/sarvam-105b · وجه معانق" . Huggingface.co . تم الاسترجاع بتاريخ 2026-03-08 .
  190. كومار، أبهيجيت (19 فبراير 2026). "لماذا يمثل نموذج 105B الجديد لشركة سارفام تحولاً في طموحات الهند السيادية في مجال الذكاء الاصطناعي؟" . بزنس ستاندرد .
  191. سينغ، جاغميت (18 فبراير 2026). "نماذج مختبر الذكاء الاصطناعي الهندي "سارفام" الجديدة رهانٌ كبير على جدوى الذكاء الاصطناعي مفتوح المصدر" . تيك كرانش . تاريخ الاسترجاع: 18 مارس 2026 .
  192. "إتاحة برنامجي Sarvam 30B و105B كمصدر مفتوح" . Sarvam AI . 6 مارس 2026. مؤرشف من الأصل في 8 مايو 2026. تم الاطلاع عليه في 8 مايو 2026 .
  193. ^ خافيير ماركيز (17 مارس 2026). "Una IA لإعادة توحيد جميع الوظائف الممكنة: la apuesta de Mistral مع Small 4 es hacer más مع أقل الأشياء" [ ذكاء اصطناعي يجمع كل الوظائف الممكنة: رهان Mistral مع Small 4 هو القيام بالمزيد بموارد أقل ] . شاتاكا (بالإسبانية) . تم الاسترجاع 20 أبريل 2026 .
  194. "تقديم ميسترال سمول 4" . ميسترال للذكاء الاصطناعي . تم الاطلاع عليه بتاريخ 20 أبريل 2026 .
  195. «كشف النقاب عن نموذج الذكاء الاصطناعي الغامض، وتبين أنه من إنتاج شركة شاومي، بعد شكوكٍ حول كونه من إنتاج شركة ديب سيك» . رويترز . ١٨ مارس ٢٠٢٦. تاريخ الاطلاع: ٣ أبريل ٢٠٢٦ .
  196. "أطلقت شاومي نموذج الذكاء الاصطناعي القوي MiMo-V2 Pro بتريليون مُعامل، ونافذة سياقية لمليون رمز" . NDTV Profit . 19 مارس 2026.
  197. «تم إصدار Qwen 3.6-Plus، والذي يتضمن وظيفة وكيل تؤدي المهام بشكل مستقل» . Gigazine . 3 أبريل 2026. تم الاطلاع عليه بتاريخ 18 يوليو 2026 .
  198. "Qwen3.6-Plus: نحو وكلاء العالم الحقيقي" . Qwen . 1 أبريل 2026. تم الاطلاع عليه في 18 يوليو 2026 .
  199. ويتوام، رايان (2 أبريل 2026). "جوجل تعلن عن نماذج الذكاء الاصطناعي المفتوحة Gemma 4، وتتحول إلى ترخيص Apache 2.0" . آرس تكنيكا . تم الاطلاع عليه في 3 أبريل 2026 .
  200. مان، توبياس (2 أبريل 2026). "جوجل تُنافس نماذج الأوزان المفتوحة الصينية بـ Gemma 4" . تم الاطلاع عليه في 3 أبريل 2026 .
  201. فرانزن، كارل (7 أبريل 2026). "الذكاء الاصطناعي ينضم إلى يوم العمل ذي الثماني ساعات مع إطلاق GLM الإصدار 5.1 من نموذج التعلم الآلي مفتوح المصدر، متفوقًا على Opus 4.6 وGPT-5.4 على SWE-Bench Pro" . فينشر بيت . تم الاطلاع عليه في 12 أبريل 2026 .
  202. "GLM-5.1: نحو مهام طويلة المدى" . Z.ai. تم الاطلاع عليه بتاريخ 12 أبريل 2026 .
  203. "تقديم ميوز سبارك: التوسع نحو الذكاء الخارق الشخصي" . ai.meta.com . 8 أبريل 2026. مؤرشف من الأصل في 9 مايو 2026. تم الاطلاع عليه في 9 مايو 2026 .
  204. «تم إطلاق نموذج مفتوح المصدر لذكاء اصطناعي صيني يُدعى "Qwen3.6-35B-A3B"، وهو أقوى من "Gemma4"Gigazine . ١٧ أبريل ٢٠٢٦. تاريخ الاطلاع: ١٧ أبريل ٢٠٢٦ .
  205. "README.md · Qwen/Qwen3.6-35B-A3B" . 15 أبريل 2026. تم الاطلاع عليه في 17 أبريل 2026 عبر Hugging Face .
  206. "الترخيص · moonshotai/Kimi-K2.6" . 14 أبريل 2026. تم الاطلاع عليه في 1 أغسطس 2026 عبر Hugging Face .
  207. جيرتز، ديفيد (21 أبريل 2026). "يُغطي برنامج Kimi K2.6 الجديد من Moonshot AI مهامك المعقدة بألف وكيل متعاون" . ZDNET . تم الاطلاع عليه في 17 يونيو 2026 .
  208. ^ لي ، يوتونغ (22 أبريل 2026). دو ، يو (محرر).13小时编码、5天自主运行!Kimi K2.6开源“硬刚”闭源巨头،长程战力能否撕开AGI工业化新赛道?[ ١٣ ساعة من البرمجة، ٥ أيام من التشغيل الذاتي! نظام Kimi K2.6 مفتوح المصدر "يتحدى" عمالقة البرمجيات المغلقة المصدر. هل يمكن لقدراته طويلة الأمد أن ترسم مسارًا جديدًا لتصنيع الذكاء الاصطناعي العام؟ ] . صحيفة الأعمال الوطنية اليومية (باللغة الصينية) . تاريخ الاطلاع: ١٧ يونيو ٢٠٢٦ .
  209. "README.md · moonshotai/Kimi-K2.6" . 23 أبريل 2026. تم الاطلاع عليه في 17 يونيو 2026 عبر Hugging Face .
  210. بوتس، ديلان (24 أبريل 2026). "شركة DeepSeek الصينية تُصدر معاينةً لنموذج V4 الذي طال انتظاره مع اشتداد سباق الذكاء الاصطناعي" . سي إن بي سي .
  211. تشو، سيسي (31 يوليو 2026). "ديب سيك تُصدر نسخة تجريبية من نماذج V4 مع احتدام حرب أسعار الذكاء الاصطناعي" . نيكاي آسيا . تم الاطلاع عليه في 1 أغسطس 2026 .
  212. "MiMo-V2.5-Pro ​​| Xiaomi" . mimo.xiaomi.com . تم الاطلاع عليه بتاريخ 2026-05-03 .
  213. توماس، براسانث آبي (28 أبريل 2026). "شركة شاومي تُصدر نماذج MiMo مرخصة من معهد ماساتشوستس للتكنولوجيا لوكلاء الذكاء الاصطناعي طويلي التشغيل" . مجلة Computerworld . تاريخ الاسترجاع: 6 مايو 2026 .
  214. "XiaomiMiMo/MiMo-V2.5" . تطبيق Hugging Face . XiaomiMiMo. 27 أبريل 2026. تاريخ الاسترجاع: 3 مايو 2026 .
  215. "Mistral Medium 3.5 - Mistral AI" . docs.mistral.ai .
  216. "Composer 2.5" . Cursor . 18 مايو 2026. تم الاطلاع عليه بتاريخ 24 يوليو 2026 .
  217. "جيميني 3.5: استخبارات رائدة مع العمل" . جوجل . 19 مايو 2026.
  218. بهاتي، ديفيا (28 مايو 2026). "أحدث نموذج من برنامج الذكاء الاصطناعي Qwen التابع لشركة علي بابا يتفوق على Google Gemini وChatGPT في البرمجة" . إنديا توداي . تم الاطلاع عليه في 18 يوليو 2026 .
  219. "Qwen3.7: The Agent Frontier" . Qwen . 20 مايو 2026. تم الاطلاع عليه بتاريخ 18 يوليو 2026 .
  220. "تقديم كلود أوبوس 4.8" . أنثروبيك . 28 مايو 2026. مؤرشف من الأصل في 30 مايو 2026. تم الاسترجاع في 30 مايو 2026 .
  221. "الخطوة 3.7 فلاش" . ستيب فن . 29 مايو 2026. مؤرشف من الأصل في 30 مايو 2026. تم الاسترجاع في 30 مايو 2026 .
  222. "الترخيص · MiniMaxAI/MiniMax-M3" . 12 يونيو 2026. تم الاطلاع عليه في 19 يوليو 2026 عبر Hugging Face .
  223. تشانغ، مينشياو (1 يونيو 2026). "ميني ماكس تطلق نموذج ذكاء اصطناعي مصمم لمهام البرمجة الطويلة والمعقدة" . صحيفة ساوث تشاينا مورنينغ بوست . تاريخ الاسترجاع: 19 يوليو 2026 .
  224. "README.md · MiniMaxAI/MiniMax-M3" . ١٢ يونيو ٢٠٢٦. تم الاطلاع عليه في ١٩ يوليو ٢٠٢٦ عبر Hugging Face .
  225. 1 2 "OpenMDW-1.1" . OpenMDW . تم الاسترجاع في 19 يوليو 2026 .
  226. أعلنت شركة NVIDIA عن أقوى نموذج مفتوح المصدر لها في الولايات المتحدة، وهو "Nemotron 3 Ultra"، وأعلنت عن بدء الإنتاج الضخم لخادم الذكاء الاصطناعي الخاص بها، "Vera Rubin"." . Gigazine . 1 يونيو 2026. تم الاطلاع عليه في 16 يوليو 2026 .
  227. "README.md · nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4" . 24 يونيو 2026. تم الاطلاع عليه في 16 يوليو 2026 عبر Hugging Face .
  228. "Claude Fable 5 and Claude Mythos 5" . Anthropic . 9 يونيو 2026. مؤرشف من الأصل في 10 يونيو 2026. تم الاطلاع عليه في 11 يونيو 2026 .
  229. "الترخيص · moonshotai/Kimi-K2.7-Code" . 11 يونيو 2026. تم الاطلاع عليه في 1 أغسطس 2026 عبر Hugging Face .
  230. «تم إطلاق نموذج الذكاء الاصطناعي الصيني الصنع "Kimi K2.7 Code" كنموذج مفتوح المصدر، ويتميز بأفضل أداء برمجي في سلسلة Kimi واستهلاك منخفض للرموز . » Gigazine . ١٥ يونيو ٢٠٢٦. تاريخ الاطلاع: ١٧ يونيو ٢٠٢٦ .
  231. "README.md · moonshotai/Kimi-K2.7-Code" . ١٢ يونيو ٢٠٢٦. تم الاطلاع عليه في ١٧ يونيو ٢٠٢٦ عبر Hugging Face .
  232. تشانغ، مينشياو (15 يونيو 2026). "ارتفاع أسهم شركة زيبو للذكاء الاصطناعي بشكل صاروخي بعد إطلاق الشركة الصينية نموذج GLM-5.2" . صحيفة ساوث تشاينا مورنينغ بوست . تاريخ الاسترجاع: 17 يونيو 2026 .
  233. «نموذج Z.ai GLM-5.2 الصيني يتفوق على نموذج GPT 5.5 من OpenAI في المعايير الرئيسية» . صحيفة إيكونوميك تايمز . ١٧ يونيو ٢٠٢٦. تاريخ الاطلاع: ١٧ يونيو ٢٠٢٦ .
  234. "GLM-5.2: مصمم لمهام طويلة المدى" . Z.ai. تم الاطلاع عليه بتاريخ 16-06-2026 .
  235. فرانزن، كارل (29 يونيو 2026). "ميتوان تُعلن عن LongCat-2.0، نموذج الترميز الوكيلي الرائد الذي تبلغ سعته 1.6 تيرابايت والذي يقود مشروع OpenRouter - تم تدريبه بالكامل على رقائق صينية" . فينشر بيت . تم الاطلاع عليه في 16 يوليو 2026 .
  236. "تقديم LongCat-2.0" . LongCat . 30 يونيو 2026. تم الاطلاع عليه بتاريخ 16 يوليو 2026 .
  237. ويتفين، سام (6 يوليو 2026). "برنامج Hy3 من شركة Tencent، المرخص بموجب رخصة Apache، ينافس GLM-5.2 بنصف الحجم - ويتفوق عليه في كل شيء باستثناء البرمجة" . VentureBeat . تم الاطلاع عليه في 15 يوليو 2026 .
  238. "تقديم Grok 4.5" . x.ai. تم الاطلاع عليه بتاريخ 24 يوليو 2026 .
  239. "أصدرت شركة SpaceXAI برنامج Grok 4.5، والذي وصفه إيلون بأنه "نموذج من فئة Opus"" . TechCrunch . 8 يوليو 2026. تم الاطلاع عليه بتاريخ 24 يوليو 2026. "
  240. "SWE-1.7" . الإدراك . 8 يوليو 2026. تم الاسترجاع في 24 يوليو 2026 .
  241. فارغيز، هارشيتا (9 يوليو 2026). "ميتا تُطلق نموذج Muse Spark 1.1 مع معاينة متاحة للمطورين" . رويترز . تم الاطلاع عليه في 9 يوليو 2026 .
  242. لويزوس، كوني (15 يوليو 2026). "شركة Thinking Machines تُعزز رهانها ضد الذكاء الاصطناعي ذي المقاس الواحد الذي يناسب الجميع، وذلك من خلال أول نموذج مفتوح المصدر لها، Inkling" . TechCrunch . تم الاطلاع عليه بتاريخ 15 يوليو 2026 .
  243. فرانزن، كارل (15 يوليو 2026). "شركة Thinking Machines تُطلق أول نموذج لغوي متعدد الوسائط مفتوح المصدر، وهو Inkling، ويركز على التكلفة المنخفضة و"مقاومة الرقابة"" . VentureBeat . تم الاطلاع عليه في 15 يوليو 2026 .
  244. فرانزن، كارل (27 يوليو 2026). "الأوزان الكاملة لـ Kimi K3 متوفرة الآن، لكنها "مفتوحة" مع تحذير: ما يجب على الشركات معرفته" . VentureBeat . تم الاطلاع عليه في 1 أغسطس 2026 .
  245. "مونشوت إيه آي تُصدر أوزان نموذج كيمي كي 3 بموجب ترخيص مخصص: ما يعنيه ذلك للمؤسسات" . صحيفة إنديان إكسبريس . 28 يوليو 2026. تاريخ الاطلاع: 1 أغسطس 2026 .
  246. يلدريم، إيجي (16 يوليو 2026). "الصين تُلقي قنبلة أخرى على شركات الذكاء الاصطناعي الأمريكية الرائدة" . جيزمودو . تاريخ الاسترجاع: 16 يوليو 2026 .
  247. "كوين من علي بابا تكشف عن معاينة نموذج الذكاء الاصطناعي الرائد" . بلومبيرغ نيوز . 19 يوليو 2026. تم الاطلاع عليه بتاريخ 19 يوليو 2026 .
  248. "تقديم Gemini 3.6 Flash و3.5 Flash-Lite و3.5 Flash Cyber" . جوجل . 21 يوليو 2026. تاريخ الاسترجاع: 22 يوليو 2026 .
  249. مارتن، إيان (21 يوليو 2026). "مختبرات المصادر المفتوحة الأمريكية تعتقد أنها قادرة على التفوق على أفضل الشركات الناشئة الصينية في مجال الذكاء الاصطناعي" . فوربس . تم الاطلاع عليه في 23 يوليو 2026 .
  250. نونيز، مايكل (21 يوليو 2026). "بولسايد تُطلق لاجونا إس 2.1، نموذج ترميز مفتوح الوزن يتفوق على منافسيه الذين يفوقونه حجمًا بعشرة أضعاف" . فينشر بيت . تم الاطلاع عليه في 23 يوليو 2026 .
  251. ^ "فوجو" . سكنا آي . تم الاسترجاع 24 يوليو 2026 .
  252. براندوم، راسل (24 يوليو 2026). "أنثروبيك تطلق أوبوس 5" . تك كرانش .
  253. فرانزن، كارل (30 يوليو 2026). "شركة Thinking Machines تُطلق نموذج Inkling Small مفتوح المصدر للذكاء الاصطناعي، والذي يقترب من أداء سابقه بحجم ربع حجمه تقريبًا" . VentureBeat . تاريخ الاسترجاع: 1 أغسطس 2026 .