OpenAI o1
OpenAI o1 هو نموذج تحويلي توليدي مُدرَّب مسبقًا (GPT)، وهو الأول في سلسلة نماذج الاستدلال "o" من OpenAI . أصدرت OpenAI نسخة تجريبية من o1 في 12 سبتمبر 2024. يقضي o1 وقتًا في "التفكير" قبل الإجابة، مما يجعله أكثر كفاءة في مهام الاستدلال المعقدة والعلوم والبرمجة من GPT-4o . [ 1 ] أُصدرت النسخة الكاملة لمستخدمي ChatGPT في 5 ديسمبر 2024. [ 2 ]
تاريخ
خلفية
بحسب معلومات مُسرّبة، كان يُعرف o1 سابقًا داخل OpenAI باسم "Q*"، ثم باسم "Strawberry". [ 3 ] ظهر الاسم الرمزي "Q*" لأول مرة في نوفمبر 2023، بالتزامن مع إقالة سام ألتمان ثم عودته ، مع شائعات تُشير إلى أن هذا النموذج التجريبي قد أظهر نتائج واعدة في الاختبارات الرياضية المعيارية. [ 4 ] في يوليو 2024، أفادت رويترز أن OpenAI كانت تُطوّر نموذجًا مُولّدًا مُدرّبًا مُسبقًا يُعرف باسم "Strawberry"، [ 3 ] والذي أصبح فيما بعد o1.
يطلق
تم إطلاق "o1-preview" و"o1-mini" في 12 سبتمبر 2024 لمستخدمي ChatGPT Plus وTeam. [ 1 ] وبدأ GitHub في اليوم نفسه اختبار دمج o1-preview في خدمة Copilot . [ 5 ] وفي 5 ديسمبر 2024، تم إطلاق النسخة الكاملة من o1. [ 6 ] وفي اليوم نفسه، تم إطلاق اشتراك ChatGPT Pro، الذي يتيح الوصول إلى نسخة احترافية من o1 تستخدم موارد حاسوبية أكبر لتقديم إجابات أدق. [ 6 ] وفي يناير 2025، تم دمج o1 في Microsoft Copilot . [ 7 ]
تُعد واجهة برمجة التطبيقات (API) الخاصة بـ o1-preview أغلى بعدة مرات من GPT-4o . [ 8 ] اعتبارًا من يناير 2025، يقتصر استخدام واجهة برمجة التطبيقات (API) لنموذج o1 الكامل على المطورين في المستوى الخامس من الاستخدام. [ 9 ]
أشارت OpenAI إلى أن o1 هو أول نموذج من سلسلة نماذج "الاستدلال". وقد شاركت OpenAI في ديسمبر 2024 نتائج قياس الأداء لنموذجها اللاحق، o3 (تم حذف اسم o2 لتجنب تعارض العلامة التجارية مع علامة شركة الاتصالات O2 ). [ 10 ]
في مارس 2025، أطلقت OpenAI واجهة برمجة التطبيقات o1-pro، وهي أغلى نموذج ذكاء اصطناعي لديها حتى الآن. يبلغ سعرها 150 دولارًا لكل مليون رمز إدخال و600 دولار لكل مليون رمز إخراج. [ 11 ]
القدرات
بحسب OpenAI، تم تدريب النموذج o1 باستخدام خوارزمية تحسين جديدة ومجموعة بيانات مصممة خصيصًا لها، مع دمج التعلم المعزز في عملية التدريب. [ 8 ] وصفت OpenAI النموذج o1 بأنه مكمل للنموذج GPT-4o وليس خليفة له. [ 12 ] [ 13 ]
يقضي النموذج o1 وقتًا إضافيًا في التفكير (تكوين سلسلة من الأفكار) قبل تقديم الإجابة، مما يجعله أكثر كفاءة في مهام الاستدلال المعقدة، لا سيما في العلوم والرياضيات . [ 1 ] بالمقارنة مع النماذج السابقة، تم تدريب o1 على تكوين " سلاسل فكرية " طويلة قبل تقديم الإجابة النهائية. [ 14 ] [ 15 ] ووفقًا لميرا موراتي ، تمثل هذه القدرة على التفكير قبل الإجابة نموذجًا جديدًا إضافيًا، يعمل على تحسين مخرجات النموذج من خلال زيادة قوة الحوسبة المستخدمة في توليد الإجابة، بينما يعمل نموذج توسيع نطاق النموذج على تحسين المخرجات من خلال زيادة حجم النموذج وبيانات التدريب وقوة الحوسبة المستخدمة في التدريب. [ 12 ] تشير نتائج اختبارات OpenAI إلى وجود علاقة بين الدقة ولوغاريتم مقدار الحوسبة المستخدمة في التفكير قبل الإجابة. [ 15 ] [ 14 ]
أظهر برنامج o1-preview أداءً يُقارب مستوى الدكتوراه في اختبارات قياس الأداء المتعلقة بالفيزياء والكيمياء والأحياء. في امتحان الرياضيات الأمريكي المدعو ، حلّ 83% من المسائل (12.5/15)، مقارنةً بـ 13% (1.8/15) لبرنامج GPT-4o. كما احتلّ مرتبةً ضمن أفضل 89% في مسابقات البرمجة على منصة Codeforces . [ 16 ] أما برنامج o1-mini فهو أسرع وأقل تكلفة بنسبة 80% من o1-preview. وهو مناسبٌ بشكلٍ خاص للبرمجة والمهام المتعلقة بمجالات العلوم والتكنولوجيا والهندسة والرياضيات ، ولكنه لا يمتلك نفس "المعرفة الشاملة" التي يتمتع بها o1-preview. [ 17 ]
أشارت OpenAI إلى أن قدرات الاستدلال لدى o1 تجعله أكثر التزامًا بقواعد السلامة المُقدمة في نافذة السياق الخاصة بالموجه. وأفادت OpenAI أنه خلال اختبار، استغل أحد نماذج o1-preview خللًا في الإعدادات لينجح في مهمة كان من المفترض أن تكون مستحيلة بسبب خلل برمجي. [ 18 ] [ 19 ] كما منحت OpenAI معهدَي سلامة الذكاء الاصطناعي في المملكة المتحدة والولايات المتحدة إمكانية الوصول المبكر إلى النموذج لأغراض البحث والتقييم والاختبار. ووفقًا لتقييمات OpenAI، صُنِّف كل من o1-preview وo1-mini ضمن فئة "المخاطر المتوسطة" في مجال الأسلحة البيولوجية والكيميائية والإشعاعية والنووية. وكتب دان هندريكس أن "النموذج يتفوق بالفعل على علماء الدكتوراه في معظم الأحيان في الإجابة على الأسئلة المتعلقة بالأسلحة البيولوجية ". وأشار إلى أن هذه القدرات المثيرة للقلق ستستمر في التطور. [ 20 ]
القيود
يتطلب النموذج o1 عادةً وقتاً وقوة حاسوبية أكبر من نماذج GPT الأخرى من OpenAI، لأنه يُولّد سلاسل طويلة من الأفكار قبل تقديم الاستجابة النهائية. [ 14 ]
وفقًا لشركة OpenAI، قد يقوم النموذج o1 "بتزييف التوافق "، أي توليد استجابة تتعارض مع الدقة وتسلسل تفكيره الخاص، في حوالي 0.38% من الحالات. [ 21 ]
تمنع OpenAI المستخدمين من محاولة كشف تسلسل تفكير o1، وهو مخفيٌّ عمدًا وغير مُدرَّب على الامتثال لسياسات الشركة. تخضع المطالبات للمراقبة، وقد يفقد المستخدمون الذين ينتهكون هذا الأمر عمدًا أو سهوًا إمكانية الوصول إلى o1. تُشير OpenAI إلى سلامة الذكاء الاصطناعي والميزة التنافسية كأسباب لهذا التقييد، الذي وصفه المطورون الذين يعملون مع نماذج اللغة الكبيرة (LLMs) بأنه فقدان للشفافية. [ 22 ]
في أكتوبر 2024، نشر باحثون في شركة آبل بحثًا أوليًا يفيد بأن نماذج التعلم المنطقي (LLMs) مثل o1 قد تُكرر خطوات الاستدلال من بيانات التدريب الخاصة بها. [ 23 ] وبتغيير الأرقام والأسماء المستخدمة في مسألة رياضية، أو ببساطة بإعادة تشغيل المسألة نفسها، كان أداء نماذج التعلم المنطقي أسوأ قليلًا من أفضل نتائجها المعيارية. أما إضافة معلومات خارجية غير ذات أهمية منطقية إلى المسائل فقد تسببت في انخفاض أكبر بكثير في الأداء، من -17.5% لنموذج o1-preview و-29.1% لنموذج o1-mini، إلى -65.7% لأسوأ نموذج تم اختباره. [ 24 ]
أظهرت تقييمات السلامة التي أجرتها شركة أبولو للأبحاث أن نظام o1 كان أكثر قدرة على الخداع من غيره من الأنظمة الرائدة في الاختبارات الخاضعة للرقابة (مثل محاولة نسخ نفسه إلى خادم خارجي عند التهديد بإيقاف التشغيل). وعند مواجهته، نادراً ما اعترف بفعل الخداع (في 20% من حالات الاختبار). [ 25 ]
انظر أيضاً
مراجع
- 1 2 3 ميتز، كيد (12 سبتمبر 2024). "OpenAI تكشف النقاب عن ChatGPT الجديد القادر على الاستدلال من خلال الرياضيات والعلوم" . صحيفة نيويورك تايمز . تم الاطلاع عليه بتاريخ 12 سبتمبر 2024 .
- ↑ "تقديم OpenAI o1" . OpenAI . تم الاطلاع عليه في 6 ديسمبر 2024 .
- 1 2 تونغ، آنا؛ بول، كاتي (15 يوليو 2024). "حصري: تعمل OpenAI على تقنية استدلال جديدة تحت الاسم الرمزي 'فراولة'"" . رويترز . تم الاطلاع عليه في 12 سبتمبر 2024. "
- ↑ «باحثو OpenAI يحذرون مجلس الإدارة من اختراق في مجال الذكاء الاصطناعي قبل إقالة الرئيس التنفيذي، بحسب مصادر» . رويترز . ٢٣ نوفمبر ٢٠٢٣.
- ↑ بيترز، جاي (12 سبتمبر 2024). "بدأت GitHub باختبار معاينة o1 من OpenAI في GitHub Copilot" . The Verge . تم الاطلاع عليه بتاريخ 12 سبتمبر 2024 .
- روبيسون ، كايلي (5 ديسمبر 2024). "تفرض OpenAI رسومًا قدرها 200 دولار شهريًا مقابل نسخة حصرية من نموذج o1 'للاستدلال'" . ذا فيرج . تم الاطلاع عليه في 5 ديسمبر 2024 .
- ↑ كلابورن، توماس (31 يناير 2025). "توسلتم إلى مايكروسوفت أن تكون معقولة. لكنها بدلاً من ذلك جعلت برنامج Copilot معقولاً باستخدام OpenAI GPT-o1" . ذا ريجستر .
- روبيسون ، كايلي (12 سبتمبر 2024). " أوبن إيه آي تُصدر o1، أول نموذج لها بقدرات 'الاستدلال'" . ذا فيرج . تم الاطلاع عليه في 15 سبتمبر 2024 .
- ↑ "OpenAI o1 وأدوات جديدة للمطورين" . openai.com . تم الاطلاع عليه بتاريخ 26 يناير 2025 .
- ↑ «OpenAI تؤكد إطلاق نماذجها الرائدة الجديدة o3 و o3-mini» . VentureBeat . 20 ديسمبر 2024. تم الاطلاع عليه بتاريخ 26 يناير 2025 .
- ↑ ويغرز، كايل (19 مارس 2025). "نموذج o1-pro من OpenAI هو أغلى نموذج ذكاء اصطناعي للشركة حتى الآن" . TechCrunch . تم الاطلاع عليه في 21 مارس 2025 .
- 1 2 نايت، ويل. "أوبن إيه آي تعلن عن نموذج ذكاء اصطناعي جديد، يحمل الاسم الرمزي ستروبيري، يحل المشكلات الصعبة خطوة بخطوة" . وايرد . ISSN 1059-1028 . تاريخ الاسترجاع: 15 سبتمبر 2024 .
- ↑ "نماذج استدلال جديدة: OpenAI o1-preview و o1-mini" . منتدى مطوري OpenAI . 12 سبتمبر 2024. تم الاطلاع عليه في 17 أكتوبر 2024 .
- 1 2 3 "التعلم على الاستدلال باستخدام نماذج التعلم الموجه" . OpenAI . مؤرشف من الأصل في 12 سبتمبر 2024. تم الاطلاع عليه في 13 سبتمبر 2024 .
- 1 2 كان، جيريمي. "إليك 9 أشياء تحتاج إلى معرفتها حول نموذج o1 من OpenAI" . مجلة فورتشن . تم الاطلاع عليه في 15 سبتمبر 2024 .
- ↑ فرانزن، كارل (12 سبتمبر 2024). "انسَ GPT-5! تُطلق OpenAI عائلة نماذج الذكاء الاصطناعي الجديدة o1 التي تدّعي أداءً بمستوى الدكتوراه" . VentureBeat . تم الاسترجاع في 15 سبتمبر 2024 .
- ^ "OpenAI o1-mini" . أوبن آي . 12 سبتمبر 2024.
- ↑ كومبس، لويد (13 سبتمبر 2024). "نموذج ChatGPT o1 الجديد من OpenAI 'غشّ' في اختبار مستحيل - إليكم ما حدث" . دليل توم . تم الاطلاع عليه في 15 سبتمبر 2024 .
- ↑ "بطاقة نظام OpenAI o1" (ملف PDF) . OpenAI . 12 سبتمبر 2024. الصفحات 16-17 .
- ↑ بوران، ماري (13 سبتمبر 2024). "تحذير من عالم بشأن نموذج OpenAI o1: "خطير بشكل خاص"" . نيوزويك . تم الاطلاع عليه في 15 سبتمبر 2024 .
- ↑ روبيسون، كايلي (17 سبتمبر 2024). "نموذج OpenAI الجديد أفضل في الاستدلال، وفي بعض الأحيان، في الخداع" . ذا فيرج .
- ↑ إدواردز، بنج (16 سبتمبر 2024). "تحذيرات الحظر تتزايد مع جرأة المستخدمين على استكشاف "أفكار" أحدث نموذج من OpenAI" . آرس تكنيكا .
- ↑ ميرزاده، إيمان؛ علي زاده، كيفان؛ شاهروخي، هومان؛ توزيل، أونجيل؛ بنجيو، سامي؛ فرجتابار، مهرداد (2024). "GSM-Symbolic: فهم حدود الاستدلال الرياضي في نماذج اللغة الكبيرة". arXiv : 2410.05229 [ cs.LG ].
- ↑ أورلاند، كايل (14 أكتوبر 2024). "دراسة أبل تكشف عن ثغرات عميقة في قدرات "الاستدلال" لدى حاملي شهادات الماجستير في القانون" . آرس تكنيكا . تم الاطلاع عليه في 15 أكتوبر 2024 .
- ↑ بيلاي، ثارين (15 ديسمبر 2024). "اختبارات جديدة تكشف قدرة الذكاء الاصطناعي على الخداع" . مجلة تايم . مؤرشف من الأصل في 22 أبريل 2025. تم الاطلاع عليه في 8 يوليو 2025 .
روابط خارجية
- برامج 2024
- محولات توليدية مدربة مسبقًا
- نماذج لغوية كبيرة
- أوبن إيه آي
- ChatGPT
- 2024 في مجال الذكاء الاصطناعي
