أوبن أيه آي أو 3

أوبن أيه آي أو 3
معلومات عامة
نوع
المطورون
التسلسل
أوبن أيه آي أو 3 ميني، وأوبن أيه آي أو 4 ميني

أوبن أيه آي أو 3 هو نموذج محول مولد مسبق التدريب مُضمن في تطبيق شات جي بي تي طوّرته شركة أوبن أيه آي خلفا لنموذجها السابق أوبن أيه آي أو 1، وقد صُمم هذا النموذج لتخصيص وقت إضافي للمناقشة عند معالجة الأسئلة التي تتطلب تفكيرًا منطقيًا تدريجيًا.[1][2] طرحت شركة أوبن أيه آي في 31 يناير (كانون الثاني) 2025 نموذجا مصغرا من أوبن أيه آي أو 3 أطلق عليه اسم أوبن أيه آي أو 3 ميني،[3] ثُم طرحت في 16 أبريل (نيسان) نموذجها المصغر التالي، والذي أطلقت عليه اسم أوبن أيه آي أو 4 ميني.[4]

التاريخ

كشفت شركة أوبن أيه آي النقاب عن نموذج محولها التوليدي مسبق التدريب الجديد في 20 ديسمبر (كانون الأول) 2024، وقد أطلقت عليه اسم «أوبن أيه آي أو 3» لتفادي تعارض العلامة التجارية لنموذجها مع العلامة التجارية لشركة الاتصالات أو تو.[1] وعلى غرار أوبن أيه آي أو 1، طرحت الشركة إصدارين من نموذجها هما أوبن أيه آي أو 3، وأوبن أيه آي أو 3 ميني، وأتاحت شركة أوبن أيه آي لباحثي السلامة والأمن إمكانية التقدم بطلب الوصول المبكر لهذه النماذج حتى 10 يناير (كانون الثاني) 2025.[5][3]

وفي 31 يناير (كانون الثاني) 2025، طرحت أوبن أيه آي نموذحها المصغر أوبن أيه آي أو 3 ميني بصورة رسمية لجميع مستخدمي شات جي بي تي، حتى أولئك الذين يستخدمون الإصدار المجاني من التطبيق، بالإضافة إلى بعض مستخدمي واجهات برمجة التطبيقات. وصفت شركة أوبن أيه آي نموذج أوبن أيه آي 3 المصغر بأنه بديل متخصص لنموذج أوبن أيه آي أو 1 في المجالات التقنية التي تتطلب الدقة والسرعة.[6] تميز أوبن أيه آي أو 3 ميني بثلاثة مستويات لجهد التفكير، مستوى منخفض، ومستوى متوسط، ومستوى عالي. تستخدم الإصدارات المجانية من شات جي بي تي وغيره نموذج أوبن أيه آي أو 3 ميني ذا المستوى المتوسط.، بينما يتوفر الإصدار عالي المستوى من أوبن أيه آي أو 3 ميني، والذي يتطلب قدرًا أكبر من الحوسبة فقط للمشتركين في النُسخ المدفوعة.[3][7] ويتمتع مشتركو النسخة الاحترافية من شات جي بي تي بوصول غير محدود إلى كلٍّ من أوبن أيه آي أو 3 ميني وأوبن أيه آي أو 3 ميني عالي المستوى.[6]

في 2 فبراير (شباط) 2025، أطلقت شركة أوبن أيه آي خدمة أوبن أيه آي ديب ريسيرش، وهي خدمة مضمنة في تطبيق شات جي بي تي تستخدم إصدارًا من أوبن أيه آي أو 3 يُمكنه أن ينشئ تقارير شاملة خلال مدة زمنية تتراوح ما بين 5 إلى 30 دقيقة فقط، استنادًا إلى عمليات البحث على الويب.[8] وفي 6 فبراير (شباط) 2025، طرحت أوبن أيه آي، تحت ضغط من منافسيها مثل ديب سيك، تحديثًا جديدا لنموذج أوبن أيه آي أو 3 ميني يهدف إلى تعزيز شفافية عملية التفكير في النموذج الخاص بها.[9]

وفي ١٢ فبراير (شباط) 2025، زادت أوبن أيه آي حد عدد المطالبات اليومية المسموح بها في أوبن أيه آي أو 3 ميني للمُستخدمين المُشتركين في خدمة شات جي بي تي المدفوعة إلى ٥٠ مطالبة في اليوم الواحد، بدلًا من ٥٠ مطالبة أسبوعيًا، كما وفرت دعمًا لتحميل الملفات والصور.[10] وفي ١٦ أبريل (نيسان) ٢٠٢٥، أصدرت شركة أوبن أيه آي نظامي أوبن أيه آي أو 3 وأوبن أيه آي أو 4.[4]

التقييم

استُخدمت شركة أوبن أيه آي التعلم بالتعزيز لتعليم نموذج أوبن أيه آي أو 3 التفكير قبل توليد الإجابات باستخدام ما تُطلق عليه أوبن أيه آي اسم «سلسلة التفكير الخاصة».[11] يُمكّن هذا النهج النموذج من التخطيط المُسبق والتفكير المنطقي خلال المهام، وتنفيذ سلسلة من خطوات التفكير الوسيطة للمساعدة في حل المشكلة، مع الحاجة إلى قوة حوسبة إضافية وعلى حساب زيادة زمن وصول الاستجابات.[12]

أظهر نموذج أوبن أيه آي أو 3 أداءًا أفضل بكثير مقارنةً بنموذج أوبن أيه آي أو 1 السابق له فيما يتعلق بأداء المهام المُعقدة، بما في ذلك البرمجة والرياضيات والعلوم.[1] وأفادت شركة أوبن أيه آي أن نموذج أوبن أيه آي أو 3 حقق نسبة دقة بلغت 87.7% وفقًا لمعيار أسئلة وأجوبة مستوى الدراسات العليا المعتمد من جوجل، والقائم على أسئلة علمية متخصصة غير متاحة للعامة على الإنترنت.[13] أما وفقًا لمعيار سوي-بينش فيريفايد، وهو معيار في هندسة البرمجيات يُقيّم قدرة النماذج على حل مشكلات غيت هاب الفعلية، فقد حقق نموذج أوبن أيه آي أو 3 نسبة 71.7%، مقارنةً بالإصدار السابق له أوبن أيه آي أو 1، والذي حقق 48.9%. وحقق نموذج أوبن أيه آي أو 3 بحسب ما أورده موقع كود فورسيز نسبة دقة بلغت 2727 وفقًا لنظام تصنيف إيلو، بينما حقق أوبن أيه آي أو 1 نسبة 1891.[13] وفي معيار مجموعة التجريد والاستدلال للذكاء الاصطناعي العام، والذي يُقيّم مدى قدرة الذكاء الاصطناعي على التعامل مع المشكلات المنطقية ومشكلات اكتساب المهارات الجديدة، حقق أوبن أيه آي أو 3 نسبة دقة أعلى بثلاث مرات من أوبن أيه آي أو 1.[1][14]

مراجع

  1. 1 2 3 4 Knight، Will (20 ديسمبر 2024). "OpenAI Upgrades Its Smartest AI Model With Improved Reasoning Skills". Wired. مؤرشف من الأصل في 2025-05-13.
  2. Metz، Cade (20 ديسمبر 2024). "OpenAI Unveils New A.l. That Can 'Reason' Through Math and Science Problems". نيويورك تايمز. مؤرشف من الأصل في 2025-05-10.
  3. 1 2 3 Franzen, Carl (31 Jan 2025). "It's here: OpenAI's o3-mini advanced reasoning model arrives to counter DeepSeek's rise". VentureBeat (بالإنجليزية الأمريكية). Archived from the original on 2025-03-29. Retrieved 2025-02-01.
  4. 1 2 "Introducing OpenAI o3 and o4-mini". openai.com (بالإنجليزية الأمريكية). Archived from the original on 2025-05-13. Retrieved 2025-04-16.
  5. "Early access for safety testing". OpenAI. 20 ديسمبر 2024. مؤرشف من الأصل في 2025-05-05.
  6. 1 2 "Introducing OpenAI O3 Mini". OpenAI. 13 فبراير 2025. مؤرشف من الأصل في 2025-05-12. اطلع عليه بتاريخ 2025-02-13.
  7. "OpenAI o3-mini". OpenAI (بالإنجليزية الأمريكية). 31 Jan 2025. Archived from the original on 2025-05-12. Retrieved 2025-02-03.
  8. Ha, Anthony (3 Feb 2025). "OpenAI unveils a new ChatGPT agent for 'deep research'". TechCrunch (بالإنجليزية الأمريكية). Archived from the original on 2025-05-06. Retrieved 2025-02-04.
  9. Wiggers, Kyle (6 Feb 2025). "OpenAI now reveals more of its o3-mini model's thought process". TechCrunch (بالإنجليزية الأمريكية). Archived from the original on 2025-04-09. Retrieved 2025-02-07.
  10. OpenAI (13 فبراير 2025). "Two updates you'll like— OpenAI o1 and o3-mini now support both file & image uploads in ChatGPT. We raised o3-mini-high limits by 7x for Plus users to up to 50 per day" (تغريدة). اطلع عليه بتاريخ 2025-02-13.
  11. OpenAI O3 Mini System Card (PDF) (Report). OpenAI. 13 يناير 2025. مؤرشف من الأصل (PDF) في 2025-05-02. اطلع عليه بتاريخ 2025-02-13.
  12. Zeff, Maxwell; Wiggers, Kyle (20 Dec 2024). "OpenAI announces new o3 models". تك كرانش (بالإنجليزية الأمريكية). Archived from the original on 2025-05-13. Retrieved 2024-12-22.
  13. 1 2 Franzen, Carl; David, Emilia (20 Dec 2024). "OpenAI confirms new frontier models o3 and o3-mini". فنشر بيت (بالإنجليزية الأمريكية). Archived from the original on 2025-05-04. Retrieved 2024-12-26.
  14. Hsu, Jeremy (20 Dec 2024). "OpenAI's o3 model aced a test of AI reasoning – but it's still not AGI". نيو ساينتست (بالإنجليزية الأمريكية). Archived from the original on 2025-04-30. Retrieved 2024-12-22.