أعلنت شركة OpenAI، اليوم، إطلاق GPT-5.5، وقالت إنه يمثل أقوى نماذجها وأكثرها سهولة في الاستخدام حتى الآن. مع تركيز واضح على إنجاز المهام العملية على الحاسوب، من كتابة الأكواد وتصحيحها إلى البحث عبر الإنترنت وتحليل البيانات وإعداد الوثائق والجداول. وأوضحت الشركة أن النموذج الجديد يفهم نية المستخدم بسرعة أكبر. ويستطيع إتمام جزء أكبر من العمل بشكل مستقل.
ويأتي إطلاق GPT-5.5 من OpenAI في سياق سباق متسارع بين الشركات المطورة للذكاء الاصطناعي من أجل تقديم نماذج لا تكتفي بالإجابة. بل تخطط وتستخدم الأدوات وتراجع النتائج وتواصل تنفيذ المهمة حتى نهايتها. ووفق ما أعلنته الشركة. فإن النموذج الجديد يحقق هذا التطور من دون التضحية بالسرعة، إذ يحافظ على زمن استجابة مماثل لـ GPT-5.4 لكل رمز، مع مستوى أعلى من الذكاء والكفاءة.
قدرات GPT-5.5 في العمل والبرمجة
قالت OpenAI إن GPT-5.5 يحقق مكاسب قوية خصوصا في البرمجة الوكيلة. واستخدام الحاسوب، والعمل المعرفي، والبحث العلمي المبكر. وأضافت أن النموذج أصبح أفضل في التعامل مع المهام المعقدة والمتشعبة. خاصة تلك التي تحتاج إلى تخطيط، وتنقل بين الأدوات، ومتابعة طويلة عبر مراحل متعددة.
وفي مجال البرمجة، سجل GPT-5.5 نسبة 82.7 في المائة في اختبار Terminal-Bench 2.0. مقابل 75.1 في المائة لـ GPT-5.4. كما حقق 58.6 في المائة في SWE-Bench Pro، و73.1 في المائة في Expert-SWE الداخلي. وهي أرقام قالت الشركة إنها تعكس قدرة أعلى على حل المهام البرمجية المعقدة من البداية إلى النهاية. مع استهلاك أقل للرموز مقارنة بالإصدار السابق.
وأكدت الشركة أيضا أن النموذج يقدم أداء أفضل داخل Codex، سواء في التنفيذ أو إعادة الهيكلة أو التصحيح أو الاختبار أو التحقق من النتائج. وأضافت أن GPT-5.5 أظهر فهما أعمق لبنية الأنظمة البرمجية، وقدرة أوضح على معرفة سبب العطل، والمكان المناسب للإصلاح، وتأثير التعديلات على بقية الشيفرة.
إطلاق GPT-5.5 من OpenAI في مهام المعرفة
لم تحصر OpenAI قدرات النموذج في البرمجة فقط، بل قالت إن GPT-5.5 أصبح أكثر فاعلية في ما سمته العمل المعرفي اليومي على الحاسوب. ويشمل ذلك البحث عن المعلومات، وفهم المعطيات المهمة، واستخدام الأدوات، والتحقق من المخرجات، ثم تحويل المواد الخام إلى وثائق أو جداول أو عروض تقديمية قابلة للاستعمال.
وأفادت الشركة بأن GPT-5.5 تفوق على GPT-5.4 داخل Codex في إنشاء الوثائق والجداول والعروض. كما أظهر نتائج أفضل في أبحاث العمليات، ونمذجة الجداول، وتحويل مدخلات أعمال غير مرتبة إلى خطط واضحة. وأضافت أن أكثر من 85 في المائة من فرق OpenAI تستخدم Codex أسبوعيا في مجالات تشمل الهندسة، والمالية، والتواصل، والتسويق، وعلوم البيانات، وإدارة المنتجات.
وفي اختبارات الأداء المهنية، سجل GPT-5.5 نسبة 84.9 في المائة في GDPval، و60.0 في المائة في FinanceAgent v1.1. و88.5 في المائة في مهام النمذجة المصرفية الاستثمارية الداخلية، و54.1 في المائة في OfficeQA Pro. كما حقق 78.7 في المائة في OSWorld-Verified، و98.0 في المائة في Tau2-bench Telecom دون ضبط إضافي للمحفزات.
البحث العلمي والسلامة والإتاحة
أوضحت OpenAI أن GPT-5.5 أحرز تقدما أيضا في مسارات البحث العلمي والتقني، خاصة في المهام التي تتطلب استكشاف فكرة، وجمع الأدلة، وفحص الفرضيات، وتفسير النتائج، ثم تحديد الخطوة التالية. وفي هذا السياق، أشارت الشركة إلى تحسن واضح مقارنة بـ GPT-5.4 في اختبار GeneBench الخاص بتحليل البيانات العلمية متعددة المراحل في علم الوراثة والبيولوجيا الكمية.
وعلى مستوى السلامة، قالت OpenAI إنها تطرح GPT-5.5 مع أقوى مجموعة ضمانات لديها حتى الآن. مضيفة أنها أخضعت النموذج لاختبارات السلامة والاستعداد، وعملت مع فرق داخلية وخارجية. كما أضافت اختبارات موجهة لقدرات الأمن السيبراني والبيولوجيا. وجمعت ملاحظات من نحو 200 شريك من المستخدمين الأوائل قبل الإطلاق.
وبخصوص الإتاحة، أعلنت الشركة أن GPT-5.5 بدأ الوصول إلى مستخدمي Plus وPro وBusiness وEnterprise داخل ChatGPT وCodex، بينما بدأ GPT-5.5 Pro بالوصول إلى فئات Pro وBusiness وEnterprise داخل ChatGPT. وأكدت OpenAI أن طرح النموذج في واجهة API سيتطلب ضمانات مختلفة. وقالت إنها تعمل مع الشركاء والعملاء على شروط السلامة والأمن قبل تعميمه على نطاق واسع.
وتشير المعطيات التي عرضتها الشركة إلى أن OpenAI لا تقدم GPT-5.5 كنموذج أسرع فقط. بل كنقلة نحو ذكاء عملي قادر على تنفيذ المهام الممتدة والمعقدة بكفاءة أعلى. وهذا المعطى قد يدفع مزيدا من الشركات والمهنيين إلى اختبار النموذج في البرمجة، والبحث، وتحليل البيانات، وإدارة الأعمال الرقمية خلال المرحلة المقبلة.