تقارير أصلية مع ذكر المصادر دائمًا

OpenAI تكشف عن نموذج GPT-6 Astra بدرجات كاملة في الأمن السيبراني والاستدلال

قدمت شركة OpenAI نموذج الذكاء الاصطناعي GPT-6 Astra، الذي سجل نسبة 100 بالمئة في اختبارات الأمن السيبراني ودرجات شبه كاملة في الرياضيات والاستدلال التجريدي.

The Global Wire Newsroom ·

Link preview · horizonglobalnews.com

OpenAI تكشف عن نموذج GPT-6 Astra بدرجات كاملة في الأمن السيبراني والاستدلال

قدمت شركة OpenAI نموذج الذكاء الاصطناعي GPT-6 Astra، الذي سجل نسبة 100 بالمئة في اختبارات الأمن السيبراني ودرجات شبه كاملة في الرياضيات والاستدلال التجريدي.

Share

تُرجم هذا المقال آليًا بواسطة الذكاء الاصطناعي في غرفة أخبارنا عن الأصل الإنجليزي. اقرأ بالإنجليزية

OpenAI تكشف عن نموذج GPT-6 Astra بدرجات كاملة في الأمن السيبراني والاستدلال

في 3 سبتمبر 2026، قدمت منظمة أبحاث الذكاء الاصطناعي OpenAI أحدث أنظمتها الرائدة باسم GPT-6 Astra، واصفة النموذج بأنه أذكى ذكاء اصطناعي تم تطويره حتى الآن. ووفقاً لتقارير أعدها Aamir Khollam، سجل النظام درجة كاملة في التقييمات المعيارية القياسية للأمن السيبراني، بينما حقق في الوقت نفسه نتائج شبه كاملة في اختبارات الرياضيات المتقدمة والاستدلال التجريدي. وقد أعادت مؤشرات الأداء هذه إشعال المناقشات العالمية بين علماء الكمبيوتر والرؤساء التنفيذيين في القطاع وصناع السياسات حول ما إذا كان النموذج يستوفي معايير الذكاء الاصطناعي العام (AGI)، وهو حد نظري يمثل مرونة معرفية ذاتية على مستوى الإنسان عبر مجالات تشغيلية متعددة.

## Key facts - كشفت OpenAI عن أحدث نموذج للذكاء الاصطناعي لديها، المسمى GPT-6 Astra، في 3 سبتمبر 2026. - تؤكد تقارير Aamir Khollam أن النظام حقق درجة 100 بالمئة في التقييمات المعيارية للأمن السيبراني. - سجل النموذج أداءً شبه خالٍ من الأخطاء في التقييمات التي تقيس المنطق الرياضي المعقد وحل المشكلات الكمية متعددة الخطوات. - حقق GPT-6 Astra نتيجة قريبة من الحد الأقصى النظري في اختبارات الاستدلال التجريدي المصممة لتقييم التركيب النمطي غير اللفظي المكاني والمنطقي. - أدت نتائج الاختبارات المعيارية إلى تجدد النقاش عبر قطاع التكنولوجيا حول ما إذا كان النظام يلبي التعاريف التشغيلية للذكاء الاصطناعي العام.

## What happened مثل الكشف عن GPT-6 Astra في 3 سبتمبر 2026 أحدث إصدارات OpenAI العامة للنماذج، مصحوباً بادعاءات أداء تجريبية عبر معايير معرفية ومجالية رئيسية. ووفقاً لتقارير Aamir Khollam، تركز جوهر العرض التقديمي لشركة OpenAI على ثلاثة مؤشرات قدرة رئيسية: تقييم الأمن السيبراني الهجومي والدفاعي، والاستدلال الرياضي المتقدم، والمنطق التجريدي غير اللفظي.

في اختبارات الأمن السيبراني المعيارية، سجل GPT-6 Astra درجة تقييم كاملة، وهي نتيجة تعني تنفيذاً خالياً من الأخطاء في المهام التي تغطي عادة فحص الكود الآلي، وتحديد ثغرات البرمجيات، وتحليل الاستغلال، والترقيع الدفاعي. وبينما حددت نماذج اللغات الكبيرة التقليدية تاريخياً عيوب البرمجيات المعروفة بدرجات متفاوتة من الدقة، فإن تحقيق درجة كاملة في مجموعات الأمن السيبراني القياسية يشير إلى تقدم كبير في التحليل الآلي للبرمجيات.

وفي تقييمات الاستدلال الرياضي، سجل النموذج نتائج شبه كاملة. وتفيس هذه التقييمات قدرة النموذج على التنقل عبر هياكل البراهين المعقدة، والتفاضل والتكامل المتقدم، والجبر الخطي، والرياضيات المنفصلة دون القيام بقفزات منطقية أو أخطاء حسابية. وإلى جانب نتائجه الكمية، حقق GPT-6 Astra درجات شبه كاملة في تقييمات الاستدلال التجريدي، والتي تقيم قدرة النظام على التعرف على القواعد المنطقية الكامنة وحل الألغاز المكانية أو المفاهيمية الجديدة دون الاعتماد على بيانات التدريب المحفوظة.

وكما أفاد Aamir Khollam، فإن التقاء درجات الأمن السيبراني الخالية من العيوب والاستدلال الرياضي والتجريدي الشبه كامل يمثل أجرأ ادعاء لشركة OpenAI حتى الآن بشأن قدرة النموذج، مما يطرح بشكل مباشر التساؤل عما إذا كان GPT-6 Astra يمثل ظهور الذكاء الاصطناعي العام.

## Why it matters إن تحقيق درجات أمن سيبراني خالية من العيوب إلى جانب قدرات استدلال شبه كاملة يحمل عواقب هيكلية فورية على البنية التحتية للتكنولوجيا، والأمن الدولي، والأطر التنظيمية العالمية.

من منظور أمن المعلومات، يقدم نظام الذكاء الاصطناعي القادر على تحقيق نتائج كاملة في اختبارات الأمن السيبراني ديناميكية مزدوجة الاستخدام بحجم غير مسبوق. في الجانب الدفاعي، يمكن لشركات البرمجيات ومشغلي البنية التحتية الاستفادة من هذه النماذج لإجراء عمليات فحص برمجية مستمرة ومستقلة، وتحديد وتغطية ثغرات اليوم الصفر (zero-day vulnerabilities) عبر شبكات الطاقة الحيوية، والشبكات المالية، والنظم الطبية قبل أن يتمكن الفاعلون الخبيثون من استغلالها. وعلى العكس من ذلك، إذا تم نشره هجومياً، فإن نظاماً آلياً يتمتع بقدرات استكشاف ثغرات خالية من العيوب قد يخفض بشكل كبير الحواجز التقنية لإنشاء هجمات سيبرانية معقدة، وسكريبتات استغلال آلية، واختراقات شبكية واسعة النطاق.

من منظور تقني ومعرفي، تشير الدرجات الشبه كاملة في الاستدلال التجريدي إلى الانتقال بعيداً عن مجرد الاستكمال البسيط للأنماط نحو التركيب الخوارزمي الحقيقي. وغالباً ما فشلت الأجيال الأولى من النماذج التوليدية عندما عُرضت عليها هياكل مشكلات جديدة تفتقر إلى تكافؤ مباشر في مجموعات تدريبها. وتشير علامات الاستدلال التجريدي العالية إلى أن GPT-6 Astra يمكنه بناء نماذج داخلية ديناميكية لحل المهام غير المألوفة، وهي قدرة أساسية في الاكتشاف العلمي والهندسة المستقلة.

بالنسبة للأسواق المالية والاستراتيجية المؤسسية، يعزز هذا الإصدار ضغوط المنافسة عبر قطاع التكنولوجيا. وتواجه المنافسات الرئيسية، بما في ذلك Google DeepMind وAnthropic وMeta، ضغوطاً سوقية فورية لمطابقة هذه العتبات المعيارية أو تجاوزها. بالتزامن مع ذلك، ستحدد السلطات الحكومية المسؤولة عن مراقبة أنظمة الذكاء الاصطناعي المتقدمة ما إذا كان GPT-6 Astra يفعل أحكام الرقابة الإلزامية بموجب الأوامر التنفيذية للأمن القومي أو أطر الامتثال الدولية.

## The background تأسست OpenAI في سان فرانسيسكو بكاليفورنيا في ديسمبر 2015 كمختبر أبحاث غير ربحي ملتزم بتطوير ذكاء اصطناعي عام آمن ومفيد. وفي عام 2019، أعادت المنظمة هيكلتها لتشمل شركة تابعة محدودة الأرباح، مما أمن استثمارات رأسمالية ضخمة من شركة Microsoft Corporation لتمويل البنية التحتية الحاسوبية الهائلة المطلوبة لتدريب نماذج التعلم العميق واسعة النطاق.

وتوسع الحضور العام للشركة بسرعة عقب إطلاق GPT-3 في يونيو 2020، والذي أظهر قدرات غير مسبوقة في توليد اللغة الطبيعية من خلال بنية محول تضم 175 مليار معامل. وفي نوفمبر 2022، أطلقت OpenAI نموذج ChatGPT، وهو واجهة محادثة تفاعلية مبنية على GPT-3.5، والتي جذبت أكثر من 100 مليون مستخدم نشط في غضون شهرين وأطلقت موجة عالمية في نشر الذكاء الاصطناعي التوليدي. وفي مارس 2023، قدمت OpenAI نموذج GPT-4، الذي أظهر كفاءة على مستوى المهنيين في امتحانات المحاماة، واختبارات التراخيص الطبية، والتقييمات الأكاديمية المتقدمة. وتركزت الإصدارات اللاحقة للنموذج، مثل GPT-4o في مايو 2024 والهندسات الموجهة للاستدلال بما في ذلك OpenAI o1 في سبتمبر 2024، على المعالجة متعددة الوسائط المدمجة واستدلال سلسلة الأفكار الكامنة لحل المشكلات المنطقية المعقدة متعددة الخطوات.

لطالما شكلت الاختبارات المعيارية القياسية المقياس الأساسي لتقييم تقدم الذكاء الاصطناعي. في المجالات الكمية، قاست مجموعات البيانات مثل MATH (التي تضم مشكلات مسابقات المدارس الثانوية) وGSM8K تاريخياً الاستدلال الرياضي. وفي المنطق التجريدي، أسس مجمع التجريد والاستدلال (ARC)، الذي أنشأه عالم الكمبيوتر François Chollet في عام 2019، معياراً لقياس الذكاء العام من خلال تقديم ألغاز منطقية بصرية قائمة على الشبكات للأنظمة لا يمكن حلها عن طريق الحفظ الآلي. وفي الأمن السيبراني، تعتمد التقييمات روتينياً على بيئات اصطياد العلم (CTF) ومجموعات الاختبارات المعيارية مثل SWE-bench، والتي تقيم قدرة الوكيل على حل أخطاء البرمجة وثغرات الأمن في العالم الحقيقي.

ولا يزال مفهوم الذكاء الاصطناعي العام يخضع لتعاريف تقنية متغيرة. وتعرف OpenAI الذكاء الاصطناعي العام داخلياً بأنه أنظمة عالية الاستقلالية تتفوق على القدرات البشرية في الغالبية العظمى من المهام ذات القيمة الاقتصادية. وتصنف مؤسسات رائدة أخرى، مثل DeepMind، الذكاء العام عبر مستويات أداء متميزة، تتراوح من المتخصصين الناشئين إلى الأنظمة الفائقة البشرية. وقد نظر علماء الكمبيوتر على نطاق واسع إلى تحقيق أداء شبه كامل في المنطق التجريدي والرياضيات البحتة كمعيار حيوي قبل أن يتمكن أي نموذج من الادعاء بشرعية امتلاكه قدرة معرفية عامة.

## Reaction فصلت التقارير الأولية التي أعدها Aamir Khollam نتائج الاختبارات المعيارية التقنية التي تم تقديمها خلال إطلاق OpenAI لنموذج GPT-6 Astra، دون تضمين تصريحات رسمية من أطراف ثالثة من شركات التكنولوجيا المنافسة، أو المختبرات الأكاديمية، أو الجهات التنظيمية الحكومية.

وعقب الإعلانات عن النماذج المتقدمة بارزة بارزة، تتبع ردود الفعل الرسمية عادة القنوات المؤسسية القائمة. ومن المتوقع أن تسعى منظمات التقييم المستقلة، بما في ذلك معهد أمان الذكاء الاصطناعي بالولايات المتحدة (United States AI Safety Institute)، ومعهد أمان الذكاء الاصطناعي بالمملكة المتحدة (United Kingdom AI Safety Institute)، ومجموعات التدقيق التابعة لأطراف ثالثة، إلى الحصول على إمكانية الوصول إلى GPT-6 Astra لإجراء اختبارات الفريق الأحمر (red-teaming) والتحققات من الأمان بشكل مستقل. وستركز هذه التقييمات بشكل خاص على التحقق من صحة درجات الأمن السيبراني الكاملة المسجلة للنموذج لتقييم المخاطر المحتملة مزدوجة الاستخدام.

ومن المتوقع أن تفحص مؤسسات الأبحاث المنافسة والمطورون في الشركات، بما في ذلك Google DeepMind وAnthropic وMeta وMistral AI، عن كثب منهجيات التقييم الخاصة بـ OpenAI لتحديد ما إذا كانت المعايير المبلغ عنها قد استخدمت التلقين الصفري (zero-shot prompting)، أو الحسابات الممتدة في وقت الاختبار، أو الضبط الدقيق الخصيص للمهام. بالإضافة إلى ذلك، من المرجح أن تطالب منظمات المجتمع المدني، والمدافعون عن الخصوصية، وعلماء الأخلاق الأكاديميون بالنشر الفوري لبطاقات أمان النظام التفصيلية، مطالبين OpenAI بتوضيح الضوابط المطبقة لمنع الاستخدام غير المصرح به للنموذج في الاستغلال الخبيث للشبكات.

## What we don't know yet على الرغم من المؤشرات المهمة التي تم تسليط الضوء عليها في التقرير الأولي لـ Aamir Khollam، لا تزال العديد من التفاصيل التقنية والتشغيلية الأساسية غير معلنة. ولا يحدد الملخص مجموعات بيانات الاختبارات المعيارية أو بروتوكولات الاختبار الدقيقة المستخدمة لقياس أداء GPT-6 Astra في الأمن السيبراني والرياضيات والاستدلال التجريدي، مما يترك الباب مفتوحاً أمام تساءل عما إذا كانت التقييمات قد أجريت بشكل مستقل أم داخلياً من قبل OpenAI.

ولا يزال من غير الواضح ما إذا كانت الدرجة الكاملة للنموذج في الأمن السيبراني قد تم الحصول عليها ضمن بيئات تركيبية مقيدة، مثل ألغاز اصطياد العلم (Capture The Flag) القياسية، أم أنها تعكس الأداء مقابل ثغرات اليوم الصفر في العالم الحقيقي في هياكل برمجية معقدة ومتعددة الطبقات. كما يحذف التقرير معلومات حول الأجهزة الحاسوبية الفعالية المطلوبة لتدريب وتشغيل GPT-6 Astra، وحجم معاملاته الإجمالي، ومتطلبات الطاقة، وسعة نافذة السياق.

بالإضافة إلى ذلك، لم يتم تأكيد التفاصيل التجارية الرئيسية وتفاصيل الوصول، بما في ذلك هيكل التسعير لتكامل واجهة برمجة التطبيقات (API) للمؤسسات، والجداول الزمنية للتوافر العام، أو الضمانات التقنية المحددة التي تم نشرها لتقييد الوصول إلى ميزات الأمن السيبراني ذات المخاطر العالية المحتملة.

## What to watch في أعقاب الإعلان، ستحدد عدة نقاط تطوير رئيسية الأثر الأوسع لـ GPT-6 Astra على قطاع التكنولوجيا: - إصدار التقرير التقني الشامل وبطاقة أمان النظام الخاصين بـ OpenAI، مما يوفر توثيقاً دقيقاً حول بنية النموذج، ومنهجية التدريب، ونتائج اختبارات الفريق الأحمر للمحاذاة. - نتائج التحقق من معاهد الأمان المستقلة ومجموعات الأبحاث الأكاديمية التي تسعى إلى تكرار درجات الاختبارات المعيارية للنموذج في الأمن السيبراني والرياضيات والاستدلال التجريدي على مجموعات اختبار جديدة غير منشورة. - الاستجابات التنظيمية من السلطات الدولية، وتحديداً فيما يتعلق بالامتثال لقانون الذكاء الاصطناعي للاتحاد الأوروبي والمراسيم التنفيذية للولايات المتحدة التي تحكم النماذج المتقدمة ذات الآثار على الأمن القومي مزدوج الاستخدام. - إطلاقات النماذج المنافسة أو الكشوفات المعيارية المحدثة من مختبرات الذكاء الاصطناعي الأقران رداً على الادعاءات التشغيلية لـ OpenAI. - انطباعات التكامل التجاري الأولية من المؤسسات الشريكة التي تقيم ما إذا كانت درجات الاختبارات المعيارية النظري لـ GPT-6 Astra تترجم إلى هندسة برمجية موثوقة ومستقلة وحل للمشكلات في بيئات الإنتاج.

يستند هذا التقرير إلى تغطية صحفية أصلية نشرها Aamir Khollam.

المصدر: Aamir Khollam

أخبار ذات صلة