غوغل تكشف أقوى نماذجها لـ«الذكاء الاصطناعي».. مليون رمز وقدرات استثنائية - عين ليبيا
أطلقت شركة غوغل نموذج الذكاء الاصطناعي «جيميناي 4 أرغون» (Gemini 4 Argon)، الذي تقدمه بوصفه أحدث نماذجها الرائدة وأكثرها قدرة حتى الآن، مع تركيز على تنفيذ المهام المعقدة وطويلة المدى التي تمتد عبر خطوات متعددة، بدلًا من الاكتفاء بإنتاج إجابات قصيرة أو تنفيذ أوامر منفردة.
ويستهدف النموذج بصورة خاصة هندسة البرمجيات، والعمل المعرفي المتخصص في مجالات مثل التمويل والقانون والضرائب، إلى جانب الدفاع السيبراني.
وقالت غوغل إن أرغون صُمم للحفاظ على استدلال عميق ومستمر خلال سير عمل معقد وطويل، وإنه يجري طرحه في مرحلته الأولى على مجموعة من المدافعين السيبرانيين الموثوقين عبر برنامج «فيرويند» (Fairwind)، قبل توسيع نطاق إتاحته للمطورين والشركات والمستخدمين.
ويصل حد الإخراج في النموذج إلى مليون رمز، مقارنة بـ64 ألف رمز في النموذج السابق، بحسب غوغل.
وتقول الشركة إن هذه المساحة الإضافية تتيح للنموذج الاستمرار في عمليات استدلال طويلة وإنشاء مئات الآلاف من الرموز ضمن مسار واحد، بما يدعم المهام التي تحتاج إلى تحليل متتابع بدلًا من سلسلة قصيرة من التعليمات.
وتعني هذه القدرة، وفق غوغل، إمكانية التعامل مع مشاريع برمجية ضخمة أو مهام بحثية متعددة المراحل ضمن مسار واحد، مع الاحتفاظ بكمية أكبر من المعلومات اللازمة لمواصلة العمل.
وتؤكد الشركة أن توسيع القدرة على التعامل مع المهام الطويلة يمثل جزءًا أساسيًا من تصميم أرغون، وليس مجرد زيادة في حجم السياق.
وتضع غوغل هندسة البرمجيات في مقدمة الاستخدامات التي تستهدفها من خلال النموذج.
وقالت إن مهندسيها يستخدمون أرغون في تصحيح الأخطاء، وتصميم الخوارزميات، وترحيل قواعد شيفرة ضخمة بين لغات البرمجة.
ويعمل وكلاء أرغون على ترحيل قواعد شيفرة مكتوبة بلغتي سي (C) وسي++ (C++) إلى رَست (Rust)، ووصل حجم إحدى عمليات الترحيل إلى أكثر من 800 ألف سطر في نواة نظام فوشيا زيركون (Fuchsia Zircon).
كما قالت غوغل إن النموذج سجل 77.9% في اختبار «ديب إس دبليو إي 1.1» (DeepSWE v1.1)، المخصص لقياس أداء النماذج في مهام هندسة البرمجيات الواقعية طويلة المدى.
وفي مثال آخر، قالت الشركة إن وكلاء أرغون أعادوا كتابة 32 ألف سطر من شيفرة «إس آي إم دي» (SIMD) في مشروع «ليب غاف 1» (libgav1).
وأوضحت أن النسخة الجديدة المكتوبة بلغة رَست أصبحت أسرع بنحو 2.7 مرة من نسخة رَست السابقة، مع الحفاظ على المخرجات نفسها.
وأشارت غوغل إلى أن عمليات إعادة الكتابة واسعة النطاق تخضع لمراجعة واختبارات آلية ويدوية، إضافة إلى اختبارات محاكاة، قبل اعتمادها في بيئات الإنتاج.
ولا تقتصر استخدامات أرغون على البرمجة، إذ صممته غوغل أيضًا لتنفيذ مهام معرفية متخصصة في مجالات التمويل والقانون والضرائب.
وتقول الشركة إن النموذج حقق أداءً متقدمًا في اختبارات تشمل البحث المالي متعدد الخطوات، والبحث والصياغة القانونية، ومهام الأعمال التي تتطلب تنفيذ سلسلة كاملة من الإجراءات.
كما يتمتع أرغون بقدرات متعددة الوسائط، بينها تحليل الرسوم البيانية وفهم مقاطع الفيديو الطويلة، وسجل 91.7% في اختبار «إل في بنش» (LVBench) المخصص لقياس فهم مقاطع الفيديو الطويلة، وفق غوغل.
ويحتل الأمن السيبراني موقعًا محوريًا في إطلاق النموذج.
وقالت غوغل إن أرغون قادر على اكتشاف الثغرات البرمجية والتحقق منها وإعداد إصلاحات لها بصورة ذاتية، وإنه سجل 68% في اختبار «سي دبليو إي بنش» (CWE-bench v1) الخاص بقياس قدرة النماذج على معالجة الثغرات الأمنية.
وبحسب الشركة، تعادل هذه النتيجة أفضل نتيجة مسجلة في الاختبار.
وتستخدم غوغل هذه القدرات ضمن برنامج «فيرويند»، الذي يتيح النموذج لمجموعة مختارة من المدافعين السيبرانيين، مع ضوابط وصول صارمة تقصر الاستخدام على فرق الأمن السيبراني والاستجابة للحوادث واختبارات الاختراق، إلى جانب مهام دفاعية وبحثية محددة.
وقالت غوغل إن شركة «ويز» تستخدم أرغون أيضًا في الدفاع السيبراني ضمن مبادرة «Scan for Good»، المخصصة لحماية البنية التحتية الحيوية من خلال اكتشاف ومعالجة المخاطر الأمنية عالية الخطورة.
وأضافت أن النموذج اكتشف خلال تجربة مبكرة ثغرة خطيرة كانت تكشف معلومات شخصية حساسة في برمجيات صحية تستخدمها مستشفيات حول العالم، وهي ثغرة قالت الشركة إن نماذج رائدة سابقة لم تكتشفها.
وفي الوقت نفسه، اختارت غوغل طرح أرغون بصورة تدريجية بدلًا من إتاحته مباشرة لجميع المستخدمين، بسبب القدرات التي يتضمنها والمخاطر المرتبطة باستخدامه.
وبدأت الشركة إتاحته لمختبرين موثوقين ومدافعين سيبرانيين ضمن برنامج «فيرويند»، بينما تعمل على اختبار إجراءات الحماية قبل توسيع نطاق الوصول.
وتشمل إجراءات الحماية، بحسب غوغل، مقاومة إساءة الاستخدام، والتصدي للهجمات المعروفة باسم «حقن التعليمات غير المباشر» (Indirect Prompt Injection)، إلى جانب أنظمة لمراقبة سلوك النموذج وإيقاف التنفيذ عند رصد خروج عن حدود المهمة.
كما تستخدم الشركة بيئات اختبار معزولة للعمليات عالية الخطورة، وتقول إنها تعمل على تعزيز أنظمة الحماية من إساءة استخدام النموذج في الهجمات السيبرانية والمخاطر الكيميائية والبيولوجية والإشعاعية والنووية.
وتقول غوغل إن أرغون يمثل أيضًا نموذجها الأكثر مقاومة حتى الآن لهجمات حقن التعليمات غير المباشر، وإنها تستخدم المراقبة والتدريب العدائي واختبارات الفرق الحمراء لتعزيز هذه الحماية.
وتشارك غوغل كذلك في العملية الطوعية التي أطلقتها الإدارة الأمريكية للوصول إلى النماذج قبل طرحها، ضمن إجراءات تتعلق باختبار النماذج المتقدمة وسلامتها.
وقالت الشركة إنها ستوسع الإتاحة تدريجيًا بعد جمع ملاحظات المختبرين الأوائل وتعزيز أنظمة الحماية، على أن تبدأ الإتاحة الموسعة لعملاء واجهة برمجة التطبيقات (API) المدفوعة ومشتركي «غوغل إيه آي ألترا» (Google AI Ultra)، قبل الوصول إلى المطورين والشركات والمستخدمين على نطاق أوسع.
ولم تحدد غوغل موعدًا لإطلاق عام كامل للنموذج، وفق ما أوردته رويترز.
ونقلت رويترز عن متحدث باسم الشركة أن أرغون هو «أكثر نماذجها أداءً حتى الآن» ومصمم للتعامل مع أعباء العمل المعقدة، وأن أداءه يقارن بنماذج رائدة مثل «أسترا» من أوبن إيه آي و«أوبوس» من أنثروبي في بعض اختبارات البرمجة والأمن السيبراني.
وأشارت رويترز إلى أن أرغون حقق نتائج أفضل من «أسترا» و«أوبوس» في عدد من مؤشرات الأداء التي أعلنتها غوغل، لكنه بقي خلف نماذج منافسة في مؤشرات أخرى، بينها اثنان من أربعة اختبارات مرتبطة بالبرمجة أوردتها الشركة.
وبذلك، لا تقدم نتائج الاختبارات صورة متفوقة للنموذج في جميع المجالات، وإنما تظهر تباينًا بين الاختبارات، بالتزامن مع تركيز غوغل على قدرته على تنفيذ مهام طويلة ومعقدة.
ويأتي إطلاق جيميناي 4 أرغون بعد تأخيرات شهدتها خطة غوغل لنماذج الذكاء الاصطناعي، إذ أبلغت الشركة رويترز أنها لم تعد تخطط لإطلاق «جيميناي 3.5 برو»، الذي كان الرئيس التنفيذي سوندار بيتشاي قد قال في وقت سابق إنه سيصدر في يونيو.
وأشارت رويترز إلى أن غوغل أعادت هيكلة مختبر «ديب مايند» للذكاء الاصطناعي خلال الفترة التي سبقت إطلاق أرغون، مع مغادرة عدد من القيادات المرتبطة بنماذج جيميناي.
ويعكس إطلاق أرغون تحولًا في تركيز غوغل من نماذج تركز على إنتاج الإجابات إلى أنظمة تستمر في العمل عبر مراحل متعددة للوصول إلى نتيجة نهائية، خصوصًا في البرمجة والبحث المالي والقانوني والأمن السيبراني.
وتقول غوغل إن النموذج مصمم ليكون أداة للمطورين والمهنيين والشركات في التعامل مع أكثر المهام تعقيدًا، بينما تشير نتائج الاختبارات التي أوردتها الشركة وتقييمات رويترز إلى أن أداءه يختلف من مجال إلى آخر.
وبذلك تضع غوغل «جيميناي 4 أرغون» في قلب سباق نماذج الذكاء الاصطناعي المتقدمة، مع رهان واضح على الاستدلال الطويل وتنفيذ المهام متعددة الخطوات بدلًا من الاكتفاء بالإجابة عن الأسئلة.
جميع الحقوق محفوظة © 2026 عين ليبيا