أعلنت OpenAI نموذج GPT-6.1 Sol بسعر يعادل خمس سعر النموذج الرائد Astra، مع ادّعاء بأن أداءه في البرمجة الوكيلية يكاد يطابقه. الخبر لا يتعلق بنموذج أقوى بقدر ما يتعلق بنموذج أرخص بما يكفي ليصبح الخيار الافتراضي. وحين يصبح الذكاء المتقدم سلعة رخيصة، تتغير حسابات كل فريق يبني منتجاً فوق واجهات الذكاء الاصطناعي. في هذا المقال نفكك الأرقام، ونفصل ما قالته OpenAI عمّا يجب أن تتحقق منه بنفسك.

أين يقع Sol في عائلة GPT-6؟

GPT-6.1 Sol: أداء قريب من الرائد بخُمس السعر، فماذا يتغيّر في حساباتك؟ — أدوات الذكاء الاصطناعي

بحسب التغطية المتاحة، يقع GPT-6.1 Sol في الوسط من عائلة GPT-6، فوق النموذج الصغير Luna وتحت النموذج الرائد Astra الذي صدر مطلع سبتمبر. وهو ترقية لنموذج GPT-6 Sol السابق بالسعر نفسه تقريباً، مع تحسينات في البرمجة الوكيلية واستخدام الحاسوب والمهام المهنية.

النموذج الإدخال لكل مليون رمز الإخراج لكل مليون رمز
GPT-6 Astra 10 دولارات 50 دولاراً
GPT-6.1 Sol 2 دولار 10 دولارات

الإدخال المخزّن مؤقتاً أرخص بكثير، إذ انخفض من 0.20 إلى 0.10 دولار لكل مليون رمز. ونافذة السياق تتجاوز مليون رمز، مع حدّ أقصى للإخراج يبلغ 128 ألف رمز.

السعر الرخيص لا يغيّر ما تستطيع بناءه فقط، بل يغيّر ما تستطيع تجريبه دون إذن من قسم المالية.

فخّ السياق الطويل

التسعير القياسي ينطبق على الطلبات حتى نحو 272 ألف رمز إدخال. ما فوق ذلك تُحاسَب الطلبية كلها بضعف سعر الإدخال وبمعامل 1.5 للإخراج. أي أن تمرير مستودع ضخم في كل طلب قد يضاعف الفاتورة فجأة، فصمّم سياقك بحيث يبقى أصغر من هذا الحد كلما أمكن.

ماذا تقول أرقام الأداء؟

تذكر OpenAI أن Sol يطابق Astra تقريباً في اختبار DeepSWE للبرمجة الوكيلية بخُمس التكلفة، وأنه في اختبار OSWorld 2.0 لاستخدام الحاسوب يتفوق على سلفه بسبع نقاط بأقل من نصف التكلفة، ويقترب من Astra بفارق نحو نقطتين مقابل سُبع تكلفة المهمة تقريباً.

لكن لا بد من ملاحظتين:

  • معظم هذه الأرقام صادرة عن OpenAI نفسها، والتحقق المستقل ما زال محدوداً.
  • Astra يتقدم في المهام الأصعب، خصوصاً التقييمات المتقدمة في الأمن السيبراني والأحياء والعلوم.

كيف تصل إليه؟

  • من منتقي النماذج في Codex أو ChatGPT بخطة مدفوعة.
  • عبر واجهة Responses برمز النموذج gpt-6.1-sol، وتدعم الأدوات مثل البحث في الملفات ومفسّر الكود والصدفة المستضافة وتطبيق الرقع واستخدام الحاسوب وMCP.
  • هو النموذج الافتراضي في Codex، ومتاح كذلك في GitHub Copilot وOpenRouter.

كيف تعيد حساب تكلفة مشروعك؟

  1. قِس مهامك أنت. اختر عشرين مهمة حقيقية من عملك، ومرّرها على Sol وAstra، وقارن النجاح والتكلفة. لا تعتمد على اختبار منشور.
  2. وجّه بحسب الصعوبة. أرسل المهام الروتينية إلى Sol واحتفظ بـAstra للحالات التي يفشل فيها.
  3. استفد من التخزين المؤقت. السعر المخزّن عُشر سعر الإدخال العادي تقريباً، فرتّب الموجّه بحيث يتكرر الجزء الثابت في البداية.
  4. راقب عتبة السياق الطويل كي لا تنتقل طلباتك إلى التسعير المضاعف دون أن تنتبه.

مثال حسابي بسيط

لنفترض فريقاً يشغّل وكيلاً برمجياً ينفّذ مئة مهمة يومياً، وتستهلك كل مهمة في المتوسط 150 ألف رمز إدخال و20 ألف رمز إخراج. على Astra تبلغ التكلفة التقريبية لكل مهمة 1.5 دولار للإدخال ودولاراً للإخراج، أي نحو 2.5 دولار، فيصل المجموع اليومي إلى 250 دولاراً. على Sol تنخفض إلى 0.30 دولار للإدخال و0.20 للإخراج، أي نصف دولار للمهمة و50 دولاراً يومياً. الفارق نحو 200 دولار في اليوم، وأكثر من ستة آلاف دولار شهرياً، دون احتساب مكاسب التخزين المؤقت.

هذه حسبة تقريبية بأسعار الإدخال والإخراج المعلنة، وهي لا تأخذ في الحسبان أن النموذج الأرخص قد يحتاج إلى محاولات أكثر في المهام الصعبة. لذلك القياس الفعلي لمعدل النجاح من المرة الأولى أهم من السعر المجرد.

متى لا تستعمل Sol؟

  • المهام الحساسة أمنياً: الفجوة المعلنة لصالح Astra في تقييمات الأمن السيبراني تعني أن مراجعة الثغرات الحرجة تستحق النموذج الأقوى.
  • المسائل العلمية المعقدة: إذا كانت الدقة أهم من الكلفة، فلا توفّر في المكان الخطأ.
  • الحالات التي تتكرر فيها الأخطاء الصغيرة: إذا كلّفتك كل محاولة فاشلة وقتاً بشرياً في المراجعة، فقد يضيع الوفر في ساعات المطوّرين.

قاعدة التوجيه المقترحة

ابدأ بـSol لكل شيء، وسجّل المهام التي يفشل فيها أو تحتاج مراجعة بشرية كثيفة، ثم انقل هذه الفئة وحدها إلى Astra. بعد أسبوعين ستملك بيانات حقيقية بدل التخمين، وستعرف نسبة الحركة التي تستحق الدفع الأعلى.

ما الذي يعنيه ذلك للسوق؟

حين يقدّم المزوّد نفسه نموذجاً بخُمس السعر وبأداء قريب، يتحول الفرق بين النماذج من سؤال "أيها أذكى" إلى سؤال "أيها يكفي". وهذا يضغط على المنافسين، ويجعل الوكلاء البرمجيين التي تعمل لساعات أقل كلفة وأسهل تبريراً. كما يرفع أهمية بناء طبقة توجيه تختار النموذج المناسب لكل مهمة بدل التعلق بنموذج واحد.

أسئلة شائعة

هل يحل Sol محل Astra تماماً؟

لا. بحسب OpenAI نفسها يتفوق Astra في أصعب التقييمات، فيبقى الخيار الأنسب للمهام الحرجة. أما Sol فيناسب الأغلبية الساحقة من الأعمال اليومية.

هل الأرقام المنشورة موثوقة؟

هي أرقام الشركة المطوّرة في معظمها، وتحتاج إلى اختبار مستقل. جرّب نموذجك على بياناتك قبل أن تبني قرارات تكلفة عليها.

هل يهمّ التسعير إذا كنت مطوراً فرداً؟

نعم، فانخفاض التكلفة يعني أن وكيل البرمجة يمكنه العمل على مهام أطول وأكثر تكراراً دون أن تقلق بشأن الفاتورة الشهرية.

الخلاصة

GPT-6.1 Sol ليس أقوى نموذج من OpenAI، لكنه ربما الأهم عملياً لأنه يضع أداءً قريباً من الرائد بسعر أقل بكثير. استفد منه بأن تقيس على مهامك، وتوجّه الطلبات بحسب صعوبتها، وتتجنب عتبة السياق الطويل. وتذكّر أن الأرقام التسويقية بداية النقاش لا نهايته.