اخبار الذكاء الاصطناعي

GPT-6.1 Sol Ultrafast يصل بسرعة أعلى 8 مرات مع Decisions API الجديدة

GPT-6.1 Sol Ultrafast يصل بسرعة أعلى 8 مرات مع Decisions API الجديدة
GPT-6.1 Sol Ultrafast يصل بسرعة أعلى 8 مرات مع Decisions API الجديدة

بدأت OpenAI طرح GPT-6.1 Sol Ultrafast فعليًا عبر API وCodex وChatGPT Work، بعد أن كان وضع السرعة الجديد معلنًا فقط كخيار قادم عند إطلاق GPT-6.1 Sol في نهاية سبتمبر. وتقول الشركة إن الوضع الجديد يمكن أن يرفع سرعة توليد الرموز إلى ما يصل إلى 8 مرات مقارنة بسرعة Sol القياسية، بالتزامن مع إطلاق Decisions API في نسخة تجريبية عامة لاتخاذ قرارات محددة بسرعة تصل إلى 10 مرات مقارنة باستخدام GPT-6 Luna عبر Responses API.

الإجابة السريعة

GPT-6.1 Sol Ultrafast ليس نموذجًا جديدًا منفصلًا، بل مستوى معالجة أسرع لـGPT-6.1 Sol عندما تكون الاستجابة اللحظية أهم من التكلفة. يتوفر للمطورين عبر Responses API باستخدام service_tier: "ultrafast"، بينما تستهدف Decisions API نوعًا مختلفًا من المهام: الاختيار والتصنيف والتقييم السريع باستخدام GPT-6 Luna، بدل إنشاء إجابات نصية طويلة.

ما الذي تغير في GPT-6.1 Sol Ultrafast الآن؟

عندما أعلنت OpenAI عن GPT-6.1 Sol في 29 سبتمبر، قدمت النموذج باعتباره خيارًا قريبًا من مستوى Astra في البرمجة واستخدام الكمبيوتر والعمل الاحترافي، لكن بسعر أقل بكثير. في ذلك الوقت قالت الشركة إن وضع Ultrafast سيصل خلال الأيام التالية. الجديد في 8 أكتوبر هو أن GPT-6.1 Sol Ultrafast أصبح متاحًا بالفعل للمطورين في API، كما بدأ الوصول إليه داخل Codex وChatGPT Work للخطط المؤهلة.

OpenAI تصف Ultrafast بأنه أسرع Service Tier لديها للمهام الحساسة للزمن. وبدل تغيير النموذج أو طريقة استدلاله، يطلب المطور نفس gpt-6.1-sol لكنه يحدد مستوى الخدمة Ultrafast. الهدف هو تقليل الزمن بين الرموز الناتجة وتسريع التفاعل في السيناريوهات التي ينتظر فيها المستخدم أو الوكيل النتيجة قبل تنفيذ الخطوة التالية.

الخدمة الغرض الأساسي السرعة المعلنة النموذج
Sol Standard العمل الاحترافي والاستدلال المتقدم الخط الأساسي للمقارنة GPT-6.1 Sol
Sol Fast زمن استجابة أقل للتطبيقات التفاعلية أسرع من Standard GPT-6.1 Sol
Sol Ultrafast المهام شديدة الحساسية للزمن حتى 8 مرات أسرع من Sol Standard GPT-6.1 Sol
Decisions API تصنيف واختيار وتقييم سريع نحو 10 مرات أسرع من Responses API في مهام القرار GPT-6 Luna

السرعة الأعلى تأتي بسعر أعلى بوضوح

التحسن في السرعة ليس مجانيًا. السعر القياسي لـGPT-6.1 Sol يبلغ دولارين لكل مليون Token إدخال و10 دولارات لكل مليون Token إخراج، بينما يرفع GPT-6.1 Sol Ultrafast التكلفة إلى 12 دولارًا لكل مليون Token إدخال و60 دولارًا لكل مليون Token إخراج. أي أن Ultrafast يكلف ستة أضعاف مستوى Standard وفق جدول OpenAI الحالي.

لهذا لا يبدو الوضع الجديد مناسبًا لتشغيل كل طلب داخل تطبيق بصورة افتراضية. القيمة الأكبر تظهر عندما يكون التأخير نفسه مكلفًا: وكيل يتنقل بين تطبيقات ويحتاج عدة خطوات متتالية، عملية Debugging أثناء عطل إنتاجي، أو تجربة مباشرة ينتظر فيها المستخدم كل استجابة قبل متابعة العمل.

  • وكلاء يستخدمون أدوات متعددة بصورة متتابعة.
  • تصحيح أعطال الإنتاج حيث تؤثر كل ثانية في زمن الاستجابة.
  • تجارب برمجية مباشرة تحتاج تدفقًا سريعًا للرموز.
  • تطبيقات تفاعلية يصعب فيها إخفاء زمن انتظار النموذج.
  • عمليات تستخدم عدة استدعاءات قصيرة داخل مهمة واحدة.

لماذا توصي OpenAI باستخدام WebSockets؟

مع GPT-6.1 Sol Ultrafast قد يصبح جزء ملحوظ من زمن المهمة خارج النموذج نفسه. فإذا كان التطبيق ينشئ اتصال HTTP جديدًا لكل استدعاء، يمكن أن تلتهم مصافحة الشبكة والاتصال جزءًا من المكسب الذي دفع المطور ثمنه. لهذا توصي OpenAI باستخدام WebSockets خصوصًا في التطبيقات الوكيلية التي تنفذ العديد من Tool Calls بسرعة متتابعة.

الفكرة هنا عملية: لا فائدة من جعل توليد النموذج أسرع عدة مرات إذا كان التطبيق يضيف زمنًا ثابتًا بين كل خطوة وأخرى. الاتصال المستمر يسمح باستخدام السرعة الأعلى بصورة أفضل، ويجعل Ultrafast أكثر من مجرد رقم في اختبار توليد الرموز.

Decisions API يحل مشكلة مختلفة تمامًا

بالتوازي مع GPT-6.1 Sol Ultrafast أطلقت OpenAI واجهة Decisions API في Public Beta لجميع المطورين. ورغم جمع الإعلانين تحت عنوان السرعة، فإنهما لا يؤديان المهمة نفسها. Decisions API ليست طريقة أسرع للحصول على مقال أو شرح أو كود، بل Endpoint متخصص عندما يحتاج التطبيق إلى قرار محدود وواضح.

تعتمد الواجهة حاليًا على GPT-6 Luna فقط، وتستقبل نصًا أو صورة أو الاثنين معًا. ثم تعيد نوعًا محددًا من النتائج بدل نص مفتوح. وتقول OpenAI إنها حققت في الاختبارات المبكرة نحو 10 أضعاف سرعة تنفيذ قرارات مماثلة باستخدام GPT-6 Luna من خلال Responses API.

ثلاثة أنواع من القرارات بدل إجابة مفتوحة

تحدد OpenAI ثلاثة أشكال رئيسية للنتائج. النوع الأول Predicate ويقدر احتمال صحة عبارة معينة. النوع الثاني Choice ويختار إجابة من خيارات يحددها المطور مسبقًا ويعيد درجات ثقة. أما Score فيقيّم الإدخال على نطاق رقمي أو Rubric مرتب.

هذا التصميم يجعل Decisions API مناسبة لفرز طلبات الدعم، أو تحديد القسم المناسب لرسالة العميل، أو إعطاء درجة خطورة، أو توجيه وكيل إلى الأداة التالية. إذا كان المطلوب استخراج كائن JSON معقد أو كتابة تفسير كامل، توصي وثائق OpenAI باستخدام Structured Outputs أو Responses API بدل محاولة تحويل Decisions إلى واجهة عامة لكل شيء.

السعر مختلف أيضًا: تدفع على الإدخال فقط

في النسخة التجريبية الحالية تبلغ تكلفة Decisions API باستخدام GPT-6 Luna نحو 0.10 دولار لكل مليون Token إدخال، ولا توجد رسوم منفصلة على Token الإخراج أو Cache Read أو Cache Write. هذا يعكس طبيعة الخدمة؛ المخرجات قصيرة ومحددة وليست استجابة لغوية طويلة.

لكن الواجهة ما زالت Beta، وGPT-6 Luna هو النموذج الوحيد المدعوم حاليًا. لذلك يجب التعامل مع المواصفات الحالية على أنها قابلة للتوسع أو التغيير قبل الوصول إلى General Availability، خصوصًا في المنتجات التي تعتمد على تفاصيل التسعير أو شكل الاستجابة بصورة ثابتة.

الفرق بين «أسرع نموذج» و«أسرع قرار»

الجمع بين GPT-6.1 Sol Ultrafast وDecisions API يوضح أن OpenAI لا تحاول حل مشكلة السرعة بطريقة واحدة. عندما تحتاج إلى ذكاء مرتفع واستدلال أو استخدام أدوات مع الحفاظ على زمن استجابة منخفض، تستخدم Sol مع Ultrafast. وعندما تكون المهمة مجرد اختيار سريع بين عدة مسارات، قد يكون تشغيل نموذج استدلال قوي وإجبار التطبيق على تحليل نصه النهائي تكلفة وزمنًا غير ضروريين.

بمعنى آخر، الأول يسرع نموذجًا قويًا، والثاني يعيد تصميم نوع المهمة نفسها. وهذا فارق مهم للمطورين، لأن أسرع بنية ليست دائمًا اختيار Model Tier أعلى، بل أحيانًا استخدام API أكثر تخصصًا.

من إعلان DevDay إلى توفر فعلي خلال أيام

سبق أن جمعنا في سوالف سوفت إعلانات OpenAI في DevDay 2026، وكان من بينها GPT-6.1 Sol وUltrafast وDecisions API. لكن الوضع تغير سريعًا بعد المؤتمر: Decisions API انتقلت من المعاينة المحدودة إلى Public Beta، بينما GPT-6.1 Sol Ultrafast انتقل من وعد بإطلاق قريب إلى خدمة متاحة فعليًا.

وهذا هو سبب أهمية التطور الحالي رغم وجود الإعلان السابق؛ الخبر لم يعد مجرد قائمة بميزات قادمة، بل أصبح بإمكان المطور إدخال الخدمتين في تطبيقاته الآن وفق حدود التوفر والتسعير المنشورة.

من يستطيع استخدام GPT-6.1 Sol Ultrafast؟

في OpenAI API أصبح وضع Ultrafast لـGPT-6.1 Sol متاحًا لجميع مستخدمي API وفق حدود الاستخدام الخاصة بالحساب. كما يدعم المعالجة العالمية وإقامة البيانات في الولايات المتحدة والاتحاد الأوروبي. أما داخل Codex وChatGPT Work فالوصول مرتبط بخطط مؤهلة مثل Pro 500 وبعض خطط Enterprise القائمة على الاستخدام وEdu القائمة على الرصيد، وقد يحتاج مدير المؤسسة إلى تفعيل الميزة.

وتوضح صفحة النموذج أن GPT-6.1 Sol Ultrafast يستخدم نفس نافذة السياق الكبيرة للنموذج، التي تصل إلى 1.05 مليون Token، مع حد إخراج أقصى 128 ألف Token. لذلك الاختلاف الأساسي هنا في مستوى الخدمة والسرعة والتكلفة، وليس في إنشاء نسخة أصغر من النموذج للحصول على هذا الأداء.

ماذا يعني GPT-6.1 Sol Ultrafast وDecisions API للمطورين؟

التطور الأهم هو أن اختيار النموذج لم يعد القرار الوحيد عند تصميم تطبيق AI. هناك الآن طبقة أخرى من الاختيارات: هل المهمة تحتاج Standard أم Fast أم GPT-6.1 Sol Ultrafast؟ وهل تحتاج Responses API أصلًا، أم يمكن اختزالها إلى Decision سريع باستخدام Luna؟ هذا يسمح ببناء التطبيق بمزيج من الذكاء والسرعة والتكلفة بدل إجبار كل خطوة على المرور عبر نفس المسار.

يمكن مراجعة وثائق OpenAI الرسمية لوضع Ultrafast لمعرفة إعداد service_tier والحدود، كما تشرح وثائق Decisions API أنواع Predicate وChoice وScore وطريقة اختيار الواجهة المناسبة. ومع انتقال OpenAI إلى خدمات أكثر تخصصًا، يبدو أن المنافسة في API لم تعد حول «من يملك أذكى نموذج» فقط، بل حول مقدار الزمن والتكلفة اللازمين لتحويل هذا الذكاء إلى قرار مفيد داخل التطبيق.

لا يسمح بنقل هذا المحتوى من سوالف دون الاشارة برابط مباشر

استضافة مجانية استضافة محتوى

Ayman abdallah

مؤسس ومدير تنفيذي لمشروع [محتوى] للمواقع العربية، مدير ادارة المحتوى في شركة Super App والرئيس التنفيذي ومدير التحرير والاعلانات لموقع سوالف سوفت.

اقرأ أيضا:

اترك تعليقاً

زر الذهاب إلى الأعلى