العودة إلى المدونة

GPT-6 Sol وLuna وClaude Opus 5.5: أيّها أنسب لعملك الفعلي؟

OpenAI, Claude and MuseWork marks in three equally sized square tiles for a model comparison article.

قد يبدو إعداد تقرير عن المنافسين قليل التكلفة، ثم يقضي الفريق ساعة في تصحيح الأرقام والبحث عن مصادرها. لهذا لا تكفي قائمة أسعار الرموز للحكم على النماذج الثلاثة التي صدرت في 22 سبتمبر 2026. المهم هو تكلفة الوصول إلى نتيجة صالحة للاستخدام.

ما الذي تغيّر في الأسعار؟

طرحت OpenAI نموذج GPT-6 Sol للمهام البرمجية والعمل متعدد الخطوات، وGPT-6 Luna للأعمال الواضحة والمتكررة بكميات كبيرة. وتقول الشركة إن سعر واجهة البرمجة انخفض 50% مقارنة بالسعر الترويجي لإصدارات GPT-5.6. عند التحقق، بلغ سعر المليون من رموز الإدخال والإخراج 2 و10 دولارات لـSol، و0.10 و0.50 دولار لـLuna. وفي اليوم نفسه طرحت Anthropic نموذج Claude Opus 5.5 بسعر 4 و20 دولاراً، أقل 20% من السعر المعلن لـOpus 5؛ وبلغ سعر قراءة الرموز المخزنة مؤقتاً 0.20 دولار. أما تقدير Anthropic بانخفاض تكلفة أحمال العمل المعتادة نحو 40% فهو تقدير للشركة، وليس خصماً إضافياً على السعر المعلن.

مثال حسابي يبيّن الفرق بين السعر والتكلفة

لنفترض مهمة تستخدم 100 ألف رمز إدخال و10 آلاف رمز إخراج، من دون تخزين مؤقت أو أدوات. وفق الأسعار القياسية التي تحقّقنا منها في 24 سبتمبر، تبلغ رسوم استدعاء النموذج تقريباً 0.30 دولار لـSol، و0.015 دولار لـLuna، و0.60 دولار لـOpus 5.5. هذا حساب افتراضي، وليس تجربة أداء أو مقارنة على أساس جودة متساوية. إذا احتاج النموذج الأقل سعراً إلى محاولات إضافية، أو خفّض نموذج آخر وقت مراجعة الموظف، تغيرت تكلفة النتيجة المقبولة.

تنص وثائق OpenAI على أن تجاوز 272 ألف رمز إدخال في طلب Sol أو Luna يفعّل سعراً أعلى على الطلب كله، لا على الجزء الزائد فحسب. وهناك أسعار مختلفة للمعالجة السريعة وبعض المعالجات الإقليمية. وانخفاض سعر قراءة الذاكرة المؤقتة في Opus 5.5 يفيد أكثر عندما يكرر الفريق استخدام سياق العمل نفسه. لذلك ينبغي مراجعة طبيعة الطلبات الفعلية قبل اتخاذ قرار من رقم واحد.

ماذا تخبرنا الاختبارات المستقلة؟

سجّلت Artificial Analysis لنموذج Opus 5.5 درجة 58 على مؤشر Intelligence Index عند أعلى إعداد للاستدلال، وكانت الأعلى على مؤشرها وقت النشر. هذه نتيجة مستقلة في ظروف محددة؛ لا تثبت أن النموذج سيُنجز مذكرة الموردين الخاصة بفريقك بأفضل صورة. إعدادات الاستدلال والأدوات والملفات تختلف، وكذلك معايير قبول النتيجة. وإتاحة سياق طويل لا تعني صحة كل رقم أو إحالة في مستند طويل.

لنفترض أن المطلوب تلخيص ثلاث صفحات منتجات وملفّي PDF وجدول أسعار في توصية من صفحة واحدة. نص جميل يغفل تغييراً في السعر ليس تقريراً جاهزاً للتسليم. اختر ثلاثاً إلى خمس مهام حقيقية بعد إزالة البيانات الحساسة، وقدّم المواد نفسها والصيغة المطلوبة لكل نموذج. راجع الأرقام والمصادر والأقسام المطلوبة، ثم احسب عمليات الإعادة والتعديل ووقت المراجعة البشرية ضمن تكلفة كل نتيجة مقبولة.

ثلاث مهام، وثلاثة معايير مختلفة

في تقرير أسبوعي يجمع مصادر متعددة، تحقق من الأرقام المتعارضة والمراجع. وفي استخراج حقول من سجلات كثيرة، راقب الأخطاء وإعادة التنفيذ لكل سجل. أما مخطط العرض التقديمي فقيّمه وفق صلته بالبيانات وسهولة تحريره. اجمع مواد الإدخال وشروط القبول ونسبة النجاح من المحاولة الأولى ووقت المراجعة والرسوم في جدول واحد. قد تكون النتيجة اختياراً افتراضياً، وخياراً للحالات المعقدة، وموعداً لإعادة التجربة.

من المقارنة إلى قرار قابل للتنفيذ

قد يتطلب العمل المليء بالاستثناءات نموذجاً أقوى، بينما تناسب عمليات الاستخراج المتكررة نموذجاً أقل تكلفة. احتفظ بنسبة النتائج المقبولة وأمثلة الأخطاء والوقت اللازم لتصحيحها وما لم يُختبر بعد، بدلاً من إعلان فائز واحد للجميع.

يمكن تزويد MuseWork بالإعلانات الرسمية وعينات العمل المجهّلة التي يحق لفريقك مشاركتها ومعايير القبول، ليُنظّم الأدلة ويُعد خطة تجربة ومذكرة قرار قابلة للمراجعة. مثال للطلب: «نظّم هذه المصادر وثلاث عينات عمل مجهّلة في خطة تقارن دقة الإحالات ووقت التصحيح والتكلفة الإجمالية للنتيجة المقبولة، واذكر ما يحتاج إلى اختبار».

حوّل الأخبار إلى عمل قابل للمراجعة

قدّم مستنداتك ومصادرك إلى MuseWork لإعداد موجز يمكن لفريقك مراجعته. ابدأ مهمة بحث، أو تعرّف إلى البحث المتعمق.

تابع عملك بعيداً عن المكتب: نزّل MuseWork لهاتف iPhone أو Android. وللعمل على ملفات الحاسوب بإذنك، نزّل نسخة سطح المكتب.

المصادر

نزّل MuseWork لسطح المكتب

بإذنك، يستطيع MuseWork Desktop استخدام متصفحك وملفاتك المحلية لإنجاز المهام نيابةً عنك.

معاينة مساحة عمل MuseWork لسطح المكتب