قبل ثلاثة أسابيع، كانت بنية Anthropic من فئة Mythos تعيش في مكان واحد بالضبط: Claude Fable 5، بسعر $10 لكل مليون رمز إدخال و$50 للإخراج لأصعب أعمال البرمجة الوكيلية. والسؤال المفتوح كان هل ستنزل تلك البنية يوماً في السعر، أم تبقى ترفاً حصرياً على النموذج الرائد.
في 1 يوليو، أجابت Anthropic. يعمل Claude Sonnet 5 على بنية فئة Mythos نفسها، ويطلق بسعر $2 لكل مليون رمز إدخال و$10 للإخراج — وهو سعر جعلته Anthropic قياسيًا بدل الانتقال إلى $3/$15 — ليس "Sonnet 4.7" جديداً، بل نموذجاً ثانياً مبنياً على أساس Fable 5.
بنية واحدة، طبقتان
يطلق Sonnet 5 دون سعر Sonnet 4.6 مؤقتاً: $2 لكل مليون رمز إدخال و$10 للإخراج حتى 31 أغسطس 2026 — وفي 31 أغسطس أكدت Anthropic أن $2/$10 هو السعر القياسي وألغت انتقال 1 سبتمبر إلى $3/$15، فبقي دون Sonnet 4.6 ($3/$15) وOpus 4.8 ($5/$25). يكلف الإدخال المخزّن مؤقتاً $0.20 لكل مليون، وتخصم واجهة الدفعات (Batch) 50% من الاتجاهين. يبقى السياق عند مليون رمز، مطابقاً لـ Sonnet 4.6 وOpus 4.8، لكن حد الإخراج يقفز إلى 128,000 رمز. معرّف الـAPI هو claude-sonnet-5، وتلتزم Anthropic بألا تُقاعده قبل 30 يونيو 2027.
تجلب البنية سمتين موروثتين إضافيتين. التفكير التكيفي مفعّل دائماً، بلا مفتاح تفكير موسّع يمكن قلبه — نفس السلوك الذي دشّنه Fable 5. وتنطبق مصنفات الأمان نفسها: ترجع الطلبات المصنفة في الأمن السيبراني الهجومي أو الأحياء والكيمياء أو التقطير برفض صريح. لا تحدث إعادة محاولة بنموذج آخر إلا إذا هيّأها التطبيق أو المنتج.
ماذا تقول المعايير
أبرز رقم في إعلان Anthropic هو SWE-bench Verified: يسجل Sonnet 5 نسبة 89.4% مقابل 88.6% لـClaude Opus 4.8. ويسجل 71.8% على SWE-bench Pro، اختبار البرمجة القائم على الوكلاء، و85.6% على Terminal-Bench 2.1.
في التفكير العلمي، يسجل GPQA Diamond نسبة 92.0% مقابل 93.6% لـOpus 4.8. وعلى ARC-AGI-2، يسجل Sonnet 5 نتيجة 20.0 مقابل 15.0 لـSonnet 4.6. أما Humanity's Last Exam بلا أدوات فنتيجته 42.5%. وتذكر بقية أرقام الإطلاق: LMSYS Arena عند 1435، وMMLU عند 93.8%، وHumanEval عند 96.0%، وMATH عند 93.5%.
اقرأ النمط بصدق: يغلق Sonnet 5 تقريباً كل فجوة البرمجة إلى Opus 4.8، بل يتجاوزه فعلياً على SWE-bench Verified، بينما يتنازل عن أرضية في معيار التفكير الأصعب. ويفعل ذلك بسعر $2 / $10 صار قياسيًا، أي 40% من سعري Opus 4.8 في الإدخال والإخراج.
Sonnet 5 مقابل Sonnet 4.6 مقابل Opus 4.8
| المواصفة | Claude Sonnet 5 | Claude Sonnet 4.6 | Claude Opus 4.8 |
|---|---|---|---|
| السعر (إدخال/إخراج لكل مليون) | $2 / $10 (قياسي منذ 31 أغسطس) | $3 / $15 | $5 / $25 |
| نافذة السياق | 1M رمز | 1M رمز | 1M رمز |
| حد الإخراج | 128K | 64K | 128K |
| SWE-bench Verified | 89.4% | 79.6% | 88.6% |
| GPQA Diamond | 92.0% | 89.9% | 93.6% |
| وضع التفكير | تكيفي، مفعّل دائماً | قياسي | قياسي |
| القيود | طلبات السيبراني / الأحياء / التقطير المصنفة ترفض صراحةً | قياسية | قياسية |
هل تستحق ترقية الطبقة الوسطى؟
احسب على عبء عمل حقيقي قبل التبديل. وكيل برمجة يحرق 2M رمز إدخال و400K رمز إخراج يومياً يكلف نحو $8 على Sonnet 5 (2 × $2 + 0.4 × $10)، مقابل $12 على Sonnet 4.6 و$20 على Opus 4.8. ولأن Anthropic أبقت $2/$10 سعرًا قياسيًا، لم ترتفع هذه الـ$8 بعد 31 أغسطس. حاسبة التكلفة تفعلها لأحجامك الخاصة، وتفصيل أسعار Claude Sonnet 5 يغطي حسابات التخزين المؤقت والدفعات بالكامل.
حيث تستحق الترقية بوضوح: وكلاء البرمجة وحلقات الأدوات الطويلة التي كانت تصطدم بسقف الـ64K إخراج لدى Sonnet 4.6، لأن حد الإخراج 128K يعني ردوداً مبتورة أقل بكثير في منتصف المهمة. وحيث يصعب تبرير الترقية: أعباء العمل المرتاحة أصلاً على Sonnet 4.6 والتي لا تحتاج هامش الإخراج الإضافي أو قفزة البرمجة؛ فالسعر الأقل مرحّب به، لكن الانتقال يبقى ترحيلًا يُختبر لا تبديلًا أعمى. وإذا كان عملك يعتمد على سقف التفكير بمستوى GPQA الذي تصدّره Opus 4.8 عند الإطلاق، فإن Sonnet 5 لم يغلق تلك الفجوة؛ اختبر Claude Opus 5 الذي حلّ محل Opus 4.8 بالسعر نفسه $5 / $25 بدل الاكتفاء بالنموذج الأقدم.
أسبوع إطلاق مزدحم
لم يصدر Sonnet 5 في عزلة. في اليوم نفسه أُغلقت مراجعة ضوابط التصدير وأُعيد Claude Fable 5 لجميع العملاء، مع استعادة AWS الوصول على Bedrock. كان GPT-5.6 محصوراً بالشركاء حينها، ثم وصل إلى الإتاحة العامة في 9 يوليو. لا يغير ذلك حسابات Sonnet 5، لكنه يثبت التسلسل الحالي للإتاحة.