مقارنة أسعار نماذج الذكاء الاصطناعي 2026: التكلفة لكل مليون رمز

مقارنة لأسعار توكنات API، بما فيها الإدخال والإخراج والتخزين المؤقت، عبر OpenAI وAnthropic Claude وGoogle Gemini وDeepSeek والنماذج مفتوحة الأوزان، اعتماداً على الوثائق الرسمية.

بقلم فريق benchr التحريري · · تم التحقق من الأرقام من مصادر رسمية في 6 يونيو 2026 · سجل التغييرات

مقارنة أسعار نماذج الذكاء الاصطناعي 2026: التكلفة لكل مليون رمز: طبقات أدلة ومسارات للمقارنة.
لوحة تحريرية من benchr مقارنة أسعار نماذج الذكاء الاصطناعي 2026 مفاضلات مقاسة · لا فائز دائم
بحث النماذجيعتمد تصميم مقارنة أسعار نماذج الذكاء الاصطناعي 2026: التكلفة لكل مليون رمز على طبقات أدلة ومسارات للمقارنة.

تحول تسعير API لنماذج اللغة الكبيرة إلى سلعة بسرعة، لكن هياكل التسعير أصبحت أعقد. بين الإدخال والإخراج وتخزين المطالبات والدفعات والحالات ذاتية الاستضافة، يجب على المطورين حساب الأسعار بعناية لتقدير أعبائهم الشهرية. أدناه جدول المقارنة الديناميكي، المتزامن بدقة مع فهرس النماذج الرئيسي.

النموذج المزود الإدخال / 1M الإخراج / 1M الإدخال المخبأ / 1M
Qwen3.6-27BAlibabaاستضافة ذاتيةاستضافة ذاتية—
Llama 4 MaverickMetaاستضافة ذاتيةاستضافة ذاتية—
Llama 4 ScoutMetaاستضافة ذاتيةاستضافة ذاتية—
Phi-4Microsoftاستضافة ذاتيةاستضافة ذاتية—
GPT-5 MiniOpenAI$0.250$2.00$0.025
DeepSeek V4-FlashDeepSeek$0.440$1.32$0.014
Mistral Large 3Mistral$0.500$1.50—
Kimi K2.6Moonshot AI$0.950$4.00$0.160
Claude Haiku 4.5Anthropic$1.00$5.00$0.100
GPT-5OpenAI$1.25$10.00—
Grok 4.3xAI$1.25$2.50$0.200
DeepSeek V4-ProDeepSeek$1.32$3.96$0.044
Gemini 3.5 FlashGoogle$1.50$9.00$0.150
Mistral Medium 3.5Mistral$1.50$7.50—
Gemini 3.1 ProGoogle$2.00$12.00$0.200
Claude Sonnet 4.6Anthropic$3.00$15.00$0.300
Claude Opus 4.8Anthropic$5.00$25.00$0.500
Claude Opus 4.7Anthropic$5.00$25.00$0.500
GPT-5.5OpenAI$5.00$30.00$0.500

DeepSeek هو المزوّد الوحيد هنا الذي يتغيّر سعره بحسب وقت تشغيل الطلب. الأرقام المعروضة سعر الذروة؛ ونافذة 01:00–04:00 و06:00–10:00 بالتوقيت العالمي في أيام العمل غالية وما عداها بنصف السعر. ماذا يعني ذلك عمليًا. أوقفت DeepSeek نموذج V4-Flash المستضاف في 10 سبتمبر 2026؛ ويبقى صفّه في الفهرس المشترك إلى أن يُحدَّث، بينما يحوّل المعرّف deepseek-v4-flash مؤقتًا إلى DeepSeek-V4.1-Flash ‏($0.30 / $1.20 لكل مليون توكن في الذروة، و$0.15 / $0.60 خارجها).

طبقات التسعير: متقدمة مقابل متوسطة مقابل صغيرة

عند تحليل التكاليف، تقع النماذج عموماً في ثلاث طبقات:

  • الطبقة المتقدمة ($4.00+ إدخال / $20.00+ إخراج): تضم الآن GPT-6 Astra وClaude Fable 5.1 بسعر $10 / $50، وClaude Opus 5 بسعر $5 / $25، وGPT-5.6 Sol بسعر $4 / $20. وما زال GPT-5.5 وClaude Opus 4.8 مدرجين، لكن لكل منهما خلفًا بالسعر نفسه أو أقل. اختبر هذه الطبقة حين يبرر مكسب الجودة المتوقع العلاوة؛ فالمهام اليومية عالية الحجم تحتاج غالبًا مسارًا أرخص.
  • الطبقة المتوسطة ($1.25 - $3.00 إدخال / $2.50 - $15.00 إخراج): يُدرج Claude Sonnet 5 ‏($2 / $10) وGPT-5.6 Terra ‏($2 / $12) وGemini 3.1 Pro ‏($2 / $12) وGrok 4.6 ‏($2 / $6) جميعًا بسعر إدخال $2، ويقع هنا أيضًا GPT-5 ‏($1.25 / $10) وDeepSeek-V4-Pro. وصار Gemini 3.5 Flash ‏($1.50 / $9) أغلى من Gemini 3.8 Flash. قارن بينها حين تحتاج قدرة أعلى من الطبقة الاقتصادية من دون دفع أعلى الأسعار المدرجة.
  • طبقة النماذج الصغيرة أو مفتوحة الأوزان (أقل من $1.00 للإدخال): تضم GPT-5.6 Luna ‏($0.20 / $1.20) وQwen3.8-Flash ‏($0.15 / $0.47) وDeepSeek-V4.1-Flash وGemini 3.5 Flash-Lite ‏($0.30 / $2.50) وGPT-5 Mini وخيارات مستضافة من Llama 4 Scout. ويبقى Gemini 3.8 Flash في هذه الطبقة بسعر $0.75 / $3.75 حتى 31 ديسمبر 2026 فقط، إذ تُدرج Google سعر $1.50 / $7.50 ابتداءً من 1 يناير 2027. قد تلائم التوجيه والتصنيف والتلخيص عالي الحجم، لكن كلفة الاستضافة الذاتية تعتمد على العتاد ونسبة تشغيله ولا تساوي صفراً.

لمزيد من التفاصيل عن ترتيبات الأداء العامة، راجع ترتيب نماذج الذكاء الاصطناعي أو احسب تكلفتك الشهرية الدقيقة عبر حاسبة التكلفة.

كيف تتجنب الدقة الوهمية

تسعير كل مليون رمز يبدو رقماً دقيقاً، لكن الفاتورة الفعلية تعتمد على شكل العمل. روبوت دعم لديه مطالبة سياسة طويلة وإجابات قصيرة سيدفع غالباً على الإدخال، أما مساعد كتابة بمطالبات قصيرة ومسودات طويلة فسيدفع غالباً على الإخراج. النموذج نفسه قد يكون رخيصاً في مسار ومكلفاً في مسار آخر.

استخدم الجدول كخط أساس موحد، ثم احسب مزيجك أنت: متوسط توكنات الإدخال، ومتوسط توكنات الإخراج، ومعدل إصابة الكاش، ونسبة الدفعات، ومعدل الإعادة، ونسبة المخرجات المقبولة. هذه الأرقام الستة أهم من سعر المزوّد في سطر واحد عند اتخاذ قرار إنتاجي.

راجع صفحة المزود قبل الالتزام بإنفاق سنوي. صفحات الأسعار قد تتغير بهدوء، وبعض العقود المؤسسية تتضمن خصومات أو حدّاً أدنى أو رسوماً للمنصة لا تظهر في الوثائق العامة.

قاعدة القرار

ابدأ بأرخص نموذج يجتاز مجموعة مهام محددة الإصدار، لا بأرخص سطر في الجدول. شغّل المطالبات ومعايير القبول نفسها على نموذج اقتصادي ونموذج أقوى للضبط، ثم احسب تكلفة المخرجات المقبولة بدل عدد النداءات الخام. اصعد إلى فئة أعلى فقط حين تكون قيمة الأعمال الإضافية المقبولة أكبر من فرق التوكنات، وانزل حين تبقى الإعادات والنموذج الاحتياطي ووقت المراجعة داخل حدك التشغيلي.

أسئلة شائعة

كيف يوفر تخزين المطالبات المال؟

يسمح تخزين المطالبات لمزودي API مثل Anthropic وOpenAI وDeepSeek بإعادة استخدام أجزاء ثابتة من سعة السياق، مثل مطالبات النظام الكبيرة أو سياقات النظام. تُحتسب قراءة الكاش عادةً بـ 10% من سعر الإدخال القياسي، وبأقل من ذلك في بعض النماذج: تحتسب Anthropic قراءة الكاش في Claude Fable 5.1 بـ 2.5% من سعر الإدخال الأساسي. ويخفض ذلك كلفة حلقات الوكلاء التي تكرر البادئة نفسها بوضوح.

هل النماذج مفتوحة الأوزان ذاتية الاستضافة مجانية تماماً؟

لا. قد تتاح أوزان نماذج مثل Llama 4 Scout وMaverick وPhi-4 من دون رسم ترخيص مباشر وفق شروط كل رخصة، لكنك تظل تدفع مقابل عتاد GPU وتشغيله. وإذا كان حجم الاستخدام منخفضاً، فقد تكون واجهات API المُدارة أوفر من إبقاء خادم GPU نشطاً طوال اليوم.

سجل التغييرات

  • 11 سبتمبر 2026 — أعدنا كتابة الإجابة المختصرة وطبقات التسعير الثلاث حول GPT-6 Astra وClaude Fable 5.1 وClaude Opus 5 وعائلة GPT-5.6 وClaude Sonnet 5 وGrok 4.6، وسجّلنا إيقاف DeepSeek لنموذج V4-Flash المستضاف في 10 سبتمبر وتحويل معرّفه إلى DeepSeek-V4.1-Flash، وأشرنا إلى تغيّر سعر Gemini 3.8 Flash في 1 يناير 2027، وأضفنا إلى سؤال الكاش سعر قراءة الكاش في Fable 5.1 البالغ 2.5%.
  • — نُشرت النسخة الأولى. كل الأسعار مأخوذة من وثائق المزودين الرسمية وتمت مطابقتها مع ملف benchr model-figures.json.

المصادر