أقل واجهات LLM المستضافة سعراً ضمن تتبع benchr: لقطة 24 يوليو 2026

قارن أقل أسعار الرموز لدى DeepSeek وGPT-5 Mini وClaude Haiku، إلى جانب تكلفة النماذج مفتوحة الأوزان ذاتية الاستضافة.

بقلم فريق benchr التحريري · · رُوجع نطاق المقارنة ولقطة الأسعار في 24 يوليو 2026 · سجل التغييرات

أقل واجهات LLM المستضافة سعراً ضمن تتبع benchr: لقطة 24 يوليو 2026: شرائط سعر ومسارات تقيس التوكنات.
لوحة تحريرية من benchr أقل واجهات LLM المستضافة سعراً ضمن تتبع benchr تدفق الاستخدام · التكلفة الكاملة
تحليل تكلفةيرافق أقل واجهات LLM المستضافة سعراً ضمن تتبع benchr: لقطة 24 يوليو 2026 تصميم يقوم على شرائط سعر ومسارات تقيس التوكنات.

للمهام عالية الحجم مثل إدخال مستندات RAG، وتوجيه محادثات المستخدمين، واستخراج البيانات المنظمة، يكون اختيار نموذج منخفض التكلفة ضرورياً. أدناه قائمة مرتبة بكل النماذج في benchr التي تكلف $1.00 أو أقل لكل مليون رمز إدخال، أو هي نماذج مفتوحة الأوزان موجهة للاستضافة الذاتية المجانية.

النموذج المزود الإدخال / 1M الإخراج / 1M الرخصة
Qwen3.6-27BAlibabaاستضافة ذاتيةاستضافة ذاتيةمفتوح الأوزان
Llama 4 MaverickMetaاستضافة ذاتيةاستضافة ذاتيةمفتوح الأوزان
Llama 4 ScoutMetaاستضافة ذاتيةاستضافة ذاتيةمفتوح الأوزان
Phi-4Microsoftاستضافة ذاتيةاستضافة ذاتيةمفتوح الأوزان
Qwen3.8-FlashAlibaba$0.150$0.47—
GLM-5.3-FlashZ.ai$0.150$0.50مفتوح الأوزان
Mistral Small 4Mistral$0.150$0.60مفتوح الأوزان
GPT-5.6 LunaOpenAI$0.200$1.20ملكية
GPT-5 MiniOpenAI$0.250$2.00ملكية
DeepSeek-V4.1-FlashDeepSeek$0.300$1.20لم تُسجَّل بعد
Gemini 3.5 Flash-LiteGoogle$0.300$2.50ملكية
DeepSeek V4-Flash (أُوقف على API في 10 سبتمبر 2026)DeepSeek$0.440$1.32مفتوح الأوزان
Mistral Large 3Mistral$0.500$1.50مفتوح الأوزان
Kimi K2.6Moonshot AI$0.950$4.00مفتوح الأوزان
Claude Haiku 4.5Anthropic$1.00$5.00ملكية
DeepSeek V4-ProDeepSeek$1.32$3.96مفتوح الأوزان

تنبيه على صفَّي DeepSeek: هذه أسعار ساعات الذروة. وكل ما يُرسل خارج 01:00–04:00 و06:00–10:00 بالتوقيت العالمي في يوم عمل يكلّف نصف ذلك، فيصير DeepSeek-V4.1-Flash عند $0.15/$0.60 نحو أربعة أخماس الأسبوع. أما صف V4-Flash فهو آخر سعر حمله النموذج المستضاف المتقاعد. وصف GLM-5.3-Flash هو السعر المدرج الحالي؛ عرض إطلاقه من 26 أغسطس إلى 9 سبتمبر بلغ $0.075/$0.25.

أبرز النقاط في فئة التكلفة المنخفضة

  • DeepSeek-V4.1-Flash ($0.30/$1.20 في الذروة، $0.15/$0.60 خارجها): البديل المستضاف لـV4-Flash منذ 10 سبتمبر 2026، بسعة سياق 1M وحدّ إخراج 384K. خارج الذروة يأتي بين أقل الأسعار في هذه المجموعة؛ وفي الذروة يصبح GPT-5.6 Luna أرخص في الإدخال ومساويًا في الإخراج. لم يسجّل benchr بعد نتيجة بنشمارك أو رخصة له.
  • DeepSeek V4-Flash (سجل تاريخي): قضى معظم 2026 بوصفه أرخص نافذة سياق بمليون توكن في السوق، ثم رفع سعره في 16 أغسطس إلى $0.44/$1.32 في الذروة، وأوقفته DeepSeek على API في 10 سبتمبر. وما زالت أوزانه برخصة MIT متاحة للاستضافة الذاتية.
  • GLM-5.3-Flash ($0.15/$0.50): عرض إطلاق Z.ai عند $0.075/$0.25 استمر من 26 أغسطس إلى 9 سبتمبر 2026؛ السعر المدرج منذ ذلك $0.15 للإدخال و$0.50 للإخراج، ويبقى من بين الأقل في هذه المجموعة.
  • GPT-5.6 Luna ($0.20/$1.20): فئة OpenAI للأحجام الكبيرة، بسعة سياق 1.05M. أرخص من GPT-5 Mini على جانبي العدّاد وبنافذة أكبر.
  • GPT-5 Mini ($0.25/$2.00): خيار OpenAI الأقدم منخفض التكلفة، مع دعم Structured Outputs وBatch API وسعة سياق 400K وحدّ إخراج 128K. قِس الكمون في بيئتك؛ لا تنشر OpenAI ضمانًا عامًا لسرعة معيّنة.
  • Claude Haiku 4.5 ($1.00/$5.00): رغم أنه أعلى سعراً من DeepSeek وGPT-5 Mini، فإنه يملك قدرات قوية في تخزين المطالبات مؤقتاً، مع بصمة Anthropic المعروفة في السلامة وضبط التنسيق.

تريد مقارنتها بالنماذج الرئيسية؟ راجع ترتيب نماذج الذكاء الاصطناعي الكامل أو احسب تسعير الحجم بدقة عبر حاسبة التكلفة.

متى يتوقف الرخيص عن كونه رخيصاً

أرخص API ليس دائماً أقل نظام تكلفة. قد يخسر نموذج أقل سعراً إذا احتاج محاولات إعادة أكثر، أو أنتج إجابات أطول من اللازم، أو أخطأ في قيود التنسيق، أو احتاج مراجعة بشرية أكبر. في الإنتاج، المقياس المفيد هو تكلفة الإجابة المقبولة.

في التوجيه والاستخراج والتصنيف عالي الحجم، قد تكون النماذج الاقتصادية ممتازة لأن المهمة ضيقة ويسهل كشف الفشل. أما في المراجعة القانونية، وإصلاح الكود المعقد، وتلخيص الأبحاث، وحلقات الوكلاء ذات الأثر، فانتبه إلى تكلفة الفشل قبل تحسين فاتورة الرموز.

طريقة عملية لبناء قائمة مختصرة

بالنسبة إلى معظم الفرق، يجب أن ينتهي البحث عن النموذج الأرخص بقائمة مختصرة لا بفائز واحد. اختر نموذجاً تحت $0.50 لكل مليون رمز إدخال، ونموذجاً بين $0.50 و$1.50، وخياراً أقوى احتياطياً فوق ذلك. وجّه العمل السهل إلى الطبقة الأرخص، ولا تصعّد إلا عند فشل الثقة أو التنسيق أو فحوص السلامة.

بهذا يبقى النظام رخيصاً من دون أن تراهن بالمنتج كله على أدنى سطر في الجدول. كما يعطيك مسار ترقية واضحاً: إذا تحسن النموذج الاقتصادي زِد حصته، وإذا فشل في حالة طرفية فالمسار الاحتياطي موجود مسبقاً.

انتبه أيضاً إلى تركّز الاعتماد على مزود واحد. توفير بضعة دولارات لكل مليون رمز لا يستحق خسارة المرونة إذا كان العمل حرجاً. في الأنظمة المهمة، اجعل النموذج الأرخص خياراً افتراضياً مع مزود ثانٍ يستطيع استلام الحمل عند تدهور الكمون أو حدود المعدل أو التوفر.

ولا تجعل السعر وحده يحدد الثقة. إذا كان النموذج الأرخص جيداً في مهمة واحدة، فهذا لا يعني أنه يصلح لكل مهام المنتج. اربط كل قاعدة توجيه باختبار واضح، واحتفظ بسجل للحالات التي صُعّدت إلى نموذج أقوى حتى تعرف أين تنتهي طبقة التوفير.

أسئلة شائعة

هل كان DeepSeek V4-Flash الأقل سعراً بين النماذج المستضافة في لقطة benchr؟

لا. لم يعد موجودًا على API: أوقفت DeepSeek نموذج V4-Flash المستضاف في 10 سبتمبر 2026. حافظ على أقل سعر مدرج حتى لقطة 24 يوليو 2026 عند $0.14 إدخالاً و$0.28 إخراجاً، ثم انتقل في 16 أغسطس إلى $0.44 و$1.32 داخل الذروة (01:00–04:00 و06:00–10:00 بالتوقيت العالمي من الاثنين إلى الجمعة) و$0.22 و$0.66 خارجها. وبديله DeepSeek-V4.1-Flash يُدرج عند $0.30 / $1.20 في الذروة و$0.15 / $0.60 خارجها، وليس الأرخص كذلك: يُدرج GLM-5.3-Flash وQwen3.8-Flash سعر إخراج أقل في كل ساعة. هذا ليس ضماناً للسوق كله؛ تحقّق من قائمة أسعار المزوّد الحية قبل اعتماد الميزانية.

هل أقدر استضافة النماذج مفتوحة الأوزان مجاناً؟

النماذج مفتوحة الأوزان مثل Llama 4 Scout أو Maverick أو Phi-4 مجانية التنزيل والاستخدام. لكن عليك تغطية تكاليف البنية التحتية للعتاد لتشغيلها (مثل تشغيل خوادم على AWS أو مواقع تأجير GPU).

هل النماذج مفتوحة الأوزان أرخص فعلاً من DeepSeek V4-Flash؟

يعتمد ذلك على حجمك. استضافة نموذج مثل Qwen3.6-27B أو Llama 4 Scout تتطلب استئجار GPU مثل A10G أو A100، ويُحاسب بالساعة. إذا كنت تنفذ ملايين الطلبات يومياً، تكون الاستضافة الذاتية غالباً أرخص. أما للأحجام الأقل أو الأعباء المتقطعة، فواجهة مستضافة مثل DeepSeek-V4.1-Flash أرخص غالبًا وتعفيك من تشغيل المعالجات الرسومية بنفسك.

سجل التغييرات

  • — صحّحنا سعر GLM-5.3-Flash من عرض الإطلاق المنتهي $0.075/$0.25 إلى سعره المدرج $0.15/$0.50 (استمر العرض من 26 أغسطس إلى 9 سبتمبر 2026)، وأضفنا Mistral Small 4 ($0.15/$0.60) إلى الترتيب والجدول.
  • — أعدنا الترتيب بعد إيقاف DeepSeek لنموذج V4-Flash المستضاف في 10 سبتمبر. صارت الإجابة المختصرة والجدول والنقاط البارزة تبدأ بـGLM-5.3-Flash وQwen3.8-Flash وGPT-5.6 Luna وDeepSeek-V4.1-Flash وGemini 3.5 Flash-Lite، مع التنبيه إلى أن سعر GLM-5.3-Flash عرض ترويجي. وأبقينا أسعار V4-Flash في يوليو وأغسطس سجلًّا تاريخيًا، وحذفنا ادعاء سرعة GPT-5 Mini غير المسند.
  • — قُيدت نتيجة أقل سعر بالنماذج المستضافة التي يتتبعها benchr في هذه اللقطة المؤرخة، وأُضيف فحص السعر الحي قبل اعتماد الميزانية.
  • — نُشرت النسخة الأولى. تم التحقق من كل الأسعار وفق وثائق API الرسمية للمزودين.

المصادر