أفضل نموذج برمجة مجاني: DeepSeek ضد Qwen ضد Kimi

ثلاث عائلات مفتوحة الأوزان تستطيع تنزيلها أو تجربتها مجاناً، مع مقارنة نتائج البرمجة المنشورة وتكلفة التشغيل الفعلية.

بقلم فريق benchr التحريري · · سجل التغييرات · طابقنا الأرقام مع المصادر الرسمية في 30 مايو 2026، وأعدنا فحص الترتيب مقابل سجلّ benchr في 11 سبتمبر 2026

أفضل نموذج برمجة مجاني: DeepSeek ضد Qwen ضد Kimi: كتل أوزان مفتوحة ومسارات للنشر.
لوحة تحريرية من benchr أفضل نموذج برمجة مجاني مقارنة البنى مفتوحة الأوزان
نماذج مفتوحةيجمع تصميم أفضل نموذج برمجة مجاني: DeepSeek ضد Qwen ضد Kimi بين كتل أوزان مفتوحة ومسارات للنشر.

لنكن دقيقين في معنى "مجاني"، لأن الكلمة تحمل أكثر مما يبدو. لا نتحدث عن تجربة مجانية ولا عن طبقة سخية داخل منتج مدفوع. هذه نماذج مفتوحة الأوزان. الأوزان منشورة برخص مفتوحة على Hugging Face، لذلك تستطيع تنزيلها وتشغيلها على عتادك مقابل تكلفة الحوسبة فقط. وكل جهة توفر أيضاً دردشة مستضافة مجانية، فتستطيع استخدام النموذج مباشرة. هذا مختلف عن مساعد IDE مدفوع يغلف النموذج بأدوات ويفرض رسوماً شهرية. لذلك النوع من المقارنة، راجع مواجهة مساعدات البرمجة.

ثلاث عائلات تتصدر فئة نماذج البرمجة مفتوحة الأوزان الآن: DeepSeek من الصين، وQwen من Alibaba، وKimi من Moonshot AI. إليك ترتيبها حسب النتائج التي ينشرها المصنعون أنفسهم.

نماذج البرمجة مفتوحة الأوزان، سبتمبر 2026، وفق بطاقة النموذج والتقرير التقني لكل جهة. الأرقام يعلنها المزوّد نفسه، و"غير منشور" تعني أن الجهة لم تنشر ذلك الرقم
النموذجالمعاملات (الإجمالي / النشط)الرخصةالسياقSWE-bench Verified
DeepSeek-V4-Pro1.6T / 49BMIT1M80.6
Kimi K2.61T / 32BModified MIT256K80.2
DeepSeek-V4-Flash (أوزان فقط؛ توقفت واجهته المستضافة في 10 سبتمبر 2026)284B / 13BMIT1M79.0
Qwen3.6-27B27B كثيفApache 2.0262K77.2
Qwen3.6-35B-A3B35B / 3BApache 2.0262K73.4%
Qwen3-Coder-Next80B / 3BApache 2.0256K~71%
Kimi K32.8T / 104BKimi K3 License1Mغير منشور

DeepSeek-V4-Pro: متصدر النتائج

وفق أقوى رقم منشور رسمياً، يتصدّر DeepSeek-V4-Pro هذا الجدول الآن. تعلن DeepSeek في بطاقة النموذج أنه يسجّل 80.6 في SWE-bench Verified، وهو البنشمارك الذي يقيس حلّ مشكلات GitHub حقيقية، و87.9 في Terminal-Bench 2.1. النموذج من نوع Mixture-of-Experts بإجمالي 1.6T معامل، منها 49B نشطة لكل توكن، وأصدرته DeepSeek في أبريل 2026 برخصة MIT وبسعة سياق تبلغ مليون توكن. لم تطبع هذه الصفحة رقماً لـ V4 حين نُشرت في مايو؛ أما الآن فيحمل سجلّ benchr الرقم الذي نشرته DeepSeek، وعليه يقوم الترتيب هنا.

80.6 نتيجة DeepSeek-V4-Pro في SWE-bench Verified كما تعلنها DeepSeek، وهي أعلى رقم ينشره مزوّد بين النماذج مفتوحة الأوزان في سجلّ benchr

تغيّر الجانب المستضاف في 10 سبتمبر 2026: أوقفت DeepSeek نموذج V4-Flash في واجهتها البرمجية واستبدلت به DeepSeek-V4.1-Flash، ويُحوَّل المعرّف القديم deepseek-v4-flash مؤقتاً إلى النموذج الجديد. بقيت أوزان V4-Flash المرخّصة MIT متاحة للتنزيل، لذلك ما زالت نتيجته 79.0 في SWE-bench Verified تصف نموذجاً تستطيع استضافته بنفسك. تقول DeepSeek إن V4.1-Flash يتفوق على V4-Pro في بنشماركاتها، لكن benchr لم يسجّل له رقماً ولا رخصة بعد، فبقي خارج الجدول. أما V4-Pro فمستمر في الواجهة: أعلنت DeepSeek لفترة قصيرة أنها ستحوّله إلى V4.1-Flash ابتداءً من 14 سبتمبر، ثم تراجعت وأكدت استمراره بطريقة الفوترة نفسها.

ما زالت دردشة DeepSeek المجانية على chat.deepseek.com أسهل طريقة لتجربة العائلة قبل تنزيل أي شيء، لكن benchr لم يُعِد فحص النموذج الذي تخدمه بعد تغيير 10 سبتمبر. موقع DeepSeek أمام بقية النماذج القابلة للتنزيل مغطى في طبقة النماذج مفتوحة الأوزان الآن.

Kimi K2.6، ولماذا لا يدخل K3 الترتيب

يأتي Kimi K2.6 من Moonshot AI بعده بفارق 0.4 نقطة، عند 80.2 في SWE-bench Verified وفق بطاقة Moonshot، إضافة إلى 58.6 في SWE-bench Pro الأصعب و76.7 في النسخة متعددة اللغات. وفي SWE-bench Pro يتقدم على DeepSeek-V4-Pro الذي تعلن له DeepSeek 55.4، فالصدارة بين الاثنين تتبدّل بحسب البنشمارك الذي تعتمده.

داخلياً هو نموذج Mixture-of-Experts بتريليون معامل، منها 32 ملياراً نشطة لكل توكن، وصدر في أواخر أبريل 2026 تحت رخصة Modified MIT. تركيز Moonshot واضح على العمل الوكيلي طويل الأفق: يستطيع K2.6 تنسيق ما يصل إلى 300 وكيل فرعي عبر ما يصل إلى 4,000 خطوة في تشغيل واحد، مع جلسات ذاتية موثقة تصل إلى 12 ساعة.

المشكلة هي الحجم. نموذج بتريليون معامل ليس شيئاً تشغله على لابتوب، لذلك تعني "مجاني" لمعظم الناس هنا الدردشة المستضافة أو GPUs مستأجرة، لا التشغيل المحلي. مراجعة Kimi K2.6 الكاملة تتعمق أكثر في Agent Swarm وتكلفة الاستضافة الذاتية.

أطلقت Moonshot نموذجها الأحدث Kimi K3 في 16 يوليو 2026، بسعة سياق 1M توكن وسعر $3 / $15 لكل مليون توكن إدخال/إخراج لـ Kimi K3 في الواجهة البرمجية. تنشر Moonshot له 88.3 في Terminal-Bench 2.1، أعلى قليلاً من 87.9 لـ DeepSeek-V4-Pro، و67.5 في DeepSWE و93.5 في GPQA Diamond، لكنها لا تنشر رقماً في SWE-bench Verified، فلا يوجد رقم مماثل يضعه أمام K2.6 أو DeepSeek في هذا الجدول. وتصدر أوزانه برخصة Kimi K3 License لا برخصة Modified MIT التي تغطي K2.6، فاقرأ شروطها قبل أن تبني عليه.

Qwen: النموذج الذي تستطيع تشغيله بنفسك

حجة Qwen هي الكفاءة، وهذا سبب أنه قد يكون الجواب الصحيح رغم أنه لا يتصدر الجدول. يقدّم جيل Qwen3.6 الصادر في أبريل 2026 خيارين: Qwen3.6-27B الكثيف يسجّل 77.2 في SWE-bench Verified، وQwen3.6-35B-A3B يسجّل 73.4% بينما يفعّل 3B معامل فقط لكل توكن من إجمالي 35B. وتطرح Alibaba أيضاً نموذج برمجة متخصصاً، Qwen3-Coder-Next، وهو نموذج 80B بالبصمة النشطة نفسها 3B ويصل إلى أكثر قليلاً من 70% حسب الإطار. الثلاثة برخصة Apache 2.0، وهي أكثر رخصة تساهلاً هنا، بلا قيود على الاستخدام التجاري. توجد على Hugging Face نسخة أحدث هي Qwen3.8-27B، لكنها لم تدخل سجلّ benchr بعد، لذلك لا ترد في الترتيب.

صِغر البصمة هو العنوان الأهم. نموذج كثيف بـ27B أو نموذج MoE بـ3B نشطة يعمل على عتاد لا يستطيع نموذج بتريليون معامل الاقتراب منه، وهذا يضع نموذج برمجة قوياً في متناول GPU جيد واحد. إذا كان "مجاني" يجب أن يعني "مجاني على جهازي"، فعائلة Qwen هي نقطة البداية، ومقال النماذج اللغوية الصغيرة يشرح لماذا تنجح حيلة المعاملات النشطة.

إذن أيها تختار؟

اختر DeepSeek-V4-Pro إذا أردت أعلى رقم منشور من المزوّد في SWE-bench Verified بأوزان مفتوحة (80.6، MIT) وتستطيع استضافته أو استخدام واجهة DeepSeek أو دردشتها. يقترب Kimi K2.6 كثيراً عند 80.2 ويتقدم في SWE-bench Pro، لذلك قد يحسم Agent Swarm أو اختبارك على مستودعك الخيار بينهما. تعامل مع Kimi K3 كمرشح للتجربة لا كخيار مرتّب إلى أن تنشر Moonshot رقماً في SWE-bench Verified. واختر Qwen إذا احتجت تشغيل النموذج بنفسك على عتاد معقول: Qwen3.6-27B للنتيجة الأعلى، وQwen3.6-35B-A3B حين تريد 3B معامل نشطة فقط لكل توكن. وإن استضفت DeepSeek-V4-Flash (79.0) بنفسك فتذكّر أن واجهته المستضافة توقفت، وأن DeepSeek تخدم الآن V4.1-Flash في فئة Flash.

تنبيه واقعي قبل الالتزام: النموذجان المتصدران من فئة تريليون معامل، لذلك "مجاني للتنزيل" و"مجاني للتشغيل" ليستا الجملة نفسها. إذا كان هدفك الاستضافة الذاتية، فاقرأ أولاً تشغيل النماذج على جهازك، ثم اضبط طموحك حسب قدرات GPUs لديك.

احسب تكلفتك ←·قارن هذا النموذج ←·اعثر على نموذجك ←

أسئلة شائعة

ما أفضل نموذج برمجة مجاني الآن؟

وفق أقوى نتيجة منشورة رسمياً، يتصدّر DeepSeek-V4-Pro عند 80.6 في SWE-bench Verified كما تعلنها DeepSeek، بأوزان مفتوحة برخصة MIT. يليه Kimi K2.6 من Moonshot AI بفارق 0.4 عند 80.2 تحت رخصة Modified MIT، ويتقدم على V4-Pro في SWE-bench Pro. أما Kimi K3 الأحدث فلم تنشر له Moonshot رقماً في SWE-bench Verified، لذلك لا يدخل الترتيب. وإذا لم تستطع تشغيل نموذج بتريليون معامل، فخياراك للاستضافة الذاتية هما Qwen3.6-27B عند 77.2 وQwen3.6-35B-A3B عند 73.4% مع 3B نشطة.

هل هذه النماذج مجانية فعلاً؟

نعم، بمعنيين. أوزانها مرخصة ترخيصاً مفتوحاً وقابلة للتنزيل من Hugging Face، لذلك تستطيع استضافتها ذاتياً مقابل تكلفة العتاد أو GPUs المستأجرة. وكل جهة توفر دردشة مستضافة مجانية، فتستطيع استخدام النموذج مباشرة من دون دفع. هذا مختلف عن مساعدات IDE المدفوعة التي تضيف اشتراكاً فوق النموذج.

هل أستطيع تشغيلها على اللابتوب؟

غالباً لا بالنسبة للنماذج الكبيرة. Kimi K2.6 نموذج بتريليون معامل وDeepSeek V4-Pro بـ1.6 تريليون؛ هذه تحتاج خوادم متعددة GPU جدية. نماذج Qwen، مع 3 مليارات معامل نشطة فقط، أكثر قابلية بكثير على GPU قوي واحد. للواقع المحلي، راجع دليلنا لتشغيل النماذج على جهازك.

هل لـ DeepSeek V4 نتيجة في SWE-bench Verified؟

نعم. تعلن DeepSeek في بطاقات نماذجها 80.6 في SWE-bench Verified لـ V4-Pro و79.0 لـ V4-Flash. قالت نسخة سابقة من هذه الصفحة إن DeepSeek لم تنشر رقماً لـ V4؛ يحمل سجلّ benchr الرقمين الآن، وصحّحنا الصفحة في 11 سبتمبر 2026. وأوقفت DeepSeek واجهة V4-Flash المستضافة في 10 سبتمبر 2026 واستبدلت بها V4.1-Flash، ولا يحمل سجلّ benchr رقماً لها بعد، بينما بقيت أوزان V4-Flash متاحة للتنزيل.

كيف يختلف هذا عن مساعدات البرمجة المدفوعة؟

هذه الصفحة عن النماذج مفتوحة الأوزان نفسها، التي تستطيع تنزيلها أو الدردشة معها مجاناً. مساعدات البرمجة المدفوعة منتجات IDE تغلف نموذجاً بأدوات وتفرض رسوماً عليه. إذا أردت أفضل تجربة مدفوعة داخل المحرر بدلاً من ذلك، فراجع مواجهة مساعدات البرمجة.

سجل التغييرات

  • 11 سبتمبر 2026 — أعدنا الترتيب وفق SWE-bench Verified كما ينشره المزوّدون: يتصدّر DeepSeek-V4-Pro (80.6 بحسب DeepSeek) الآن على Kimi K2.6 (80.2)، وصحّحنا القول السابق إن DeepSeek لم تنشر رقماً لـ V4. أضفنا إلى الجدول DeepSeek-V4-Flash (79.0) وQwen3.6-27B (77.2)، وسطراً وقسماً لـ Kimi K3 (بلا رقم منشور في SWE-bench Verified)، وملاحظة بأن نسخة Qwen3.8-27B لم تدخل سجلّ benchr بعد، وخبر إيقاف DeepSeek لواجهة V4-Flash المستضافة في 10 سبتمبر لصالح V4.1-Flash.
  • 30 مايو 2026 — نُشرت النسخة الأولى. تم التحقق من المعاملات والرخص وسعات السياق ونتائج SWE-bench Verified وفق بطاقات نماذج Moonshot AI وDeepSeek وQwen وتقاريرها التقنية؛ لم يُطبع رقم لـ DeepSeek V4 لأن الجهة لم تنشره.

المراجع

  1. Moonshot AI, "Kimi K2.6," kimi.com/blog، اطُّلع عليه في مايو 2026.
  2. Moonshot AI, "Kimi-K2.6 model card," huggingface.co/moonshotai، اطُّلع عليه في مايو 2026.
  3. DeepSeek, "DeepSeek V4 Preview Release," api-docs.deepseek.com، اطُّلع عليه في مايو 2026.
  4. Qwen, "Qwen3.6-35B-A3B model card," huggingface.co/Qwen، اطُّلع عليه في مايو 2026.
  5. Qwen, "Qwen3-Coder-Next model card," huggingface.co/Qwen، اطُّلع عليه في مايو 2026.
  6. DeepSeek, "DeepSeek-V4-Pro model card," huggingface.co/deepseek-ai/DeepSeek-V4-Pro، مصدر الأرقام في سجلّ نماذج benchr.
  7. DeepSeek, "DeepSeek-V4-Flash model card," huggingface.co/deepseek-ai/DeepSeek-V4-Flash، مصدر الأرقام في سجلّ نماذج benchr.
  8. Qwen, "Qwen3.6-27B model card," huggingface.co/Qwen/Qwen3.6-27B، مصدر الأرقام في سجلّ نماذج benchr.
  9. Moonshot AI, "Kimi-K3 model card," huggingface.co/moonshotai/Kimi-K3، مصدر الأرقام في سجلّ نماذج benchr.