تبدو واجهة برمجة التطبيقات (API) الخاصة بـ Kimi K3 رخيصة على الورق، لكن الرسوم الخفية والتفاصيل التقنية المفقودة قد تجعلها أغلى بكثير مما توحي به الأرقام المعلنة.

ما يتجاهله الضجيج الإعلامي

تتباهى مواد الإطلاق الخاصة بـ Moonshot AI بنموذج يحتوي على 2.8 تريليون معلمة (parameter) بأنه "رخيص" و"مفتوح". كما يعد البيان الصحفي بتوفير أوزان (weights) قابلة للتنزيل قريبًا. لكن كلا الادعاءين لا يصمدان أمام الواقع.

  • الأوزان غير متاحة – حددت Moonshot موعدًا نهائيًا في 27 يوليو 2026 لإصدار نقطة فحص (checkpoint) عامة. وحتى ذلك الحين، يجب على المستخدمين استخدام واجهة برمجة التطبيقات المستضافة، لذا فإن وعد "المصدر المفتوح" لا يقدم شيئًا يمكن الاستفادة منه.
  • ليست كل المعلمات الـ 2.8 تريليون نشطة – يصف هذا الرقم السعة الإجمالية للهيكلية. يقوم تصميم Mixture-of-Experts في K3 بتوجيه كل رمز (token) عبر 16 من أصل 896 شبكة فرعية من الخبراء. لم تذكر Moonshot عدد المعلمات التي تعمل لكل طلب، مما يجعل تقدير الذاكرة والحوسبة أمرًا مستحيلاً.

التسعير الذي يبدو جيدًا – حتى تبدأ في عدّ الكلمات

الأسعار المعلنة:

  • المدخلات عند وجود نسخة مخبأة (Cache-hit): 0.30 دولار لكل 1 مليون رمز (token)
  • المدخلات غير المخزنة مؤقتًا: 3.00 دولار لكل 1 مليون رمز (token)
  • المخرجات: 15.00 دولار لكل 1 مليون رمز (token)

تبدو هذه الأسعار متواضعة، لكنها تتجاهل حجم الرموز.

قاس اختبار حديث مخرجات K3 بـ 130 مليون رمز، وهو أكثر من ضعف الـ 63 مليون التي تنتجها النماذج الرائدة الأخرى في المهام نفسها. تؤدي إسهاب النموذج (verbosity) إلى تضخم فاتورة المخرجات مباشرة؛ فضعف عدد الكلمات يعني ضعف التكلفة. بالنسبة لتوليد الكود، أو المقالات، أو وكلاء الدردشة، يمكن أن يهيمن سعر 15 دولارًا لكل مليون رمز على إجمالي الإنفاق.

ماذا يعني هذا لمختلف المستخدمين

المطورون والباحثون

إذا كنت تختبر K3 للمساعدة في البرمجة أو الأبحاث القائمة على البيانات، فضع حدودًا صارمة لمخرجات الرموز. سيظهر اختبار A/B الذي يضع K3 في مواجهة نموذج أساسي بحدود مخرجات متطابقة ما إذا كان استخدام الرموز المرتفع نابعًا من النموذج نفسه أم من تصميم المطالبة (prompt design).

الفرق المهتمة بالميزانية

ينطبق خصم الـ cache-hit فقط عندما يتكرر نفس المدخل. قم بصياغة بادئات مطالبات (prompt prefixes) مستقرة تنتج سلاسل مدخلات متطابقة لدفع المزيد من الطلبات إلى فئة الـ 0.30 دولار؛ يعمل هذا فقط مع أعباء العمل المتكررة للغاية (مثل الاستعلامات القائمة على القوالب). أما معظم المدخلات المتنوعة فستعود إلى سعر الـ 3.00 دولار للمدخلات غير المخزنة مؤقتًا.

الشركات التي تفكر في الاستضافة الذاتية

الانتظار حتى إصدار نقطة الفحص (checkpoint) هو قرار حكيم. الاستضافة الذاتية للنموذج تلغي رسوم الرموز لكل وحدة، لكنها تضيف تكاليف ترخيص وبنية تحتية غير معلنة. وحتى تصبح الأوزان عامة، تظل واجهة برمجة التطبيقات المستضافة هي الخيار الواقعي الوحيد.

بيئات الإنتاج

لا تنتقل لمجرد أن السعر المعلن يبدو أقل من المنافسين. قم بإجراء تجربة رائدة تقيس التكلفة لكل مهمة مكتملة، بما في ذلك التكاليف الإضافية الخفية الناتجة عن الاستجابات الطويلة، بدلاً من التكلفة لكل رمز. عندها فقط يمكنك تحديد ما إذا كان K3 يوفر المال حقًا.

ما يجب مراقبته لاحقًا

  • إصدار نقطة الفحص في 27 يوليو 2026 – من المقرر إصدار الأوزان في ذلك التاريخ.
  • الإفصاح عن المعلمات النشطة – معرفة عدد المعلمات النشطة من أصل 2.8 تريليون لكل رمز ستسمح للمستخدمين بتحديد حجم الأجهزة بدقة.

الخلاصة

سعر مخرجات K3 المعلن وهو 15 دولارًا لكل مليون رمز لا يروي إلا نصف القصة. فميله لتوليد ضعف عدد الرموز التي ينتجها أقرانه يمكن أن يمحو أي توفير معلن، خاصة في المهام التي تتطلب إجابات طويلة. وحتى يتم إصدار الأوزان وتتضح أعداد المعلمات النشطة، تعامل مع K3 كخدمة متميزة (premium) وقد تكون مسرفة في الكلام (verbose) بدلاً من كونها بديلاً رخيصًا. قم بإجراء اختبارات لميزانية الرموز، وافرض حدودًا للمخرجات، ولا تنتقل إليه إلا بعد قياس التكلفة الحقيقية لكل مهمة منجزة.