كل واجهات API المجانية
واجهة API مجانيةLLMمفتاح APIرسمي

Cerebras Inference

رقائق Wafer-Scale تخدم النماذج المفتوحة بمعدلات رمز استثنائية مع طبقة مجانية

تشغّل Cerebras Inference النماذج ذات الأوزان المفتوحة (gpt-oss-120b و GLM و Llama و Qwen) على أجهزتها المبنية على Wafer-Scale، مما يتيح بعضاً من أعلى معدلات الإنتاجية المتاحة. تتوفر طبقة مجانية دون الحاجة إلى بطاقة ائتمان عبر cloud.cerebras.ai، وتعرض نقطة نهاية دردشة متوافقة مع OpenAI.

الطبقة المجانية

طبقة مجانية دون الحاجة إلى بطاقة ائتمان. حصة يومية محدودة من الرموز؛ الطبقات المدفوعة ترفع الحدود.

حدود المعدّل

الطبقة المجانية (تم التحقق يونيو 2026): 5 RPM، 30,000 رمز/دقيقة، 1,000,000 رمز/يوم لكل نموذج. تضمّنت قائمة النماذج المجانية gpt-oss-120b و zai-glm-4.7. قد يُطبَّق حدٌّ مخفَّض لسياق بعض النماذج المجانية. راجع صفحة Limits في حسابك للقيم الحالية.

المصادقة

مفتاح API

عنوان URL الأساسي

https://api.cerebras.ai/v1

ما يمكنك بناؤه بها

  • العروض التوضيحية الحساسة للكمون حيث يكون معدل التوليد السريع هو عامل الإبهار
  • خطوات الأتمتة المتقطعة التي تنسجم ضمن ميزانية 1M رمز/يوم
  • قياس أداء النماذج المفتوحة مقارنةً ببعضها من حيث الإنتاجية
  • المهام أحادية الطلب الثقيلة التفكير حيث تساعد المخرجات الطويلة السريعة

نقاط النهاية الرئيسية

  • POST/chat/completionsإتمام الدردشة المتوافق مع OpenAI (يدعم البث)
  • POST/completionsإتمام النص
  • GET/modelsسرد النماذج المتاحة لحسابك
الأعضاء

يحصل الأعضاء على الوصفة القابلة للتشغيل

سجّل الدخول مجانًا لنسخ مثال الطلب، ومعاينة استجابة نموذجية، وقراءة التنبيهات.

الوسوم

llminferenceopenai-compatiblehigh-throughputopen-weights