Ücretsiz APILLMAPI anahtarıResmi
Cerebras Inference
Wafer ölçekli çipler üzerinde açık modelleri aşırı token/saniye hızıyla sunan ücretsiz katman
Cerebras Inference, açık ağırlıklı modelleri (gpt-oss-120b, GLM, Llama, Qwen) wafer ölçekli donanımı üzerinde çalıştırarak mevcut en yüksek verim oranlarından bazılarını sağlar. cloud.cerebras.ai üzerinden kredi kartı gerektirmeden ücretsiz katmana erişilebilir; OpenAI ile uyumlu bir sohbet uç noktası sunar.
Ücretsiz katman
Ücretsiz katman, kredi kartı gerekmez. Günlük token kotası sınırlıdır; ücretli katmanlar limitleri artırır.İstek limitleri
Ücretsiz katman (Haziran 2026 itibarıyla doğrulanmış): model başına 5 RPM, dakikada 30.000 token, günde 1.000.000 token. Ücretsiz model menüsü gpt-oss-120b ve zai-glm-4.7 modellerini içermektedir. Bazı ücretsiz modellerde bağlam penceresi kısıtlaması uygulanabilir. Güncel değerler için hesabınızdaki Limits sayfasını kontrol edin.Kimlik doğrulama
API anahtarıTemel URL
https://api.cerebras.ai/v1Neler geliştirebilirsiniz
- Ham üretim hızının belirleyici etken olduğu gecikmeye duyarlı demolar
- 1 milyon token/gün bütçesine sığan sık aralıklı otomasyon adımları
- Açık modelleri verim açısından karşılaştırmalı olarak kıyaslama
- Hızlı ve uzun çıktıların avantaj sağladığı tek adımlı yoğun çıkarım görevleri
Önemli uç noktalar
- POST
/chat/completionsOpenAI uyumlu sohbet tamamlama (akış desteklenir) - POST
/completionsMetin tamamlama - GET
/modelsHesabınızdaki kullanılabilir modelleri listeleme
Üyeler
Üyeler çalıştırılabilir tarifi alır
Örnek isteği kopyalamak, örnek bir yanıt görmek ve püf noktalarını okumak için ücretsiz giriş yapın.
Etiketler
llminferenceopenai-compatiblehigh-throughputopen-weights