Zurück zu den Anbietern



Cerebras
BetriebsbereitTelemetrie aktualisiert: vor 20 Min.
Ultra-fast inference provider powered by the Cerebras Wafer Scale Engine, known for extremely high tokens/sec throughput. Offers OpenAI-compatible API with free tier access.
Dieser Inhalt ist derzeit auf Englisch verfügbar.
API-Basis-URL
Authentifizierung
api-key
Verfügbarkeit (24 Std.)
100.0%
Verfügbarkeit (7 Tage)
100.0%
Unterstützte Regionen
us-east-1
Latenz (TTFT)
Perzentile der Zeit bis zum ersten Token
Keine Latenzdaten verfügbar
Verfügbarkeitsverlauf
Verfügbarkeit in den letzten 7 Tagen
Verfügbarkeit über 7 Tage100.00% — Ausgezeichnet
Verfügbarkeit über 24 Stunden100.00% — Ausgezeichnet
Aktueller Status
Betriebsbereit
Zuletzt geprüft
vor 20 Min.
Unterstützte Modelle (3)
Modelle, die über diesen Anbieter verfügbar sind. Wählen Sie ein Modell aus, um Details anzuzeigen.
K2 Think
k2-think
- Preis (pro 1 Mio.)
- Eingabe: $0.60
Ausgabe: $0.60 - Nutzungslimits
- 30 RPM
60K TPM - Regionen
- us-east-1
Llama 4 Scout
llama-4-scout
- Preis (pro 1 Mio.)
- Eingabe: $0.60
Ausgabe: $0.60 - Nutzungslimits
- 30 RPM
60K TPM - Regionen
- us-east-1
Llama 3.3 70B Instruct
llama-3-3-70b
- Preis (pro 1 Mio.)
- Eingabe: $0.60
Ausgabe: $0.60 - Nutzungslimits
- 30 RPM
60K TPM - Regionen
- us-east-1