Volver a proveedores



Cerebras
OperativoTelemetría actualizada hace 33 min
Ultra-fast inference provider powered by the Cerebras Wafer Scale Engine, known for extremely high tokens/sec throughput. Offers OpenAI-compatible API with free tier access.
Este contenido está disponible actualmente en inglés.
URL base de la API
Autenticación
api-key
Disponibilidad (24 h)
100.0%
Disponibilidad (7 días)
100.0%
Regiones disponibles
us-east-1
Latencia (TTFT)
Percentiles de tiempo hasta el primer token
No hay datos de latencia disponibles
Historial de disponibilidad
Disponibilidad durante los últimos 7 días
Disponibilidad de 7 días100.00% — Excelente
Disponibilidad de 24 horas100.00% — Excelente
Estado actual
Operativo
Última comprobación
hace 33 min
Modelos disponibles (3)
Modelos disponibles a través de este proveedor. Selecciona un modelo para ver los detalles.
K2 Think
k2-think
- Precio (por 1 M)
- Entrada: $0.60
Salida: $0.60 - Límites de uso
- 30 RPM
60K TPM - Regiones
- us-east-1
Llama 4 Scout
llama-4-scout
- Precio (por 1 M)
- Entrada: $0.60
Salida: $0.60 - Límites de uso
- 30 RPM
60K TPM - Regiones
- us-east-1
Llama 3.3 70B Instruct
llama-3-3-70b
- Precio (por 1 M)
- Entrada: $0.60
Salida: $0.60 - Límites de uso
- 30 RPM
60K TPM - Regiones
- us-east-1