Volver a proveedores




Groq
OperativoTelemetría actualizada hace 32 min
Ultra-fast LPU (Language Processing Unit) inference provider offering extremely low latency. Supports streaming, function calling, and audio transcription via Whisper models. Per-model rate limits apply.
Este contenido está disponible actualmente en inglés.
URL base de la API
Autenticación
bearer
Disponibilidad (24 h)
100.0%
Disponibilidad (7 días)
100.0%
Regiones disponibles
us-east-1eu-west-1
Latencia (TTFT)
Percentiles de tiempo hasta el primer token
No hay datos de latencia disponibles
Historial de disponibilidad
Disponibilidad durante los últimos 7 días
Disponibilidad de 7 días100.00% — Excelente
Disponibilidad de 24 horas100.00% — Excelente
Estado actual
Operativo
Última comprobación
hace 32 min
Modelos disponibles (4)
Modelos disponibles a través de este proveedor. Selecciona un modelo para ver los detalles.
Llama 4 Scout
llama-4-scout
- Precio (por 1 M)
- Entrada: $0.11
Salida: $0.34 - Límites de uso
- 30 RPM
100K TPM - Regiones
- us-east-1eu-west-1
Qwen3 32B
qwen3-32b
- Precio (por 1 M)
- Entrada: $0.29
Salida: $0.39 - Límites de uso
- 30 RPM
100K TPM - Regiones
- us-east-1
DeepSeek R1
deepseek-r1
- Precio (por 1 M)
- Entrada: $0.75
Salida: $0.99 - Límites de uso
- 30 RPM
100K TPM - Regiones
- us-east-1
Llama 3.3 70B Instruct
llama-3-3-70b
- Precio (por 1 M)
- Entrada: $0.59
Salida: $0.79 - Límites de uso
- 30 RPM
100K TPM - Regiones
- us-east-1eu-west-1