Volver a proveedores




Fireworks
OperativoTelemetría actualizada hace 22 min
High-speed AI inference platform optimized for low-latency serving of open-source models, offering OpenAI-compatible API endpoints with custom model deployment and fine-tuning capabilities.
Este contenido está disponible actualmente en inglés.
URL base de la API
Autenticación
api-key
Disponibilidad (24 h)
100.0%
Disponibilidad (7 días)
100.0%
Regiones disponibles
us-east-1us-west-2
Latencia (TTFT)
Percentiles de tiempo hasta el primer token
No hay datos de latencia disponibles
Historial de disponibilidad
Disponibilidad durante los últimos 7 días
Disponibilidad de 7 días100.00% — Excelente
Disponibilidad de 24 horas100.00% — Excelente
Estado actual
Operativo
Última comprobación
hace 22 min
Modelos disponibles (4)
Modelos disponibles a través de este proveedor. Selecciona un modelo para ver los detalles.
DeepSeek V4
deepseek-v4
- Precio (por 1 M)
- Entrada: $0.20
Salida: $0.80 - Límites de uso
- 600 RPM
1.0M TPM - Regiones
- us-east-1us-west-2
Llama 4 Maverick
llama-4-maverick
- Precio (por 1 M)
- Entrada: $0.22
Salida: $0.88 - Límites de uso
- 600 RPM
1.0M TPM - Regiones
- us-east-1us-west-2
Qwen3 32B
qwen3-32b
- Precio (por 1 M)
- Entrada: $0.20
Salida: $0.20 - Límites de uso
- 600 RPM
1.0M TPM - Regiones
- us-east-1us-west-2
Llama 3.3 70B Instruct
llama-3-3-70b
- Precio (por 1 M)
- Entrada: $0.90
Salida: $0.90 - Límites de uso
- 600 RPM
1.0M TPM - Regiones
- us-east-1us-west-2