Volver a proveedores






SiliconFlow
OperativoTelemetría actualizada hace 22 min
High-performance AI inference platform offering ultra-low latency and cost-effective access to open-source models. Supports models with up to 1M token context windows and OpenAI-compatible API endpoints.
Este contenido está disponible actualmente en inglés.
URL base de la API
Autenticación
bearer
Disponibilidad (24 h)
100.0%
Disponibilidad (7 días)
100.0%
Regiones disponibles
ap-east-1us-west-2global
Latencia (TTFT)
Percentiles de tiempo hasta el primer token
No hay datos de latencia disponibles
Historial de disponibilidad
Disponibilidad durante los últimos 7 días
Disponibilidad de 7 días100.00% — Excelente
Disponibilidad de 24 horas100.00% — Excelente
Estado actual
Operativo
Última comprobación
hace 22 min
Modelos disponibles (6)
Modelos disponibles a través de este proveedor. Selecciona un modelo para ver los detalles.
MiniMax M3
minimax-m3
- Precio (por 1 M)
- Entrada: $0.60
Salida: $2.40 - Límites de uso
- 300 RPM
1.0M TPM - Regiones
- ap-east-1us-west-2global
Hy3 Preview
hy3-preview
- Precio (por 1 M)
- Entrada: $0.14
Salida: $0.28 - Límites de uso
- 300 RPM
500K TPM - Regiones
- ap-east-1global
DeepSeek V4
deepseek-v4
- Precio (por 1 M)
- Entrada: $0.14
Salida: $0.28 - Límites de uso
- 600 RPM
1.0M TPM - Regiones
- ap-east-1global
Qwen3 32B
qwen3-32b
- Precio (por 1 M)
- Entrada: $0.16
Salida: $0.16 - Límites de uso
- 600 RPM
1.0M TPM - Regiones
- ap-east-1global
DeepSeek R1
deepseek-r1
- Precio (por 1 M)
- Entrada: $0.55
Salida: $2.19 - Límites de uso
- 300 RPM
500K TPM - Regiones
- ap-east-1global
Llama 3.3 70B Instruct
llama-3-3-70b
- Precio (por 1 M)
- Entrada: $0.35
Salida: $0.35 - Límites de uso
- 600 RPM
1.0M TPM - Regiones
- ap-east-1global