Назад к провайдерам



Cerebras
РаботаетТелеметрия обновлена 22 мин назад
Ultra-fast inference provider powered by the Cerebras Wafer Scale Engine, known for extremely high tokens/sec throughput. Offers OpenAI-compatible API with free tier access.
Этот материал пока доступен на английском языке.
Базовый URL API
Аутентификация
api-key
Доступность (24 ч)
100.0%
Доступность (7 дней)
100.0%
Поддерживаемые регионы
us-east-1
Задержка (TTFT)
Перцентили времени до первого токена
Данные о задержке отсутствуют
История доступности
Доступность за последние 7 дней
Доступность за 7 дней100.00% — Отлично
Доступность за 24 часа100.00% — Отлично
Текущий статус
Работает
Последняя проверка
22 мин назад
Поддерживаемые модели (3)
Модели, доступные у этого провайдера. Выберите модель, чтобы открыть подробности.
K2 Think
k2-think
- Цена (за 1 млн)
- Вход: $0.60
Выход: $0.60 - Лимиты запросов
- 30 RPM
60K TPM - Регионы
- us-east-1
Llama 4 Scout
llama-4-scout
- Цена (за 1 млн)
- Вход: $0.60
Выход: $0.60 - Лимиты запросов
- 30 RPM
60K TPM - Регионы
- us-east-1
Llama 3.3 70B Instruct
llama-3-3-70b
- Цена (за 1 млн)
- Вход: $0.60
Выход: $0.60 - Лимиты запросов
- 30 RPM
60K TPM - Регионы
- us-east-1