Пополнение баланса
- Открытые модели на wafer-scale железе с рекордной скоростью вывода
- Оплата за токены по факту использования
- OpenAI-совместимый API и официальные SDK
Главная / API и токены / Cerebras
Cerebras
Состав тарифов по данным вендора; цены продавцов появятся с открытием площадки.
Cerebras Inference запускает открытые модели на wafer-scale чипах и выдаёт один из самых высоких показателей скорости генерации токенов на рынке. Доступны Llama, Qwen, GPT-OSS и другие модели через OpenAI-совместимый API с SDK для Python и JS. Актуально для агентных цепочек и рассуждающих моделей, где длинный вывод иначе съедает секунды ожидания.