Статус сервиса

Считается по реальным запросам за последние 24 часа, обновляется раз в минуту. Ошибки на стороне клиента (неверные параметры) не учитываются.

99,51%

успешных запросов за последние 24 часа

Скорость по моделям (24 часа)

Модель Первый токен, p50 Ответ целиком, p50 Ответ целиком, p95
z-ai/glm-5.3-flash 3,67 с 9,93 с 65,72 с
~deepseek/deepseek-v4-flash-latest 2,94 с 4,72 с 27,63 с
deepseek/deepseek-v4-flash 4,39 с 9,96 с 31,89 с
qwen/qwen3.8-max 2,03 с 11,00 с 73,37 с
z-ai/glm-4.7 0,94 с 15,91 с 104,24 с
qwen/qwen3.8-27b 9,75 с 137,03 с 462,31 с
qwen/qwen3-embedding-8b 3,40 с 9,31 с
deepseek/deepseek-v4-pro-0813 3,18 с 46,10 с 76,48 с
deepseek/deepseek-v4-pro 5,34 с 79,90 с 144,86 с
openai/gpt-5.6-luna-pro 27,53 с 32,29 с

Обновлено: 28.08.2026 22:30:32 (MSK). Проблемы? Напишите: support@neurly.ru