1

Claude Haiku 4.5

Claude · Быстрая и умная

~150 мс TTFT, стабильность на edge cases.

  • ~150 мс
  • Стабильность
2

Gemini 3 Flash

Gemini · Быстрый reasoning, 1M контекст

~100-200 мс TTFT, multimodal.

  • Multimodal
  • Скорость
3

GPT-5 Nano

ChatGPT · Самая быстрая и дешёвая GPT-5

Лёгкая модель OpenAI для массовых простых задач, $0.05/$0.40 за 1M токенов.

  • Низкая цена
4

GPT-6 Luna

ChatGPT · Быстрая GPT-6 · 1M · экономичная

Быстрая экономичная модель GPT-6 для чата и классификации, $0.10/$0.50 за 1M токенов.

  • Низкая цена
5

Gemini 2.5 Flash

Gemini · Быстрая с огромным контекстом

Стабильная классика среди flash-моделей.

  • Дешево

Частые вопросы

Какой TTFT у топ-моделей?

Haiku 4.5 ~150 мс, Gemini 3 Flash ~100-200 мс. Для GPT-5 Nano и GPT-6 Luna мы не публикуем замеры — проверьте на своих запросах.

Помогает ли streaming?

Да, для UX. Пользователь видит ответ по мере генерации — снижает воспринимаемое ожидание.

Как ускорить ответы?

1) Выбрать Mini/Flash/Haiku. 2) Streaming. 3) Уменьшить промпт. 4) RAG вместо длинного контекста.

Цены?

Все модели — копейки за миллион токенов на gptrf.ru.

Все модели — в одной подписке

От 990 ₽ в месяц, без VPN, в рублях, серверы в России. После регистрации — 2 пробные генерации изображений бесплатно.

Запустить быструю модель →