
Pay-per-request — платите только за то, что используете
Стоимость запроса зависит от выбранной нейросети и её сложности; пополняйте баланс и работайте с любыми моделями — списание автоматическое.
Актуальные тарифы
Цены указаны в рублях. Тарифы обновляются автоматически при изменении у провайдеров моделей.
| Модель AI | Context (запрос) за 1K токенов ₽ | Output (ответ AI) за 1K токенов ₽ |
|---|---|---|
| GPT-5.5 Pro | 6 | 36 |
| GPT-5.6 Sol | 1 | 6 |
| GPT-5.5 | 1 | 6 |
| GPT-5.6 Terra | 0,5 | 3 |
| GPT-5.4 | 0,5 | 3 |
| GPT-5.6 Luna | 0,2 | 1,2 |
| GPT-5.4 Mini | 0,15 | 0,9 |
| GPT-5.4 Nano | бесплатно | бесплатно |
| Claude Fable 5 | 2 | 10 |
| Claude Opus 4.8 | 1 | 5 |
| Claude Opus 4.7 | 1 | 5 |
| Claude Sonnet 5 | 0,4 | 2 |
| Claude Sonnet 4.6 | 0,6 | 3 |
| Claude Haiku 4.5 | 0,2 | 1 |
| Gemini 3.1 Pro | 0,4 | 2,4 |
| Gemini 3.5 Flash | 0,3 | 1,8 |
| Gemini 3 Flash | 0,1 | 0,6 |
| Gemini 3.1 Flash Lite | 0,05 | 0,3 |
| Grok 4.5 | 0,4 | 1,2 |
| Grok 4.3 | 0,25 | 0,5 |
| Grok 4.20 | 0,25 | 0,5 |
| DeepSeek V4 Pro | 0,1 | 0,19 |
| DeepSeek V4 Flash | 0,02 | 0,04 |
| DeepSeek V3.2 | бесплатно | бесплатно |
| Qwen3.7 Max | 0,25 | 0,75 |
| GLM-5.2 | 0,19 | 0,59 |
| GLM-5.1 | 0,2 | 0,62 |
| Kimi K3 | 0,6 | 3 |
| Kimi K2.6 | 0,14 | 0,69 |
| MiMo-V2.5-Pro | 0,09 | 0,17 |
| MiMo-V2.5 | 0,03 | 0,06 |
| Embedding 3 Large | 0,03 | — |
| Веб-поиск | 1,4 за запрос | — |
GPT-5.4 Nano и DeepSeek V3.2 доступны бесплатно, без ограничений — с тарифом «0 / 0» в таблице выше.
Генерация изображений
| Модель AI | Стоимость ₽ |
|---|---|
| Krea 2 Medium | 7 за генерацию |
| GPT-Image 2 | 11 за генерацию |
| Flux 2 pro | 11 за генерацию |
| Nano Banana 2 (Gemini 3.1 Flash Image Preview) | 14 за генерацию |
Часто задаваемые вопросы
Как устроена тарификация и как платить меньше
Что такое токены и зачем они нужны?
Токен — это часть текста, которую нейросеть обрабатывает за один шаг. Это более точная единица для AI, чем символы или слова. 1000 токенов примерно равны 750 русским словам (размер небольшой статьи).
Как контекст диалога влияет на стоимость?
Многие современные нейросети (GPT-5.4, Claude Sonnet 4.6, DeepSeek V3.2 и другие) работают с контекстом: при диалоге в одном чате ИИ «помнит» всю предыдущую переписку. При каждом новом запросе в обработку отправляется весь накопленный контекст (ваши прошлые сообщения + ответы ИИ), поэтому в длинном диалоге стоимость обработки запроса (Input) постепенно растёт.
Как экономить на коротких задачах?
Для разовых, несвязанных вопросов создавайте новый чат — так в обработку не попадает лишний контекст, и запрос обходится дешевле.
Как работать с длинными и сложными диалогами?
Для разработки проекта или глубокого анализа используйте один чат, чтобы сохранить контекст. При этом учитывайте, что стоимость ввода будет постепенно расти по мере роста переписки.
Заявка успешно отправлена
Мы свяжемся с вами в ближайшее время.