К содержанию

Токены списываются за работу модели

Учитываются запрос, контекст диалога, ответ и действия агента. Затем применяется коэффициент выбранной модели.

Под каждым ответом показываются фактическая обработка и списание с лимита.

Пример одного запроса

Запрос и контекст2 000
Ответ модели400
Кэшированный контекст2 000 → 500
Действия агента2 × 100 = 200
Поиск и источники500 + 200

Кэшированный контекст учитывается только на 25%.

3 800
Коэффициент модели×1,5
Списано с лимита 5 700 токенов

Пример. Реальные цифры зависят от запроса и модели.

Кэш дешевле

Повторно прочитанный контекст считается на 25%.

Коэффициент модели

Сейчас ×1,5, ×1,75 или ×2. Он указан в окне выбора модели.

Минимум за запрос

Если модель начала работу, спишется не менее 400 токенов.

Новый чат дешевле

Контекст отправляется модели заново каждый ход. Когда переписка стала длинной, новый чат дешевле, чем продолжение этого.

Сколько токенов на каждой модели

Квота одна на все модели — отличается лишь скорость, с которой они её тратят: чем дороже модель, тем быстрее. В таблице это уже посчитано — столько токенов вы потратите за неделю, если возьмёте только эту модель.

МодельFreeСтандартПроПремиум
GPT-5.6 Luna4.4M10M21M
DeepSeek V4 Flash330K1.8M4M8.4M
Kimi K2.6165K875K2M4.2M
Claude Haiku 4.5875K2M4.2M
GPT-5.6 Terra1.7M3.5M
Claude Sonnet 51.7M3.5M
GPT-5.6 Sol1.8M
Claude Opus 51.8M

Таблицу можно листать влево и вправо.

Шестичасовое окно — пятая часть недельного: неделя это ровно пять полных окон.

Частые вопросы

Почему длинный диалог может стоить дороже?
Модель не помнит прошлые ходы сама — нужный контекст отправляется ей заново. Чем длиннее переписка, тем больше данных она читает. Повторно прочитанный кэшированный контекст считается на 25%.
Почему обработано больше, чем списано?
«Обработано» — весь объём, который прошёл через модель. «Списано» — итог после скидки на кэш, действий агента и коэффициента модели. Поэтому эти числа могут отличаться в обе стороны.
Улучшение запроса тоже тратит токены?
Да. Кнопка «улучшить» отправляет настоящий запрос выбранной модели. Она читает ваш текст и контекст диалога, а точное списание появляется в карточке результата.