Кэш дешевле
Повторно прочитанный контекст считается на 25%.
Учитываются запрос, контекст диалога, ответ и действия агента. Затем применяется коэффициент выбранной модели.
Под каждым ответом показываются фактическая обработка и списание с лимита.
Что обработала модель
| Запрос и контекст | 2 000 |
| Ответ модели | 400 |
| Кэшированный контекст | 2 000 → 500 |
| Действия агента | 2 × 100 = 200 |
| Поиск и источники | 500 + 200 |
Кэшированный контекст учитывается только на 25%.
Промежуточный итог
Пример. Реальные цифры зависят от запроса и модели.
Повторно прочитанный контекст считается на 25%.
Сейчас ×1,5, ×1,75 или ×2. Он указан в окне выбора модели.
Если модель начала работу, спишется не менее 400 токенов.
Контекст отправляется модели заново каждый ход. Когда переписка стала длинной, новый чат дешевле, чем продолжение этого.
Квота одна на все модели — отличается лишь скорость, с которой они её тратят: чем дороже модель, тем быстрее. В таблице это уже посчитано — столько токенов вы потратите за неделю, если возьмёте только эту модель.
| Модель | Free | Стандарт | Про | Премиум |
|---|---|---|---|---|
| GPT-5.6 Luna | — | 4.4M | 10M | 21M |
| DeepSeek V4 Flash | 330K | 1.8M | 4M | 8.4M |
| Kimi K2.6 | 165K | 875K | 2M | 4.2M |
| Claude Haiku 4.5 | — | 875K | 2M | 4.2M |
| GPT-5.6 Terra | — | — | 1.7M | 3.5M |
| Claude Sonnet 5 | — | — | 1.7M | 3.5M |
| GPT-5.6 Sol | — | — | — | 1.8M |
| Claude Opus 5 | — | — | — | 1.8M |
Таблицу можно листать влево и вправо.
Шестичасовое окно — пятая часть недельного: неделя это ровно пять полных окон.