Тарифы и биллинг
📚 Навигация по серии: Предыдущая статья 03 Установка и авторизация помогла вам установить Codex и войти через аккаунт ChatGPT или API-ключ. В этой статье мы подробно разберем финансовую сторону: какой тарифный план выбрать, как списываются средства, в чем специфика авторизации по API-ключу и как оптимизировать расход лимитов.
Принято считать, что для работы с Codex достаточно оформить подписку ChatGPT Plus. Однако на практике ценообразование и лимиты Codex устроены значительно сложнее.
В начале 2026 года, когда я только внедрил Codex в свои рабочие процессы, я совершил распространенную ошибку: решил, что подписка Plus за 20 долларов в месяц дает безлимитное использование Codex. Запустив масштабный рефакторинг старого проекта на десятки тысяч строк кода, уже на второй день я столкнулся с блокировкой: CLI вывел предупреждение о достижении лимитов сессии. Я удивился: «ведь я отправил всего пару десятков запросов!». Ответ крылся в деталях: лимиты Codex рассчитываются не по количеству сообщений, а по объему потребляемых токенов. Мои длинные запросы с чтением огромных файлов расходовали лимиты в десятки раз быстрее обычных диалогов.
Кроме того, Codex предлагает две принципиально разные модели оплаты: при входе через аккаунт ChatGPT используются «лимиты подписки», а при использовании API-ключе средства списываются с баланса платформы за «каждый обработанный токен». Из-за совмещения этих схем новички часто путаются в расчетах.
В этой статье мы подробно разберем обе платежные модели. Понимание правил тарификации важнее выбора конкретного тарифного плана: при правильном подходе лимитов Plus легко хватает на месяц работы, в то время как при нерациональном использовании они могут закончиться за пару дней.
После прочтения этой статьи вы получите:
- Сравнительную таблицу тарифов ChatGPT и модели API-ключей для выбора оптимальной схемы
- Понимание принципов работы лимитов подписки и схемы оплаты за фактический объем токенов
- Навык использования команды
/statusв CLI для мгновенного контроля остатка лимитов - Проверенные приемы оптимизации расхода токенов для экономии лимитов при выполнении сложных задач
01 За что именно вы платите
Начнем с главного: сам по себе клиент Codex бесплатен, вы платите исключительно за вычислительные мощности языковых моделей на серверах OpenAI.
Codex — это лишь интерфейс (CLI, настольное приложение, плагин для IDE или веб-версия), за скачивание и установку которого плата не взимается. Финансовые затраты связаны с отправкой запросов к нейросетям семейства GPT. Каждый шаг — анализ кода, редактирование файлов или выполнение команд — требует обработки токенов на удаленном сервере. Объем этих данных и является единицей тарификации.
Аналогия: Codex — это бесплатное приложение для вызова такси, а языковая модель — сам автомобиль. Установка приложения и регистрация бесплатны, но за каждую поездку списываются деньги. Каждый километр пути тарифицируется — чем сложнее запросы, больше файлы проекта и длиннее контекст, тем выше стоимость поездки.
Единицей измерения этого «расстояния» служит токен (token). Токен можно сравнить со слогом или частью слова. Текст, отправляемый модели, разбивается на токены: запросы учитываются как «входные токены» (input tokens), ответы — как «выходные токены» (output tokens), при этом стоимость генерации выходных токенов обычно значительно выше стоимости анализа входных.
Сценарии, приводящие к быстрому расходу токенов:
- Запрос вида «прочитай этот файл на 2000 строк и внеси правку» — весь объем исходного файла отправляется на сервер как входные токены.
- Длинная сессия из 50 сообщений — все предыдущие 49 сообщений отправляются на сервер в качестве контекста при каждом новом запросе.
- Перегруженный инструкциями файл
AGENTS.mdв корневой папке — его содержимое добавляется к контексту каждого отправляемого запроса.
Таким образом, стоимость работы определяется не столько количеством заданных вопросов, сколько объемом передаваемого контекста. Понимание этого принципа лежит в основе методов оптимизации расходов.
💡 Краткий вывод: Сам клиент бесплатен. Оплата взимается за вычисления на серверах OpenAI на основе объема токенов: учитываются входные данные, сгенерированные ответы и передаваемый контекст.
02 Сравнение схем оплаты: подписка ChatGPT и API-ключ
Средства могут списываться по двум различным каналам. Выберите подходящий вариант на основе таблицы:
| Критерий | Вход через подписку ChatGPT | Вход по API-ключу |
|---|---|---|
| Принцип оплаты | Фиксированная абонентская плата с лимитами; при исчерпании докупаются баллы | Без абонентской платы; оплата за фактически потребленные токены |
| Прогнозируемость расходов | Затраты фиксированы и понятны заранее | Оплата по факту использования, счет выставляется в конце месяца |
| Облачные функции (review в GitHub, интеграция со Slack) | ✅ Доступны | ❌ Недоступны |
| Доступ к новым моделям | Мгновенный доступ сразу после релиза | Доступ с задержкой (новые специализированные модели выходят позже) |
| Целевая аудитория | Разработчики для повседневной работы с предсказуемыми расходами | Серверные среды, задачи автоматизации в CI/CD, общие рабочие места |
| Способ входа | Вызов codex login с подтверждением в браузере | Запуск с передачей API-ключа в консоли |
Выбор метода оплаты зависит от характера использования инструмента:
Подписка ChatGPT — оптимальный вариант для большинства индивидуальных разработчиков. При наличии Plus или Pro лимиты Codex включены в стоимость. Вам не нужно отслеживать детализированные счета и привязывать банковские карты к платформе API. Облачные интеграции (с Slack или GitHub Actions) доступны только в этом режиме.
API-ключ ориентирован на автоматические сценарии без участия человека (например, интеграция в пайплайны CI/CD). Списание средств производится по стандартным тарифам OpenAI Platform. Обратите внимание на ограничения: облачные функции и новейшие специализированные модели в этом режиме закрыты.
Списание средств при использовании API-ключа идет с баланса вашего аккаунта OpenAI API по действующим расценкам платформы (сверяйте с официальным прайс-листом API pricing). Эти расходы никак не пересекаются с лимитами подписок ChatGPT.
Рекомендуемое разделение: при интерактивной работе за компьютером авторизуйтесь через подписку ChatGPT; для автоматических ночных тестов и скриптов переключайтесь на API-ключ. Это упростит планирование расходов.
💡 Краткий вывод: Используйте подписку для интерактивной работы за компьютером, а API-ключ — для интеграции в автоматические скрипты и пайплайны сборки. Не путайте эти сценарии.
03 Выбор подписки: Plus, Pro, Business или Enterprise
Сравнение тарифных планов подписки ChatGPT, включающих лимиты Codex:

| Тарифный план | Стоимость (ориентировочно) | Лимиты Codex (сравнительно) | Ключевые возможности | Целевая аудитория |
|---|---|---|---|---|
| Plus | $20 / мес | Базовый лимит | Доступ через CLI, IDE, веб и iOS; облачные интеграции с GitHub/Slack; свежие модели | Индивидуальные разработчики с умеренной нагрузкой |
| Pro | от $100 / мес | В 5–20 раз больше, чем в Plus | Все функции Plus + приоритетный доступ к быстрым специализированным моделям | Профессионалы с высокой ежедневной нагрузкой |
| Business | Оплата по факту (Pay-as-you-go) | На уровне Plus (с покупкой баллов) | Управление аккаунтами команды, выделенные облачные виртуалки, SSO/MFA, конфиденциальность данных | Небольшие команды разработчиков и стартапы |
| Enterprise & Edu | По запросу | Индивидуальные лимиты | Все функции Business + приоритетный роутинг запросов, поддержка SCIM/RBAC, аудит логов, локальное хранение данных | Крупные компании и академические организации |
Детализация выбора тарифа:
План Plus ($20) — оптимальная отправная точка. Он включает доступ ко всем интерфейсам (веб, CLI, плагины для IDE) и облачным функциям. Единственный вопрос — хватит ли вам выделенных лимитов (этот нюанс мы подробно разберем в следующем разделе).
План Pro (от $100) предлагает существенно увеличенные лимиты. Объемы запросов в нем превышают лимиты Plus в 5–20 раз, предоставляя доступ к приоритетным быстрым моделям. Это выбор для тех, кто регулярно упирается в лимиты базового плана. Прежде чем переходить на дорогой тариф, попробуйте оптимизировать расход токенов — в большинстве случаев базового Plus будет достаточно.
Тарифы Business и Enterprise ориентированы на организации. План Business предлагает централизованное управление счетами и ролями, а Enterprise добавляет требования соответствия безопасности, аудит логов и гарантированную конфиденциальность кодовой базы. Для индивидуальных разработчиков эти планы избыточны.
Доступ на бесплатных тарифах (Free) и плане Go
Часто возникает вопрос: можно ли использовать Codex на бесплатном аккаунте ChatGPT или бюджетном тарифе Go?
В официальной документации этот момент не имеет четких формулировок. В прайс-листе Codex минимальным тарифом с гарантированной поддержкой указан Plus ($20). Базовый бесплатный план (Free) и промежуточный тариф Go не упоминаются в спецификациях лимитов Codex.
Наши выводы и рекомендации:
Аналогия: гостевой визит в фитнес-клуб против полноценного абонемента. Гостевой доступ позволяет осмотреться, но полноценные тренировки с оборудованием требуют покупки абонемента. Возможности программирования Codex официально закреплены за подпиской Plus и выше.
- Не рассчитывайте на полноценную разработку на бесплатных аккаунтах — лимиты для них официально не задокументированы.
- Для бесплатного ознакомления доступна функция Sites в веб-интерфейсе Codex (на этапе бета-тестирования), но она не заменяет полноценную локальную среду CLI.
- Доступность функций Codex на бесплатных тарифах может меняться. Перед принятием решения сверяйтесь с официальной страницей chatgpt.com/pricing.
💡 Краткий вывод: Начинайте с подписки Plus, переходите на Pro при реальной необходимости в гигантских лимитах, а командные тарифы оставьте организациям. Возможность бесплатного использования на тарифах Free/Go официально не гарантирована.
04 Лимиты запросов: пятичасовые скользящие окна
Разберем механизм расчета лимитов и порядок действий при их исчерпании.
Скользящее пятичасовое окно (rolling window)
Лимиты Codex разделяются на локальные запросы (Local Messages) и облачные задачи (Cloud Tasks). Оба показателя суммируются в рамках скользящего 5-часового окна (rolling window). Лимиты не сбрасываются раз в сутки, а рассчитываются непрерывно за последние 5 часов работы.
Важно понимать: лимит представляет собой диапазон, а не фиксированное число запросов. Например, для плана Plus лимит заявляется как «от 15 до 80 локальных запросов на модели GPT-5.5 за 5 часов». Разброс объясняется следующим образом:
«Количество доступных запросов зависит от выбранной модели, объема и сложности кодовой базы проекта, а также от среды выполнения (локально или в облаке). Простые правки функций расходуют минимум лимита, тогда как анализ больших репозиториев, длительные вычисления и длинные диалоги с передачей объемного контекста тратят квоты значительно быстрее». (из документации по тарифам)
Это объясняет, почему в моем случае блокировка наступила после небольшого числа запросов — каждый из них передавал модели огромную кодовую базу. При работе с точечными функциями лимита Plus хватает на 80 запросов, а при анализе крупных проектов лимит может быть исчерпан за 15 итераций.
Сравнение лимитов по тарифам
Ориентировочные лимиты локальных запросов на модели GPT-5.5 за 5 часов:
| Тарифный план | Количество запросов за 5 часов к GPT-5.5 (ориентир) |
|---|---|
| Plus | 15–80 |
| Pro (5x) | 80–400 |
| Pro (20x) | 300–1600 |
| Business | 15–80 (с возможностью покупки дополнительных баллов) |
Эта таблица демонстрирует важную закономерность: выбор облегченных моделей (например, GPT-5.4-mini) увеличивает доступный лимит запросов в несколько раз. Мы применим это в Разделе 05.
Превышение лимитов: покупка дополнительных баллов
При исчерпании лимитов вам не требуется переходить на более дорогой тариф. Достаточно приобрести дополнительные баллы (credits):
«Пользователи ChatGPT Plus и Pro, достигшие лимитов использования, могут приобрести дополнительные баллы для продолжения работы без изменения тарифного плана». (из документации)
Аналогия: покупка дополнительного пакета интернет-трафика. Выделенный лимит — это базовый пакет. При его исчерпании вы просто активируете разовый пакет трафика без перевода телефона на более дорогой тариф.
Расход баллов привязан к объему токенов в запросе. Документация приводит ориентировочный показатель:
«В среднем один запрос к модели GPT-5.5 расходует от 5 до 45 баллов». (из прайс-листа)
Примите этот диапазон в качестве базового ориентира. Актуальные сетки тарифов и стоимость обработки миллиона токенов проверяйте на официальном сайте.
💡 Краткий вывод: Лимиты рассчитываются по скользящему 5-часовому окну и зависят от выбранной модели. Анализ крупных файлов быстро исчерпывает квоты. При достижении ограничений докупайте разовые баллы (credits) вместо перехода на дорогой тариф.
05 Оптимизация расходов: официальные рекомендации по экономии токенов
Лучший способ снизить расходы — научиться эффективно использовать инструмент. Объем списываемых средств напрямую зависит от размера передаваемого контекста. Официальное руководство предлагает четыре основных метода оптимизации, проверенных на практике:
1. Формулируйте точные запросы и исключайте лишний контекст. При размытых формулировках агент начинает сканировать все файлы проекта в поисках нужного места, расходуя на это огромные объемы входных токенов. Четкое указание: «измени функцию login в файле src/auth.ts, добавив валидацию параметров» исключает лишнее сканирование каталогов.
2. Оптимизируйте размер файлов AGENTS.md. Содержимое этого файла добавляется к контексту каждого отправляемого сообщения. Для крупных проектов разработчики рекомендуют использовать модульную структуру, размещая небольшие локальные файлы AGENTS.md в подкаталогах вместо хранения гигантского единого файла в корне проекта. Это существенно сокращает объем входящего контекста.
3. Подключайте только необходимые серверы MCP. Описания доступных инструментов MCP передаются в контексте каждого запроса, снижая свободный лимит. Отключайте неиспользуемые в данный момент интеграции.
4. Используйте более легкие модели для простых задач. Документация прямо указывает, что переключение на GPT-5.4 или GPT-5.4-mini увеличивает лимит доступных сообщений. Для рутинного рефакторинга или исправления мелких багов возможностей облегченных моделей вполне достаточно. Вызывайте команду /model для переключения во время сессии.
Чек-лист для оптимизации расходов токенов:
| Неэффективный подход ❌ | Правильный подход ✅ | За счет чего экономия |
|---|---|---|
| «Помоги оптимизировать этот проект» | «Измени функцию login в src/auth.ts, добавив валидацию» | Исключение сканирования лишних файлов |
Хранение сотен строк в едином корневом AGENTS.md | Разделение правил по подкаталогам и сокращение объема | Уменьшение размера контекста каждого запроса |
| Постоянно включенные серверы MCP | Включение интеграций только при необходимости | Снижение размера описаний инструментов |
| Постоянное использование флагманской модели | Переключение на облегченные модели для простых правок | Экономия квоты за счет снижения стоимости токена |
Дополнительный практический совет для CLI: при переключении на другую задачу очищайте контекст командой /new. Это сбросит историю диалога без закрытия сессии CLI, предотвращая отправку устаревшей истории сообщений при каждом новом запросе.
💡 Краткий вывод: Оптимизация расходов строится на точных формулировках запросов, разбиении файлов
AGENTS.md, отключении неактивных серверов MCP, переходе на легкие модели для простых задач и очистке контекста диалога командой/new.
06 Практика: Контроль лимитов в CLI
Выполните следующие шаги для настройки контроля лимитов в вашей локальной среде:
Подготовка: у вас должен быть установлен и настроен клиент Codex (см. Статью 03). Настройте сетевой доступ к серверам OpenAI.
Запустите Codex в каталоге проекта:
codexШаг 1: Проверьте статус сессии с помощью команды /status
/statusКонсоль выведет информацию о текущей модели, политике подтверждений, разрешенной папке для записи и остатке размера контекста. Для проверки лимитов также используйте /status:
«Для просмотра остатка лимитов в процессе CLI-сессии используйте команду
/status». (из документации)
Контролируйте два параметра: активную модель и остаток лимита во избежание внезапной блокировки сессии.
Шаг 2: Отправьте простой запрос и сравните статус
看看当前目录下有哪些文件,简单说下这个项目是干嘛的После получения ответа повторно вызовите /status и сравните изменение размера контекста. Это даст вам представление о расходе токенов при базовых операциях чтения каталога.
Шаг 3: Переключитесь на легкую модель
/modelВыберите облегченную модель (например, GPT-5.4-mini) из предложенного списка. Вы также можете зафиксировать модель при старте сессии CLI:
codex --model gpt-5.5(--model 后跟哪些模型名以你账号当前可用的为准,/status 里能看到当前用的是哪个。)
Шаг 4: Проверьте статистику в веб-интерфейсе (для подписчиков)
https://chatgpt.com/codex/settings/usageЭтот адрес ведет в официальную панель управления лимитами Codex usage dashboard.
Для пользователей API-ключей: статистика использования и счета отображаются в панели управления OpenAI Platform. Приемы оптимизации контекста (команды
/statusи/new) остаются актуальными и для вас.
Эти действия помогут вам полностью контролировать расходы лимитов и токенов в процессе разработки.
💡 Краткий вывод: Используйте команду
/statusдля контроля остатка лимита, переключайтесь на облегченные модели через/modelи отслеживайте глобальную статистику расходов в личном кабинете.
07 Резюме
Основные выводы главы о тарификации:
| Вы изучили | Ключевой вывод |
|---|---|
| Принцип тарификации | Клиент бесплатен, оплачивается обработка токенов языковыми моделями |
| Способы оплаты | Лимиты подписки ChatGPT для личного использования, биллинг API-ключей для автоматизации |
| Выбор тарифа | Старт с Plus, переход на Pro при нехватке лимитов, Business — для команд |
| Расчет лимитов | Учитываются скользящие 5-часовые окна; при превышении докупаются credits |
| Оптимизация расходов | Точные промпты, модульные AGENTS.md, отключение MCP, использование легких моделей и команды /new |
Главное правило: стоимость использования зависит от объема передаваемого контекста, а не от количества сообщений. Понимание этого принципа позволит вам эффективно управлять бюджетом проекта.
⚠️ Важное напоминание: все цены, лимиты и тарифные ставки могут изменяться со стороны OpenAI. Актуальные условия проверяйте на официальных ресурсах pricing и chatgpt.com/pricing. Описание поведения команд CLI соответствует официальной спецификации.
Мы разобрались с тарифами и лимитами. Если вы хотите использовать сторонние или локальные языковые модели, в следующей статье 05 · Подключение DeepSeek и сторонних моделей мы разберем процесс настройки Codex для работы с альтернативными провайдерами API (DeepSeek, Kimi, GLM и др.).