Skip to content

Тарифы и биллинг

📚 Навигация по серии: Предыдущая статья 03 Установка и авторизация помогла вам установить Codex и войти через аккаунт ChatGPT или API-ключ. В этой статье мы подробно разберем финансовую сторону: какой тарифный план выбрать, как списываются средства, в чем специфика авторизации по API-ключу и как оптимизировать расход лимитов.

Принято считать, что для работы с Codex достаточно оформить подписку ChatGPT Plus. Однако на практике ценообразование и лимиты Codex устроены значительно сложнее.

В начале 2026 года, когда я только внедрил Codex в свои рабочие процессы, я совершил распространенную ошибку: решил, что подписка Plus за 20 долларов в месяц дает безлимитное использование Codex. Запустив масштабный рефакторинг старого проекта на десятки тысяч строк кода, уже на второй день я столкнулся с блокировкой: CLI вывел предупреждение о достижении лимитов сессии. Я удивился: «ведь я отправил всего пару десятков запросов!». Ответ крылся в деталях: лимиты Codex рассчитываются не по количеству сообщений, а по объему потребляемых токенов. Мои длинные запросы с чтением огромных файлов расходовали лимиты в десятки раз быстрее обычных диалогов.

Кроме того, Codex предлагает две принципиально разные модели оплаты: при входе через аккаунт ChatGPT используются «лимиты подписки», а при использовании API-ключе средства списываются с баланса платформы за «каждый обработанный токен». Из-за совмещения этих схем новички часто путаются в расчетах.

В этой статье мы подробно разберем обе платежные модели. Понимание правил тарификации важнее выбора конкретного тарифного плана: при правильном подходе лимитов Plus легко хватает на месяц работы, в то время как при нерациональном использовании они могут закончиться за пару дней.

После прочтения этой статьи вы получите:

  • Сравнительную таблицу тарифов ChatGPT и модели API-ключей для выбора оптимальной схемы
  • Понимание принципов работы лимитов подписки и схемы оплаты за фактический объем токенов
  • Навык использования команды /status в CLI для мгновенного контроля остатка лимитов
  • Проверенные приемы оптимизации расхода токенов для экономии лимитов при выполнении сложных задач

01 За что именно вы платите

Начнем с главного: сам по себе клиент Codex бесплатен, вы платите исключительно за вычислительные мощности языковых моделей на серверах OpenAI.

Codex — это лишь интерфейс (CLI, настольное приложение, плагин для IDE или веб-версия), за скачивание и установку которого плата не взимается. Финансовые затраты связаны с отправкой запросов к нейросетям семейства GPT. Каждый шаг — анализ кода, редактирование файлов или выполнение команд — требует обработки токенов на удаленном сервере. Объем этих данных и является единицей тарификации.

Аналогия: Codex — это бесплатное приложение для вызова такси, а языковая модель — сам автомобиль. Установка приложения и регистрация бесплатны, но за каждую поездку списываются деньги. Каждый километр пути тарифицируется — чем сложнее запросы, больше файлы проекта и длиннее контекст, тем выше стоимость поездки.

Единицей измерения этого «расстояния» служит токен (token). Токен можно сравнить со слогом или частью слова. Текст, отправляемый модели, разбивается на токены: запросы учитываются как «входные токены» (input tokens), ответы — как «выходные токены» (output tokens), при этом стоимость генерации выходных токенов обычно значительно выше стоимости анализа входных.

Сценарии, приводящие к быстрому расходу токенов:

  • Запрос вида «прочитай этот файл на 2000 строк и внеси правку» — весь объем исходного файла отправляется на сервер как входные токены.
  • Длинная сессия из 50 сообщений — все предыдущие 49 сообщений отправляются на сервер в качестве контекста при каждом новом запросе.
  • Перегруженный инструкциями файл AGENTS.md в корневой папке — его содержимое добавляется к контексту каждого отправляемого запроса.

Таким образом, стоимость работы определяется не столько количеством заданных вопросов, сколько объемом передаваемого контекста. Понимание этого принципа лежит в основе методов оптимизации расходов.

💡 Краткий вывод: Сам клиент бесплатен. Оплата взимается за вычисления на серверах OpenAI на основе объема токенов: учитываются входные данные, сгенерированные ответы и передаваемый контекст.


02 Сравнение схем оплаты: подписка ChatGPT и API-ключ

Средства могут списываться по двум различным каналам. Выберите подходящий вариант на основе таблицы:

КритерийВход через подписку ChatGPTВход по API-ключу
Принцип оплатыФиксированная абонентская плата с лимитами; при исчерпании докупаются баллыБез абонентской платы; оплата за фактически потребленные токены
Прогнозируемость расходовЗатраты фиксированы и понятны заранееОплата по факту использования, счет выставляется в конце месяца
Облачные функции (review в GitHub, интеграция со Slack)✅ ДоступныНедоступны
Доступ к новым моделямМгновенный доступ сразу после релизаДоступ с задержкой (новые специализированные модели выходят позже)
Целевая аудиторияРазработчики для повседневной работы с предсказуемыми расходамиСерверные среды, задачи автоматизации в CI/CD, общие рабочие места
Способ входаВызов codex login с подтверждением в браузереЗапуск с передачей API-ключа в консоли

Выбор метода оплаты зависит от характера использования инструмента:

Подписка ChatGPT — оптимальный вариант для большинства индивидуальных разработчиков. При наличии Plus или Pro лимиты Codex включены в стоимость. Вам не нужно отслеживать детализированные счета и привязывать банковские карты к платформе API. Облачные интеграции (с Slack или GitHub Actions) доступны только в этом режиме.

API-ключ ориентирован на автоматические сценарии без участия человека (например, интеграция в пайплайны CI/CD). Списание средств производится по стандартным тарифам OpenAI Platform. Обратите внимание на ограничения: облачные функции и новейшие специализированные модели в этом режиме закрыты.

Списание средств при использовании API-ключа идет с баланса вашего аккаунта OpenAI API по действующим расценкам платформы (сверяйте с официальным прайс-листом API pricing). Эти расходы никак не пересекаются с лимитами подписок ChatGPT.

Рекомендуемое разделение: при интерактивной работе за компьютером авторизуйтесь через подписку ChatGPT; для автоматических ночных тестов и скриптов переключайтесь на API-ключ. Это упростит планирование расходов.

💡 Краткий вывод: Используйте подписку для интерактивной работы за компьютером, а API-ключ — для интеграции в автоматические скрипты и пайплайны сборки. Не путайте эти сценарии.


03 Выбор подписки: Plus, Pro, Business или Enterprise

Сравнение тарифных планов подписки ChatGPT, включающих лимиты Codex:

Сравнение лимитов и возможностей Codex в тарифах Plus, Pro, Business и Enterprise

Тарифный планСтоимость (ориентировочно)Лимиты Codex (сравнительно)Ключевые возможностиЦелевая аудитория
Plus$20 / месБазовый лимитДоступ через CLI, IDE, веб и iOS; облачные интеграции с GitHub/Slack; свежие моделиИндивидуальные разработчики с умеренной нагрузкой
Proот $100 / месВ 5–20 раз больше, чем в PlusВсе функции Plus + приоритетный доступ к быстрым специализированным моделямПрофессионалы с высокой ежедневной нагрузкой
BusinessОплата по факту (Pay-as-you-go)На уровне Plus (с покупкой баллов)Управление аккаунтами команды, выделенные облачные виртуалки, SSO/MFA, конфиденциальность данныхНебольшие команды разработчиков и стартапы
Enterprise & EduПо запросуИндивидуальные лимитыВсе функции Business + приоритетный роутинг запросов, поддержка SCIM/RBAC, аудит логов, локальное хранение данныхКрупные компании и академические организации

Детализация выбора тарифа:

План Plus ($20) — оптимальная отправная точка. Он включает доступ ко всем интерфейсам (веб, CLI, плагины для IDE) и облачным функциям. Единственный вопрос — хватит ли вам выделенных лимитов (этот нюанс мы подробно разберем в следующем разделе).

План Pro (от $100) предлагает существенно увеличенные лимиты. Объемы запросов в нем превышают лимиты Plus в 5–20 раз, предоставляя доступ к приоритетным быстрым моделям. Это выбор для тех, кто регулярно упирается в лимиты базового плана. Прежде чем переходить на дорогой тариф, попробуйте оптимизировать расход токенов — в большинстве случаев базового Plus будет достаточно.

Тарифы Business и Enterprise ориентированы на организации. План Business предлагает централизованное управление счетами и ролями, а Enterprise добавляет требования соответствия безопасности, аудит логов и гарантированную конфиденциальность кодовой базы. Для индивидуальных разработчиков эти планы избыточны.

Доступ на бесплатных тарифах (Free) и плане Go

Часто возникает вопрос: можно ли использовать Codex на бесплатном аккаунте ChatGPT или бюджетном тарифе Go?

В официальной документации этот момент не имеет четких формулировок. В прайс-листе Codex минимальным тарифом с гарантированной поддержкой указан Plus ($20). Базовый бесплатный план (Free) и промежуточный тариф Go не упоминаются в спецификациях лимитов Codex.

Наши выводы и рекомендации:

Аналогия: гостевой визит в фитнес-клуб против полноценного абонемента. Гостевой доступ позволяет осмотреться, но полноценные тренировки с оборудованием требуют покупки абонемента. Возможности программирования Codex официально закреплены за подпиской Plus и выше.

  • Не рассчитывайте на полноценную разработку на бесплатных аккаунтах — лимиты для них официально не задокументированы.
  • Для бесплатного ознакомления доступна функция Sites в веб-интерфейсе Codex (на этапе бета-тестирования), но она не заменяет полноценную локальную среду CLI.
  • Доступность функций Codex на бесплатных тарифах может меняться. Перед принятием решения сверяйтесь с официальной страницей chatgpt.com/pricing.

💡 Краткий вывод: Начинайте с подписки Plus, переходите на Pro при реальной необходимости в гигантских лимитах, а командные тарифы оставьте организациям. Возможность бесплатного использования на тарифах Free/Go официально не гарантирована.


04 Лимиты запросов: пятичасовые скользящие окна

Разберем механизм расчета лимитов и порядок действий при их исчерпании.

Скользящее пятичасовое окно (rolling window)

Лимиты Codex разделяются на локальные запросы (Local Messages) и облачные задачи (Cloud Tasks). Оба показателя суммируются в рамках скользящего 5-часового окна (rolling window). Лимиты не сбрасываются раз в сутки, а рассчитываются непрерывно за последние 5 часов работы.

Важно понимать: лимит представляет собой диапазон, а не фиксированное число запросов. Например, для плана Plus лимит заявляется как «от 15 до 80 локальных запросов на модели GPT-5.5 за 5 часов». Разброс объясняется следующим образом:

«Количество доступных запросов зависит от выбранной модели, объема и сложности кодовой базы проекта, а также от среды выполнения (локально или в облаке). Простые правки функций расходуют минимум лимита, тогда как анализ больших репозиториев, длительные вычисления и длинные диалоги с передачей объемного контекста тратят квоты значительно быстрее». (из документации по тарифам)

Это объясняет, почему в моем случае блокировка наступила после небольшого числа запросов — каждый из них передавал модели огромную кодовую базу. При работе с точечными функциями лимита Plus хватает на 80 запросов, а при анализе крупных проектов лимит может быть исчерпан за 15 итераций.

Сравнение лимитов по тарифам

Ориентировочные лимиты локальных запросов на модели GPT-5.5 за 5 часов:

Тарифный планКоличество запросов за 5 часов к GPT-5.5 (ориентир)
Plus15–80
Pro (5x)80–400
Pro (20x)300–1600
Business15–80 (с возможностью покупки дополнительных баллов)

Эта таблица демонстрирует важную закономерность: выбор облегченных моделей (например, GPT-5.4-mini) увеличивает доступный лимит запросов в несколько раз. Мы применим это в Разделе 05.

Превышение лимитов: покупка дополнительных баллов

При исчерпании лимитов вам не требуется переходить на более дорогой тариф. Достаточно приобрести дополнительные баллы (credits):

«Пользователи ChatGPT Plus и Pro, достигшие лимитов использования, могут приобрести дополнительные баллы для продолжения работы без изменения тарифного плана». (из документации)

Аналогия: покупка дополнительного пакета интернет-трафика. Выделенный лимит — это базовый пакет. При его исчерпании вы просто активируете разовый пакет трафика без перевода телефона на более дорогой тариф.

Расход баллов привязан к объему токенов в запросе. Документация приводит ориентировочный показатель:

«В среднем один запрос к модели GPT-5.5 расходует от 5 до 45 баллов». (из прайс-листа)

Примите этот диапазон в качестве базового ориентира. Актуальные сетки тарифов и стоимость обработки миллиона токенов проверяйте на официальном сайте.

💡 Краткий вывод: Лимиты рассчитываются по скользящему 5-часовому окну и зависят от выбранной модели. Анализ крупных файлов быстро исчерпывает квоты. При достижении ограничений докупайте разовые баллы (credits) вместо перехода на дорогой тариф.


05 Оптимизация расходов: официальные рекомендации по экономии токенов

Лучший способ снизить расходы — научиться эффективно использовать инструмент. Объем списываемых средств напрямую зависит от размера передаваемого контекста. Официальное руководство предлагает четыре основных метода оптимизации, проверенных на практике:

1. Формулируйте точные запросы и исключайте лишний контекст. При размытых формулировках агент начинает сканировать все файлы проекта в поисках нужного места, расходуя на это огромные объемы входных токенов. Четкое указание: «измени функцию login в файле src/auth.ts, добавив валидацию параметров» исключает лишнее сканирование каталогов.

2. Оптимизируйте размер файлов AGENTS.md. Содержимое этого файла добавляется к контексту каждого отправляемого сообщения. Для крупных проектов разработчики рекомендуют использовать модульную структуру, размещая небольшие локальные файлы AGENTS.md в подкаталогах вместо хранения гигантского единого файла в корне проекта. Это существенно сокращает объем входящего контекста.

3. Подключайте только необходимые серверы MCP. Описания доступных инструментов MCP передаются в контексте каждого запроса, снижая свободный лимит. Отключайте неиспользуемые в данный момент интеграции.

4. Используйте более легкие модели для простых задач. Документация прямо указывает, что переключение на GPT-5.4 или GPT-5.4-mini увеличивает лимит доступных сообщений. Для рутинного рефакторинга или исправления мелких багов возможностей облегченных моделей вполне достаточно. Вызывайте команду /model для переключения во время сессии.

Чек-лист для оптимизации расходов токенов:

Неэффективный подход ❌Правильный подход ✅За счет чего экономия
«Помоги оптимизировать этот проект»«Измени функцию login в src/auth.ts, добавив валидацию»Исключение сканирования лишних файлов
Хранение сотен строк в едином корневом AGENTS.mdРазделение правил по подкаталогам и сокращение объемаУменьшение размера контекста каждого запроса
Постоянно включенные серверы MCPВключение интеграций только при необходимостиСнижение размера описаний инструментов
Постоянное использование флагманской моделиПереключение на облегченные модели для простых правокЭкономия квоты за счет снижения стоимости токена

Дополнительный практический совет для CLI: при переключении на другую задачу очищайте контекст командой /new. Это сбросит историю диалога без закрытия сессии CLI, предотвращая отправку устаревшей истории сообщений при каждом новом запросе.

💡 Краткий вывод: Оптимизация расходов строится на точных формулировках запросов, разбиении файлов AGENTS.md, отключении неактивных серверов MCP, переходе на легкие модели для простых задач и очистке контекста диалога командой /new.


06 Практика: Контроль лимитов в CLI

Выполните следующие шаги для настройки контроля лимитов в вашей локальной среде:

Подготовка: у вас должен быть установлен и настроен клиент Codex (см. Статью 03). Настройте сетевой доступ к серверам OpenAI.

Запустите Codex в каталоге проекта:

bash
codex

Шаг 1: Проверьте статус сессии с помощью команды /status

text
/status

Консоль выведет информацию о текущей модели, политике подтверждений, разрешенной папке для записи и остатке размера контекста. Для проверки лимитов также используйте /status:

«Для просмотра остатка лимитов в процессе CLI-сессии используйте команду /status». (из документации)

Контролируйте два параметра: активную модель и остаток лимита во избежание внезапной блокировки сессии.

Шаг 2: Отправьте простой запрос и сравните статус

text
看看当前目录下有哪些文件,简单说下这个项目是干嘛的

После получения ответа повторно вызовите /status и сравните изменение размера контекста. Это даст вам представление о расходе токенов при базовых операциях чтения каталога.

Шаг 3: Переключитесь на легкую модель

text
/model

Выберите облегченную модель (например, GPT-5.4-mini) из предложенного списка. Вы также можете зафиксировать модель при старте сессии CLI:

bash
codex --model gpt-5.5

--model 后跟哪些模型名以你账号当前可用的为准,/status 里能看到当前用的是哪个。)

Шаг 4: Проверьте статистику в веб-интерфейсе (для подписчиков)

text
https://chatgpt.com/codex/settings/usage

Этот адрес ведет в официальную панель управления лимитами Codex usage dashboard.

Для пользователей API-ключей: статистика использования и счета отображаются в панели управления OpenAI Platform. Приемы оптимизации контекста (команды /status и /new) остаются актуальными и для вас.

Эти действия помогут вам полностью контролировать расходы лимитов и токенов в процессе разработки.

💡 Краткий вывод: Используйте команду /status для контроля остатка лимита, переключайтесь на облегченные модели через /model и отслеживайте глобальную статистику расходов в личном кабинете.


07 Резюме

Основные выводы главы о тарификации:

Вы изучилиКлючевой вывод
Принцип тарификацииКлиент бесплатен, оплачивается обработка токенов языковыми моделями
Способы оплатыЛимиты подписки ChatGPT для личного использования, биллинг API-ключей для автоматизации
Выбор тарифаСтарт с Plus, переход на Pro при нехватке лимитов, Business — для команд
Расчет лимитовУчитываются скользящие 5-часовые окна; при превышении докупаются credits
Оптимизация расходовТочные промпты, модульные AGENTS.md, отключение MCP, использование легких моделей и команды /new

Главное правило: стоимость использования зависит от объема передаваемого контекста, а не от количества сообщений. Понимание этого принципа позволит вам эффективно управлять бюджетом проекта.

⚠️ Важное напоминание: все цены, лимиты и тарифные ставки могут изменяться со стороны OpenAI. Актуальные условия проверяйте на официальных ресурсах pricing и chatgpt.com/pricing. Описание поведения команд CLI соответствует официальной спецификации.


Мы разобрались с тарифами и лимитами. Если вы хотите использовать сторонние или локальные языковые модели, в следующей статье 05 · Подключение DeepSeek и сторонних моделей мы разберем процесс настройки Codex для работы с альтернативными провайдерами API (DeepSeek, Kimi, GLM и др.).


Рекомендуемые материалы