Codex CLI через kosareva.cloud
Codex CLI позволяет описать собственного провайдера с произвольным базовым адресом. Наш эндпоинт OpenAI-совместимый, поэтому достаточно добавить его в конфиг и указать ключ.
Как подключить
/1Получите ключ
Создайте API-ключ в личном кабинете и пополните баланс.
/2Положите ключ в переменную окружения
export KOSAREVA_API_KEY="ВАШ_API_КЛЮЧ"
В Windows PowerShell: $env:KOSAREVA_API_KEY = "ВАШ_API_КЛЮЧ"
/3Опишите провайдера в конфиге
Откройте ~/.codex/config.toml и добавьте:
model = "gpt-5-6"
model_provider = "kosareva"
[model_providers.kosareva]
name = "kosareva.cloud"
base_url = "https://api.kosareva.cloud/v1"
env_key = "KOSAREVA_API_KEY"
Поле env_key указывает, из какой переменной окружения
брать ключ — сам ключ в конфиг писать не нужно.
/4Запустите
codex
Модель можно поменять в поле model — список доступных
и цены смотрите на странице цен.
Не хочется собирать руками — возьмите готовый config.toml: внутри уже прописан адрес шлюза, осталось вставить свой ключ.
Список моделей
Codex CLI отправляет запросы в Responses API — на /v1/responses нашего шлюза. Агент рассчитан на модели OpenAI, их и ставьте в поле model.
- Протокол
- OpenAI Responses API
- Адрес
https://api.kosareva.cloud/v1- Имя модели
- как в каталоге, латиницей через дефисы:
gpt-6-1-sol - Подходят
- Модели OpenAI из каталога; в таблице — те, что подходят для кода.
| Модель | Имя в запросе | Контекст, токенов | Вход / выход за 1M |
|---|---|---|---|
| GPT-6.1 Sol | gpt-6-1-sol | 1 050 000 | 216 / 1 080 ₽ |
| GPT-5.6 | gpt-5-6 | 1 050 000 | 432 / 2 160 ₽ |
| GPT-5.3-Codex | gpt-5-3-codex | 400 000 | 189 / 1 512 ₽ |
| GPT-5.1-Codex-Max | gpt-5-1-codex-max | 400 000 | 135 / 1 080 ₽ |
| GPT-5.1-Codex-Mini | gpt-5-1-codex-mini | 400 000 | 27 / 216 ₽ |
| GPT-6 Luna | gpt-6-luna | 1 050 000 | 10,8 / 54 ₽ |
Все модели с ценами — на странице цен. Точные имена отдаёт и сам API по адресу /v1/models.
Какие функции Codex CLI работают через kosareva.cloud
Агент Codex работает на вашей машине, к нам он ходит только за ответами модели. Всё, что завязано на аккаунт ChatGPT, с ключом не работает.
Агент в терминале работает
Читает проект, правит файлы и запускает команды в песочнице, спрашивая подтверждения.
Неинтерактивный режим работает
codex exec для скриптов и CI ходит через того же провайдера.
MCP-серверы работает
Описываются в том же config.toml и от провайдера моделей не зависят.
Вход через ChatGPT не работает
Подписка ChatGPT из России недоступна. С провайдером в config.toml вход не нужен.
Облачные задачи Codex не работает
Задачи в облаке OpenAI требуют аккаунта ChatGPT, наш ключ на них не действует.
Рекомендуемые модели для Codex CLI
Codex рассчитан на модели OpenAI. Выбор — между новой универсальной моделью GPT-6.1 Sol и кодовыми моделями прошлых поколений.
GPT-6.1 Sol gpt-6-1-sol
Средняя модель GPT-6 для кода и агентов: окно больше миллиона токенов, чтение из кэша вдвое дешевле, чем у GPT-6 Sol.
GPT-5.3-Codex gpt-5-3-codex
Кодовая модель OpenAI для агентной работы с репозиторием — как раз под режим Codex.
GPT-5.1-Codex-Max gpt-5-1-codex-max
Сжимает историю и продолжает задачу за пределами окна — для длинных рефакторингов.
GPT-5.1-Codex-Mini gpt-5-1-codex-mini
Младшая кодовая модель: для простых правок и скриптов в CI.
Устранение неполадок
Наши ошибки приходят с русским текстом — по нему и ищите свой случай. Подробные разборы — в справочнике.
401: «Ключ не найден» или «Ключ не принят»
Ключ скопирован не целиком, с пробелом или переносом строки, удалён в кабинете — или вставлен не в то поле. Codex берёт ключ из переменной, названной в env_key, — она должна быть задана в том же терминале, где вы запускаете codex.
404: адрес без /v1 или с лишним хвостом
Базовый адрес — ровно https://api.kosareva.cloud/v1. Без /v1 запрос уходит мимо API, а с /chat/completions на конце путь удваивается — инструмент допишет его сам. В Codex это base_url в секции [model_providers.kosareva].
«Такой модели нет в каталоге»
Имя модели — как в каталоге: латиницей через дефисы, например claude-sonnet-5-5. Вариант через точку шлюз поймёт сам, а с префиксом вендора (anthropic/…), датой версии или пробелом — нет. В Codex имя — в поле model config.toml.
402: «Закончились средства на балансе»
На балансе не хватает денег на запрос. Пополните его в кабинете картой или СБП — от 50 ₽. Если деньги на балансе есть, а отказ повторяется, проверьте, не стоит ли у ключа свой лимит в рублях.
Ответ обрывается на полуслове
Модель упёрлась в потолок длины ответа — max_tokens. Поднимите его или попросите модель продолжить. Обратная ошибка — 400 «Запрос длиннее, чем помещается в контекст этой модели»: потолок ответа вместе с историей не влезает в окно модели. Тогда уменьшите потолок или сожмите историю.
Долго нет ответа или 504
Длинный ответ без потоковой выдачи идёт минутами, и инструмент может сдаться раньше модели. В Codex ожидание потока задаёт stream_idle_timeout_ms у провайдера (по умолчанию 300 000 мс). Если пришёл наш 504 «Модель не ответила за отведённое время», деньги за такой запрос не списываются — повторите его.
Ошибка про wire_api
Новые версии Codex работают только через Responses API: wire_api = "responses" стоит по умолчанию и другое значение не принимается. Если в вашем config.toml осталась строка wire_api = "chat" из старых инструкций — удалите её.
Частые вопросы
Нужна ли подписка ChatGPT?
Нет. С провайдером в config.toml Codex не просит входа, оплата идёт по токенам с баланса в рублях.
Почему ключ в переменной, а не в конфиге?
Так устроен Codex: в config.toml пишется имя переменной (env_key), а сам ключ остаётся в окружении. Конфиг можно класть в репозиторий без риска.
Работают ли модели Claude или Gemini?
Codex рассчитан на модели OpenAI, и инструменты агента сделаны под них. Для Claude возьмите Claude Code, для любых моделей — opencode.
Нужен ли VPN?
Нет. Codex обращается только к нашему API, а он отвечает из России напрямую.
Можно ли выдать ключи команде?
Да. В кабинете — отдельный ключ на каждого разработчика или на CI, у каждого свой расход и лимит в рублях.
Рекомендуемые модели и цены
На странице модели — все цены, включая кэш, и калькулятор расхода.
GPT-6.1 Sol
Обновление GPT-6 Sol: та же цена, чтение кэша вдвое дешевле, контекст свыше 1M, картинки и файлы
GPT-5.3-Codex
Самая свежая кодовая модель OpenAI: агентная работа с репозиторием, контекст 400K
GPT-5.1-Codex-Max
Кодовая модель для долгих сессий: сжимает историю и продолжает задачу за пределами окна
GPT-5.1-Codex-Mini
Младшая кодовая модель линейки: 27 ₽ за миллион входа при контексте 400K