Вайбцех

Ошибка Codex в AWS Bedrock: около 85% расходов ушло на cache writes

Опубликовано 7 мин чтения
Автор статьи показывает данные о расходах Codex через Bedrock, рядом испуганный кот.
Что узнаете
  • Причину высокой стоимости Codex через AWS Bedrock
  • Таблицу «было / стало» по prompt caching
  • Порядок проверки cache-write расходов
  • Границы сравнения Codex, Claude Code и Cursor
  • Подтверждённые ценовые правила и пробелы в данных
Применить за 30 мин
14просмотров
Что в новости
  1. Что произошло с Codex на AWS Bedrock 9 августа 2026 года?
  2. Что было раньше и что изменилось в работе Codex через Bedrock?
  3. Что это меняет для того, кто собирает проект?
  4. Как проверить переплату Codex через Bedrock по шагам?
  5. Сколько стоит Codex через AWS Bedrock и что известно о доступности?
  6. Вопросы и ответы

Что произошло с Codex на AWS Bedrock 9 августа 2026 года?

В issue нет подтверждения неправильных счетов для всех пользователей или удорожания каждого запуска ровно в десять раз. Есть репорт о пробеле в интеграции Codex с explicit prompt caching и расчёт автора по данным использования.

Автор описал проблему так:

По описанию автора issue #37674, нативные запросы Codex CLI к Amazon Bedrock Mantle не поддерживали явное кэширование промпта для GPT-5.6 Sol: репозиторий OpenAI Codex.

В окружении были зафиксированы:

  • дата публикации issue - 9 августа 2026 года;
  • продукт - Codex CLI;
  • версия - 0.147.0;
  • провайдер - amazon-bedrock;
  • endpoint - Bedrock Mantle;
  • модель - openai.gpt-5.6-sol;
  • отсутствующие поля - prompt_cache_options и prompt_cache_breakpoint.

При этом Codex уже отправлял prompt_cache_key. Одного ключа оказалось недостаточно, чтобы обозначить стабильную границу большого префикса промпта. Именно эту границу и должен был задавать prompt_cache_breakpoint.

Автор issue #37674 привёл оценку за завершённые дни с 5 по 8 августа 2026 года: первоисточник.

ПоказательЗначение
Запросы3 656
Cache-write tokens171,94 млн
Расчётная стоимость cache writes$1 182,09
Расчётная общая стоимость$1 386,46

Около 85% расчётных расходов пришлись на записи в кэш. Это оценка по данным usage и Cost Explorer. Финальный AWS-инвойс в этих данных не подтверждён. Автор сопоставил эти данные с тарифной картой Bedrock.

Событие касается только Codex CLI с GPT-5.6 Sol через amazon-bedrock и Bedrock Mantle. Переносить вывод на Claude Code, Cursor, другие модели или способы подключения Codex нельзя.

Проверь запросы и отдельно cache read/write.

Что было раньше и что изменилось в работе Codex через Bedrock?

Кот смотрит на сравнение ключа кэша и границы промпта.

Codex vs Claude Code зависит от того, как контекст передаётся до ответа. В работе через Bedrock контекст и способ передать запрос влияют на расходы.

БылоСтало
prompt_cache_keyНет prompt_cache_options и prompt_cache_breakpoint
Повторяемый контекстПовторные cache writes
config.tomlНе исправляет отсутствие breakpoint

В issue #35300 без breakpoint было 0% попаданий и около 9 060 записываемых токенов. С breakpoint hit rate достиг 98,6%, а запись сократилась до 123-128 токенов.

В issue #35300 автор сообщает, что Codex не может отправить это поле: репозиторий OpenAI Codex.

Объём записи зависит от префикса, fork и compaction, поэтому десятикратное превышение не является правилом.

Для GPT-5.6 Sol подтверждены ставки: cache write 1,25x, cache read 0,1x. Запись в 12,5 раза дороже чтения. Поэтому долю расходов нужно проверять по фактической разбивке токенов и тарифу конкретной модели.

Держи стабильную часть до breakpoint, переменную после.

config.toml не задаёт breakpoint, а issue не подтверждает релиз с исправлением.

Практикум «Старт»

Три дня живой практики: от идеи до работающего проекта по ссылке

2 000 ₽старт 5 августа, 18:00 МСК

Что это меняет для того, кто собирает проект?

Claude Code или Codex не имеет универсального ответа: сопоставимого теста качества и оплаты нет.

Проверь четыре вещи:

  • cache-write и cache-read расходы Codex;
  • модель, регион и провайдера;
  • длину агентной сессии;
  • отдельную фактуру для сравнения с Cursor.

Для Claude Code проверь выбранную модель и закрепи её ID перед сравнением.

Я проверяю у Codex caching fields, а у Claude Code модель и prompt caching. Эти причины не смешивай.

Запись стоит 1,25x или 2x, чтение 0,1x. Разделяй эти категории.

Здесь сравниваются только расходы Bedrock и видимость cache writes.

В длинной сессии проверка расходов обязательна.

Как проверить переплату Codex через Bedrock по шагам?

Собака одобряет последовательность проверки расходов Codex через Bedrock.
  1. Зафиксируй параметры подключения.

    Перед сравнением запиши версию Codex, провайдера, модель и регион.

    Конфигурация события: 0.147.0, amazon-bedrock, Bedrock Mantle, openai.gpt-5.6-sol, us-east-1.

    Codex CLI: 0.147.0
    provider: amazon-bedrock
    endpoint: Bedrock Mantle
    model: openai.gpt-5.6-sol
    region: us-east-1
  2. Сними локальные счётчики токенов.

    В локальной телеметрии выпиши четыре значения завершённых ходов.

    Токен в локальной телеметрии представлен полями input_tokens, cached_input_tokens, cache_write_input_tokens и output_tokens; локальный аудит приблизителен.

  3. Сверь данные с AWS Cost Explorer.

    Открой период локальной сессии и сравни запросы и категории токенов.

    Источники считают данные по-разному, поэтому расхождения проверяй отдельно.

  4. Раздели cache write и cache read.

    Не объединяй категории: Bedrock отдельно считает input, output, cache read и cache write. В issue #37674 cache writes дали около 85% расчётных расходов.

    Аудит расходов Codex через Bedrock
    Сопоставь локальные данные Codex с AWS Cost Explorer.
    
    Проверь:
    - число запросов;
    - input_tokens;
    - cached_input_tokens;
    - cache_write_input_tokens;
    - output_tokens;
    - отдельную стоимость cache write;
    - отдельную стоимость cache read;
    - регион вызова;
    - модель и провайдера.
    
    Не называй локальную оценку AWS invoice. Если не хватает ставки для модели, явно напиши, что точная стоимость не подтверждена.
  5. Ограничь длинные агентные сессии.

    Если cache writes выше cache reads, наблюдай длинный цикл.

    Я разделяю задачу на короткие сессии: это ограничивает повторную работу, но не исправляет отсутствие breakpoint.

  6. Сравни другой способ подключения.

    При высокой доле cache writes сравни другой путь, не меняя модель, задачу и регион.

    Я считаю разницу конфигураций, а не преимущество инструмента: релиз с этими полями не подтверждён.

Практикум «Старт»

Три дня живой практики: от идеи до работающего проекта по ссылке

2 000 ₽старт 5 августа, 18:00 МСК

Сколько стоит Codex через AWS Bedrock и что известно о доступности?

Мужчина закрывает лицо перед карточками ставок записи и чтения из кэша.

Анализ только input и output занижает расходы при prompt caching.

Без model rate card и разбивки токенов точную цену Codex не назвать.

Полной официальной тарифной карты GPT-5.6 Sol в фактуре нет, однако для этой связки подтверждено соотношение cache write и cache read: 1,25x против 0,1x, то есть запись в 12,5 раза дороже чтения. Сумма $1 386,46 не является ценой запроса или месячным тарифом.

Для Anthropic правила prompt caching описаны отдельно:

  • запись на 5 минут - 1,25 от базовой цены входа;
  • запись на 1 час - 2 от базовой цены входа;
  • чтение из кэша - 0,1 от базовой цены входа.

Эти правила относятся к Anthropic и не задают цену GPT-5.6 Sol. Переносить их на Codex нельзя.

Cross-region inference не имеет отдельной routing-комиссии. Регион обработки проверяй через additionalEventData.inferenceRegion в CloudTrail.

Что неизвестно по доступности:

  • работает ли Codex через AWS Bedrock из России;
  • в каких регионах доступен именно Codex;
  • какие требования предъявляются к AWS account;
  • какие дневные, месячные или аккаунтные лимиты действуют;
  • в какой версии Codex появится исправление.

Я не буду закрывать эти пробелы догадками. Для них нужны актуальные официальные данные AWS и OpenAI.

Вопросы и ответы

Вопросы и ответы

Что лучше Claude Code или Codex?

По этой фактуре нельзя честно назвать один инструмент лучшим по качеству. Для Codex через Bedrock сначала проверь cache-write расходы и способ подключения. Для Claude Code отдельно проверь фактически выбранную модель перед сравнением.

Claude Code vs Codex vs Cursor: что выбрать?

Сопоставимого теста трёх инструментов нет. Для Codex подтверждена проблема explicit prompt caching в конкретной конфигурации Bedrock, а по Cursor нет данных для сравнения.

Cursor vs Claude Code vs OpenAI Codex: что дешевле?

Точный ответ отсутствует: по GPT-5.6 Sol нет полной тарифной карты, а по Cursor нет данных для расчёта. Claude Code нужно считать по модели и объёму токенов.

Что выбрать: Claude или Codex и Cursor?

Не выбирай по названию: зафиксируй задачу, модель, способ подключения и категории расходов. Для Codex проверь cache writes, для Claude Code закрепи модель, а Cursor сравнивай отдельно.

GPT Codex или Claude: что выгоднее?

В issue #37674 эта codex переплата оценивается в $1 386,46 за 3 656 запросов, около 85% пришлось на cache writes. Это не тариф. Сравнивать можно только одинаковую нагрузку и полные ставки.

Cursor, Claude Code или Codex: что выбрать новичку?

Если главное - понять неожиданные расходы, начни с отдельного учёта input, output, cache read и cache write. Универсального вывода по простоте и качеству нет.

Почему возникает ошибка Codex при работе через AWS Bedrock?

Вызовы могли проходить без явной ошибки: нативный провайдер amazon-bedrock не передавал prompt_cache_options и prompt_cache_breakpoint, поэтому стабильный префикс мог записываться заново.

Как работа Codex через AWS Bedrock влияет на итоговую стоимость?

Bedrock отдельно считает input, output, cache read и cache write. В issue #37674 доля cache writes составила около 85% расчётных расходов за 5-8 августа, но финальный инвойс не подтверждён. Проверь четыре категории в локальной телеметрии и AWS Cost Explorer.

Источники

Практикум «Старт»

Три дня живой практики: от идеи до работающего проекта по ссылке

2 000 ₽старт 5 августа, 18:00 МСК

Материал был полезен?
Сергей Мазур
Автор
Сергей Мазур
Основатель Вайбцеха

Собираю продукты с ИИ-агентами и рассказываю, как это делать без программиста.

Читайте также

Термины из инструкции