Что произошло с Codex на AWS Bedrock 9 августа 2026 года?
В issue нет подтверждения неправильных счетов для всех пользователей или удорожания каждого запуска ровно в десять раз. Есть репорт о пробеле в интеграции Codex с explicit prompt caching и расчёт автора по данным использования.
Автор описал проблему так:
По описанию автора issue #37674, нативные запросы Codex CLI к Amazon Bedrock Mantle не поддерживали явное кэширование промпта для GPT-5.6 Sol: репозиторий OpenAI Codex.
В окружении были зафиксированы:
- дата публикации issue - 9 августа 2026 года;
- продукт - Codex CLI;
- версия -
0.147.0; - провайдер -
amazon-bedrock; - endpoint - Bedrock Mantle;
- модель -
openai.gpt-5.6-sol; - отсутствующие поля -
prompt_cache_optionsиprompt_cache_breakpoint.
При этом Codex уже отправлял prompt_cache_key. Одного ключа оказалось недостаточно, чтобы обозначить стабильную границу большого префикса промпта. Именно эту границу и должен был задавать prompt_cache_breakpoint.
Автор issue #37674 привёл оценку за завершённые дни с 5 по 8 августа 2026 года: первоисточник.
| Показатель | Значение |
|---|---|
| Запросы | 3 656 |
| Cache-write tokens | 171,94 млн |
| Расчётная стоимость cache writes | $1 182,09 |
| Расчётная общая стоимость | $1 386,46 |
Около 85% расчётных расходов пришлись на записи в кэш. Это оценка по данным usage и Cost Explorer. Финальный AWS-инвойс в этих данных не подтверждён. Автор сопоставил эти данные с тарифной картой Bedrock.
Событие касается только Codex CLI с GPT-5.6 Sol через amazon-bedrock и Bedrock Mantle. Переносить вывод на Claude Code, Cursor, другие модели или способы подключения Codex нельзя.
Проверь запросы и отдельно cache read/write.
Что было раньше и что изменилось в работе Codex через Bedrock?

Codex vs Claude Code зависит от того, как контекст передаётся до ответа. В работе через Bedrock контекст и способ передать запрос влияют на расходы.
| Было | Стало |
|---|---|
prompt_cache_key | Нет prompt_cache_options и prompt_cache_breakpoint |
| Повторяемый контекст | Повторные cache writes |
config.toml | Не исправляет отсутствие breakpoint |
В issue #35300 без breakpoint было 0% попаданий и около 9 060 записываемых токенов. С breakpoint hit rate достиг 98,6%, а запись сократилась до 123-128 токенов.
В issue #35300 автор сообщает, что Codex не может отправить это поле: репозиторий OpenAI Codex.
Объём записи зависит от префикса, fork и compaction, поэтому десятикратное превышение не является правилом.
Для GPT-5.6 Sol подтверждены ставки: cache write 1,25x, cache read 0,1x. Запись в 12,5 раза дороже чтения. Поэтому долю расходов нужно проверять по фактической разбивке токенов и тарифу конкретной модели.
Держи стабильную часть до breakpoint, переменную после.
config.toml не задаёт breakpoint, а issue не подтверждает релиз с исправлением.
Prompt caching не гарантирует экономию. Отдельно анализируй cache write, cache read и значение «cached».
Практикум «Старт»
Три дня живой практики: от идеи до работающего проекта по ссылке
2 000 ₽старт 5 августа, 18:00 МСК
Что это меняет для того, кто собирает проект?
Claude Code или Codex не имеет универсального ответа: сопоставимого теста качества и оплаты нет.
Проверь четыре вещи:
- cache-write и cache-read расходы Codex;
- модель, регион и провайдера;
- длину агентной сессии;
- отдельную фактуру для сравнения с Cursor.
Для Claude Code проверь выбранную модель и закрепи её ID перед сравнением.
Я проверяю у Codex caching fields, а у Claude Code модель и prompt caching. Эти причины не смешивай.
Запись стоит 1,25x или 2x, чтение 0,1x. Разделяй эти категории.
Здесь сравниваются только расходы Bedrock и видимость cache writes.
В длинной сессии проверка расходов обязательна.
Как проверить переплату Codex через Bedrock по шагам?

Зафиксируй параметры подключения.
Перед сравнением запиши версию Codex, провайдера, модель и регион.
Конфигурация события:
0.147.0,amazon-bedrock, Bedrock Mantle,openai.gpt-5.6-sol,us-east-1.Codex CLI: 0.147.0 provider: amazon-bedrock endpoint: Bedrock Mantle model: openai.gpt-5.6-sol region: us-east-1Сними локальные счётчики токенов.
В локальной телеметрии выпиши четыре значения завершённых ходов.
Токен в локальной телеметрии представлен полями
input_tokens,cached_input_tokens,cache_write_input_tokensиoutput_tokens; локальный аудит приблизителен.Сверь данные с AWS Cost Explorer.
Открой период локальной сессии и сравни запросы и категории токенов.
Источники считают данные по-разному, поэтому расхождения проверяй отдельно.
Раздели cache write и cache read.
Не объединяй категории: Bedrock отдельно считает input, output, cache read и cache write. В issue #37674 cache writes дали около 85% расчётных расходов.
Аудит расходов Codex через BedrockСопоставь локальные данные Codex с AWS Cost Explorer. Проверь: - число запросов; - input_tokens; - cached_input_tokens; - cache_write_input_tokens; - output_tokens; - отдельную стоимость cache write; - отдельную стоимость cache read; - регион вызова; - модель и провайдера. Не называй локальную оценку AWS invoice. Если не хватает ставки для модели, явно напиши, что точная стоимость не подтверждена.
Ограничь длинные агентные сессии.
Если cache writes выше cache reads, наблюдай длинный цикл.
Я разделяю задачу на короткие сессии: это ограничивает повторную работу, но не исправляет отсутствие breakpoint.
Сравни другой способ подключения.
При высокой доле cache writes сравни другой путь, не меняя модель, задачу и регион.
Я считаю разницу конфигураций, а не преимущество инструмента: релиз с этими полями не подтверждён.
Практикум «Старт»
Три дня живой практики: от идеи до работающего проекта по ссылке
2 000 ₽старт 5 августа, 18:00 МСК
Сколько стоит Codex через AWS Bedrock и что известно о доступности?

Анализ только input и output занижает расходы при prompt caching.
Без model rate card и разбивки токенов точную цену Codex не назвать.
Полной официальной тарифной карты GPT-5.6 Sol в фактуре нет, однако для этой связки подтверждено соотношение cache write и cache read: 1,25x против 0,1x, то есть запись в 12,5 раза дороже чтения. Сумма $1 386,46 не является ценой запроса или месячным тарифом.
Для Anthropic правила prompt caching описаны отдельно:
- запись на 5 минут - 1,25 от базовой цены входа;
- запись на 1 час - 2 от базовой цены входа;
- чтение из кэша - 0,1 от базовой цены входа.
Эти правила относятся к Anthropic и не задают цену GPT-5.6 Sol. Переносить их на Codex нельзя.
Cross-region inference не имеет отдельной routing-комиссии. Регион обработки проверяй через additionalEventData.inferenceRegion в CloudTrail.
Что неизвестно по доступности:
- работает ли Codex через AWS Bedrock из России;
- в каких регионах доступен именно Codex;
- какие требования предъявляются к AWS account;
- какие дневные, месячные или аккаунтные лимиты действуют;
- в какой версии Codex появится исправление.
Я не буду закрывать эти пробелы догадками. Для них нужны актуальные официальные данные AWS и OpenAI.
Вопросы и ответы
Вопросы и ответы
Что лучше Claude Code или Codex?
По этой фактуре нельзя честно назвать один инструмент лучшим по качеству. Для Codex через Bedrock сначала проверь cache-write расходы и способ подключения. Для Claude Code отдельно проверь фактически выбранную модель перед сравнением.
Claude Code vs Codex vs Cursor: что выбрать?
Сопоставимого теста трёх инструментов нет. Для Codex подтверждена проблема explicit prompt caching в конкретной конфигурации Bedrock, а по Cursor нет данных для сравнения.
Cursor vs Claude Code vs OpenAI Codex: что дешевле?
Точный ответ отсутствует: по GPT-5.6 Sol нет полной тарифной карты, а по Cursor нет данных для расчёта. Claude Code нужно считать по модели и объёму токенов.
Что выбрать: Claude или Codex и Cursor?
Не выбирай по названию: зафиксируй задачу, модель, способ подключения и категории расходов. Для Codex проверь cache writes, для Claude Code закрепи модель, а Cursor сравнивай отдельно.
GPT Codex или Claude: что выгоднее?
В issue #37674 эта codex переплата оценивается в $1 386,46 за 3 656 запросов, около 85% пришлось на cache writes. Это не тариф. Сравнивать можно только одинаковую нагрузку и полные ставки.
Cursor, Claude Code или Codex: что выбрать новичку?
Если главное - понять неожиданные расходы, начни с отдельного учёта input, output, cache read и cache write. Универсального вывода по простоте и качеству нет.
Почему возникает ошибка Codex при работе через AWS Bedrock?
Вызовы могли проходить без явной ошибки: нативный провайдер amazon-bedrock не передавал prompt_cache_options и prompt_cache_breakpoint, поэтому стабильный префикс мог записываться заново.
Как работа Codex через AWS Bedrock влияет на итоговую стоимость?
Bedrock отдельно считает input, output, cache read и cache write. В issue #37674 доля cache writes составила около 85% расчётных расходов за 5-8 августа, но финальный инвойс не подтверждён. Проверь четыре категории в локальной телеметрии и AWS Cost Explorer.
Источники
- Native Bedrock Codex GPT-5.6 Sol lacks explicit cache controls, producing high cache-write spend - Issue #37674
- GPT-5.6 prompt caching: Codex cannot emit
prompt_cache_breakpoint- Issue #35300 - Claude Code on Amazon Bedrock
- Pricing - Anthropic
- Understanding Amazon Bedrock Cost and Usage Report data
- Prompt caching for faster model inference
- Inference profiles in Amazon Bedrock
- Cross-Region inference in Amazon Bedrock
- Codex local token telemetry
Практикум «Старт»
Три дня живой практики: от идеи до работающего проекта по ссылке
2 000 ₽старт 5 августа, 18:00 МСК

