24 апреля 2026 года OpenAI выкатила в API GPT-5.5 и GPT-5.5 Pro — обе модели доступны и в Chat Completions, и в Responses API. В changelog разработчика перечислен набор возможностей: контекстное окно в 1 миллион токенов, изображения на вход, structured outputs и function calling.
Два пункта в этом списке легко проскочить взглядом, а они как раз про деньги и поведение в проде. Первый: reasoning_effort по умолчанию теперь medium. Второй: кэширование у GPT-5.5 ограничено только extended prompt caching — привычный автоматический механизм здесь работает не так, как вы могли настроить его на прошлом поколении.
Ценник тоже сдвинулся: тарифы выросли, но конкретных цифр OpenAI в changelog не приводит, а страница анонса недоступна для проверки — поэтому цены здесь не называем. Сверяйтесь с официальной страницей тарифов, прежде чем закладывать стоимость в смету.
Апрель у OpenAI вообще выдался плотным. 15 апреля Agents SDK научился запускать агентов в контролируемых песочницах и открыл для инспекции и правки свой опенсорсный harness — то есть цикл «модель → инструменты → результат» перестал быть чёрным ящиком. 21 апреля вышла GPT Image 2 с гибкими размерами картинок, токенной тарификацией и поддержкой Batch API со скидкой 50%. А 6 мая Agents SDK с песочницами доехал до TypeScript — до этого продвинутая версия жила только в Python.
Что это значит для практика. Удвоение цены на входе — повод пересчитать, а не пережить: если ваш пайплайн гоняет одинаковый системный промпт на каждый запрос, разница между кэш-хитом и кэш-миссом кратная, и организация промпта (стабильный префикс, переменная часть в конце) внезапно стоит реальных денег. Всё, что можно увести в Batch API — ночные переиндексации, разметка, регрессионные эвалы, — там же и должно жить: пакетная обработка остаётся заметно дешевле синхронной. И проверьте reasoning_effort явно: молчаливый medium по умолчанию — это либо лишние выходные токены на простых вызовах, либо недостаточно думающая модель на сложных, в зависимости от того, что у вас за нагрузка.
Комментарии