Share GPT-6 рассчитан на то, чтобы постоянные агенты часами выполняли сложные задачи, такие как реорганизация кодовых баз, подготовка исследовательских документов и презентаций. В последовательных API-запросах этих агентов повторяющиеся инструкции, описания инструментов и контекст кэшируются, благодаря чему вычисления используются повторно; время ответа сокращается, а разработчики получают скидку до 90% на кэшированные входные токены. Семейство GPT-6 представляет новую систему кэширования, которая по умолчанию обеспечивает более высокий процент попаданий. Подходящие общие префиксы подпадают под скидку при повторном использовании в течение 30-минутного окна.
- Prompt Caching Dashboard показывает объем входных данных, предоставленных из кэша, и показатели попаданий с течением времени; он позволяет сравнивать кэшированные и некэшированные токены.
- Prompt caching diagnostics tool сравнивает изменения в модели, инструментах, настройках или входных данных при промахах кэша. В примере причина указана как «tools_changed», число сопоставимых повторно используемых токенов — 5629, а число токенов при промахе — 5629.
- С помощью явных точек разрыва кэша можно выбрать, какие префиксы инструкций будут сохраняться.
- В моделях GPT-6 параметр reasoning effort можно менять между ответами, не нарушая кэш.
- Описания инструментов, схемы и порядок можно сохранять неизменными; можно использовать allowed_tools или tool_choice.
- Новые сообщения developer можно добавлять в конец контекста, чтобы они отменяли предыдущие инструкции.
- Prewarming подготавливает общий контекст до запроса пользователя. Codex помогает просматривать код и применять улучшения.
Почему это важно
Эта оптимизация упрощает управление затратами и задержками, возникающими из-за того, что долгоживущие агенты на каждом шаге заново обрабатывают одни и те же инструкции, сведения об инструментах и контекст. В частности, разработчики приложений, работающих с кодовыми базами, создающих документы или выполняющих несколько вызовов API, смогут оценивать производительность не только по ответу модели, но и по эффективности использования кэша. Dashboard и инструмент диагностики делают процесс отладки более предметным, показывая, вызвано ли кэш-промах изменениями в инструментах, настройках или входных данных. Возможность задавать явные точки разрыва и менять уровень рассуждений позволяет установить более контролируемую взаимосвязь между поведением агента и использованием кэша. Однако масштаб выигрыша по-прежнему зависит от того, в какой степени общие префиксы и конфигурацию инструментов удаётся сохранять на протяжении всего рабочего процесса.
Предыстория
GPT — не новое имя в архиве FikirPilot: за последние 90 дней мы опубликовали 4 новости, в которых упоминалось это имя; самая свежая датирована 29 сентября 2026 года.
Термин: агент
Агент искусственного интеллекта — это программное обеспечение, которое не просто генерирует один ответ, а вызывает инструменты и выполняет многоэтапную работу для достижения цели.