Share GPT-6, kalıcı ajanların kod tabanlarını yeniden düzenleme, araştırılmış belgeler ve sunumlar hazırlama gibi karmaşık görevlerde saatlerce çalışmasını hedefliyor. Bu ajanların art arda yaptığı API isteklerinde tekrarlanan talimat, araç tanımları ve bağlam önbelleğe alınarak hesaplama yeniden kullanılıyor; yanıt süreleri kısalıyor ve geliştiriciler önbelleğe alınan girdi belirteçlerinde %90’a varan indirim elde ediyor. GPT-6 ailesi, varsayılan olarak daha yüksek isabet oranı sunan yeni bir önbellekleme sistemi getiriyor. Uygun ortak önekler, 30 dakikalık pencere içinde yeniden kullanıldığında indirim kapsamına giriyor.
- Prompt Caching Dashboard, önbellekten sunulan girdi miktarını ve zaman içindeki isabet oranlarını gösteriyor; önbelleğe alınan ve alınmayan belirteçleri karşılaştırmaya yarıyor.
- Prompt caching diagnostics tool, önbellek kaçırmalarında model, araçlar, ayarlar veya girdilerdeki değişiklikleri karşılaştırıyor. Örnekte neden “tools_changed”, karşılaştırılabilir yeniden kullanılabilir belirteç sayısı 5629 ve kaçırılan belirteç sayısı 5629 olarak veriliyor.
- Açık önbellek kesme noktalarıyla hangi talimat öneklerinin saklanacağı seçilebiliyor.
- GPT-6 modellerinde reasoning effort, önbelleği bozmadan yanıtlar arasında değiştirilebiliyor.
- Araç tanımları, şemalar ve sıralama sabit tutulabiliyor; allowed_tools veya tool_choice kullanılabiliyor.
- Yeni developer mesajları, eski talimatları geçersiz kılmak üzere bağlamın sonuna eklenebiliyor.
- Prewarming, ortak bağlamı kullanıcı isteğinden önce hazırlıyor. Codex ise kodu inceleyip iyileştirmeleri uygulamaya yardımcı oluyor.
Neden önemli
Bu düzenleme, uzun süreli ajanların her adımda aynı talimat, araç bilgisi ve bağlamı yeniden işlemesinden kaynaklanan maliyet ve gecikmeyi yönetmeyi kolaylaştırıyor. Özellikle kod tabanları üzerinde çalışan, belge üreten veya birden çok API çağrısı yapan uygulamaların geliştiricileri, performansı yalnızca model yanıtıyla değil, önbelleğin ne kadar etkili kullanıldığıyla da değerlendirebilecek. Dashboard ve tanılama aracı, bir önbellek kaçırmasının araçlar, ayarlar ya da girdilerdeki değişikliklerden kaynaklanıp kaynaklanmadığını görünür kılarak hata ayıklama sürecini somutlaştırıyor. Açık kesme noktaları ile akıl yürütme düzeyinin değiştirilebilmesi, ajan davranışı ile önbellek kullanımı arasında daha kontrollü bir ilişki kuruyor. Ancak kazanımın kapsamı, ortak öneklerin ve araç yapılandırmasının iş akışı boyunca ne ölçüde korunabildiği sorusuna bağlı kalıyor.
Arka plan
GPT, FikirPilot arşivinde yeni bir ad değil: son 90 günde bu adın geçtiği 4 haber yayımladık; en yenisi 29 Eylül 2026 tarihli.
Terim: ajan
Yapay zekâ ajanı, tek bir yanıt üretmek yerine hedefe ulaşmak için araç çağırıp çok adımlı iş yürüten yazılımdır.