OpenAI
Bu sayfanın çevirisi otomatik olarak yapılmıştır. Orijinal İngilizce makaleyi görüntüleyin.

Hızlı mod SSS

Hızlı mod ve Ultrafast hizmet kademesi hakkında sık sorulan sorular.

Güncellenme zamanı: 3 days ago

Belirli modellerde daha hızlı ve daha tutarlı performansa erişmek isteyen API müşterilerine Hızlı mod sunuyoruz. Aşağıda bu modun işleyişi, fiyatlandırması, model kullanılabilirliği, işlem limitleri, güvenilirliği, politikaları ve uygunluk koşullarıyla ilgili sık sorulan soruların yanıtlarını bulabilirsiniz.

Not: Öncelikli işleme, 30 Temmuz 2026'da Hızlı mod olarak yeniden adlandırıldı. API isteklerinizde service_tier: priority veya service_tier: fast seçeneklerinden birini kullanabilirsiniz. 

Daha fazla bilgiye buradan ulaşabilirsiniz.

Hızlı mod tüm bölgelerde kullanılabilir mi?

Hızlı modun kullanılabilirliği, her yargı alanındaki geçerli yasa ve düzenlemelere bağlıdır. Bölgenizdeki kullanılabilirlikle ilgili sorularınız varsa lütfen Müşteri Direktörünüzle iletişime geçin.

Nasıl çalışır?

Müşteriler, mevcut service_tier parametresinde service_tier = "fast" seçeneğini kullanarak trafiği istek bazında Hızlı moda yönlendirebilir.

Hızlı modda işlenen token'lar, Standart işleme tarifesinden daha yüksek bir ücretle token başına faturalandırılır.

Hızlı modu istek düzeyinde ayarlamanın yanı sıra, Proje ayarları > Varsayılan Hizmet Kademesi: Hızlı yolunu izleyerek bir projenin varsayılanı olarak da belirleyebilirsiniz. Bu ayarı her istek için ayrı ayrı değiştirmeye devam edebilirsiniz. Proje ayarlarınızda Hızlı seçeneğini belirlemek, Öncelikli seçeneğini belirlemekle aynıdır.

Hızlı mod ile Ölçek Kademesi arasındaki ilişki nedir?

Ölçek Kademesi, Hızlı moddan ayrı kalmaya devam edecek. Hızlı moda gönderilen istekler ayrı olarak faturalandırılır ve satın aldığınız Ölçek Kademesi TPM paketlerinden düşülmez.

Ölçek Kademesi kotasını aşan trafiğimi otomatik olarak Hızlı moda yönlendirebilir miyim?

Hayır. Ölçek Kademesine gönderilen trafik, kota aşıldığında otomatik olarak Hızlı moda yönlendirilmez.

Hızlı mod nasıl faturalandırılır?

Hızlı modda işlenen token'lar, Standart işleme tarifesinden daha yüksek bir ücretle token başına faturalandırılır.

Yıllık taahhüdüm belirli bir işleme moduna mı bağlı?

Hayır. Tüm işleme modlarındaki harcamalarınız, yıllık Enterprise harcama taahhüdünüze sayılır.

Önbelleğe alınmış girdi token'larında indirim almaya devam eder miyim?

Evet! Önbelleğe alınmış girdilere, Standart işlemede olduğu gibi %50–75 indirim uygulanır.

Hızlı mod kullanımımı ve harcamalarımı nasıl görüntüleyebilirim?

Hızlı modda (eski adıyla Öncelikli işleme) işlenen token'ları görüntülemek için Kullanım panosuna gidin, Chat Completions veya Responses'ı seçin ve Hizmet Kademesine göre gruplandırın.

Hızlı mod maliyetini görüntülemek için Kullanım panosuna gidin ve Fatura kalemine göre gruplandır seçeneğini belirleyin.

Kullanım panosunda, service_tier değeri olarak priority veya fast kullanan istekler priority olarak görünmeye devam edecek. Bu gösterim, gelecekteki modeller için güncellenecek.

Modeller

Hızlı mod uzun bağlam, ince ayarlanmış modeller, gömmeler vb. için kullanılabilir mi?

Şu anda kullanılamıyor. İleride Hızlı modu en yeni modellerimiz dışındaki ürünlerde de sunmayı değerlendireceğiz.

Hızlı mod diğer modalitelerle nasıl çalışır?

Hızlı mod, Standart kademede sunulan çok modlu yeteneklerin aynısını destekler. Özellikle görseller, Öncelikli işlemede girdi olarak kullanılabilir ve aynı düşük gecikmeyle işlenir.

Gelecekteki modeller desteklenecek mi?

Yeni GPT modellerinde Hızlı modu sunmayı planlıyoruz ancak her modelin destekleneceğini garanti etmiyoruz.

İşlem limitleri

İşlem limitleri nelerdir?

Öncelikli işleme kullanımı, işlem limitleri açısından standart API trafiğiyle aynı şekilde değerlendirilir.

İşlem artış hızı limitleri nelerdir?

Hızlı mod, esnek ve talebe bağlı fiyatlandırma sunarken tüm müşterilere sürekli yüksek performans sağlamak için işlem artış hızı limitleri uygular. Hem (a) Hızlı mod performansı düşüyorsa HEM DE (b) bir müşterinin trafiği çok hızlı artıyorsa, nadiren bazı istekler daha düşük bir kademe olan Standart işlemeye yönlendirilebilir.

Hızlı mod için geçerli işlem artış hızı limiti, buradaki ana dokümantasyonumuzda tanımlanmıştır.

İşlem artış hızı limitinizi aşmamak için en iyi uygulamalar

Model değiştirirken trafiği kademeli olarak artırın. Örneğin uygulamanız önceki bir model sürümünden yenisine geçiyorsa, trafiği tek seferde değil birkaç saate yayarak yönlendirmek için bir özellik bayrağı kullanın.

Hızlı modda büyük veri işleme görevleri veya asenkron görevler çalıştırmaktan kaçının. Bu görevler trafiği çok hızlı artırabilir ve genellikle Hızlı modun sunduğu daha yüksek performansa ihtiyaç duymaz.

İşlem artış hızı limitlerine sık sık takılıyorsanız, bunun yerine Ölçek Kademesi kotası satın almayı değerlendirin.

İşlem artış hızı limitleri projelerim veya kuruluşlarım arasında ortak mı?

Evet, tüm trafiğiniz aynı işlem artış hızı limitine tabi tutulur.

Politikalar

Hızlı mod gecikme hedefine ulaşamazsa ne olur?

Sorularınız veya endişeleriniz için lütfen AD'nizle iletişime geçin. Hızlı mod SLA'ları, Ölçek Kademesi SLA'larıyla aynı şekilde ele alınır. Enterprise sözleşmesi olan müşteriler için belirli bir zaman aralığında bu SLA'ları karşılayamazsak hizmet kredileri sunulur.

Hızlı mod veri yerleşimi ile uyumlu mu?

Evet.

Hızlı mod ZDR ve BAA ile uyumlu mu?

Evet.

GPT-6 Astra için Ultrafast

Ultrafast, etkileşimli uygulamalar ve kodlama iş akışları gibi daha düşük gecikmeli GPT-6 Astra yanıtlarına ihtiyaç duyan iş yükleri için ayrı bir hizmet kademesidir.

Hızlı modun fiyatlandırma, işlem limiti ve politika yönergeleri, service_tier="fast" kullanan istekler için geçerlidir. Ultrafast istekleri, ayrı bir kademe olan service_tier="ultrafast" kademesini kullanır.

Ultrafast isteği nasıl gönderilir?

Ultrafast erişimi olan bir kuruluş için Responses API'yi şu ayarlarla kullanın:

  • Model: gpt-6-astra

  • Hizmet kademesi: ultrafast

  • İstek üst bilgisi: OpenAI-Service-Tier: ultrafast

Hizmet kademesi ayarına ek olarak istek üst bilgisi de gereklidir.

Araç çağrıları gerçekleştiren uygulamalarda WebSocket modu, bir bağlantıyı konuşma turları boyunca yeniden kullanmanıza ve bağlantı kurmanın getirdiği ek yükü azaltmanıza olanak tanır.

Aynı istek üst bilgisini diğer hizmet kademeleri için kullanabilir miyim?

Ultrafast alfa sürecinde OpenAI-Service-Tier üst bilgisi yalnızca ultrafast değerini kabul eder. default, fast veya flex dahil başka bir değer gönderilmesi HTTP 400 hatası döndürür. Başka bir kademe kullanırken bu üst bilgiyi eklemeyin.

Ultrafast'ı Çalışma veya Codex'te kullanabilir miyim?

Ultrafast, uygun planlar ve çalışma alanları için Çalışma ve Codex'te de kullanılabilir. ChatGPT planlarındaki uygunluk koşulları ve kullanım, API erişiminden farklıdır.

Kullanılabilirlik ve kullanım ayrıntıları için ChatGPT Çalışma ve Codex makalesine bakın.

Bu makale yararlı oldu mu?