OpenAI
Ez az oldal gépi fordítással készült. Tekintsd meg az eredeti angol nyelvű cikket.

Gyors mód – gyakori kérdések

Gyakran ismételt kérdések a Gyors módról és az Ultrafast szolgáltatási szintről.

Frissítve: 4 days ago

A Gyors módot azoknak az API-ügyfeleknek kínáljuk, akik bizonyos modellek esetében gyorsabb és egyenletesebb teljesítményt szeretnének. Az alábbiakban választ adunk a működéssel, az árakkal, a modellek elérhetőségével, a használati korlátokkal, a megbízhatósággal, a szabályzatokkal és az igénybevételi jogosultsággal kapcsolatos gyakori kérdésekre.

Megjegyzés: A Priority processing neve 2026. július 30-án Gyors módra változott. Az API-kérésekben a service_tier: priority és a service_tier: fast egyaránt használható. 

További információ itt.

Minden régióban elérhető a Gyors mód?

A Gyors mód elérhetősége az egyes joghatóságokban alkalmazandó törvényektől és rendeletektől függ. Ha kérdése van a szolgáltatás elérhetőségével kapcsolatban az Ön régiójában, forduljon ügyfélkapcsolati igazgatójához.

Hogyan működik?

Az ügyfelek kérésenként irányíthatják a forgalmat a Gyors módba a meglévő service_tier paraméter service_tier = "fast" beállításával.

A Gyors módban feldolgozott tokeneket tokenenként számlázzuk, a normál feldolgozás díjainál magasabb áron.

A kérésenkénti beállítás mellett a projekt alapértelmezett módjaként is megadhatod a Gyors módot itt: Projektbeállítások > Alapértelmezett szolgáltatási szint: Gyors. Ezt továbbra is felülírhatod kérésenként. A projektbeállításokban a Gyors lehetőség kiválasztása egyenértékű az Elsőbbségi lehetőség kiválasztásával.

Hogyan kapcsolódik ez a Skálázási szinthez?

A Skálázási szint továbbra is elkülönül a Gyors módtól. A Gyors módba küldött kéréseket külön számlázzuk, és nem számítanak bele a Skálázási szinten vásárolt TPM-csomagjaidba.

Átirányíthatom automatikusan a Skálázási szint kvótáján felüli forgalmamat a Gyors módba?

Nem. A Skálázási szintre küldött forgalom a kvóta túllépésekor nem kerül át automatikusan a Gyors módba.

Hogyan történik a Gyors mód számlázása?

A Gyors módban feldolgozott tokeneket tokenenként számlázzuk, a normál feldolgozás díjainál magasabb áron.

Az éves költési vállalásom egy adott feldolgozási módhoz kötődik?

Nem. Minden feldolgozási mód használata beleszámít az Enterprise-szerződésedben vállalt éves költésbe.

Továbbra is kapok kedvezményt a gyorsítótárazott bemeneti tokenekre?

Igen! A gyorsítótárazott bemenetekre ugyanaz az 50–75%-os kedvezmény vonatkozik, mint a normál feldolgozásnál.

Hol nézhetem meg a Gyors mód használatát és költségeit?

A Gyors módban (korábbi nevén elsőbbségi feldolgozás) feldolgozott tokenek megtekintéséhez nyisd meg a Használat irányítópultot, válaszd a Chat Completions vagy a Responses lehetőséget, majd a Csoportosítás szolgáltatási szint szerint beállítást.

A Gyors mód költségeinek megtekintéséhez nyisd meg a Használat irányítópultot, és válaszd a Csoportosítás számlatétel szerint beállítást.

A Használat irányítópulton azok a kérések, amelyeknél a service_tier értéke priority vagy fast, továbbra is priority megjelöléssel jelennek meg. Ezt a jövőbeli modelleknél frissítjük.

Modellek

Elérhető a Gyors mód hosszú kontextus, finomhangolt modellek, beágyazások stb. esetén?

Jelenleg nem. A jövőben megvizsgáljuk, hogy a legújabb modelljeinken túl további termékekhez is elérhetővé tegyük-e a Gyors módot.

Hogyan működnek a többi modalitások a Gyors módban?

A Gyors mód ugyanazokat a multimodális képességeket támogatja, mint a normál feldolgozás. Az elsőbbségi feldolgozás például képeket is fogad bemenetként, és ezeket ugyanolyan alacsony késleltetéssel dolgozza fel.

A jövőbeli modellek is támogatottak lesznek?

Tervezzük, hogy az új GPT-modellekhez is elérhetővé tesszük a Gyors módot, de nem garantáljuk, hogy minden modell támogatott lesz.

Használati korlátok

Milyen használati korlátok vannak?

A használati korlátok szempontjából az elsőbbségi feldolgozás használata ugyanúgy számít, mint a normál API-forgalom.

Milyen korlátok vonatkoznak a felfutási sebességre?

A Gyors mód korlátozza a felfutási sebességet, hogy minden ügyfél számára egyenletesen magas teljesítményt biztosítson, miközben rugalmas, használatalapú díjszabást kínál. Ha (a) a Gyors mód teljesítménye romlik, ÉS (b) egy ügyfél forgalma túl gyorsan növekszik, akkor ritka esetekben egyes kérések normál feldolgozásra kerülhetnek át.

A Gyors mód aktuális felfutási sebességkorlátját itt, a fő dokumentációnkban határozzuk meg.

Bevált módszerek a felfutási sebességkorlát betartásához

Modellváltáskor fokozatosan növeld a forgalmat. Ha például az alkalmazásod egy korábbi modellverzióról újra áll át, használj funkciókapcsolót, és néhány óra alatt, fokozatosan irányítsd át a forgalmat, ne egyszerre.

Kerüld a nagy adatfeldolgozási vagy aszinkron feladatok futtatását Gyors módban. Ezek a feladatok nagyon gyorsan megnövelhetik a forgalmat, és gyakran nincs szükségük a Gyors mód nagyobb teljesítményére.

Ha rendszeresen eléred a felfutási sebességkorlátot, fontold meg inkább kvóta vásárlását a Skálázási szinten.

A projektjeimre és szervezeteimre közös felfutási sebességkorlát vonatkozik?

Igen, a teljes forgalmadra ugyanaz a közös felfutási sebességkorlát vonatkozik.

Szabályzatok

Mi történik, ha a Gyors mód nem teljesíti a késleltetési célértéket?

Kérdés vagy probléma esetén fordulj az AD-kapcsolattartódhoz. A Gyors mód SLA-it ugyanúgy kezeljük, mint a Skálázási szint SLA-it: ha egy adott időszakban nem teljesítjük ezeket az Enterprise-szerződéssel rendelkező ügyfeleknél, szolgáltatási jóváírást biztosítunk.

A Gyors mód összeegyeztethető az adatok tárolási helyére vonatkozó követelményekkel?

Igen.

A Gyors mód összeegyeztethető a ZDR-rel és a BAA-val?

Igen.

Ultrafast a GPT-6 Astra modellhez

Az Ultrafast külön szolgáltatási szint az olyan feladatokhoz, amelyeknél a GPT-6 Astra alacsonyabb késleltetésű válaszaira van szükség, például interaktív alkalmazásokhoz és programozási munkafolyamatokhoz.

A Gyors mód díjszabására, használati korlátaira és szabályzataira vonatkozó útmutatás a service_tier="fast" beállítást használó kérésekre érvényes. Az Ultrafast-kérések a különálló service_tier="ultrafast" szintet használják.

Hogyan küldhetek Ultrafast-kérést?

Ha a szervezeted rendelkezik Ultrafast-hozzáféréssel, használd a Responses API-t az alábbi beállításokkal:

  • Modell: gpt-6-astra

  • Szolgáltatási szint: ultrafast

  • Kérésfejléc: OpenAI-Service-Tier: ultrafast

A szolgáltatási szint beállítása mellett a kérésfejléc megadása is kötelező.

Az eszközhívásokat végrehajtó alkalmazásoknál a WebSocket mód lehetővé teszi ugyanannak a kapcsolatnak a használatát több fordulón át, csökkentve ezzel a kapcsolatkezelés többletterhelését.

Használhatom ugyanazt a kérésfejlécet más szolgáltatási szintekhez is?

Az Ultrafast alfatesztje során az OpenAI-Service-Tier fejléc csak az ultrafast értéket fogadja el. Más érték küldése – beleértve a default, fast és flex értékeket – HTTP 400-as hibát eredményez. Más szint használatakor hagyd el ezt a fejlécet.

Használhatom az Ultrafast szintet a Work módban vagy a Codexben?

Az Ultrafast a Work módban és a Codexben is elérhető az arra jogosult csomagok és munkaterületek esetén. A ChatGPT-csomagok jogosultsági és használati feltételei eltérnek az API-hozzáférés feltételeitől.

Az elérhetőségről és a használatról a ChatGPT Work és Codex című cikkben olvashatsz részletesen.

Hasznos volt ez a cikk?