OpenAI
Aquesta pàgina s'ha traduït automàticament. Mostra l'article original en anglès.

Preguntes freqüents sobre el mode ràpid

Preguntes freqüents sobre el mode ràpid i el nivell de servei Ultrafast.

Actualització: 3 days ago

Oferim el mode ràpid als clients de l'API que volen un rendiment més ràpid i estable en determinats models. A continuació trobareu respostes a preguntes freqüents sobre el funcionament, els preus, la disponibilitat dels models, els límits de peticions, la fiabilitat, les polítiques i els requisits d'accés.

Nota: el processament prioritari va passar a anomenar-se mode ràpid el 30 de juliol de 2026. Podeu utilitzar tant service_tier: priority com service_tier: fast a les sol·licituds de l'API. 

Trobareu més informació aquí.

El mode ràpid està disponible a totes les regions?

La disponibilitat del mode ràpid depèn de les lleis i normatives aplicables a cada jurisdicció. Si teniu dubtes sobre la disponibilitat a la vostra regió, poseu-vos en contacte amb el vostre director de compte.

Com funciona

Els clients poden dirigir el trànsit al mode ràpid per a cada petició mitjançant el paràmetre existent service_tier, amb l'opció service_tier = "fast".

Els segments processats pel mode ràpid es facturaran per segment, a un preu superior al de les tarifes del processament estàndard.

A més de configurar-lo per a cada petició, també pots establir el mode ràpid com a predeterminat per a un projecte a Configuració del projecte > Nivell de servei predeterminat: Ràpid. Tot i així, pots canviar aquesta opció per a cada petició. Seleccionar Ràpid a la configuració del projecte equival a seleccionar Prioritari.

Com es relaciona amb el nivell d'escalat?

El nivell d'escalat continuarà sent independent del mode ràpid. Les peticions enviades al mode ràpid es facturaran per separat i no consumiran els paquets de TPM que hagis contractat al nivell d'escalat.

Puc enviar automàticament al mode ràpid el trànsit que excedeixi la capacitat del nivell d'escalat?

No. El trànsit enviat al nivell d'escalat que n'excedeixi la capacitat no es desviarà automàticament al mode ràpid.

Com es factura el mode ràpid?

Els segments processats pel mode ràpid es facturaran per segment, a un preu superior al de les tarifes del processament estàndard.

El meu compromís anual està vinculat a un mode de processament concret?

No. Tots els modes de processament compten per al teu compromís de despesa anual d'Enterprise.

Continuo tenint un descompte en els segments d'entrada en memòria cau?

Sí! A les entrades en memòria cau s'aplica el mateix descompte del 50–75 % que amb el processament estàndard.

Com puc consultar l'ús i la despesa del mode ràpid?

Per consultar els segments processats pel mode ràpid (abans anomenat processament prioritari), ves al tauler d'ús, selecciona Chat Completions o Responses i agrupa per nivell de servei.

Per consultar el cost del mode ràpid, ves al tauler d'ús i selecciona Agrupa per partida.

Al tauler d'ús, les peticions que utilitzin priority o fast com a valor de service_tier continuaran apareixent com a priority. Això s'actualitzarà per als futurs models.

Models

El mode ràpid està disponible per a contextos llargs, models amb ajust fi, incrustacions, etc.?

De moment, no. En el futur valorarem si oferim el mode ràpid en altres productes, a més dels nostres models més recents.

Com funcionen les altres modalitats amb el mode ràpid?

El mode ràpid ofereix les mateixes capacitats multimodals que el processament estàndard. En particular, es poden utilitzar imatges com a entrades per al processament prioritari, i es processen amb la mateixa latència baixa.

Els futurs models seran compatibles?

Tenim previst oferir el mode ràpid en els nous models GPT, però no garantim que tots els models siguin compatibles.

Límits de peticions

Quins són els límits de peticions?

A efectes dels límits de peticions, el consum del processament prioritari es tracta igual que el trànsit estàndard de l'API.

Quins són els límits del ritme d'increment?

El mode ràpid té límits del ritme d'increment per garantir un rendiment alt i constant a tots els clients, sense deixar d'oferir preus flexibles sota demanda. Si (a) el rendiment del mode ràpid es degrada I (b) el trànsit d'un client augmenta massa de pressa, en casos excepcionals algunes peticions poden passar al processament estàndard.

El límit actual del ritme d'increment del mode ràpid es defineix aquí, a la nostra documentació principal.

Bones pràctiques per no superar el límit del ritme d'increment

Augmenta el trànsit gradualment quan canviïs de model. Per exemple, si la teva aplicació passa d'una versió anterior a una de nova, utilitza un indicador de funcionalitat per traslladar-hi el trànsit al llarg d'unes quantes hores, en lloc de fer-ho tot de cop.

Evita executar tasques de processament de grans volums de dades o tasques asíncrones en el mode ràpid. Aquestes tasques poden fer augmentar el trànsit molt de pressa i sovint no necessiten el rendiment millorat del mode ràpid.

Si arribes sovint als límits del ritme d'increment, considera contractar quota del nivell d'escalat com a alternativa.

Els límits del ritme d'increment es comparteixen entre els meus projectes o organitzacions?

Sí, tot el teu trànsit compta per al mateix límit del ritme d'increment.

Polítiques

Què passa si el mode ràpid no compleix l'objectiu de latència?

Contacta amb el teu AD si tens qualsevol dubte o inquietud. Els SLA del mode ràpid es tractaran igual que els SLA del nivell d'escalat; s'oferiran crèdits de servei als clients amb contractes Enterprise si no complim aquests SLA durant un període determinat.

El mode ràpid és compatible amb la ubicació de les dades?

Sí.

El mode ràpid és compatible amb ZDR i el BAA?

Sí.

Ultrafast per a GPT-6 Astra

Ultrafast és un nivell de servei independent per a càrregues de treball que necessiten respostes de GPT-6 Astra amb menys latència, com ara aplicacions interactives i fluxos de treball de programació.

Les indicacions sobre preus, límits de peticions i polítiques del mode ràpid s'apliquen a les peticions que utilitzen service_tier="fast". Les peticions d'Ultrafast utilitzen el nivell independent service_tier="ultrafast".

Com envio una petició d'Ultrafast?

Si l'organització té accés a Ultrafast, utilitza l'API Responses amb:

  • Model: gpt-6-astra

  • Nivell de servei: ultrafast

  • Capçalera de petició: OpenAI-Service-Tier: ultrafast

A més de configurar el nivell de servei, cal incloure la capçalera de petició.

Per a les aplicacions que executen crides a eines, el mode WebSocket permet reutilitzar una connexió entre torns i reduir la sobrecàrrega de connexió.

Puc utilitzar la mateixa capçalera de petició per a altres nivells de servei?

Durant la fase alfa d'Ultrafast, la capçalera OpenAI-Service-Tier només accepta ultrafast. Si s'envia un altre valor, inclosos default, fast o flex, es retorna un error HTTP 400. Omet aquesta capçalera quan utilitzis un altre nivell.

Puc utilitzar Ultrafast a Work o Codex?

Ultrafast també està disponible a Work i Codex per als plans i espais de treball que compleixin els requisits. Els requisits d'accés i les condicions d'ús dels plans de ChatGPT són diferents dels de l'API.

Consulta ChatGPT Work i Codex per obtenir informació sobre la disponibilitat i l'ús.

T'ha estat útil aquest article?