GPT-6 Luna är den rekommenderade utgångspunkten för migrering av befintliga användningsfall för GPT-4.x. Vilken konfiguration som passar bäst beror på din applikation, så utvärdera modellen med representativa arbetsbelastningar innan du flyttar produktionstrafiken.
Välj inställning för resonemang
Börja med resonemangsnivån inställd på none. De flesta användningsfall för GPT-4.x förväntas kunna migreras med den här inställningen. Testa andra inställningar för att hitta rätt balans mellan kvalitet, latens och kostnad för din applikation.
Information om API-ändringar och tekniska detaljer finns i utvecklarguiden för GPT-6.
Jämför kostnad och prestanda
GPT-6 Luna har ett lägre pris per token än de GPT-4.x-modeller som omfattas av den här migreringen. För de flesta användningsfall innebär det en mer kapabel modell till ett lägre pris per token.
Jämför totalkostnaden för dina egna arbetsbelastningar innan du migrerar. Tokenanvändning och resonemangsinställningar kan påverka kostnaden för varje uppgift.
Migrera din applikation
Fastställ en baslinje. Välj representativa förfrågningar, inklusive viktiga gränsfall, och dokumentera den nuvarande modellens kvalitet, latens och kostnad.
Utvärdera Luna. Börja med resonemangsnivån inställd på
noneoch jämför resultaten med baslinjen. Kontrollera de beteenden som din applikation är beroende av, inklusive svarsformatering och verktygsanvändning där det är relevant.Justera och testa igen. Justera promptar, resonemangsnivå och detaljnivå utifrån utvärderingsresultaten och testa sedan igen.
Rulla ut gradvis. Börja med en begränsad andel av produktionstrafiken. Övervaka kvalitet, latens, fel och kostnad innan du slutför migreringen.
Få support
Självbetjäningskunder: Kontakta OpenAI:s support via chattbubblan på help.openai.com.
Kunder med säljansvarig: Kontakta ditt kundteam på OpenAI för att få hjälp av vårt tekniska team. Vi kan hjälpa dig att ta fram en migreringsplan som är anpassad till din produkt och hitta sätt att få ut så mycket som möjligt av Luna.
