OpenAI
Ukurasa huu ulitafsiriwa na mashine. Tazama makala asili ya Kiingereza.

Kuboresha Upakiaji wa Faili katika ChatGPT Enterprise

Elewa jinsi vipengele vya ChatGPT Enterprise vinavyoshughulikia faili kulingana na aina, idadi na ukubwa wake. Boresha matokeo kulingana na mahitaji ya faili.

Ilisasishwa: 13 days ago

ChatGPT Enterprise sasa inasaidia kusoma na kuelewa maudhui ya kuona (picha, grafu, michoro, n.k.) yaliyopachikwa katika faili za PDF zilizojumuishwa katika madokeza. Watumiaji wanaweza kupakia PDF, na ChatGPT inaweza kufasiri maandishi na vipengele vyovyote vya kuona vilivyomo kwenye faili hiyo.

Kwa maelezo tazama Maswali Yanayoulizwa Sana kuhusu Urejeshaji wa Maudhui ya Kuonekana katika PDF.

ChatGPT Enterprise hukuruhusu kupakia faili kwa njia kadhaa:

Mwongozo huu unaeleza jinsi vipengele vya ChatGPT Enterprise vinavyoshughulikia faili kulingana na aina, idadi, na ukubwa wake, na kujadili mikakati ya kuboresha matokeo kulingana na mahitaji ya faili.

Muhtasari

ChatGPT Enterprise hushughulikia aina tofauti za faili kwa njia tofauti sana: kutoa maandishi kutoka nyaraka kama PDF, Mawasilisho, na faili za Word, kuchanganua data iliyopangiliwa kutoka lahajedwali kwa kutumia msimbo wa Python, na kuelezea faili za picha kupitia GPT-Vision. Kuelewa ni aina gani ya faili huanzisha mtiririko gani wa kazi ni muhimu ili kupata matokeo yanayotarajiwa.

Kwa nyaraka za maandishi, ChatGPT Enterprise hujumuisha maandishi mengi husika kadiri iwezekanavyo moja kwa moja pamoja na dokeza na hutumia mfumo wa utafutaji kufikia taarifa za ziada. Hii hufanya kazi vizuri kwa kujibu maswali mahususi. Hata hivyo, mbinu hii inaweza kutatizika na kazi changamano kama kufupisha nyaraka kubwa sana au kulinganisha faili kubwa kadhaa. Endelea kusoma ili kuelewa mikakati ya kuboresha matokeo yako.

Kushughulikia faili kulingana na aina

ChatGPT Enterprise huchakata faili kwa njia kuu tatu: utoaji wa maandishi, uchanganuzi wa msimbo, na ufafanuzi wa picha. Aina ya faili huamua ni mtiririko gani wa kazi ChatGPT Enterprise itafuata.

Urejeshaji Unaotegemea MaandishiKifasiri cha MsimboUchakataji wa PichaUrejeshaji wa Maudhui ya Kuonekana
Mifano ya Aina za Failipptx, docx, txt, md, json, xml, pdf*
* PDF zilizopakiwa kama

Maarifa ya GPT
au

Faili za Mradi
csv, xls, xlsx*
*Dokezo: Kifasiri cha Msimbo kinaweza kufanya kazi kwenye aina yoyote ya faili, lakini ChatGPT Enterprise mara nyingi zaidi huchagua CI kwa lahajedwali
jpg, pngpdf*
* PDF zilizojumuishwa katika madokeza ya mtumiaji
TabiaHutoa maandishi kutoka kwenye faili – baadhi ya maandishi hubandikwa (“huwekwa”) moja kwa moja kwenye dirisha la muktadha; baadhi ya maandishi huhifadhiwa kwa ajili ya utafutajiKifasiri cha Msimbo hupitisha faili kwa Python ili ichakatwePicha hufasiriwa kwa asili na miundo ya multimodal, kwa kuzingatia

vikwazo vinavyojulikana
.
Mseto wa urejeshaji wa maandishi na uchakataji wa picha. Maandishi hutolewa kidijitali, na maudhui ya kuona hufasiriwa kwa asili na miundo ya multimodal.

Kwa faili za maandishi pekee, faili za picha, au faili za data zilizopangiliwa wazi (k.m., jedwali la Excel la miamala), migawanyo hii huwakilisha tabia bora zaidi inayowezekana.

Kuna maeneo kadhaa ya kijivu ambayo hayaonekani wazi sana, kwa mfano:

  • Picha zilizopachikwa katika faili zisizo PDF hazichakatwi. Ili kuzijumuisha, badilisha faili iwe PDF kabla ya kuipakia.

  • ChatGPT Enterprise itatumia Kifasiri cha Msimbo kila wakati kuingiliana na lahajedwali, hata kama hati ina kiasi kikubwa cha maandishi. Kwa mfano, ukiomba ChatGPT Enterprise itafsiri faili ya CSV yenye safu 10 za maandishi, itajaribu kutafsiri faili kwa kutumia maktaba ya Python, ambayo si sahihi kama kuruhusu muundo uzalishe tafsiri moja kwa moja. Ili kupunguza tatizo hili, jaribu kuhamisha lahajedwali hadi muundo unaotegemea maandishi (kwa mfano, PDF).

  • Vivyo hivyo, ukipakia jedwali la miamala lililopangiliwa lililo katika faili ya JSON, ChatGPT Enterprise itafasiri faili hii kama maandishi ya kawaida. Ikiwa unataka kuchanganua data iliyo katika faili ya JSON, elekeza muundo utumie Kifasiri cha Msimbo katika dokeza lako.

Kushughulikia faili kulingana na ukubwa

ChatGPT Enterprise hutumia miundo yenye dirisha la muktadha la juu zaidi la tokeni 128k (takriban kurasa 200 za maandishi). Hata hivyo, si tokeni zote hutumika kujumuisha maandishi kutoka faili zilizopakiwa. Idadi ya tokeni “zilizowekwa” hutofautiana kulingana na aina ya matumizi.

ChatGPT Enterprise “huweka” kiasi fulani cha maandishi, na maandishi yaliyosalia hutumwa kwenye faharasa binafsi ya utafutaji (“hifadhi ya vekta”, ambayo ni aina ya hifadhidata iliyoundwa kuhifadhi na kurejesha kiasi kikubwa cha maandishi kwa ufanisi). Unapouliza swali, ChatGPT Enterprise huleta maandishi yaliyojumuishwa pamoja na vipande husika vilivyorejeshwa kutoka faharasa binafsi ya utafutaji.

Ukipakia hati moja, ChatGPT Enterprise hujumuisha maandishi kuanzia mwanzo hadi ifikie kikomo chake. Ukipakia nyaraka kadhaa, ChatGPT Enterprise hujumuisha baadhi au yote ya kila hati. Maandishi yote kutoka kwenye nyaraka pia hutumwa kwenye faharasa binafsi ya utafutaji.

Ujazaji wa muktadha kwa nyaraka za maandishi

Kipengele hiki bado kinaendelezwa kikamilifu. Kwa hivyo, maelezo yafuatayo yanaweza kubadilika bila taarifa.

ChatGPT Enterprise inaweza kuchakata hadi tokeni 110k kutoka nyaraka zilizopakiwa katika dirisha la muktadha. Ukipakia hati moja au zaidi zenye jumla iliyounganishwa ya chini ya tokeni 110k, maudhui yote yatajumuishwa.

Kwa hati moja inayozidi tokeni 110k, ni tokeni 110k za kwanza pekee zitakazojumuishwa, kuanzia mwanzo. Zilizosalia zitatumwa tu kwenye faharasa binafsi ya utafutaji.

Ikiwa nyaraka kadhaa zimepakiwa na jumla yake iliyounganishwa inazidi tokeni 110k, ChatGPT Enterprise hutumia mchakato wa hatua mbili kusawazisha uwakilishi wa nyaraka:

  1. Toa hadi tokeni 55k, zikigawanywa kwa usawa kati ya nyaraka zilizopakiwa.

  1. Kwa nyaraka ambazo hazikuwakilishwa kikamilifu katika hatua ya kwanza, gawa tokeni 55k zilizosalia kwa uwiano kulingana na tokeni zilizobaki katika kila hati.

  1. Tokeni zozote zilizosalia hutumwa tu kwenye faharasa binafsi ya utafutaji.

Unaweza kukadiria idadi ya tokeni katika hati ya maandishi kwa kunakili maandishi ya hati kwenye OpenAI Tokenizer.

Ujazaji wa muktadha kwa PDF za midia anuwai

Watumiaji wanapopakia PDF zilizo na maandishi na picha, Urejeshaji wa Maudhui ya Kuonekana huiwezesha ChatGPT kuchakata picha hizi kwa asili pamoja na maandishi yaliyotolewa kidijitali. Hatua zifuatazo huongezea taratibu zetu za kawaida za kushughulikia muktadha kwa PDF za midia anuwai:

  • Utoaji na Upachikaji wa Picha: Picha hutolewa na kupachikwa pamoja na maandishi yake ya kidijitali yanayohusiana.

  • Urekebishaji Mahiri wa Ukubwa: Picha hurekebishwa ukubwa kiotomatiki ili kudumisha uwiano kati ya ubora wa taarifa na matumizi bora ya dirisha la muktadha linalopatikana.

PDF zilizopakiwa zinapozidi kikomo cha tokeni 110k, picha na maandishi hupachikwa katika faharasa binafsi ya utafutaji. Upachikaji wa maandishi hurejelea picha husika, ukiiruhusu ChatGPT kurejesha jozi zinazofaa za maandishi na picha kulingana na hoja za mtumiaji. Picha zilizorejeshwa kisha huchakatwa kwa kutumia uwezo asilia wa ChatGPT wa multimodal.

Kukadiria kwa usahihi mahitaji ya tokeni kwa PDF za midia anuwai ni changamoto. Majaribio yanaonyesha kuwa takriban kurasa 350 za maandishi na picha mchanganyiko zitatumia kikamilifu dirisha la muktadha la tokeni 110k.

Mikakati ya utafutaji kulingana na aina ya muundo

Miundo ya mfululizo wa GPT na mfululizo wa o yote inasaidia upakiaji wa faili na hutumia mantiki sawa ya kujaza muktadha na upachikaji wa utafutaji. Miundo yote hutekeleza utafutaji mseto dhidi ya faharasa binafsi ya utafutaji, ikichanganya mbinu za maneno muhimu na za kisemantiki. Katika utafutaji mseto, muundo huzalisha kifungu cha utafutaji kulingana na dokeza la mtumiaji, na faharasa binafsi ya utafutaji hurejesha maandishi na picha husika ipasavyo.

Hata hivyo, miundo hii hutofautiana katika jinsi inavyotafuta ndani ya nyaraka kubwa zinazozidi dirisha la muktadha:

Miundo ya mfululizo wa GPT

  • Utafutaji mmoja kwa kila dokeza: Miundo ya mfululizo wa GPT hufanya utafutaji mmoja kwa kila dokeza la mtumiaji.

  • Matumizi yanayofaa: Inafaa kwa kujibu maswali ya moja kwa moja yaliyomo katika nyaraka nyingi.

Mifano ya hoja:

  • “Sera ya HR kuhusu kustaafu mapema ni ipi?”

  • “Kitendakazi process_order hufanya nini?”

Miundo ya mfululizo wa o

  • Utafutaji mwingi kwa kila dokeza: Inaweza kutekeleza utafutaji mwingi (kwa kawaida 2-3) kwa kila dokeza la mtumiaji, kila mmoja ukiwa na kifungu cha kipekee cha utafutaji. Utafutaji hutekelezwa kwa mfuatano, na muundo unaweza kusasisha mbinu yake kulingana na taarifa zilizopatikana katika utafutaji wa awali.

  • Matumizi yanayofaa: Inafaa zaidi kwa maswali changamano yanayohitaji utafutaji kadhaa mahususi katika nyaraka nyingi.

Mifano ya hoja:

  • “Sera za HR kuhusu kustaafu mapema, likizo ya mzazi, na uhamisho wa ng’ambo ni zipi?”

  • “Eleza kazi ya kitendakazi process_order, orodhesha mbinu zote zinazoitwa na kitendakazi hiki, na ueleze kwa kifupi kila mbinu inayoitwa.”

Licha ya uwezo wake, miundo ya mfululizo wa o inaweza kutatizika wakati hoja inahitaji zaidi ya utafutaji mitatu.

Vidokezo vya kuboresha matokeo ya utafutaji wa faili

  • Jaribu kutumia muundo wa mfululizo wa o kwa maswali changamano yanayohitaji utafutaji mwingi.

  • Kumbuka kuwa majibu yanaweza kutofautiana kulingana na aina, idadi, na ukubwa wa nyaraka unazopakia.

  • Kwa ujumla, kupakia nyaraka chache na zilizolenga mada kutasababisha usahihi wa juu zaidi.

  • Geuza mada zenye maswali mengi kuwa maswali moja moja:

    • Ikiwa unahitaji kujua sera za HR za kila jimbo, ziulize moja baada ya nyingine.

    • Ikiwa unahitaji kufupisha nyaraka nyingi, omba hati moja kwa wakati mmoja. Ikiwa hati hiyo ina mamia mengi ya kurasa, zingatia kuigawanya katika sehemu ndogo.

      • Unaweza kuiomba ChatGPT Enterprise iandike “muhtasari wa mihtasari” ikiwa umeipatia mihtasari kadhaa badala ya nyaraka nzima.

    • Ikiwa una CSV ya RFP (kila mstari ni swali tofauti), uliza maswali hayo moja baada ya jingine badala ya kupakia tu CSV na kuomba jibu moja.

  • Tafuta njia za kukagua majibu ya muundo. Mfano wa maagizo ya GPT uko hapa chini:

# Muktadha 

Wewe ni mtaalamu wa kuelewa hati. Mtumiaji ataambatisha hati na kuuliza swali. Wanahitaji kuweza kuunganisha jibu lako na sehemu halisi ya maandishi ulipotoa jibu lako.

# Maelekezo

1. Jibu swali la mtumiaji kulingana na hati aliyoiambatisha kwa kutumia muundo kamili uliotolewa hapa chini

# Muundo

- Swali: { rudia swali la mtumiaji }
- Jibu: { toa jibu la swali la mtumiaji }
Chanzo:
- - Nambari ya Sehemu: { toa nambari ya sehemu ulipochukua jibu }
- - Kichwa cha Sehemu: { toa kichwa cha sehemu ulipochukua jibu }
- - Maandishi Halisi: { toa maandishi halisi ulipotoa jibu }

# Kanuni

- Toa majibu yaliyo wazi na mafupi
- Toa tu taarifa zilizotolewa katika hati
- Ikiwa huwezi kupata jibu katika hati, jibu tu “Hakuna taarifa iliyopatikana.”

Je, makala haya yamekusaidia?