OpenAI
Aquesta pàgina s'ha traduït automàticament. Mostra l'article original en anglès.

Preguntes freqüents sobre les entrades d’imatge de ChatGPT

La teva guia per descobrir la nova funció d’entrada d’imatges de ChatGPT: com utilitzar-la de manera eficaç i entendre’n les limitacions

Actualització: 2 days ago

Què són les entrades d’imatge i com funcionen a ChatGPT?

ChatGPT ara té capacitats d’imatge per entendre i interpretar les imatges que afegeixes a les converses com a entrades d’imatge.

Com hauria d’utilitzar les entrades d’imatge en les converses?

Ús bàsic: Per començar, puja una foto. Pregunta sobre objectes que apareixen a les imatges, analitza documents o explora contingut visual. Afegeix més imatges en torns posteriors per aprofundir en la conversa o canviar-ne l’enfocament. Torna quan vulguis amb fotos noves.


Anotació d’imatges: Per cridar l’atenció sobre àrees concretes, pots utilitzar una eina de marcatge d’edició de fotos a la imatge abans de pujar-la. Això ajuda ChatGPT a centrar-se en els elements que consideres importants.

Quins plans poden utilitzar entrades d’imatge?

Plus i ChatGPT Enterprise. Al web mòbil, també pots adjuntar fotos abans d’iniciar la sessió.

Quins models poden acceptar entrades d’imatge?

Tots els models de ChatGPT poden acceptar entrades d’imatge.

En quines plataformes estan disponibles les entrades d’imatge?

En totes les plataformes, incloent-hi el web (chatgpt.com) i el mòbil (iOS / Android).

Les meves imatges s’utilitzen per millorar els vostres models?

El nostre enfocament sobre l’ús del contingut, incloses les imatges, continua sent el mateix per a cada producte.

Consulta Com s’utilitzen les teves dades per millorar el rendiment dels models per entendre millor com es pot fer servir el contingut de ChatGPT per millorar el rendiment dels models i quines opcions tenen els usuaris.

En el cas de ChatGPT Enterprise, no utilitzem contingut per entrenar els nostres models.

Com afegeixo entrades d’imatge a ChatGPT?

Toca la icona + a l’àrea de la indicació i selecciona Afegeix fotos i fitxers. També pots arrossegar un fitxer d’imatge a l’àrea de text o enganxar una imatge copiada al porta-retalls.

Les entrades d’imatge admeten vídeos?

No, no pot gestionar vídeos. Actualment només admet el processament d’imatges estàtiques.

Quins tipus de fitxer s’admeten?

PNG (.png), JPEG (.jpeg i .jpg) i GIF no animats (.gif).

Quantes imatges puc pujar alhora?

El nombre d’imatges que pots afegir a una conversa depèn de diversos factors, com ara la mida de les imatges i la quantitat de text que les acompanya. Com a orientació general, si tens problemes, prova de reduir la quantitat o la mida de les imatges.

Quin és el límit de mida per imatge?

20 MB.

Com gestionen les capacitats d’imatge les imatges ambigües o poc clares?

Si una imatge és ambigua o poc clara, el model farà tot el possible per interpretar-la. Tanmateix, els resultats poden ser menys precisos.

Quines limitacions han de tenir presents els usuaris quan fan servir ChatGPT amb entrades d’imatge?

Si fas servir la nova funció d’entrada d’imatges de ChatGPT, és important que tinguis presents aquestes limitacions:

  1. Medicina: El model no és adequat per interpretar imatges mèdiques especialitzades, com ara TAC, i no s’hauria d’utilitzar per obtenir assessorament mèdic.

  2. Idiomes no anglesos: El model no funciona tan bé quan tracta imatges amb text d’alfabets no llatins, com ara el japonès o el coreà.

  3. Text gran: Amplia el text de la imatge per millorar-ne la llegibilitat, però evita retallar detalls importants.

  4. Rotació: El model pot interpretar malament text o imatges girats o cap per avall.

  5. Elements visuals: El model pot tenir dificultats per entendre gràfics o text quan varien els colors o estils com ara línies contínues, discontínues o de punts.

  6. Espai: El model té dificultats amb tasques que requereixen una localització espacial precisa, com ara identificar posicions d’escacs.

  7. Precisió: En determinats escenaris, el model pot generar descripcions o peus d’imatge incorrectes.

  8. Forma: El model té dificultats amb imatges panoràmiques i d’ull de peix.

  9. Metadades i redimensionament: El model no processa els noms de fitxer originals ni les metadades, i les imatges es redimensionen abans d’analitzar-les, cosa que afecta les seves dimensions originals.

  10. Recompte: Pot donar recomptes aproximats dels objectes de les imatges.

T'ha estat útil aquest article?