OpenAI
این صفحه به‌صورت ماشینی ترجمه شده است. مقاله اصلی انگلیسی را مشاهده کنید.

پرسش‌های متداول ورودی‌های تصویر ChatGPT

راهنمای شما برای کار با قابلیت جدید ورودی تصویر در ChatGPT؛ از استفاده مؤثر تا شناخت محدودیت‌های آن

به‌روزرسانی: 12 days ago

ورودی‌های تصویر چیستند و در ChatGPT چگونه کار می‌کنند؟

ChatGPT اکنون قابلیت‌های تصویری دارد تا تصاویری را که به‌عنوان ورودی تصویر به مکالمه‌ها اضافه می‌کنید درک و تفسیر کند.

چگونه باید از ورودی‌های تصویر در مکالمه‌ها استفاده کنم؟

استفاده پایه: برای شروع یک عکس بارگذاری کنید. درباره اشیای موجود در تصاویر سؤال بپرسید، اسناد را تحلیل کنید یا محتوای بصری را بررسی کنید. در نوبت‌های بعدی تصاویر بیشتری اضافه کنید تا بحث عمیق‌تر شود یا مسیر آن تغییر کند. هر زمان خواستید با عکس‌های جدید برگردید.


حاشیه‌نویسی تصاویر: برای جلب توجه به نواحی مشخص، پیش از بارگذاری تصویر از یک ابزار ویرایش عکس برای علامت‌گذاری روی آن استفاده کنید. این کار به ChatGPT کمک می‌کند روی عناصری تمرکز کند که از نظر شما مهم هستند.

کدام طرح‌ها می‌توانند از ورودی‌های تصویر استفاده کنند؟

Plus و ChatGPT Enterprise. در وب موبایل، می‌توانید پیش از ورود به حساب نیز عکس پیوست کنید.

کدام مدل‌ها می‌توانند ورودی تصویر را بپذیرند؟

همه مدل‌های ChatGPT می‌توانند ورودی تصویر را بپذیرند.

ورودی‌های تصویر روی کدام پلتفرم‌ها در دسترس هستند؟

همه پلتفرم‌ها، از جمله وب (chatgpt.com) و موبایل (iOS / Android).

آیا از تصاویر من برای بهبود مدل‌های شما استفاده می‌شود؟

رویکرد ما در استفاده از محتوا، از جمله تصاویر، برای هر محصول یکسان است.

برای درک بهتر اینکه محتوای موجود در ChatGPT چگونه ممکن است برای بهبود عملکرد مدل استفاده شود و کاربران چه گزینه‌هایی دارند، لطفاً به نحوه استفاده از داده‌های شما برای بهبود عملکرد مدل مراجعه کنید.

برای ChatGPT Enterprise، ما از محتوا برای آموزش مدل‌های خود استفاده نمی‌کنیم.

چگونه در ChatGPT ورودی تصویر اضافه کنم؟

روی نماد + در ناحیه اعلان بزنید و افزودن عکس‌ها و فایل‌ها را انتخاب کنید. همچنین می‌توانید یک فایل تصویر را به ناحیه متن بکشید یا تصویری را که در کلیپ‌بورد کپی کرده‌اید جای‌گذاری کنید.

آیا ورودی‌های تصویر از ویدیو پشتیبانی می‌کنند؟

خیر، نمی‌تواند ویدیوها را پردازش کند. در حال حاضر فقط از پردازش تصاویر ثابت پشتیبانی می‌کند.

از چه نوع فایل‌هایی پشتیبانی می‌شود؟

PNG (.png)، JPEG (.jpeg و .jpg)، و GIF غیرمتحرک (.gif).

چند تصویر را می‌توانم هم‌زمان بارگذاری کنم؟

تعداد تصاویری که می‌توانید به یک مکالمه اضافه کنید به عوامل مختلفی بستگی دارد، از جمله اندازه تصاویر و میزان متن همراه آن‌ها. به‌عنوان یک راهنمای کلی، اگر با مشکل روبه‌رو شدید، تعداد یا اندازه تصاویر را کاهش دهید.

محدودیت اندازه هر تصویر چقدر است؟

۲۰ مگابایت.

قابلیت‌های تصویری با تصاویر مبهم یا نامشخص چگونه برخورد می‌کنند؟

اگر تصویری مبهم یا نامشخص باشد، مدل نهایت تلاش خود را برای تفسیر آن انجام می‌دهد. با این حال، نتایج ممکن است دقت کمتری داشته باشند.

کاربران هنگام استفاده از ChatGPT با ورودی‌های تصویر باید از چه محدودیت‌هایی آگاه باشند؟

اگر از قابلیت جدید ورودی تصویر در ChatGPT استفاده می‌کنید، مهم است از این محدودیت‌ها آگاه باشید:

  1. پزشکی: مدل برای تفسیر تصاویر پزشکی تخصصی مانند سی‌تی‌اسکن مناسب نیست و نباید برای توصیه پزشکی استفاده شود.

  2. غیرانگلیسی: مدل در کار با تصاویری که متن آن‌ها با الفباهای غیرلاتین، مانند ژاپنی یا کره‌ای، نوشته شده باشد به همان خوبی عمل نمی‌کند.

  3. متن بزرگ: برای بهبود خوانایی، متن داخل تصویر را بزرگ‌تر کنید، اما از برش دادن جزئیات مهم خودداری کنید.

  4. چرخش: مدل ممکن است متن یا تصاویر چرخانده‌شده یا وارونه را نادرست تفسیر کند.

  5. عناصر بصری: مدل ممکن است در فهم نمودارها یا متن‌هایی که رنگ‌ها یا سبک‌هایی مانند خط پیوسته، خط‌چین یا نقطه‌چین در آن‌ها متفاوت است، دچار مشکل شود.

  6. فضایی: مدل در کارهایی که به مکان‌یابی فضایی دقیق نیاز دارند، مانند شناسایی موقعیت مهره‌های شطرنج، مشکل دارد.

  7. دقت: مدل ممکن است در برخی سناریوها توصیف‌ها یا زیرنویس‌های نادرست تولید کند.

  8. شکل: مدل با تصاویر پانوراما و فیش‌آی مشکل دارد.

  9. فراداده و تغییر اندازه: مدل نام فایل‌های اصلی یا فراداده‌ها را پردازش نمی‌کند و تصاویر پیش از تحلیل تغییر اندازه می‌یابند که بر ابعاد اصلی آن‌ها اثر می‌گذارد.

  10. شمارش: ممکن است تعداد اشیای موجود در تصاویر را به‌صورت تقریبی اعلام کند.

آیا این مقاله مفید بود؟