OpenAI
این صفحه به‌صورت ماشینی ترجمه شده است. مقاله اصلی انگلیسی را مشاهده کنید.

پرسش‌های متداول بازیابی بصری با PDFها

به‌روزرسانی: 11 days ago

این قابلیت چیست؟

ChatGPT Enterprise اکنون از خواندن و درک تصاویر (تصویرها، نمودارها، دیاگرام‌ها و غیره) تعبیه‌شده در فایل‌های PDF موجود در اعلان‌ها پشتیبانی می‌کند. کاربران می‌توانند یک PDF بارگذاری کنند و ChatGPT می‌تواند متن و هر عنصر بصری درون آن فایل را تفسیر کند.

چگونه کار می‌کند؟

  1. برای بارگذاری PDF خود، روی نماد گیره کاغذ (پیوست) در چت کلیک کنید.

  2. ChatGPT هم متن و هم هر تصویر یا دیاگرام تعبیه‌شده درون PDF را می‌خواند.

  3. سپس می‌توانید سؤال بپرسید یا درخواست خلاصه کنید—از استخراج نکات اصلی یک گزارش گرفته تا توضیح نمودارهای پیچیده.

آیا با GPTها و پروژه‌ها سازگار است؟

تا حدی. PDFهایی که به‌عنوان دانش GPT یا فایل‌های پروژه بارگذاری می‌شوند، با استفاده از بازیابی فقط متنی پردازش می‌شوند. PDFهایی که کاربران هنگام تعامل با یک GPT منتشرشده یا درون یک گفت‌وگوی پروژه بارگذاری می‌کنند، با استفاده از بازیابی بصری پردازش می‌شوند.

چه کسانی می‌توانند از آن استفاده کنند؟

این قابلیت فقط برای مشتریان ChatGPT Enterprise در دسترس است. برای حساب‌های ChatGPT Free، Pro، Team یا Edu پشتیبانی نمی‌شود.

چه مشکلی را حل می‌کند؟

پیش از این، ChatGPT فقط می‌توانست تصویرهایی را پردازش کند که جداگانه بارگذاری می‌شدند (مثلاً به‌صورت PNG/JPEG). تصاویر تعبیه‌شده درون یک PDF نادیده گرفته می‌شدند. اکنون، ChatGPT می‌تواند تحلیلی جامع‌تر ارائه دهد—با ترکیب متن و تصاویر در یک مرحله—که به پاسخ‌هایی دقیق‌تر و غنی‌تر از نظر زمینه منجر می‌شود.

آیا این قابلیت در نهایت به طرح‌های دیگر نیز گسترش می‌یابد؟

در حال حاضر مختص Enterprise است و ممکن است در آینده گسترش یابد. ما بازخورد مشتریان را پایش می‌کنیم تا مشخص کنیم چه زمانی و چگونه پشتیبانی را گسترده‌تر کنیم.

آیا این مقاله مفید بود؟