Что такое ввод изображений и как он работает в ChatGPT?
Теперь ChatGPT умеет понимать и интерпретировать изображения, которые вы добавляете в разговоры в качестве входных изображений.
Как использовать ввод изображений в разговорах?
Базовое использование: для начала загрузите фото. Задавайте вопросы об объектах на изображениях, анализируйте документы или изучайте визуальный контент. Добавляйте новые изображения в последующих сообщениях, чтобы углубить обсуждение или изменить его направление. Вы можете вернуться в любое время с новыми фото.
Аннотирование изображений: чтобы привлечь внимание к конкретным областям, можно перед загрузкой разметить изображение в инструменте для редактирования фото. Это помогает ChatGPT сосредоточиться на элементах, которые вы считаете важными.
На каких тарифах можно загружать изображения?
Загрузка изображений доступна на бесплатном и платных тарифах ChatGPT с учетом установленных для тарифа ограничений на использование и настроек аккаунта. В мобильной веб-версии фотографии также можно прикреплять до входа в аккаунт.
Какие модели могут принимать изображения на вход?
Все модели ChatGPT могут принимать изображения на вход.
На каких платформах доступен ввод изображений?
На всех платформах, включая веб-версию (chatgpt.com) и мобильные приложения (iOS / Android).
Используются ли мои изображения для улучшения ваших моделей?
Наш подход к использованию контента, включая изображения, остается одинаковым для каждого продукта.
Чтобы лучше понять, как контент в ChatGPT может использоваться для улучшения работы моделей и какие возможности выбора есть у пользователей, ознакомьтесь со статьей Как ваши данные используются для улучшения работы моделей.
В ChatGPT Enterprise мы не используем контент для обучения наших моделей.
Как добавить изображения в ChatGPT?
Нажмите значок + в области промпта и выберите Добавить фото и файлы. Также можно перетащить файл изображения в текстовое поле или вставить изображение, скопированное в буфер обмена.
Можно ли загружать видео в ChatGPT?
Да. ChatGPT поддерживает прикрепление видеофайлов доступными способами загрузки, в том числе на бесплатном тарифе. Доступность зависит от платформы, способа загрузки и аккаунта. Прикрепление видеофайлов — отдельная функция, не связанная с загрузкой статичных изображений. Если не удается выбрать видео в приложении «Фото», попробуйте прикрепить его через приложение «Файлы».
ChatGPT может использовать инструменты для анализа загруженных видео, однако результаты анализа могут быть неполными или неточными. ChatGPT может проанализировать видео не полностью или неверно интерпретировать его звуковую дорожку.
Прикрепленные видео учитываются в лимитах на загрузку файлов вашего тарифа.
Трансляция видео с камеры и демонстрация экрана в голосовом режиме — это отдельные функции со своими условиями доступности и ограничениями. Подробнее см. в статье «ChatGPT Разговор».
Какие типы файлов поддерживаются?
PNG (.png), JPEG (.jpeg и .jpg), а также неанимированные GIF (.gif).
Сколько изображений можно загрузить за один раз?
Количество изображений, которые можно добавить в разговор, зависит от разных факторов, включая размер изображений и объем сопровождающего текста. В качестве общего правила: если возникнут проблемы, попробуйте уменьшить количество или размер изображений.
Каково ограничение по размеру для одного изображения?
20 МБ.
Как возможности работы с изображениями обрабатывают неоднозначные или нечеткие изображения?
Если изображение неоднозначное или нечеткое, модель постарается интерпретировать его как можно лучше. Однако результаты могут быть менее точными.
О каких ограничениях следует знать пользователям при работе с вводом изображений в ChatGPT?
Если вы используете новую функцию ввода изображений в ChatGPT, важно учитывать следующие ограничения:
Медицина: модель не предназначена для интерпретации специализированных медицинских изображений, например КТ-снимков, и ее не следует использовать для получения медицинских рекомендаций.
Неанглийский текст: модель хуже справляется с изображениями, содержащими текст на нелатинских письменностях, например на японском или корейском.
Крупный текст: увеличьте текст на изображении, чтобы улучшить читаемость, но не обрезайте важные детали.
Поворот: модель может неверно интерпретировать повернутый или перевернутый текст либо изображения.
Визуальные элементы: модель может испытывать трудности с пониманием графиков или текста, где различаются цвета или стили, например сплошные, пунктирные или точечные линии.
Пространственные задачи: модель плохо справляется с задачами, требующими точного определения расположения, например с распознаванием позиций в шахматах.
Точность: в некоторых сценариях модель может генерировать неверные описания или подписи.
Форма: модель плохо справляется с панорамными изображениями и изображениями типа «рыбий глаз».
Метаданные и изменение размера: модель не обрабатывает исходные имена файлов или метаданные, а изображения перед анализом изменяются в размере, что влияет на их исходные размеры.
Подсчет: модель может давать приблизительное количество объектов на изображениях.
