什么是图像输入?它们在 ChatGPT 中如何工作?
ChatGPT 现在具备图像功能,可以理解和解读您作为图像输入添加到对话中的图像。
我应该如何在对话中使用图像输入?
基本用法:先上传一张照片。询问图像中的物体、分析文档,或探索视觉内容。在后续轮次中添加更多图像,以深入或转移讨论。您可以随时带着新照片回来继续。
标注图像:为突出特定区域,建议在上传前使用照片编辑标注工具处理图像。这会引导 ChatGPT 关注您认为重要的元素。
哪些套餐可以使用图像输入?
免费和付费 ChatGPT 套餐均可使用图像输入,但须遵守相应套餐的使用限制和账户设置。在移动网页端,您还可以在登录前附加照片。
哪些模型可以接受图像输入?
所有 ChatGPT 模型都可以接受图像输入。
哪些平台支持图像输入?
所有平台均支持,包括网页版(chatgpt.com)和移动端(iOS / Android)。
我的图像会用于改进你们的模型吗?
我们对内容(包括图像)的使用方式在各个产品中保持一致。
请参阅您的数据如何用于提升模型性能,以更好地了解 ChatGPT 上的内容可能如何用于提升模型性能,以及用户有哪些选择。
对于 ChatGPT Enterprise,我们不会使用内容来训练我们的模型。
如何在 ChatGPT 中添加图像输入?
点按提示区域中的 + 图标,然后选择添加照片和文件。或者,您也可以将图像文件拖到文本区域,或粘贴已复制到剪贴板的图像。
我可以将视频上传到 ChatGPT 吗?
可以。ChatGPT 支持通过可用的上传方式添加视频文件作为附件,免费版也支持此功能。该功能是否可用取决于平台、上传方式和账户。视频文件附件与静态图片输入是两种不同的功能。如果无法在“照片”中选择视频,请尝试改为通过“文件”添加附件。
ChatGPT 可能会使用工具分析上传的视频,但分析结果可能不完整或不准确。它可能不会分析整段视频,也可能无法准确解读视频中的音频。
视频附件会计入您所用方案的文件上传限额。
语音模式中的实时摄像头视频和屏幕共享是两项独立功能,各自有不同的可用范围和使用限制。请参阅 ChatGPT 语音。
我一次可以上传多少张图像?
您可以添加到对话中的图像数量取决于多种因素,包括图像大小以及随附文本的多少。一般而言,如果遇到问题,建议减少图像数量或缩小图像尺寸。
每张图像的大小限制是多少?
20MB。
图像功能如何处理含义模糊或不清晰的图像?
如果图像含义模糊或不清晰,模型会尽力解读。不过,结果可能不太准确。
用户在使用 ChatGPT 图像输入时应注意哪些限制?
如果您正在使用 ChatGPT 的全新图像输入功能,请务必注意以下限制:
医疗:模型不适合解读 CT 扫描等专业医学图像,也不应被用于提供医疗建议。
非英语:对于包含非拉丁字母文本(如日语或韩语)的图像,模型的处理效果不佳。
大号文字:放大图像中的文字可提高可读性,但应避免裁掉重要细节。
旋转:模型可能会误读旋转或倒置的文字或图像。
视觉元素:对于颜色或实线、虚线、点线等样式各不相同的图表或文本,模型可能难以理解。
空间:模型不擅长需要精确空间定位的任务,例如识别棋局位置。
准确性:在某些场景中,模型可能会生成不正确的描述或说明文字。
形状:模型不擅长处理全景图像和鱼眼图像。
元数据和调整大小:模型不会处理原始文件名或元数据;图像在分析前会被调整大小,从而影响其原始尺寸。
计数:对于图像中的物体,可能只会给出近似数量。
