图片输入

图片输入

ChatGPT 图片输入中文指南:把错误截图、界面设计、架构图、图表或现有素材附加到提示词,为视觉任务提供准确上下文;学习逐张说明图片内容、关注区域、比较关系、期望结果和不可更改的约束,让 ChatGPT 检查或验证其他 App 中的工作,并区分用于理解视觉参考的图片输入与用于创建、局部修改或组合素材的图像生成能力。

图片输入#

Codex 中文站说明: 本页围绕“图片输入”重新补充了中文使用场景和验证重点。界面名称可能随 Codex 版本更新,请以当前客户端为准。

将截图、图表和视觉参考附加到 ChatGPT 提示词

当任务依赖视觉上下文时,可以把图片加入提示词,例如错误截图、界面设计、架构图或现有素材。请说明 ChatGPT 要检查什么、你希望得到什么结果,不要只靠图片本身表达任务。

按住 Shift 并把图片拖入提示词输入框,即可将其作为上下文。你也可以让 ChatGPT 检查系统中的图片,或使用截图工具验证其它 App 中的工作结果。

围绕图片编写提示词#

说明图片展示的内容,指出需要关注的区域,并写明输出要求和约束。如果附加了多张图片,请逐一标识,并说明 ChatGPT 应如何比较它们。

例如:

text
Compare this checkout screen with the design. Fix spacing and typography only;
do not change behavior. Verify the result with a new screenshot.

选择正确的图片能力#

当你希望 ChatGPT 检查视觉参考时,请使用图片输入;当你希望 ChatGPT 创建或编辑图片时,请使用图像生成

本站实践建议#

阅读“图片输入”时,建议先在非生产项目中走完一次完整流程,并记录实际界面、命令输出和验证结果。产品更新后,可据此快速判断哪些步骤需要调整。

Codex API 与国内使用#

在实践“图片输入”相关功能时,如需为 Codex 配置 OpenAI-compatible API,可以前往 APIBest 获取 API Key。第三方服务的模型映射、价格、额度和数据处理方式以 APIBest 当前说明为准。