图像理解与生成
图像理解是上传图片并提问,图像生成或编辑是根据描述创建或修改图像。它们不是同一个功能,能否使用取决于账号中开放的工具。
上传截图时怎样提问
提供清晰图片,并指出你关心的位置。截图前移除姓名、账号、令牌和私人消息。包含错误弹窗时,最好同时粘贴报错文本。
请解释截图右下角的错误提示。先逐字转写可辨认的文字,
再说明可能原因。看不清的部分标注“无法辨认”,不要猜。
图像里的精确计数、小字、坐标和空间关系可能出错。涉及医学影像、身份识别或安全判断时,不应仅靠模型输出作决定。
描述要生成的图片
从用途、主体、场景、构图和风格开始,必要时加上必须出现的文字和不应改变的细节。避免同时堆积互相冲突的风格词。
为一篇学习方法文章制作横向配图:桌面上一本打开的笔记本、
铅笔和一杯水。自然日光,画面左侧留白,不出现品牌标志和文字。
生成后检查手部、重复物体、图中文字、标志和不合理细节。若要修改,明确保留哪些部分,只描述这次需要改变的内容。
把配图要求写成一份简短制作说明
与其堆叠“高级、精致、专业”等形容词,不如写明图片放在哪里。例如:“文章列表缩略图,横向 16:9;主体在右侧,左侧预留标题区域;背景简洁,小尺寸下仍能辨认笔记本。”这直接影响构图和可读性。
如果画面里必须有文字,先单独确认文案,生成后逐字检查。标点、日期、品牌拼写和换行都可能出错。文字多的海报通常可以先生成背景,再用设计工具排版,这样修改价格或日期更方便。
编辑图片时怎样保护已满意的部分
一次只修改一个明确区域,例如:“保留主体、光线和镜头角度,只把桌面背景改为浅灰。”如工具支持选择编辑区域,先准确圈选,再描述目标。修改后仍要检查未选中的区域是否变化,尤其是商品细节和人物特征。
网页使用前检查三件事:裁切后主体是否完整、文件是否过大、替代文字是否描述实际内容。比如“浅色桌面上的笔记本与铅笔”比“最好看的 AI 配图”更有助于无法查看图片的读者。涉及真实操作步骤时,应使用实际界面截图,并说明客户端和时间。
版权与公开使用
确认你拥有上传参考图的使用权限。涉及真实人物、客户品牌或商业素材时,进一步审查授权、产品条款和用途。不要把生成的界面、证书或数据图当作真实截图和事实证据。
图像文件用于网页时,补充描述实际内容的替代文字,并根据展示尺寸压缩。原图应另存,避免多次压缩损失细节。