图片工作区
创建图片任务、使用参考素材并检查生成结果。
图片工作区用于从文字说明或参考素材开始图片任务。可用模型、尺寸和编辑能力以客户端当前显示为准。
功能状态:正式
图片任务入口属于稳定功能;不同模型提供的生成和编辑能力可能不同。
入口
在左侧「工作入口」中打开「图片」,也可从对话中描述图片任务并进入对应结果。
使用前准备
- 写清楚主体、场景、风格、构图和用途;
- 参考图只使用你有权处理的内容;
- 不要上传身份证件、私密照片或无关客户资料;
- 提前确认目标比例和大致尺寸。
操作步骤
打开图片工作区,选择可用的图片模型。
输入图片说明;需要时加入已获授权的参考图。
选择界面提供的比例、尺寸或生成选项。
开始任务并等待生成完成。
放大检查文字、人物细节、品牌元素和边缘,再保存正确版本。
成功标志
生成结果符合目标构图和用途,文件可正常打开,且不包含未授权素材、私有信息或明显错误文字。
更好的使用方法
- 一次只解决一个目标,例如先出构图,再改风格,不要一轮里同时改主体、场景、字体和比例;
- 先写用途,再写画面,例如“做小红书封面图,竖版,主体居中,留标题区”;
- 参考图越少越好,最好每张都承担明确作用,例如一张定人物,一张定光影;
- 图片里如果必须出现很多准确文字,优先先生成无字底图,再用设计工具补字;
- 重要素材先做小范围验证,确认模型和风格对路后再放大批量生成。
常见工作方式
- 从零生成:给出主体、场景、风格、比例和用途;
- 参考图变体:说明哪些元素必须保留,哪些可以变化;
- 局部重做:指出需要修改的区域,而不是只说「不好看」;
- 给视频准备素材:先生成封面、分镜参考、贴纸或背景,再交给视频流程继续使用。
常见报错会出现在哪
| 位置 | 你会看到什么 | 代表什么 |
|---|---|---|
| 图片工作区当前任务 | 无法开始、立即失败、一直等待 | 当前这次图片任务没有顺利进入生成 |
| 模型或 Provider 选择区 | 模型不可用、能力不支持 | 你当前选的能力不支持图片生成或编辑 |
| 结果预览区 | 结果为空、只有部分结果、参考不生效 | 任务跑了,但输出不符合当前输入或素材条件 |
| 运行环境提示 | runtime unavailable、bridge unavailable | 当前运行环境没有可用的图片执行桥接能力 |
常见报错与含义
| 常见提示或错误方向 | 用户应如何理解 | 建议先做什么 |
|---|---|---|
| prompt required / 需要输入说明 | 当前模型要求必须有文字说明,不能空跑 | 至少补齐主体、场景、风格和用途 |
| prompt too long / 说明过长 | 描述太散、太长,超出当前能力限制 | 先压缩成目标、主体、风格、限制四部分 |
| reference images too many / 参考图过多 | 一次塞入了过多参考图,系统无法稳定吸收 | 保留最关键的 1 到 3 张参考图 |
| model does not support media generation | 当前登录方式或模型只支持文本,不支持图片 | 改用支持图片的模型或已配置的图片 Provider |
| runtime unavailable / bridge unavailable | 不是提示词问题,而是当前环境暂时不能执行图片生成 | 先检查本地 Runtime、Provider 和模型可用性 |
| 结果和参考图差异很大 | 任务没有硬失败,但约束不够明确 | 重写说明,明确“必须保留”和“允许变化”的部分 |
建议用户怎么排查
先确认当前模型和 Provider 真的支持图片生成,不要拿纯文本能力跑图片任务。
把提示词压缩成一版最小可运行描述,再试一次。
如果用了参考图,只保留最关键的几张,并写明每张参考图要起什么作用。
如果结果里有大量错误文字,改成先出无字图,再单独补文字。
如果仍然失败,记录模型、任务时间和错误提示,再反馈问题,不要附带密钥或私密图片。
截图占位
后续建议补 3 张图:图片工作区入口、参考图上传状态、结果预览与尺寸/比例区域。
录屏占位
后续建议补 1 段短录屏:从输入提示词和参考图,到生成第一版结果,再到二次微调。