📚 离职知识库

生图 API 配置(GPT Image 2,yunwu.ai 中转)

可迁移配置(2026-07-14)。 任何新项目要接 AI 生图,照抄这四个环境变量 + 下面的调用方式即可。

#环境变量(OpenAI 兼容接口)

IMAGE_API_BASE=https://yunwu.ai/v1
IMAGE_API_KEY=<KEY>
IMAGE_MODEL=gpt-image-2
IMAGE_QUALITY=medium        # low / medium / high,质量越高越贵越慢

#调用方式(POST ${IMAGE_API_BASE}/images/generations)

curl -X POST "https://yunwu.ai/v1/images/generations" \
  -H "Authorization: Bearer $IMAGE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-image-2",
    "prompt": "绘图提示词",
    "size": "1536x1024",
    "quality": "medium",
    "n": 1
  }'

#实战经验(踩出来的,迁移时照做)

  • 尺寸只有三档:横幅 1536x1024、竖幅 1024x1536、方图 1024x1024。要 2.35:1、16:9 这类精确比例,生成后在前端/客户端居中裁剪,别指望模型出任意尺寸。
  • 返回格式两种都要兼容:正常返回 data[0].b64_json;部分情况中转只回 data[0].url,需要服务端把 url 拉回来转 base64。
  • 超时给足:GPT Image 通常要 1-2 分钟,请求超时可设 280 秒。
  • 中文封面大字的提示词写法:英文描述风格构图 + 中文双引号包裹标题文字(GPT Image 渲染中文大字最稳的写法)。
  • base64 图很大(2-3 MB/张):别长期存数据库,会成为库容量的绝对大头;做法是只留 24 小时回显副本,成品即时保存到本地。

#相关但独立的配置(配图搜图,不是生图)

正文插图走的是免费图库搜索,不是 AI 生图,key 见《配图搜图双图库策略》:

  • PEXELS_API_KEY(主)/ PIXABAY_API_KEY(兜底)

#当前使用方

  • 内容生产项目的封面生成(generateCoverImage,env 在 .env.local + Vercel Production)
  • ppt-master skill(同一套搜图 key)
  • Claude Code 的 /img/image skill:脚本在本地 skill 目录,key 单独存 skill 的 .env,用的是另一把独立云雾 key。/img 文生图走 images/generations/image 改图走 images/edits,出图落本地目录。

#改图接口 images/edits(实测于 2026-07-25)

curl -X POST "https://yunwu.ai/v1/images/edits" \
  -H "Authorization: Bearer $IMAGE_API_KEY" \
  -F "model=gpt-image-2" -F "image[]=@原图.png" \
  -F "prompt=把苹果换成绿柠檬,其余不变" -F "quality=medium" -F "n=1"
  • 字段名是 image[],可重复传多张做融合/参考,第一张为主图。
  • 支持 mask=@蒙版.png(透明处=待重绘),但实测只当弱提示:重绘位置不一定落在挖空区,蒙版外也会被重画。位置务必在 prompt 里用文字说清。
  • 本质是整图重绘,无法做到"只动一处、其余像素级不变"。
  • 生成/改图耗时均约 40–60 秒。

来源:配置信息/生图API-gpt-image-2.md(整理于 2026-08-18)