Skip to content

文生图与改图

HJToken 已接入 OpenAI 官方 gpt-image 系列,支持从文字生成图片(文生图),也支持基于已有图片修改(改图)。协议与 OpenAI 官方一致,现有 SDK 换 base_url 即用。

支持的模型

模型定位说明
gpt-image-2旗舰画质与提示词遵循度最好,适合正式交付的图
gpt-image-1.5上一代旗舰表现稳定,成本略低
gpt-image-1旧版官方将于 2026-10-23 弃用,新项目请勿使用
gpt-image-1-mini经济档最便宜,适合大批量试稿、反复调提示词

实际可用的型号以 模型定价页 为准(随上游自动同步)。

计费方式:按输出 token,不是按张

这是和很多平台不同、也最需要先搞清楚的一点:

gpt-image 系列官方按 token 计费,一次请求的费用大致是:

文字提示词 tokens × 输入单价
+ 参考图 tokens × 图片输入单价(仅改图/带参考图时)
+ 生成图 tokens × 图片输出单价

画质(quality)和尺寸(size)越高,生成图消耗的输出 token 越多,费用就越高。 例如同一张 1024×1024:

画质大致输出 token 量相对费用
low约几百最低
medium约两三千中等
high约四千以上最高

所以调提示词阶段建议用 low + gpt-image-1-mini,定稿再切高画质,能省下大部分开销。

各模型的图片输出单价见 模型定价页 的「图片输出 (/1M)」列;实际消耗与费用可在 用量统计 逐条查看。

方式一:在 Chat 页直接出图(无需写代码)

  1. 打开 Chat
  2. 在模型选择器里选一个 gpt-image-* 模型
  3. 顶部模式切到 画图(想改图就选 改图 并上传原图)
  4. 选画质(low / medium / high),输入描述,发送

出图后可直接下载。费用与走 API 完全一致,同样从余额扣。

方式二:调 API

基础地址:https://api.hjtoken.cn

文生图 /v1/images/generations

bash
curl https://api.hjtoken.cn/v1/images/generations \
  -H "Authorization: Bearer $HJTOKEN_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-image-2",
    "prompt": "一只戴着宇航头盔的柴犬,赛博朋克霓虹背景,电影感打光",
    "size": "1024x1024",
    "quality": "medium",
    "n": 1
  }'

响应里的 data[].b64_json 是 base64 编码的图片,解码后写文件即可:

bash
# 承接上面的响应
cat response.json | jq -r '.data[0].b64_json' | base64 -d > out.png

改图 /v1/images/edits

改图走 multipart/form-data,把原图作为文件上传:

bash
curl https://api.hjtoken.cn/v1/images/edits \
  -H "Authorization: Bearer $HJTOKEN_API_KEY" \
  -F model="gpt-image-2" \
  -F image="@input.png" \
  -F prompt="把背景换成雪山日落,保留主体不变" \
  -F size="1024x1024" \
  -F quality="medium"

用 OpenAI SDK

只改 base_urlapi_key,其余与官方文档一致:

python
from openai import OpenAI

client = OpenAI(
    api_key="你的 HJToken API Key",
    base_url="https://api.hjtoken.cn/v1",
)

result = client.images.generate(
    model="gpt-image-2",
    prompt="极简风格的山脉线条插画,米白背景",
    size="1024x1024",
    quality="low",
)

import base64
with open("out.png", "wb") as f:
    f.write(base64.b64decode(result.data[0].b64_json))

常用参数

参数取值说明
prompt文本图片描述。写得越具体(主体、风格、构图、光线)效果越稳
size1024x1024 / 1024x1536 / 1536x1024尺寸越大消耗输出 token 越多
qualitylow / medium / high对费用影响最大的参数
n整数一次生成几张。费用按张累加

常见问题

为什么返回的是 base64 而不是链接? gpt-image 系列官方就返回 base64,不提供托管链接。这也意味着图片不经第三方存储,用完即走。

图片会被保存在 HJToken 吗? 不会。网关只做转发与计费记录(记录 token 数与费用),不留存图片内容。

能生成视频吗? 暂不支持。当前只开放图片生成。

为什么我这张图比预期贵/便宜? 先看 用量统计 里这条记录的输出 token 数——费用直接跟它成正比。qualitylow 调到 high,token 数可能差十几倍。

报错说模型不可用? 说明你当前套餐/分组没有包含该图片模型。到 定价页 确认你能访问的模型列表,或联系我们开通。

基于 Claude / OpenAI / Gemini 的 AI API 网关