2026 年万相 2.6 图像 国内API接入实操步骤:接口地址、鉴权与第一个请求
2026 年万相 2.6 图像 国内API接入实操步骤:接口地址、鉴权与第一个请求
万相 2.6 图像的国内 API 接入,卡点通常只有三个:接口地址有没有写对、鉴权头有没有带上、第一个请求体的字段有没有用错。这三件事确认完,调试就进入正常节奏。
下面按实操顺序走一遍完整流程:先准备配置,再发出第一个请求,最后处理返回结果与常见报错。文中出现的接口地址、模型名称与参数名,请以你实际使用的控制台文档为准。如果你希望先在一个入口里比对不同图像模型的调用方式,也可以看看 通联AI中转站 展示的模型列表与兼容协议说明。
一、开始前需要准备什么
图像生成接口和纯文本接口最大的区别在于:请求体更大、响应体也可能是二进制或长链接,因此对超时、存储和错误处理的要求更高。准备工作做扎实,后面能少走很多弯路。
| 配置项 | 作用 | 检查方法 |
|---|---|---|
| 接口地址(Base URL) | 决定请求发往哪个网关,图像接口通常有独立路径 | 对照文档确认前缀与路径拼接方式,避免重复叠加版本号 |
| API Key | 用于身份鉴权与用量归属 | 确认请求头字段名,检查 Key 是否完整、有无隐藏字符 |
| 模型名称 | 指定使用哪个图像模型版本 | 直接复制控制台显示的名称,不要凭记忆手写 |
| 存储与网络出口 | 用于保存返回的图片或访问临时链接 | 确认服务器能否访问返回的图片地址,或提前规划对象存储 |
接口地址要看清楚“前缀 + 路径”
图像接口常见的形式是 /v1/images/generations 这类结构,但不同平台的路径前缀并不相同:有的统一带 /v1,有的把图像能力放在单独路径下。把 Base URL 和具体路径分开配置,是最容易排查的做法——出问题时你只需要确认哪一段错了。
二、第一个请求的四步做法
- 选定模型:从控制台复制模型名称,先不要使用任何记忆中的简称或别名。
- 拼装请求体:从最小参数开始,只写模型、提示词、尺寸和数量,先跑通链路。
- 发送并读取响应:观察状态码与返回结构,确认拿到的是图片链接还是 base64 数据。
- 保存并复核:把图片落盘或转存到对象存储,人工检查画面是否符合提示词要求。
curl -X POST 'https://你的接口地址/v1/images/generations' -H 'Authorization: Bearer YOUR_API_KEY' -H 'Content-Type: application/json' -d '{"model":"控制台显示的模型名称","prompt":"一只在窗边晒太阳的橘猫,写实摄影风格","size":"1024x1024","n":1}'
这段命令的意义不在于它可以长期使用,而在于它能帮你把变量降到最低。如果它返回 200 并带回了图片数据,说明接口地址、鉴权和模型名称三项都是正确的,接下来才值得去调尺寸、风格和批量参数。
请求体里最容易写错的字段
- prompt:主体、场景、风格、镜头建议分句写,避免把互相冲突的描述堆在一起。部分图像模型对中文提示词支持较好,但效果仍取决于具体模型,建议用同一条提示词做横向对比。
- size:必须是接口支持的尺寸枚举值,自己算出来的宽高比大概率会被参数校验拦下。
- n:单次生成数量。数值越大,单次响应体越大,超时风险也越高。
- 返回格式字段:有的接口返回可访问链接,有的直接返回 base64。写代码前先确认,否则会拿不到图片内容。
- 负面提示词或风格参数:属于可选项,建议链路跑通后再加,不要和基础参数一起调。
返回结果怎么处理更稳妥
如果返回的是图片链接,要注意链接通常带有效期,不能直接当作永久地址存进数据库,应在拿到结果后立即转存到自己的存储服务。如果返回的是 base64,注意解码后校验文件头,避免把错误信息当成图片写入文件。此外,图像生成耗时通常明显高于文本请求,读取超时建议单独配置得宽松一些,并避免在同一个连接上并行发起过多请求。
三、国内调用常见的四类问题
- 401 与 403:Key 没带上、被空格污染,或该 Key 未开通图像能力。先换最小请求复现,再核对权限。
- 404:路径拼接错误最常见。检查是否重复写了
/v1,或者把对话接口的路径用在了图像接口上。 - 400 参数校验失败:尺寸不在支持列表、模型名称拼错、字段名大小写不一致,都会落到这一类。
- 超时或连接中断:大尺寸、批量生成时更容易出现。可以降低单次数量、缩短提示词长度,并确认服务器出口网络的稳定性。
图像接口的调试顺序,建议是先用最小提示词加最小尺寸跑通链路,再逐步加上尺寸、批量与风格参数。一次性把所有参数写满,失败原因就变得难以分辨。
四、接进工作流时要考虑的三件事
第一是成本口径:图像生成通常按张计费,和文本按 Token 计费不是一套逻辑,做预算时要分开核算。第二是流程位置:图像往往处于内容生产的中后段,前面有选题和文案,后面有审核和排版,接口失败时的兜底方案要提前想清楚。第三是人工复核:生成结果需要有人确认是否符合品牌调性和合规要求,不建议全自动直发。
当工作流里同时存在文本、图像、视频甚至语音环节时,把模型调用集中到一个入口会省去不少切换成本。你可以在 通联AI中转站 的模型广场按任务类型筛选图像类能力,统一管理 API Key、余额与调用记录,具体可用模型与计费以页面实时信息为准。
五、上线前的检查清单
- 接口地址与路径分开配置,且与文档逐字一致。
- API Key 只通过环境变量或密钥管理服务注入。
- 图像请求的读取超时单独设置,不与文本接口共用同一套数值。
- 返回图片立即转存到自有存储,不依赖临时链接。
- 记录每次请求的模型名称、尺寸、耗时与结果状态,便于回溯用量。
- 建立人工复核环节,明确可用与需重做的判定标准。
把接口地址、鉴权和第一个请求这三步确认清楚,万相 2.6 图像的接入基本就完成了一半。剩下的是参数调优和流程整合,那属于效果问题,而不是接入问题。
如果你准备把图像生成接进内容流程,可以先在通联查看可用的图像模型与调用说明,注册后获取 API Key,用本文的最小请求跑通第一条链路,再逐步加上尺寸与风格参数。