2026 年万相3.0 首尾帧 短视频生成API 接入指南:首帧与尾帧参数怎么设
2026 年万相3.0 首尾帧 短视频生成API 接入指南:首帧与尾帧参数怎么设
首尾帧短视频生成最容易踩的坑,不是请求发不出去,而是首帧和尾帧参数写错,最后画面跟预期对不上。
本文按“接入前准备 → 参数含义 → 请求写法 → 失败排查”的顺序,把万相 3.0 首尾帧短视频生成 API 的接入过程拆开讲,重点是首帧与尾帧到底怎么设。
先约定一个前提:不同厂商、不同版本对图片格式、时长、分辨率的限制并不一致,下文出现的字段名和取值范围,请以你在控制台或接口文档中看到的实时说明为准。如果你是通过 通联AI中转站 这类聚合入口调用,也要先在模型页核对模型名称与兼容协议,再动手改代码。
一、接入前先确认好这三件事
首尾帧接口的必填参数并不多,真正让接入卡住的是准备工作没做全。动手写代码前先把下面三项确认清楚,能省掉后面大半的排查时间。
- 准确的模型名称:控制台里显示的模型标识往往和宣传名称不完全一致,有的带版本号后缀,有的把图生视频与首尾帧生成区分成不同入口。直接复制控制台或文档中的名称,不要凭记忆拼写。
- 接口地址与协议类型:确认接口是同步返回结果,还是先返回任务 ID 再轮询。视频生成耗时普遍高于文本请求,多数实现走异步任务模式。协议不同,轮询和超时逻辑就要跟着改。
- 图片素材的可访问性:首帧和尾帧要么是服务端能直接读取的公网 URL,要么按文档要求做编码处理。带鉴权、带防盗链、会过期的链接,是“任务创建成功但很快失败”的常见原因。
二、首帧与尾帧参数分别控制什么
首帧定起点,尾帧定落点
理解这两个参数的分工,比记住字段名更重要。首帧图片决定视频第一个画面的构图、主体位置、景别和色调;尾帧图片决定最后一个画面的状态,也就是这段运动要停在哪里。中间过程由模型推理补全,提示词更多是在描述这段过渡怎么发生,而不是逐帧绘制。
正因为如此,两张图之间如果差距过大,比如主体从正脸变成背影、场景从室内直接跳到室外,模型只能自行想象中间发生了什么,结果就不稳定。想让输出更可控,就把首尾帧的变化幅度收窄,再用提示词补充运动和镜头方式。
| 参数项 | 作用 | 常见取值方向 | 上线前怎么检查 |
|---|---|---|---|
| 首帧图片 | 决定起始构图、主体位置与色调 | 单张清晰静态图,主体完整、无裁切 | 按目标分辨率本地预览,确认变形、黑边与裁切 |
| 尾帧图片 | 决定结束画面与运动落点 | 与首帧主体一致、场景连贯 | 两张图并排看,光比和视角差异不要过大 |
| 图片地址或编码 | 决定服务端能否读到素材 | 可公开访问的 URL,或文档规定的编码格式 | 用无痕窗口打开链接,确认不需要登录、不会过期 |
| 时长与分辨率 | 影响生成耗时与计费口径 | 按业务需要选择,不超出文档上限 | 对照文档上限值与计费说明,核算单条成本 |
| 提示词 | 描述过渡方式与镜头运动 | 一到几句话,说清动作与镜头 | 检查是否与首尾帧画面互相矛盾 |
两个容易被忽略的细节
第一是图片比例。如果首帧是竖版、尾帧是横版,模型要做一次构图决策,结果可能被裁切或补边。第二是主体一致性。同一个人物或产品,尽量用同一批素材,避免服装、颜色、光线在首尾帧之间突变。
参数只是表象,真正决定成败的是首尾帧之间的变化能否被一次合理运动解释。字段全填对了画面还是不连贯,先回头检查两张图本身,而不是急着改提示词。
三、从 API Key 到首次请求的完整步骤
- 获取凭证:在平台控制台创建 API Key,同时记录接口地址(Base URL)。Key 只放在服务端环境变量中,不要写进前端代码,也不要提交到代码仓库。
- 确认模型与协议:在模型列表中找到对应的首尾帧视频模型,记下准确的模型名称,并确认它是同步接口还是异步任务接口。
- 准备素材:把首帧、尾帧上传到对象存储或平台提供的文件接口,拿到可访问的地址。测试阶段建议先用短时长、低分辨率,降低单次试错成本。
- 发一次最小请求:先只填必填项,确认能拿到任务 ID 或直接拿到结果,再逐步增加可选参数,这样出错时更容易定位。
- 轮询与转存:异步任务要设置合理的轮询间隔和超时上限,拿到结果后立即下载并落到自己的存储中,不要长期依赖临时链接。
POST {BASE_URL}/video/generations
Authorization: Bearer {API_KEY}
{
"model": "以控制台显示的模型名称为准",
"prompt": "镜头缓慢推进,人物由坐姿起身走向窗边",
"first_frame_image": "https://your-cdn.example.com/start.jpg",
"last_frame_image": "https://your-cdn.example.com/end.jpg",
"duration": 5
}
这段结构只是示意:接口路径、字段名、是否支持 raw 编码、时长单位是秒还是帧,都要以你所用平台的文档为准。把 Base URL、模型名称、API Key 做成配置项,迁移或换模型时才不用翻遍代码。
拿到结果之后别急着上线
视频生成带有一定随机性,同一个请求多跑几次结果可能不同。上线前建议固定一组测试用例,用同一对首尾帧、同一段提示词连续跑若干次,记录画面连贯度、主体一致性和失败率,再决定是否需要调整素材或参数。涉及人物形象、品牌素材时,还要安排人工复核环节,确认输出内容符合业务与合规要求。
四、常见失败与自查思路
- 任务创建成功但很快失败:优先检查图片链接能否被服务端读取,其次检查格式与体积是否超限。
- 返回参数错误:多半是字段名或取值类型不对,对照文档逐项核对,注意时长为整数、分辨率在允许列表内。
- 画面与预期差距大:先判断首尾帧本身是否连贯,再考虑精简提示词,避免提示词与画面内容冲突。
- 提示调用频率受限:检查是否触发并发或频率限制,改为队列化提交,而不是并发重试。
- 结果链接打不开:临时链接通常有有效期,应在拿到结果后及时转存到自己的存储。
五、多模型场景下如何减少重复劳动
实际项目很少只用一个视频模型。你可能需要用不同模型处理不同时长和风格,也可能用文本模型写提示词、用图像模型生成首尾帧。这时候每个平台一套 Key、一套接口地址、一套计费方式,维护成本会迅速上升。
这也是不少团队会考虑 AI 中转站的原因:用统一的接口地址和 API Key 管理多个模型,把模型名称做成配置项,切换时只改配置、不改调用结构。通联AI中转站 属于这类聚合入口,页面按对话、图像、视频、语音等能力方向组织模型,具体有哪些视频模型、是否支持首尾帧参数,要以官网模型广场的实时信息为准,不要凭印象假设。建议先用一两条测试请求验证参数结构,再决定是否纳入正式链路。
想跑通第一条首尾帧短视频请求,关键是先把接口地址、模型名称和 API Key 对齐,再用最小请求验证一遍参数结构。进入通联控制台注册并获取 API Key 后,可以在模型广场确认可用的视频模型与兼容协议,把配置项固定下来再接入正式流程。