四配置对比
容量上限
速度基准
生成服务(内测)
参考图预处理
参考图预处理(GPT-Image-2)
上传参考图(可多张)+ 一句话描述,生成首帧(可选尾帧)+ 优化后的视频 prompt,直接接入下方生成服务
访问 Token
保存
Token 只存在你浏览器本地(localStorage),和"生成服务"页共用。
后端地址:
[修改]
参考图(可多张,gpt-image-2 最多支持 16 张;多张会一起送给模型做联合参考)
+
场景/动作描述
时长:
5
秒
分辨率
480p(最快)
768p(推荐)
1080p(最慢)
画面比例
跟参考图走(推荐)
16:9 横屏
9:16 竖屏
1:1 方形
4:3
3:4
21:9 超宽
模式
只生成首帧
首帧+尾帧
视频质量档
4步(更快)
8步(更精细,默认)
用 GPT 优化视频 prompt(同时生成更贴合首尾帧的编辑指令;取消勾选则直接用你写的原文,不额外调用文本模型)
生成首/尾帧
首帧
尾帧
优化后的视频 prompt(可编辑)
用这组首/尾帧生成视频 →
跳转到下方"生成服务",直接把这两帧当 image0/image1 提交,不用再手动下载再上传。