我们将字节跳动的 Seedance 2.5 接入了我们的 API 平台。集成说明与未文档化的注意事项
上周我们在官方 Ark 渠道上运行了 Seedance 2.5,由于关于该型号的中文文档稀少,英文文档更是有限,这里是我希望在我们开始之前有人写过的笔记。
**快速信息**:
- 一个异步端点,模型 ID 为 `doubao-seedance-2.5-face`。
- 每个请求生成 4 到 30 秒的视频,分辨率为 480p 或 720p,输出格式为 MP4 或 MOV。
- 音频与视频同次生成:包括人声、音效和背景音乐。按提示中的双引号内的内容为台词,其余内容视为场景描述。
- 每个请求最多可引用 30 张图片、10 个视频和 10 条音频,单个音频文件也是有效输入,且允许使用真人参考材料,这就是 ID 中“face”部分的意思。
**接下来是我们花费时间的部分**:
- 每种模式下提示是必填项,包括图片转视频。最少需要 3 个字符。2.0 版本允许直接抛出图片;而 2.5 拒绝。
- 便宜的“参考”计费率仅在附加参考视频时触发。图片和音频参考按照全额文本费率计费。容易误解,假设错误会很贵。
- 针对视频输入,最低计费标准大约是输出秒数的 5/3,并且输入秒数也计入账单。请削减你的参考片段。
- 供应商支持 `duration=-1`(模型自动选择时长),但没有办法提前计费不确定时长,因此我们无法开放该选项。与此原因相同的是,v1 中没有视频编辑模式。
- 没有 seed 参数。两个相同的请求生成两个不同的视频。
**模型页面及完整参数参考**:
[模型页面](https://reapi.ai/models/seedance-2-5)
[官网](https://reapi.ai)
如果你尝试后遇到我没有列出的边缘情况,请在这里回复。非常好奇哪个问题会先出现。
---
原文链接:[点击查看](https://www.v2ex.com/t/1233216)
**快速信息**:
- 一个异步端点,模型 ID 为 `doubao-seedance-2.5-face`。
- 每个请求生成 4 到 30 秒的视频,分辨率为 480p 或 720p,输出格式为 MP4 或 MOV。
- 音频与视频同次生成:包括人声、音效和背景音乐。按提示中的双引号内的内容为台词,其余内容视为场景描述。
- 每个请求最多可引用 30 张图片、10 个视频和 10 条音频,单个音频文件也是有效输入,且允许使用真人参考材料,这就是 ID 中“face”部分的意思。
**接下来是我们花费时间的部分**:
- 每种模式下提示是必填项,包括图片转视频。最少需要 3 个字符。2.0 版本允许直接抛出图片;而 2.5 拒绝。
- 便宜的“参考”计费率仅在附加参考视频时触发。图片和音频参考按照全额文本费率计费。容易误解,假设错误会很贵。
- 针对视频输入,最低计费标准大约是输出秒数的 5/3,并且输入秒数也计入账单。请削减你的参考片段。
- 供应商支持 `duration=-1`(模型自动选择时长),但没有办法提前计费不确定时长,因此我们无法开放该选项。与此原因相同的是,v1 中没有视频编辑模式。
- 没有 seed 参数。两个相同的请求生成两个不同的视频。
**模型页面及完整参数参考**:
[模型页面](https://reapi.ai/models/seedance-2-5)
[官网](https://reapi.ai)
如果你尝试后遇到我没有列出的边缘情况,请在这里回复。非常好奇哪个问题会先出现。
---
原文链接:[点击查看](https://www.v2ex.com/t/1233216)
评论
暂无评论。