视频
在首帧与尾帧之间插值
在两个受控端点之间生成连续运动。
Agent 主路径
只有当首帧和尾帧共同定义过渡时,才使用 beatra.videos.interpolate,并
保持两帧顺序。
- 上传两张本地图片与可选驱动音频。
- 用
capability: "frames_to_video"调用beatra.models.list,读取当前 媒体组合、时长、分辨率、音频支持和价格。 - 描述两个端点之间的运动,而不是两个互不相干的场景。
- 使用一个
client_request_id提交一次,再用beatra.tasks.get轮询。
AI 指南
给 AI 的集成说明
接入自有应用时,可以把这份 API 指南复制给 Claude、Codex 或其他编程助手。
工具参数
不需要或模型不支持时省略 driving_audio。输入图片派生的宽高比规则以模型
发现结果为准。
模型、控制与成本
通用控制项包括 prompt、negative_prompt、resolution、
duration、aspect_ratio、seed、enhance_prompt 和 watermark;
每一项都应按所选模型的元数据使用。
不要维护静态模型表。beatra.models.list 返回可选模型、可接受的帧/音频
组合、约束、默认值、忽略字段规则和客户价格。分辨率与时长通常影响成本,
不得静默改写。
MiniMax H3
设置 model: "minimax-h3" 可使用 MiniMax H3 插帧。首尾帧和提示词均必填;
输出固定为 2K,时长为 4–15 秒,首帧决定输出宽高比。H3 支持 watermark,
但不接受驱动音频或其他可选控制项。两张输入图片免费,生成视频按每秒
590 credits 计费。
任务状态与恢复
queued 和 running 阶段持续轮询同一任务。创建响应丢失时,只能用完全
相同的参数与同一 client_request_id 重试。交换任一帧,或改变音频、提示
词、输出设置,都需要新 ID。
通过 REST 调用
直接协议集成可使用 POST /v1/videos/frames-to-video,并遵循
API 操作定义。
推荐通过 Skill + MCP 接入;REST 适合自定义应用直连。