从参考素材生成视频
在新视频中保持主体、商品、场景、视频身份或声音。
Agent 主路径
当图片或视频需要约束身份、外观、风格、商品、背景、姿态或声音时,使用
beatra.videos.generate_from_references。如果目标是修改已有片段,应使用
编辑工具。
- 上传所有本地图片、视频与声音参考。
- 每个参考项用
kind: "image"或kind: "video"标明类型,保持顺序, 并按模型返回的参考指代语法编写提示词。 - 用
capability: "reference_to_video"调用beatra.models.list,读取 当前数量、组合、时长规则与价格。 - 使用一个
client_request_id提交一次,再用beatra.tasks.get轮询。
AI 指南
给 AI 的集成说明
接入自有应用时,可以把这份 API 指南复制给 Claude、Codex 或其他编程助手。
工具参数
reference_voice 是绑定到某个参考项的音频媒体,不是布尔值;
auto/Wan 的图片和视频分别按顺序使用“图n/视频n”(英文为
Image n/Video n);HappyHorse 图片按数组顺序使用 [Image n]。
HappyHorse/Wan 不接受语义 role;仅当其他显式模型的发现结果列出角色时使用。
模型、控制与成本
通用控制项包括 prompt、negative_prompt、resolution、
duration、aspect_ratio、seed、enhance_prompt 和 watermark;
每一项都应按所选模型的元数据使用。
参考数量、支持的类型、提示词指代语法、声音能力、条件时长限制、宽高比与价格
均以 beatra.models.list 为准。若价格元数据表明输入视频时长参与计费,
成本估算也必须包含它。
MiniMax H3
设置 model: "minimax-h3" 可生成 4–15 秒的 2K 多模态参考视频。H3 必须
提供提示词,最多接受 5 张图片、3 个视频和 3 个音频;参考视频和参考音频
各自累计不得超过 15 秒。音频不能单独作为参考,必须同时包含图片或视频。
不要传 role 或 reference_voice。输入图片与音频免费;接受的输入视频
时长和生成视频时长分别按每秒 590 credits 计费。
任务状态与恢复
相同重试必须保持参考顺序。queued 或 running 时轮询同一任务。
参考、声音、提示词或输出控制有任何改变,都属于新请求,需用
新的 client_request_id。
通过 REST 调用
直接协议集成可使用 POST /v1/videos/reference-to-video,并遵循
API 操作定义。
推荐通过 Skill + MCP 接入;REST 适合自定义应用直连。