開始・終了フレームを補間
制御された二つの端点の間に連続した動きを生成します。
Agent の基本フロー
開始画像と終了画像の両方が遷移を決める場合だけ
beatra.videos.interpolate を使い、順序を維持します。
- 両方のローカルフレームと任意の駆動音声をアップロードします。
capability: "frames_to_video"でbeatra.models.listを呼び、現在の メディア組み合わせ、長さ、解像度、音声対応、価格を確認します。- 無関係な二つの場面ではなく、端点間の動きを記述します。
- 一つの
client_request_idで一度だけ送信し、beatra.tasks.getで確認します。
AI ガイド
AI 連携 Markdown
独自アプリケーションに組み込む場合は、この API ガイドを Claude や Codex などにコピーできます。
ツール引数
不要または非対応なら driving_audio を省略します。入力画像から導出される
アスペクト比の規則はモデル探索結果を正とします。
モデル、制御、コスト
共通コントロールは prompt、negative_prompt、resolution、
duration、aspect_ratio、seed、enhance_prompt、watermark です。
各項目は選択モデルのメタデータに従って使います。
静的なモデル表は使いません。beatra.models.list は選択可能なモデル、
フレーム/音声の組み合わせ、制約、既定値、無視されるフィールド、顧客価格を
返します。解像度と長さを黙って変更してはいけません。
MiniMax H3
MiniMax H3 で補間するには model: "minimax-h3" を指定します。先頭・末尾
フレームとプロンプトが必須です。出力は 2K、長さは 4〜15 秒で、先頭
フレームが出力比率を決めます。H3 は watermark に対応しますが、駆動音声
やその他の任意制御には対応しません。入力画像は無料で、生成動画は
1 秒あたり 590 credits です。
タスクの状態とリカバリー
queued と running の間は同じタスクを確認します。作成応答を失った場合は
同じ引数と client_request_id だけで再試行できます。どちらかのフレーム、
音声、プロンプト、出力設定を変える場合は新しい ID が必要です。
REST で呼び出す
直接プロトコル統合では POST /v1/videos/frames-to-video を利用できます。
API 操作
に従ってください。推奨の統合方法は Skill + MCP です。REST はカスタムアプリケーション向けです。