model: ai-talking-avatar を使ってリップシンク付きトーキング動画に変換します。GoEnhance API の非同期タスクを送信し、返された img_uuid を保存してから、完了までポーリングするかコールバックを使用します。model: ai-talking-avatar を使ってリップシンク付きトーキング動画に変換します。GoEnhance API の非同期タスクを送信し、返された img_uuid を保存してから、完了までポーリングするかコールバックを使用します。
公開されている image_url を 10MB 以下で指定します。話者の顔がはっきり見え、遮蔽されておらず、ほぼ正面を向いていることが、信頼できるソース画像に必要です。

公開されている audio_url を 3 秒から 60 秒、最大 50MB で指定します。計測された再生時間が、出力の長さと課金時間の両方を決定します。

model: ai-talking-avatar を設定し、image_url と audio_url を追加して、任意のプロンプトと解像度を選択します。https://api.goenhance.ai/api/v1/videos/generations に JSON ボディを POST してください。duration フィールドは送信しないでください。img_uuid を保存し、GET /api/v1/jobs/detail をポーリングするか、コールバックイベントを受信します。