タイムラインありのプロンプトからLLMを使いセグメントごとにプロンプトを生成→キーフレーム生成→動画生成(i2v)→連結して1本化する。その後、音声/効果音/半端に入っているBGMを分離して、BGMを破棄。新たに尺分のBGMを追加。この一連のパイプラインでモデルを4つロードしている