海外板っぽいスレを拾ってきたわ。「同じ顔のまま、ポーズとカメラだけ変えたい」問題。 動画生成の前処理としても使えるらしい。会話調に焼き直したから、ざっくり読みなさい。
キャラの一貫性(consistency)を上げて、動画生成に回すためのワークフロー試したから共有するわ。
手順はだいたい3段。
① Z-ImageTurbo か Krea 2 で「元画像」を作る
② Qwen image edit で服・背景だけ変えた2枚目を作る(顔は維持)
③ Flux2 Klein ベースの i2i(ComfyUI)で、各初期画像から16バリエーションずつ。ポーズとカメラ位置だけいじる
こうしておくと、LTX みたいな動画生成で「同じ子が動いてる」感が出やすい。
自分は ComfyUI 詳しくないから LLM に手伝わせて組んだ。アマチュアWFは Pastebin に置いとく。
>>1
おお、三段構えか。最初に「固定キャラの種」を少数作ってから、編集モデルで派生、最後に i2i でポーズ増殖……筋は通ってるな。
Krea 2 edit 使うと一貫性かなり高いぞ。ただしスタイル維持が崩れるケースもあって、毎回神ではない。
F2K9B(Flux2 Klein 9B系)はリアル寄りで好きなんだけど、テキスト崩しと身体の形(多肢・欠損)がたまに怖い。
turbo系使うならステップ12くらいまで上げて、Euler / Simple 試せ。body horror 減る。
Qwen image edit はポーズいじり強い。ただ質感がちょっとプラスチックっぽい時あるよな。速度も好み分かれる。
俺は LoRA 学習用データセット作りたくて、ポーズだけ変えてキャラ固定できる編集モデル探してるんだけど、おすすめある?
>>6
実務なら適材適所だろ。
・Krea 2 edit LoRA ……一貫性重視
・F2K9B ……リアル寄り・速度。ステップと sampler 調整必須
・Qwen でポーズ編集 → F2K9B でリアリティ足し ……併用もあり
ところで Krea 側、edit version 開発中って言ってたよな。タイムラインは約束できない、みたいな書き方だった気がする。
>>8
「Krea2 が成功したら edit 出す」って読んだ人いたけど、原文はそこまで断言してないぞ。成功条件付きじゃない。
Z-Image edit 待ち勢もいる。Turbo はあるのに edit いつ来るんだ問題。期待と不信が同居してるスレだわこれ。
要するに
種画像少数 → 軽い編集で派生 → i2i でポーズ量産
この設計が「顔キープ × ポーズ多様 × 動画用フレーム確保」を両立させる、って話だな。
>>4 のステップ12+Euler/Simple、検証パラメータとしてメモった。ありがとう。
