【ラフ画から原画生成】電車車内の描写
生成AIを使って、個人ベースのアニメ作りで遊んでいます。
今回は、この手書き線画のラフ画像から原画を生成します。電車内の描画です。

これを試していた時に、Gemini が画像入力対応になったので早速試してみました。

構図はばっちりですが、下手くそな絵もそのままに色づけされただけでした。ただし、Googleは真価が激しいので、最新の状況では変わっている可能性が高いです。
続いて、前回同様 Dreamina AI で Image+Text to Image で生成してみました。

ずっとマシになりましたが、やはり前回同様中途半端な感じです。
同じく Dreamina AI で、Text to Image で生成すると、

これは、良いです。
そして Image+Text to Image の ChatGPT-4o では、

アニメ風の指定をしなかったのでイラスト調になりましたが、やはり一番元のラフ画に近いイメージになりました。
そして、動画生成も加わった、その豊富な画像参照機能が特徴のGoogle Whiskで生成してみると、

構図は変わってしまいましたが、結果としてはかなり自然なものができました。もしかしたら、直近ではこれが正解なのかもしれません。
どこまで原画生成するか、動画化するかは、生成品質と評価(フォロー、スキ、コメント)で決めようと思っています。
