AI動画で「口だけ合ってる不気味さ」から抜け出すまでに試したこと
深夜3時過ぎ、自室の片隅にあるごちゃごちゃしたデスクで、私は同じ5秒間の動画を延々とループ再生していました。 AIで生成した人物に音声をあて、喋らせるだけの短いクリップです。音声の波形と口の形はミリ秒単位で一致しているはずなのに、画面の中の人物はどう見ても「喋っている人間」ではなく、「口元だけが独立して痙攣している何か」に見えていました。冷めたコーヒーをすすりながら、自分の画面を見つめて頭を抱えていたときの記録です。 「口元さえ合えば完成する」という思い込み AI動画の制作を始めた当初、私は完全に思い違いをしていました。 「不自然さの原因は、音声と口の形のズレにある」 「だからリ...
出典: Zenn AI(配信元の紹介文より引用)
このニュースの全文は、配信元でお読みいただけます。 Zenn AIで元記事を読む →


