Premiere Proの文字起こしからのフルテロップ作成が現状最強な理由
調査と実験を繰り返し、ようやくフルテロップの編集フローを改善できました。
WhisperとかWhisperXとかMFAとか、さらには独自アプリ開発などもいろいろ試した結果、ぐるっと回ってPremiereとCodexのみのシンプル構成に戻ってきたんですけど、この結論に至った理由について書き留めておきます。
単語単位のタイムスタンプ
Premiere Proは文字起こしをした際に、さまざまな情報を持っていて、単語単位でタイムスタンプが刻まれているそうです。
そしてそれは.json.prtranscriptという拡張子のファイルで書き出すことができて、これをCodexで加工することでテロップをいい塩梅に整えることができます。
実はこれまで最も困っていたのが、テロップのクリップが文字数で区切られてしまって、意味ごとに整理し直す必要があったことでした。
これを整理するためにはこの.json.prtranscriptというファイルが肝で、これを作ることができるアプリやサービスが大bh少ないです。
Premiere Pro以外だとElevenLabs Scribeでできるそうです。Adobe CCに課金してない方はこちらの選択肢を試してみるのも良いかと思います。
話者分離ができる
Premiere Proでは文字起こしをする際に話者を判定することができます。
2mixの音声ファイルから文字起こしをしても、かなり正確に話者分離ができるのが強みです。
もちろん、ピンマイクで収録していればトラックごとに文字起こしすればいいだけなので問題ないんですが、iPhoneでざっくり撮影しちゃって音声が2mixになってるなんてことも少なくないので、そういう時にPremiere Proでの文字起こしは信頼できます。
文字起こし精度が低い点はCodexでフォロー可能
Premiere Proで文字起こしをした際、思ったよりも間違ってるなと思うはずです。
僕も使い初めの頃は、なんでこんな間違いをするのかとびっくりしたものです。
わかりやすい例を挙げると、超有名な固有名詞でも大文字小文字を区別することができません。YOUTUBEとかiphoneとか。
このようなミスは、ファイルを書き出してCodexで処理すればいいだけなので、全く問題ありません。
よく間違える事例があればそれを指摘して修正させて、修正前と修正後の言葉をセットでメモしておけば、次回以降は自動で修正できます。
単語帳みたいなものを作っておいておくイメージです。しかもそれをゼロから自分で作る必要はなく、間違えるたびにツッコミを入れていけば自然と強化されていきます。
最後に
現状だと一つのツールでフルテロップを理想的なクオリティに仕上げるのは全然無理で、いくつかあるツールやサービスを組み合わせて理想に近づける必要があります。
僕はこれまでPremiere Pro以外のツールやサービスを使ってみようと意識が外に向きすぎてました。Premiere Proを信じることでこんなにクオリティを上げられるとは思ってなかったので、やっぱり柔軟に考えることって大事ですね。
動画編集× AIの組み合わせで、また一つ人間の仕事が減りました。
当面はこれを武器に仕事していきたいと思います。
