
#AIとやってみた 研修医向け頭部CT講義をAIで動画化!
こんにちは!とある週、あまりの忙しさに翌週に控えた初期研修医向けのレクチャーの存在をすっかり忘れていました。しかも、そのレクチャーが会議のためオンデマンド配信になったことも頭から抜けていて、まさに冷や汗ものでした。
そんな絶体絶命のピンチを救ってくれたのが、Google AI Studioの新しいGeminiです。今回は、Geminiを活用して、研修医向けの頭部CT講義を音声付き動画にするまでのプロセスをご紹介します。AIがどのようにコンテンツ作成を効率化できるのか、ぜひご覧ください。
1. 講義資料(PPT)をPDFに変換
まず、講義資料であるPowerPointファイルをPDF形式に変換します。Macの場合は「プリント」メニューからPDFに出力できます。

2. PDFをGeminiにアップロードし、セリフを生成
変換したPDFファイルをGeminiにアップロードします。そして、以下のプロンプトを入力して実行します。
「各スライドのセリフを作成してください」
Geminiが各スライドの内容を読み取り、適切なセリフを生成してくれます。これにより、動画のスクリプト作成の手間が大幅に省けます。

3. Google AI Studioで音声を生成
次に、Google AI Studioに移動し、「Generate Media」タブを選択します。そこから「Gemini speech generation」を選びます。

Gemini speech generationでの設定
Mode: 「Single-speaker audio」を選択します。
セリフの貼り付け: Geminiで生成されたセリフを、意味のある範囲で貼り付けます。注意点として、現状ではすべてのセリフを一度に貼り付けると合成時に無音になったり、短い文章だと声のトーンが変わってしまうことがあります。 意味のまとまりごとに区切って貼り付けるのがおすすめです。
Voice: 右側の「Voice」オプションから、お好みの声を選択します。非常に多くの選択肢があるので、講義の雰囲気に合った声を選んでみましょう。

設定が完了したら、音声を合成し、ダウンロードします。この作業を繰り返して、必要なセリフすべての音声ファイルを用意します。


4. 動画編集ソフトで音声とスライドを組み合わせる
ダウンロードした複数の音声ファイルと、PowerPointから出力したスライド画像(PNGまたはJPEG形式)を用意します。今回はFinal Cut Proを使用しましたが、DaVinci ResolveやPremiere Proなど、お好みの動画編集ソフトで構いません。
編集のポイント
音声ファイルの配置: 合成した複数の音声ファイルを、講義の流れに合わせてタイムラインに配置します。
スライド画像の配置: 音声に合わせて、対応するスライド画像を配置していきます。必要に応じてスライドの表示時間を調整し、話の区切りと合うようにします。

5. 動画として出力
音声とスライドの配置が完了したら、最終的な動画として出力します。これで、研修医向けの頭部CT講義の音声付き動画が完成です!
まとめ
Geminiの力を借りることで、無事にオンデマンド配信用の講義動画を完成させることができました。スライドからのセリフ生成、そして自然な音声合成まで、AIがここまでサポートしてくれるとは驚きです。
コンテンツ制作におけるAIの可能性を改めて実感しました。スライドにはtake home messageを入れてあるからかもしれませんが、PDFの画像から私が説明したいようなセリフを考えてくれました。また、先週から音声の合成が日本語にも対応しており、とても自然な(私よりも聞きやすい)日本語で説明してくれます。もし私と同じような「うっかり」に見舞われたり、単純作業に時間を取られたくないと思っている方がいれば、ぜひGeminiを試してみてください。きっと、あなたの強い味方になってくれるはずです