アニメの台詞が失敗するときには、決まったパターンがあります。画面は大きな瞳、キレのある動き、誇張されたポーズでしっかり個性を主張しているのに、声だけが全キャラクター同じニュートラルな読み上げになっている。視聴者はそれを数秒で感じ取ります。
アニメ向けのAIボイスは、吹き替えを「字幕読み」ではなく「キャスティング」として扱うことで機能します。キャラクターごとに、画面上の動きに見合った声の個性が必要です。やるべきことは、その個性を早い段階で割り当て、プリセットで固定し、口の動きや感情の見せ場に応じてタイミングを調整することです。
このガイドでは、キャラクターの配役、台本のタイミング調整、感情タグ、ナレーターの分離、シリーズ全体の一貫性、多言語吹き替えまでを扱います。インディーアニメーターや小規模スタジオが最終ミックスを書き出す前に踏む、実務的な工程です。
目次
まずアニメの作風に合わせてキャラクターボイスの方向性を決める
未就学児向けの科学アニメ、SFアクション作品、会話中心のシットコム的な一話では、必要な声の音域がまったく違います。ライブラリを開く前に、自分の作品の方向性を一文でまとめてみましょう。写実的なリアリティ重視か、誇張されたカートゥーン調か、アニメらしいコントラストの効いた組み合わせか、あるいはホストが進行するドキュメンタリー風モーショングラフィックスか。
その一文が、以降のすべてのフィルタリングを決めます。写実系は中音域のナレーターと控えめなキャラクター差が向いています。カートゥーン調は音高の差を大きく取り、セリフのテンポも速めにできます。アニメ調のシーンでは、冷静な「ツッコミ役」と、テンションの高い相方を組ませることが多く、その対比自体がギャグになります。
Voice Libraryには1,000種類以上の音声があり、これらの作風に対応するトーンタグで絞り込めます。作風を先に決めてから配役すれば、「声自体は悪くないのに、この作品には合わない」というやり直しの時間を大幅に減らせます。
シーン内の全キャラクターに聞き分けられる声を割り当てる
複数キャラクターが登場するアニメは、声の対比で成否が決まります。年齢感、テンポ、感情の音域が近い声を2つ並べると、画作りがどれだけ明確でも、視聴者は誰が話しているか分からなくなります。
配役の進め方
各キャラクターの役割を書き出します。リーダー、懐疑派、ムードメーカー、指導役、敵役など。属性の違いだけでなく、キャラクター同士の感情的な「落差」を意識して書きます。
マルチキャラクターモードで、話者ごとに1つの声を割り当てます。1ターンにつき1行にしておくと、後から台本を直したときも該当キャラクターだけに影響が留まります。
本編を吹き替える前に、15秒の掛け合いを試作します。目を閉じて聞いても誰が話しているか分かれば配役は成立です。分からなければ、テンポ・温かみ・音域のいずれかを変えて対比を広げてから台本に戻りましょう。
繰り返し登場する主要キャラクターは、承認した声をKai-Lead-Energetic-ENのように「キャラクター名+役割+トーン」の形式でプリセット保存します。この命名がそのまま作品のキャスト表になります。
口の動きとセリフのタイミングが合う吹き替え台本を書く
アニメの吹き替えは、書き方の問題に見えて、実は時間合わせの問題です。破裂音や大きく口を開ける母音は、特にキーフレームに音節を合わせる必要があります。
作画側がすでに首振りや瞬きを想定している箇所で、長いセリフを2つに分けましょう。クローズアップの会話シーンでは、短いオチが長い独白より効果的です。長いセリフを維持する必要がある場合は、キャラクターの口が閉じる位置にメモを入れ、編集者が音声をどこで分割すべきか分かるようにします。
絵コンテを見ながら台本を声に出して読んでみてください。自然に息を継ぐ場所が文の途中で、そのときキャラクターの口が閉じているなら、そのセリフは書き直すか分割します。台本を直す方が、リップシンクをやり直すよりずっと安く済みます。
ポーズマーカーで感情タグをアニメの見せ場に合わせる
リアクションカットはタイムライン上では無音でも、台本の上では無音ではありません。悪い知らせを聞いたキャラクターが、画面がホールドされた後に反応する ― このタメには、生成する音声の中にポーズマーカーが必要です。急いだセリフでその余白を潰してはいけません。
Noiz AIのポーズマーカーは、文と文、あるいは句と句の間に無音を挿入します。オチの直前、質問の後、そしてセリフなしで表情が変わるすべてのカットの前に置きましょう。
感情タグは段落全体ではなく、1行単位で使うのが最も効果的です。キーポーズに乗る1行 ― 息をのむ瞬間、淡々とした返し、囁くような告白 ― だけにタグを付け、周囲のセリフはニュートラルにしておきます。シーン中のすべての行にタグを付けると、キャラクターが互いに話しているのではなく、観客に向けて演じているように聞こえてしまいます。
キャラクターの芝居と競合しないナレーター音声を選ぶ
教育アニメ、アンソロジー作品、モーションコミック化など、進行役のナレーターがいる作品には、案内はしてもキャストの誰かに成りすまさない声が必要です。ナレーターは文脈を、キャラクターは対立を担います。
落ち着いたトーンで、テンポの安定したNarratorタグの声をフィルタリングしましょう。デモ用の文章ではなく、実際の冒頭パラグラフでプレビューします。ナレーターは作品世界の一部でありながら、シーン中のキャラクターと間違われてはいけません。
ナレーションから会話へ切り替わる瞬間、その音色の変化自体が「モードが変わった」というサインになります。ナレーター用とキャラクター用のプリセットは必ず別管理にして、地の文に主人公の声を間違って使わないようにしましょう。
キャラクターボイスのプリセットをシーズンを通して固定する
物語上の理由もなく、5話目で主人公が急に3歳老けたような声になっていたら、その時点で失敗です。AI吹き替えは再生成が簡単な分、一貫性を保つ責任は自分にあります。
対比テストに合格した瞬間に、各キャストの声をプリセットとして保存しましょう。名前には役割・トーン・言語を含めます。新しいエピソードの作業を始めるたびに、新しく音声を探すのではなく、そのプリセットを読み込みます。
後から1行だけ修正する場合は、その部分だけを、最初に使ったのと同じ声・同じテンポ設定で再生成します。同じキャラクターのテイク間でテンポが揃っていないことは、言葉選びの微妙な違いよりも早く「同じ人物」という説得力を壊してしまいます。
ピクチャーロック前に仮音声を最終AI吹き替えに差し替える
多くのアニメ制作フローでは、早い段階で仮のセリフを流します ― 作画のタイミングを取るための仮読みです。それは最終的な吹き替えではありません。仮音声はピクチャーロックまでをつなぐもので、キャストとして残るのはAIによる本番音声です。
シーンの長さとキーとなる口の形が固まった時点で本番セリフを生成します。新しいファイルを読み込み、既存の編集に合わせ、口が閉じたホールドに対してセリフが長すぎる箇所をチェックします。作画の変更を依頼する前に、まず台本を削るかポーズマーカーを追加しましょう。
この順番を守ることで、最初からプレースホルダーだったセリフのためにリップシンクをやり直す手間を避けられます。まず編集内で音声を差し替え、それでも合わない場合だけ作画に戻りましょう。
8言語に展開してもキャストの個性を保ったまま多言語化する
グローバル展開するアニメでは、同じキャストを複数言語で使うことがよくあります。台詞が現地化されても、視聴者は主人公・相棒・敵役をそれぞれ認識できる必要があります。
Noiz AIは8言語に対応しています。ライブラリに対象言語のマッチする声がある場合は、キャラクターごとに同じ保存済みの声から始めましょう。まず短いテストシーン ― 一度の掛け合いと一度のリアクション ― を生成し、元の編集とタイミングを比較してから、本編全話の吹き替えに進みます。
どの言語でも話者の割り当ては変えないことが重要です。懐疑的な友人役は、どの言語でも懐疑的な友人役のまま ― 変わるのは言葉だけです。翻訳後のセリフは長さが変わりやすいので、シリーズの途中で声を切り替えるのではなく、台本の長さや区切りのポーズで調整しましょう。
書き出し前に必ずリップシンクの最終チェックを行う
最後の工程は、画と音を突き合わせるチェックです。口の動きが早すぎる、または遅すぎると感じるフレームまでスクラブしてみましょう。半速再生は、通常の速度では気づけないズレを見つけるのに役立ちます。
修正の順番は、ポーズマーカーの調整が先、台本の短縮が次、再生成は最後です。ほとんどのズレはタイミングの問題であり、声そのものの間違いではありません。ズレている行だけを再書き出しすれば、ミックス全体を作り直す必要はありません。
公開前には、話者の一貫性、カートゥーン調の速いセリフで子音が欠けていないか、そして音楽が台詞を埋もれさせていないかを確認しましょう。最後にもう一度キャストのプリセットを読み込み、各キャラクターが第1話の基準と一致しているかを確かめます。
50,000人以上のクリエイターが、動画・アニメ・吹き替えコンテンツの制作にNoizを利用しています。