翻訳(Translate)

音声合成

ゴーストがバルーンで喋る内容を、そのまま声に出して読み上げる機能です。
Windowsに入っている音声のほか、VOICEVOXなどの外部の音声合成ソフトや、クラウドの音声合成サービスの声も使えます。
キャラクターごと(\0、\1、\2以降)に別の声を割り当てられます。

こちらはゴーストの声を出す機能です。こちらから声でゴーストに話しかける機能は「音声認識」のページをご覧ください。

使い始める

  1. 右クリックメニューの「機能」→「音声合成」を選びます。項目にチェックが付き、読み上げが始まります。
    もう一度選ぶとオフになります。オン/オフの状態は、次回起動時にも引き継がれます。
  2. 本体設定の「音声認識/合成」で、キャラクターごとの声を選びます。何も選ばない「(System Default)」の場合は、Windowsの既定の音声が使われます。
  3. 必要に応じて、喋る速度・音量・声の高さ(ピッチ)を調整します。設定の変更は、次の読み上げから反映されます(SSPの再起動は要りません)。

オンにした時にちょうど喋っている最中だった発言は読み上げられません。次の発言から読み上げが始まります。

何が読み上げられるか

バルーンに表示される通常の文章が、表示されるのに合わせて読み上げられます。
次のものは読み上げられません。

どのキャラクターの発言かによって、使われる声が変わります。メインキャラクター(\0)・サブキャラクター(\1)・それ以外のキャラクター(\2〜)で、それぞれ設定した声が使われます。
ピッチの初期値は、メインキャラクター(\0)が0、サブキャラクター(\1)が+5(少し高め)、\2以降が-5(少し低め)です。キャラクターごとに声の高さが少し変わるようになっています。変更はいつでも本体設定の「音声認識/合成」からできます。

声と文字を合わせる(同期)

本体設定の「音声合成の進行速度に合わせてスクリプトの再生待ちを行う」について説明します。

オフ(初期設定)
バルーンの文字は、いつもの速さで進みます。声はそれを追いかけるように読み上げられます。
声の合成に時間がかかる環境では、文字が先に進み、声が遅れます。遅れている間に次の発言が始まると、前の発言の読み残しは飛ばされることがあります。
オン
声の読み上げが追いつくまで、ゴーストのスクリプトの再生を待たせます。バルーンの文字と声のずれが小さくなり、読み飛ばしも起きにくくなります。
その代わり、声の合成に時間がかかると、ゴーストの動きもそれだけゆっくりになります。

外部の音声合成ソフトを使う

「音声の選択」の一覧には、Windowsに入っている音声に加えて「LocalAPI-0〜9」と「CloudAPI-0〜9」という項目が並んでいます。
これは外部の音声合成を使うための枠です。1つの枠にサーバ・声・スタイルなどを1組ずつ設定します。キャラクターごとに別々の枠を割り当てることもできますし、同じ枠を共有してもかまいません。

LocalAPI
自分のパソコン(またはネットワーク内のパソコン)で動いているソフトに接続します。VOICEVOX、VOICEVOX Nemo、SHAREVOX、AivisSpeech、COEIROINK v2、Style-BERT-VITS2、OpenAI互換のローカルサーバに対応しています。
CloudAPI
インターネット上のサービスに接続します。Aivis Cloud APIとOpenAI TTS(または互換サービス)に対応しています。APIキーの取得が必要で、利用料金はサービス側の規定に従います。

設定の手順は次のとおりです。

  1. LocalAPIの場合は、先に音声合成ソフトを起動しておきます。
  2. 本体設定の「音声認識/合成」を開き、キャラクターの「音声の選択」で「LocalAPI-0」などを選びます。
  3. その右の「設定...」を押し、「種類」で使うソフトを選びます。
  4. 「参照...」を押すと、ソフトに登録されている声の一覧が出ますので、使いたい声を選びます(IDを知っている場合は、直接入力しても構いません)。
  5. 「OK」で閉じて、「機能」→「音声合成」をオンにします。

各項目の入力のしかたは、ソフトごとに異なります。くわしくは「音声合成の詳細設定ダイアログ」をご覧ください。

声が出ない時は