UTAU音源用の声を録音したあとに必要になるのが、原音設定です。
私は自分の声からTRPG探索者用の音源を作るとき、「録音までは分かるけど、原音設定って何をすればいいの?」というところでかなり戸惑いました。
実際にやってみると、全部の音を一つずつゼロから設定する必要はなく、WindowsではsetParamを使ってある程度まとめて自動設定し、ずれたところだけ直すことができます。
この記事では、私が実際に作った、とーごア式「はじめてのれんたん風単独音」・6モーラ・BPM120・C4で録音・setParamを使用、という音源を例に、録音済みのwavからoto.iniを作り、OpenUTAUで歌わせられるところまでを順番に説明します。
なお、この記事に出てくる550ms・600msなどの数値は、今回の録音でうまくいった値です。すべての音源で同じ数値が正解になるわけではないので、使った録音リストやガイドBGMに合わせて調整してください。

- そもそも原音設定とは?
- 今回はsetParamを使う
- 1. 録音した生データをバックアップする
- 2. 原音設定するwavを作業フォルダへ入れる
- 3. oto.iniのテンプレートを用意する
- 4. setParamをダウンロードして展開する
- 5. setParamで作業フォルダを開く
- 6. 「原音パラメータファイルを読み込みますか?」では読み込む
- 7. まずパラメータを自動設定する
- 8. 自動推定の画面を開く
- 9. 録音したBPMを入力する
- 10. 発声開始位置を入力する
- 11. テンポから各値を初期化する
- 12. 「_」を1モーラ分の休符として扱う
- 13. 自動補正をONにする
- 14. 先行発声の移動可能範囲を調整する
- 15. 「パラメータ生成」を押す
- 16. 全部見る前に、まず何音か抜き打ち確認する
- 17. 確認したい音をクリックする
- 18. 左ブランクを見る
- 19. オーバーラップを見る
- 20. 先行発声を見る
- 21. 固定範囲を見る
- 22. 右ブランクを見る
- 23. 特殊音は個別に確認する
- 24. 左ブランクを大きく動かしたら他の線も確認する
- 25. 同じ修正をする音は一括変更できる
- 26. エイリアスも確認する
- 27. 今回、エイリアスが「- か」になっていた
- 28. OpenUTAUでほとんど鳴らなかった
- 29. エイリアスを一括修正する
- 30. 変更後のエイリアスを確認する
- 31. oto.iniを保存する
- 32. OpenUTAUに入れて実際に鳴らしてみる
- 33. 鳴らない音があったら、まずエイリアスを見る
- 34. 声は出るけれど「ぷつぷつ」するとき
- 35. resamplerを変えると聞こえ方が変わることもある
- 36. 今回の作業を最短でまとめると
- 自動設定してから直すと、思ったより現実的だった
そもそも原音設定とは?
UTAU用に声を録音しただけでは、「wavのどの部分を使えばいいのか」「この音は何という文字なのか」「どのタイミングで発音させればいいのか」を歌声合成ソフト側が判断できません。
そこで、録音した音声のどこを、何という音として、どんなタイミングで使うのかを設定する作業が原音設定です。
設定した内容は、主にoto.iniというファイルに保存されます。
今回はsetParamを使う
今回は、Windows用の原音設定ソフトsetParamを使います。
setParamでは、録音したフォルダを読み込む、パラメータを自動生成する、波形を見てずれを確認する、必要な音だけ手動で修正する、oto.iniを保存する、という流れで作業できます。
一音ずつ全部手作業で始めるより、かなり楽でした。
※iPhone・iPadではsetParamは使えません。スマホのみの場合はLABERUなど別の原音設定ツールを使う方法があります。
1. 録音した生データをバックアップする
まず、録音直後のwavをそのまま編集しないようにします。
01_RAW_録音
02_原音設定作業
録音フォルダを丸ごとコピーして、原音設定は02_原音設定作業側で行いました。こうしておけば、設定を失敗したりファイルがおかしくなったりしても、録音直後の状態へ戻れます。
2. 原音設定するwavを作業フォルダへ入れる
作業用フォルダには、録音したwavを一式入れておきます。
02_原音設定作業/
├─ 録音したwav
├─ 録音したwav
├─ 録音したwav
└─ …
このフォルダをsetParamで読み込みます。
3. oto.iniのテンプレートを用意する
今回使った録音リストには、原音設定用のiniファイルも付属していました。
私の場合は単独音リスト.iniを原音設定作業フォルダへコピーし、ファイル名をoto.iniに変更しました。
02_原音設定作業/
├─ wav一式
└─ oto.ini
4. setParamをダウンロードして展開する
setParamを配布元からダウンロードします。私が使用したのはsetParam 4.0-b240804です。
ZIPのままではなく、Windowsの「すべて展開」などを使って解凍し、中にあるsetParam.exeを起動します。
5. setParamで作業フォルダを開く
setParamを起動したら、先ほど作った02_原音設定作業を指定します。
つまり、wavとoto.iniが一緒に入っているフォルダを選びます。
6. 「原音パラメータファイルを読み込みますか?」では読み込む
フォルダを指定すると、原音パラメータファイルを読み込むか聞かれました。
今回はすでにoto.iniを用意しているので、「読み込む」を選びます。続いて、作業フォルダ内のoto.iniを開きます。
7. まずパラメータを自動設定する
ここからが原音設定の本体です。
今回のように一定のテンポに合わせて連続して録音した音源なら、setParamで発声位置などをまとめて推定できます。
最初から149音すべてを手作業で設定するのではなく、まず自動設定 → 変なところだけ直すという方法にしました。
8. 自動推定の画面を開く
setParam上部のメニューから「ツール」を開き、原音パラメータの自動推定にあたる項目を開きます。
バージョンによって、「連続発声用oto.ini生成」「連続音の自動推定」など、多少表記が異なる場合があります。
9. 録音したBPMを入力する
今回録音に使ったガイドBGMはBPM120でした。そのため、収録テンポに120を入力します。
ここは適当に決める数値ではなく、実際に録音で使ったガイドBGMのBPMを入力します。
10. 発声開始位置を入力する
今回の録音では、発声開始位置を550msにしました。
これは今回の録音波形を見ながら調整して決めた値です。最初から550msと決め打ちするのではなく、自分の録音で発声が始まる位置に合わせます。
11. テンポから各値を初期化する
BPMを入力したら、「収録テンポから各値を初期化」を押しました。
今回のBPM120では、おおよそ次の値が入りました。
- オーバーラップ:約83ms
- 先行発声:約250ms
- 固定範囲:約375ms
- 右ブランク:約-583ms
ここも、あとから必要に応じて調整します。
12. 「_」を1モーラ分の休符として扱う
今回使用した録音リストでは、音名に_が含まれています。
自動設定時には、「_を一モーラ分の休符とみなす」を選択しました。
13. 自動補正をONにする
自動補正もONにしました。
録音時に多少発声タイミングがずれていても、実際の波形をもとに位置を補正してもらいます。
14. 先行発声の移動可能範囲を調整する
ここが今回少し詰まったところです。
最初は移動可能範囲が狭く、「あ」は合っているのに「か」が1拍くらいずれるという状態になりました。
BPM120では1拍が500msです。そこで今回は先行発声の移動可能範囲を600msまで広げました。
すると、1拍程度ずれて録音されていた音も自動補正しやすくなりました。
これは今回の録音でうまくいった値なので、発声タイミングがきれいに揃っている音源なら、ここまで広くする必要はないと思います。
15. 「パラメータ生成」を押す
設定ができたら、「パラメータ生成」を押します。
これで各音に対して原音設定の値が入り、原音設定の仮設定が一括でできた状態です。まだ完成ではありません。
16. 全部見る前に、まず何音か抜き打ち確認する
生成された149音をいきなり一つずつ確認するのはかなり大変です。
私はまず、音の性質が違うものを何種類か確認しました。
- あ
- か
- さ
- た
- ふ
- ん
- ら
- きゃ
母音、破裂音、摩擦音、拗音など、違うタイプをいくつか見るイメージです。これらがだいたい合っていれば、自動推定自体は大きく外れていないと判断しました。
17. 確認したい音をクリックする
setParam下部に、原音パラメータの一覧があります。
確認したい音の行をクリックすると、上部にその音を含む波形が表示されます。波形の上には複数の縦線が表示されます。
18. 左ブランクを見る
左ブランクは、「この位置より前は使わない」という境界です。
発声前に無音、息、マイクノイズなどが入っている場合、その部分を除外します。ただし右へ動かしすぎると、本来必要な子音まで切れてしまいます。
19. オーバーラップを見る
オーバーラップは、前の音と今の音をどのくらい重ねるかに関係します。
- 少なすぎる → 音と音の間がぷつぷつしやすい
- 少し増やす → 滑らかになりやすい
- 増やしすぎる → 子音が前の音へ食い込みやすい
20. 先行発声を見る
先行発声は、子音を音符の開始よりどのくらい前から鳴らすかに関わります。
小さすぎると子音が遅れて聞こえ、大きすぎると前の音へ食い込みすぎることがあります。
21. 固定範囲を見る
固定範囲は、引き伸ばさず原音のまま再生する部分です。
長くしすぎると伸ばせる母音部分が少なくなり、短すぎると子音まで伸ばされて発音がぼやける場合があります。
22. 右ブランクを見る
右ブランクは、音声の後半をどこまで使うかに関係します。
今回の設定では負の数値になっていました。この場合、-300、-350、-450なら、絶対値が大きくなるほど使用する範囲が長くなります。
母音が途中で短く切れるときは、ここも確認しました。
23. 特殊音は個別に確認する
通常の「あ」「か」などがうまく設定されていても、息を吸う音、語尾息、特殊な発声などは自動推定から外れることがあります。
今回も息音は通常音とは波形の構造が違うため、個別に確認しました。
通常音がほぼ合っているなら、特殊音のためだけに全体を再生成する必要はありません。その音だけ直す方が楽です。
24. 左ブランクを大きく動かしたら他の線も確認する
発声前に余計な息が入っているなどの理由で左ブランクを大きく右へ動かした場合、左ブランクだけ直して終わりにせず、オーバーラップと先行発声の位置も確認します。
数十ms程度の小さな修正ならそのままでも問題ないことがありますが、大きく動かしたときほど再確認します。
25. 同じ修正をする音は一括変更できる
複数の音を同じように調整したい場合は、一音ずつ入力しなくても一括変更できます。
画面下の原音パラメータ一覧で変更したい行を複数選択し、その上で右クリックして「選択中の範囲の値を一括変更」を使います。
息音などの特殊音まで同じ設定にすると不自然になる可能性があるので、通常音だけを選択する方が安全です。
26. エイリアスも確認する
原音設定でもう一つ重要なのがエイリアスです。
エイリアスは、「この原音を何という名前で呼び出すか」という名前です。
たとえばかという歌詞に対して、oto.ini側にもかという原音が登録されていれば呼び出せます。
27. 今回、エイリアスが「- か」になっていた
私が自動生成したときは、- あ、- か、- き、- くのように、エイリアスの先頭に- が付いていました。
そのままOpenUTAUへ入れると、普通のかではなく- かという原音として認識されます。
28. OpenUTAUでほとんど鳴らなかった
この状態でOpenUTAUへ音源を入れたところ、10音に1音くらいしか鳴らないという状態になりました。
最初は原音設定そのものを失敗したのかと思いましたが、原因はエイリアスでした。OpenUTAU側がかを探しているのに、今回の音源には- かしかなかったためです。
29. エイリアスを一括修正する
今回はsetParamのエイリアス一括変更機能を使いました。
変更前に、念のため現在のoto.iniをコピーしてバックアップしておきます。
そのあと、エイリアス先頭から2文字削除しました。今回は半角ハイフン+半角スペースの2文字です。
- あ → あ
- か → か
- き → き
30. 変更後のエイリアスを確認する
一括変換したら、setParam下部のエイリアス列を見ます。
本当にあ、か、きなどになっているか確認します。
31. oto.iniを保存する
調整が終わったら、「ファイル」→「保存」で保存します。
画面上で一つの音だけを表示していても、保存されるのはその音だけではありません。自動生成した設定、個別に修正した設定、一括変更した設定、エイリアス変更など、現在のoto.ini全体が保存されます。
32. OpenUTAUに入れて実際に鳴らしてみる
ここまでできたら、OpenUTAU側で動作確認します。
音源名/
├─ wav一式
├─ oto.ini
├─ character.txt
└─ icon.png(任意)
OpenUTAUへインストールし、USTを読み込んで実際に歌わせます。
33. 鳴らない音があったら、まずエイリアスを見る
一部の音だけ鳴らない場合、「原音設定を全部やり直そう」と考える前に、エイリアスを確認します。
今回の場合、かには自作音源が出てこないのに、- かには自作音源名が表示されました。これで、原音自体は存在するものの名前が合っていないと分かりました。
34. 声は出るけれど「ぷつぷつ」するとき
| 聞こえ方 | まず確認したところ |
|---|---|
| 母音自体が短い・途中で切れる | 右ブランク |
| 音と音の境目がカクッとする | オーバーラップ |
| 子音が遅い・早い | 先行発声 |
| 子音が伸びて発音がぼやける | 固定範囲 |
| 発音前に余計な息やノイズが入る | 左ブランク |
一度に全部の値を変えると何が効いたのか分からなくなるので、一項目ずつ変更して聞き比べるのがおすすめです。
35. resamplerを変えると聞こえ方が変わることもある
今回の音源では、同じ原音設定でも使用するresamplerによって「ぷつぷつ」の目立ち方が違いました。
TIPSではかなり目立つのに、moresamplerやWorldlineではそこまで気にならないこともありました。
そのため、あるresamplerで不自然=録音そのものが失敗とは限りません。原音設定との相性も含めて確認するとよさそうです。
36. 今回の作業を最短でまとめると
録音データをバックアップ → 作業用フォルダへwavをコピー → テンプレートをoto.iniとして配置 → setParamでフォルダとoto.iniを読み込む → BPM120・発声開始位置などを設定 → パラメータを自動生成 → 代表的な音を抜き打ち確認 → 特殊音など外れたものだけ個別修正 → エイリアスを確認・必要なら修正 → oto.iniを保存 → OpenUTAUで実際に歌わせる → 鳴らない・ぷつぷつするところだけ再調整、という流れでした。
自動設定してから直すと、思ったより現実的だった
原音設定という言葉だけを見ると、「100音以上を波形を見ながら一つずつ設定するの?」とかなり身構えました。
ですが今回のように録音リストとガイドBGMに沿ってある程度一定のタイミングで録音していれば、setParamでまず全体を自動設定してから、外れたところだけ直す方法が使えます。
実際に大変だったのは、自動設定すること自体より、「生成された結果が合っているか」「鳴らない原因が原音位置なのかエイリアスなのか」を判断するところでした。
そのため、自動生成 → 代表音を確認 → OpenUTAUで歌わせる → 問題があるところだけ戻って修正という往復を前提にしておくと分かりやすいと思います。
原音設定が終われば、自分で録音した声が実際にUSTに合わせて歌うところまであと少しです。


今後は、録音部分についても「OREMOでUTAU音源を録音する方法」として、録音リスト・ガイドBGMの設定から録り直しまで詳しくまとめる予定です。
コメント