Vocal Prep 0.1.8 guide

前処理を速くするだけではなく、
後工程まで速くする。

Vocal Prep 0.1.8の詳細説明と操作マニュアルです。Studio One 7 ProfessionalではARA Event FXとして実機確認しています。

Overview

Vocal Prepとは

Vocal Prepは、ボーカル素材に含まれる無音、ブレス、歌唱区間、タイミング、入力レベル差を解析し、後工程へ渡せる状態へ整理するツールです。

目的は、歌唱表現を自動で決めることではありません。大量に繰り返される機械的な処理をまとめ、人間が確認すべき例外と表現判断だけを残すことです。

ARA → Analyze → Proposal → Preview → 必要なら修正 → Confirm → Bounce解析結果を即時確定せず、確認可能な提案として扱います。
Functions

素材に対して行うこと

無音整理

素材中の無音区間を解析し、SILENCEとして扱います。無音を削除して時間軸を詰めるのではなく、元の位置を保持したままミュートします。

ブレス/歌唱区間の解析

SILENCE、BREATH、SINGING、UNKNOWNの区間を解析します。自動判定は確定事項ではなく、ProposalとしてPreviewとManual Correctionで確認できます。

タイミング整理

Singingのアタックを基準に設定範囲内でタイミングを整理します。関連するBreathはSingingに追従し、再帰的に後続リージョンを押し出す設計ではありません。

レベル整理

コンプレッサーのように波形を圧縮するのではなく、素材・リージョン側の入力レベル差を先に整えます。

Section基準の相対レベル

Section未指定時は曲全体をSection Aとして扱います。0.1.8ではSection B/Cを手動編集する最終UIは未提供で、現行UIで利用できる範囲を超えて操作する必要はありません。

非破壊の確認

元素材を直接書き換えずに解析・Previewを行います。確認後にConfirmし、Studio One側のBounceで音声素材として確定できます。

Downstream impact

なぜ後段処理まで減るのか

素材ごとの入力レベル差が残ったままCompへ入ると、リージョンによってThresholdへの当たり方やGain Reductionが変化します。そこでCompを調整すると、EQやSaturationの反応まで変わり、再調整が連鎖します。

Vocal Prepは、圧縮の前に素材・リージョン側の入力レベル差を整理します。その結果、後段Compへ入る条件が安定し、ThresholdやGain Reductionの調整量が減ります。EQやSaturationも、入力条件が揃った状態から始められます。

前処理時間削減後段処理の再調整削減意思決定回数削減
Basic operation

Studio One 7での基本操作

  1. Audio EventへVocal PrepをARA Event FXとして追加

    処理対象のボーカルAudio Eventを選択し、Vocal PrepをEvent FXとして読み込みます。プラグイン右下に「ARA」と表示されることを確認してください。「Capture」と表示される場合は通常Insertとして読み込まれています。

  2. Analyze / Proposalを生成

    ARA取得後に解析が走り、無音、ブレス/歌唱区間、タイミング、レベルの候補がProposalとして生成されます。再解析したい場合はAnalyzeを押します。

  3. 解析結果を確認

    波形とRegion表示、右下のRegion / Phrase数を確認します。イベント間の空白は時間軸上の空白として残ります。

  4. Preview

    PreviewをONにし、元素材を直接変更せず提案結果を試聴します。タイミングずれ、クリック、瞬間的な音量低下、二重に聞こえる箇所がないか確認します。

  5. 必要箇所だけManual Correction

    Regionを選択し、分類、境界、Timing、Gainの必要箇所だけを修正します。Timing Enabled / Gain Enabledで個別の処理対象から外すこともできます。

  6. Confirm

    Previewで確認できたProposalをConfirmし、編集内容を確定状態へ移します。

  7. PreviewをOFFにしてBounce

    Confirm後はPreviewをOFFにし、Studio One側でBounceします。確定編集がBounce結果にも残ることを確認して次工程へ進みます。

ARA Event FX→Analyze→Proposal→Preview→必要箇所だけ修正→Confirm→Bounce→Melodyne / Mix
Timing

Timing Strengthの調整

Timing Strengthは素材ごとに最適値が変わります。0.1.8の実機確認素材では約30%付近で安定動作を確認しましたが、これは固定推奨値ではありません。

Strengthを強くした場合、素材によってRegion境界でクリックが発生することがあります。Grid、Max move、Preserve pickupを含め、必ずPreviewで確認しながら素材ごとに調整してください。
Fallback capture

通常Insertで使う場合

通常VST3 Insertとして読み込むと右下は「Capture」表示になります。このモードでは再生音を取り込んでからAnalyze / Previewします。Studio One 7ではトラック全体を直接取得できるARA Event FX運用を推奨します。

Captureをやり直す場合はClearでCapture、Preview、Sessionをリセットしてから再取得してください。

Exceptions

自動処理が合わなかった場合

解析結果はProposalです。Previewで意図と異なる箇所があれば、その部分だけManual Correctionで変更してください。素材全体を最初から手作業でやり直す必要はありません。

元の音声素材を直接破壊する設計ではありません。Confirm前にPreviewで確認し、必要な修正を行う運用を前提としています。
Scope

Vocal Prepが担当しない処理

ピッチ補正フォルマント整形音色を決めるEQ質感を作るSaturation空間演出最終的な表現判断

これらは前処理の後で、人間が素材と作品に合わせて決める領域です。Vocal Prepは、その判断を安定した素材から始められる状態を作ります。

With Formant Preamp

2本の役割分担

Vocal Prep

素材そのものを整理する。

Formant Preamp

整理された素材を、後段処理しやすい作業規格へ収束させる。

録音素材→Vocal Prep→Confirm / Bounce→Formant Preamp→Melodyne→必要ならComp / EQ→Saturation→空間系
ShushuLab philosophy

芸術ではない手作業を剥がして、
人間には表現判断だけを残す。

Vocal Prepは、自動化によって判断権を奪う道具ではありません。大量処理は機械に任せ、人間は例外と表現判断だけを見る。そのための前処理環境です。