講師が教材をアップロードすれば、あとはブラウザだけ。ログインも、ソフトのインストールも要りません。
動画・音声ファイルを画面に放り込むだけ。
話者分離と文字起こしを同時に実行し、4トラックと台本を作成。
練習したいキャラだけ消音。ソロ再生で聞き比べも。
台本を見ながらPCマイクで収録。音ズレは自動補正。
元の音声と自分の声を重ねて試聴し、ローカルへ保存。
今回のMVPで実装するコア機能です。すべて、共通URLにアクセスした単一画面で完結します。
音声を自動で文字起こしし、台本テキストを生成。誰の台詞かも話者ごとに色分けして表示します。
合体した1本の音声から、発言タイムスタンプを取得して4トラックのタイムラインに可視化します。
トラックごとにワンクリックで消音・単独再生。役を決めて自分の声だけを入れ替えられます。
再生位置に合わせて台本の該当行が光り、進行状況バーも表示。台詞をクリックすればその位置へジャンプ。
Web Audio APIで収録し、出力・入力の遅延を測定して自動補正。微調整スライダーも用意しています。
他キャラの音声と自分の録音を重ねて試聴。仕上がりはWAVでローカルに保存できます。

これまでは、教材動画を流して、その上から声を出すだけでした。役の声が邪魔で自分の台詞が聞き取りにくかったり、録音して聞き返す手間があったり。
アフレコでいちばん困るのは、録音した声が映像・音声より遅れてしまうこと。原因は、スピーカーから音が出るまでの遅れと、マイクから取り込むまでの遅れの合計です。

どれもオリジナルの台本です。音声合成で作った「1本に合体した音声」から、話者分離と台本化が済んだ状態でスタジオが開きます。
予算内で確実に価値を出すため、今回は「その場で完結する1画面」に絞り、将来のアカウント機能を足しやすい設計にしておきます。
アップロード/自動台本化/4話者の分離と可視化/ミュート・ソロ/台本同期/低遅延録音/プレビュー・書き出し。
ログイン、ユーザー管理、サーバーへの永続保存は実装しません。共通URLでアクセスし、その場で完結します。
個別データの保存、講師による講評、サブスク決済へ。今回の設計で差し込み口だけ用意します。