エントリーの編集
エントリーの編集は全ユーザーに共通の機能です。
必ずガイドラインを一読の上ご利用ください。
GitHub - TK-design336/irodori-studio: Irodori-TTS 向け Speaker Embedding 学習 + OPT 生成フロントエンド(Tauri 2)
記事へのコメント0件
- 注目コメント
- 新着コメント
このエントリーにコメントしてみましょう。
注目コメント算出アルゴリズムの一部にLINEヤフー株式会社の「建設的コメント順位付けモデルAPI」を使用しています
- バナー広告なし
- ミュート機能あり
- ダークモード搭載
関連記事
GitHub - TK-design336/irodori-studio: Irodori-TTS 向け Speaker Embedding 学習 + OPT 生成フロントエンド(Tauri 2)
設定: 初回はルート指定、Outputs / Python / Checkpoint の自動推定、v3 / v4 切替、precision / devic... 設定: 初回はルート指定、Outputs / Python / Checkpoint の自動推定、v3 / v4 切替、precision / device、ライト/ダーク差し色 話者: 埋め込み・ブレンド・参照音源・キャプションの一覧、メタデータ(本名・性別・年齢帯・タグ)、リネーム/削除(ゴミ箱へ) 学習: 元音声・動画から(to_wav → slice)またはスライス済みフォルダから → 任意のボーカル分離 → スライスレビュー → dataset → prepare_manifest → train スライスレビュー: slice 後の外れ値チェック(長さ・速度・無音・音量・話者一貫・スペクトルなど)。人手確認 / 自動除外 / スキップ ブレンド: 2〜3 embedding を三角プロットで線形ミックス 生成: Aivis 風 3 カラム UI、行単位の Sampling、複数

