フィッシュオーディオ S2 ベータ
魚音声S2 プレリリース オープンソースと閉鎖ソースの両方の中で最高のテキスト・トゥ・スピーチシステム。50以上の言語で10M時間以上のオーディオで訓練されたS2は、Dual-ARアーキテクチャ (Qwen3骨組み) とGRPO強化学習アライナインを組み合わせ、精細なインライン制御で自然で感情的に豊かなスピーチを生成します。技術報告 · ブログ · モデル · 遊び場モデル バリアント パラムス コデック出力。..
魚音声S2 プレリリース オープンソースと閉鎖ソースの両方の中で最高のテキスト・トゥ・スピーチシステム。50以上の言語で10M時間以上のオーディオで訓練されたS2は、Dual-ARアーキテクチャ (Qwen3骨組み) とGRPO強化学習アライナインを組み合わせ、精細なインライン制御で自然で感情的に豊かなスピーチを生成します。技術報告 · ブログ · モデル · 遊び場モデル バリアント パラムス コデック出力。..
次のモデルリリース前の最後の安定した支線です
フィッシュスピーチ 1.5 リリース、推論とフィントゥーンの両方が完了しました。
1.5 前の最後の安定解体
変更点 変更点 WebUI にオーディオを追加する 選択する @PoTaTo-Mika in #556 修正 キャッシュ max_seq_len by @AnyaCoder in #568 docs: zh-cn README & ja README で Docker アイコンが欠落しています 表現は英語 & properer 简体中文 by @Octopus058 in #569 docs: README でサポートされている言語の誤った表現を修正しました @Octopus058 in #574 j Apison フォーマット by @AnyaCoder in #588 更新 v1.4 readmes...
このリリースにはバグ修正とコンテナ最適化が含まれています。
複数の言語で 700k時間のオーディオデータで訓練された TTSモデルです。サポート言語: 英語 (en) ~300k時間 中国語 (zh) ~300k時間 ドイツ語 (de) ~20k時間 日本語 (ja) ~20k時間 フランス語 (fr) ~20k時間 スペイン語 (es) ~20k時間 韓国語 (ko) ~20k時間 アラビア語 (ar) ~20k時間 楽しんでください:)
これは9月10日に 1.4 版がリリースされる前の最終的な安定リリースです。
このリリースでは 1.2 プレトレインと SFT モデルの両方を展開し、安定した生成のための自動再ランキングもサポートします。
これは 1.2 の前の最終的な安定リリースです