HKGAIが推すユエ2|オープンソース音楽モデルWildSongBenchがSunoを圧す

·著者 TechRitual Editorial·エンタープライズAI
HKGAI 推 YuE2|開源音樂模型 WildSongBench 壓過 Suno
✏️ オリジナルコンテンツ| TechRitual Biz 編集部

香港生成式人工智能研發中心(HKGAI)は2026年9月18日にオープンソースの音楽大規模モデルYuE2を発表しました。チームはこれを「符号計画」を統一して創作、カバー、編集を行う世界初のオープンソース音楽大規模モデルであると説明しました。同日、Hugging Faceの全サイトトレンドで4位(トレンドスコア595)となり、トップ5の中で唯一の音楽関連モデルとなりました。サービス開始から9日間で、公式の主モデルは11,626回のダウンロードを記録し、ComfyUIのパッケージング、コミュニティのGGUF/量子化バージョンおよびツールチェーンを含む生態系全体で約17.9万回のダウンロードを達成しました。

HKGAIは2023年10月に設立され、人工知能およびロボット技術に特化したAIR@InnoHKプラットフォームが資金を提供し、香港大学が主導

システムSongBench 平均 ↑AudioBox PQ ↑MuLan ↑PER ↓
YuE2(ベストオブ8)6.96328.27140.50519.79%
Mureka 96.93778.02260.439411.69%
Suno v56.87218.16980.54288.10%
YuE26.73168

YuE2 は「符号計画(symbolic planning)」と「音響レンダリング(acoustic rendering)」を分離し、混合専門家(MoE)の設計により制御性を向上させています:AR専門家は因果注意を用いて自回帰的にABC楽譜と語義骨格を予測します。NAR専門家は流マッチング(flow matching)により音響latentを予測し、その後VAEを経て48kHzステレオ音声にデコードします。提示語を出せば音声が生成されるブラックボックスサンプリングとは異なり、クリエイターは各ステップで介入することが可能です——例えば、単一の音符を微調整するだけで、一曲を再作成する必要はなく、あるいはスタイルを変更しながらも元のメロディを保持することが可能です。

他の言語で読む:繁中EN简中한국어ไทยESDEPTالعربية
T
著者について
TechRitual Editorial

TechRitual 企業科技編輯部(香港)。biz.techritual.com 的外語版本由繁體中文原文翻譯。

PR
レシートを撮るだけで Excel に自動入力 — ThatReceipt