
中国のAI開発企業MiniMaxが、音楽生成AI「MiniMax-Music3」を日本時間の2026年8月14日に公開しました。テキストでの指示に沿って、ボーカル付きの楽曲を生成でき、日本語ボーカルにも対応しています。モデルは無償で公開されており、ローカルで実行可能です。
MiniMax-Music3は最大5分の楽曲を生成でき、出力は32kHzの16bitステレオ音楽ファイルです。モデルはGitHubとHugging Faceで配布されており、生成例も公開されています。公開ページでは、日本語の歌詞を含むロック曲の生成例も紹介されていました。
あわせて、短い入力から長い歌詞や構造化されたプロンプトを作るためのAI用スキルも公開されています。デモアプリは無料ですが、Hugging Faceの無料推論サービスの制限に達したとされています。一方で、MiniMax-Music3はComfyUIを使ったローカル生成が可能で、ローカルなら無制限に生成できると案内されています。
MiniMaxは今後、MiniMax H3をベースとした画像生成・編集モデルや動画アップスケールモデルなどをオープンモデルとして公開する計画も示しています。動画生成AIに続く公開で、同社のオープンモデル戦略を印象づける動きです。

