生活分享
MiniMax 音樂生成怎麼用:從一段描述與歌詞做出一首歌
MiniMax 的作曲 AI(音樂生成)在 2026 年換了入口:付費 API 自 8 月 20 日起不再開放給新使用者,官方把一般使用者指向 MiniMax Audio、開發者指向 Hugging Face 上的開源權重 MiniMax Music 3。這篇照官網整理提示詞與歌詞怎麼寫、14 種段落標記、長度與音檔格式、費用與免費額度、API 最小呼叫範例,以及輸出音檔的商用與著作權。
更新日期: 閱讀時間約 8 分鐘

MiniMax 的音樂生成用一段描述加一段歌詞做出一首帶人聲與編曲的完整歌曲,但入口換了位置:官方文件寫明,自 2026 年 8 月 20 日起,付費的音樂與歌詞生成 API 不再開放給新使用者,免費版音樂 API 停止提供,改請使用者用 MiniMax Audio 網頁服務,或取用 Hugging Face 上的開源權重 MiniMax Music 3。搜「作曲 AISuno 做歌:從歌詞到成品,方案、下載與商用權怎麼算Suno 2026 年 9 月 3 日生效的新版條款把商用權綁在「有沒有下載」上:免費方案只有 7 次終身試用下載且不可商用,Pro 每月 20 次、Premier 每月 60 次才附商用權。這篇照官網當天頁面整理 Simple 與 Custom 模式怎麼填、歌詞與風格欄位的寫法、v6 三個模型與單次最長 8 分鐘、Extend 與 Cover、輸出格式與方案點數,以及條款裡的所有權條文。閱讀全文」或「音樂 AI人工智慧(Artificial Intelligence)是什麼人工智慧是涵蓋多種技術與應用的總稱,不等於聊天機器人,也不必一定會產生文字。本文從 OECD 的系統定義出發,以照片分類和社區資源推薦為例,說明輸入、推導、輸出與人的目標如何連結,整理它與機器學習、深度學習和生成式 AI 的關係。讀完能用具體問題判斷一項 AI 功能在做什麼,並分辨能力、自治程度與可信度。閱讀全文」找到它的人,先看入口在哪裡。
這篇照官網文件走一遍:在哪裡動手、描述與歌詞各自要寫什麼、段落標記token(Token)是什麼:AI 如何計算文字長度token 是語言模型處理內容的基本單位,可能是一段單字、標點或中文字的一部分,不能直接當成字數。本文用整理社團公告的情境,說明輸入、輸出與上下文如何計數,為什麼同一段中文換模型後用量可能不同,以及查看分詞器和實際用量時該注意什麼。你會學會估算任務空間、保留必要資訊,並分清楚 token 與登入用的存取權杖。閱讀全文有哪幾種、一首歌多長、輸出什麼格式、費用怎麼算、API 最小呼叫長什麼樣,音檔能不能商用與著作權要注意什麼。條款沒有明講的部分直接寫「以官網為準」。
入口:官方現在把音樂生成放在哪裡
開發者文件的音樂生成說明頁與 API 參考頁掛著同一則公告:付費的 Music Generation 與 Lyrics Generation API 不再開放給新使用者,既有付費使用者可繼續使用;免費版的 music-3.0-free、music-2.6-free、music-cover-free 停止提供。公告給了兩條替代路徑。
- 一般使用者:用 MiniMax Audio 網頁服務。官方為這個功能另寫了一份「MiniMax Audio 音樂創作使用條款」,生效日 2025 年 6 月 19 日,涵蓋 AI 生成音樂與 AI 生成歌詞。
- 開發者或想自架的人:取用 Hugging Face 上的開源權重 MiniMax Music 3,官方自架文件教你用 SGLang-Omni 起服務,再透過語音端點送出歌詞與描述。
- 既有付費使用者:端點與參數規則都還在,只是新帳號不再開通,以官網為準。
海螺(Hailuo AI)的 App 或網站裡有沒有獨立的音樂分頁、台灣的 App Store 與 Google Play 上架狀況,官方說明頁沒有寫,本站也無法從台灣以外的環境確認實際畫面,以官網為準。想先弄清楚這個品牌底下有哪些產品,先看下面這篇。
MiniMax 是什麼:海螺 AI、影片與語音生成,台灣使用者怎麼用MiniMax 是什麼:海螺 AI、影片與語音生成,台灣使用者怎麼用MiniMax 是上海的 AI 公司,海螺 AI(Hailuo)、MiniMax Audio 語音、Music 3.0 音樂、MiniMax Agent 對話助理與開源的 M 系列模型都是它的產品。這篇用 2026 年 9 月查證的官網與香港交易所資料,說明五條產品線各做什麼、台灣使用者走哪個國際版網址、費用怎麼算、隱私政策把資料放在哪裡,並示範用海螺做一支 5 秒影片,附費用對照表。閱讀全文
音樂描述與歌詞怎麼寫
模型吃兩份輸入:提示詞欄位 prompt 放音樂描述,lyrics 放要唱出來的字。官方把 prompt 定義為「描述音樂的風格、情緒與使用情境」,做有人聲的歌時選填、長度 0 到 2,000 個字元;把 is_instrumental 設成 true 做純演奏曲時改為必填、1 到 2,000 個字元,歌詞可以不給。另有 lyrics_optimizer 參數模型參數(Model Parameters)是什麼模型參數是訓練時調整、用來把輸入轉成輸出的數值,例如權重與偏差。本文用簡單算式示例說明參數如何影響預測,區分模型參數、訓練超參數、提示詞與生成設定,並解釋參數量、數值精度和啟用參數為何是不同指標。讀完能更準確閱讀模型規格,理解參數增加不等於知識逐條增加,也不代表每次聊天都在重新訓練模型。閱讀全文,設成 true 又沒給歌詞時會照描述自動生一份。
描述不要只丟「抒情流行」這種標籤。模型卡建議寫成三段式的結構化描述(Structured Caption),讓模型跟得到曲子隨時間的發展:
- Global Metadata:曲風與次曲風、BPM、調性與音階、情緒推進、聆聽情境、製作質感。
- Vocal Details:人聲性別、音色、演唱方式、和聲與背景人聲、人聲效果。
- Arrangement:主次樂器、各段落樂器的進出、律動、低音聲部、打擊與空間效果。
歌詞欄位做有人聲的歌時必填,長度 1 到 3,500 個字元,行與行之間用換行分隔。官方列出 14 種段落標記,每個標記各自占一行,完整清單附在下面的範例裡。歌詞生成 API 回傳的歌詞也帶標記,可直接貼進 lyrics;兩份文件列的寫法略有出入,以你呼叫的那一支為準。
音樂描述(prompt 欄位,可直接用英文寫,模型對英文樂理詞彙的辨識較穩)
Genre: acoustic pop. BPM: 96. Key: C major. Warm and intimate, building gently into the chorus.
Vocals: soft female lead, close and breathy, light stacked harmonies in the chorus.
Arrangement: fingerpicked guitar and soft piano; brushed drums and upright bass enter in the chorus.
歌詞(lyrics 欄位,段落標記各自占一行,行與行之間用 \n 分隔)
[Verse]
清晨的光穿過松林
街角安靜得只剩呼吸
[Chorus]
世界慢慢地開始呼吸
把昨天的雨收進口袋
音樂生成 API 文件列出的 14 種段落標記
[Intro] [Verse] [Pre Chorus] [Chorus] [Interlude] [Bridge] [Outro]
[Post Chorus] [Transition] [Break] [Hook] [Build Up] [Inst] [Solo]閱讀完整文字說明
流程圖分成五個方塊。左側兩個輸入方塊:音樂描述 prompt 寫風格、情緒、樂器與人聲,長度 0 到 2,000 個字元,純演奏曲時改為必填;歌詞 lyrics 用 14 種段落標記,每個標記各占一行,長度 1 到 3,500 個字元,也可以讓 API 代寫。兩者一起進入中間的模型與音檔設定方塊:模型選 music-3.0,取樣率 44100,位元率 256000,格式可選 mp3、wav 或 pcm。接著到右上的生成與取回方塊:模型卡寫原生最長 5 分鐘,output_format 選 url 時連結 24 小時後失效,也可以改用 hex 直接取回。最後往下到右下的發布前檢查方塊:標示這是 AI 生成、投入的聲音要先取得授權、商用範圍以官網條款為準、浮水印與識別資訊不要移除。
長度、格式與取樣率
長度方面,MiniMax Music 3 的模型卡寫的是原生支援最長五分鐘的完整歌曲,並在這個長度內維持主題、節奏、人聲特徵與編曲推進,撐得住前奏、主歌、副歌、橋段與尾奏的完整結構。自架文件另外提醒,服務框架容許的上限比五分鐘再長一點,但那是框架限制、不是模型多出來的能力。
音檔格式由 audio_setting 決定:取樣率可選 16000、24000、32000、44100,位元率可選 32000、64000、128000、256000,格式可選 mp3、wav、pcm。取回方式由 output_format 決定,url 給一條 24 小時後失效的連結,要盡快下載;hex 直接回傳十六進位字串,開啟串流時只支援 hex。自架開源權重那條路線輸出 32 kHz、16 位元立體聲 WAV。
| 項目 | 官網數字或規則 |
|---|---|
| 目前主力模型 | music-3.0,2026 年 7 月 16 日列入模型發布紀錄 |
| 音樂描述 prompt | 0 到 2,000 個字元;純演奏曲時必填,1 到 2,000 個字元 |
| 歌詞 lyrics | 有人聲時必填,1 到 3,500 個字元;段落標記 14 種 |
| 單首長度 | 模型卡:原生支援最長五分鐘 |
| 取樣率 | 16000、24000、32000、44100 |
| 位元率 | 32000、64000、128000、256000 |
| 音檔格式 | mp3、wav、pcm;自架開源權重輸出 32 kHz、16 位元立體聲 WAV |
| 取回方式 | output_format 選 url 或 hex;url 連結 24 小時後失效 |
| 翻唱參考音檔 | 6 秒到 6 分鐘、最大 50 MB、常見音訊格式 |
| 速率限制 | 音樂生成 RPM 120、並行連線 20 |
| API 價格 | Music-3.0 與 Music-2.6 每首 0.15 美元(最長 5 分鐘);歌詞生成每首 0.01 美元 |
費用與免費額度
API 這一側,定價頁已把音樂模型全部標成 Discontinued(停止提供),價格仍列在頁上:Music-3.0 與 Music-2.6 每首 0.15 美元、單首最長 5 分鐘,歌詞生成每首 0.01 美元;翻唱的前處理步驟官方註明不計費。這是給既有付費使用者看的價目。
MiniMax Audio 這一側走點數制。官方訂閱服務條款寫:免費使用者登入後可拿到每日限時的免費點數;Starter 每月 5 美元、含每月 100,000 點;Standard 每月 30 美元、含每月 1,000,000 點;也可單次加值,每 1,000,000 點 30 美元,最低 5 美元。2026 年 2 月 12 日以後買的點數有效期兩個月,之前的維持兩年,月費附的點數每個自然月月底歸零,生成失敗或未過審會自動退點。一首歌扣多少點,條款沒有列,以官網為準。
API 最小呼叫範例
既有付費帳號要接 API,最小的一次呼叫就是一個 POST:帶模型名稱、描述、歌詞與音檔設定。金鑰用環境變數讀,不要寫進程式碼。回應裡 status 是 2 代表完成,extra_info 附上音檔長度、取樣率、聲道數與檔案大小。
import os
import requests
# 金鑰放環境變數,不要寫進程式碼:export MINIMAX_API_KEY="..."
api_key = os.environ["MINIMAX_API_KEY"]
payload = {
"model": "music-3.0",
"prompt": "Indie folk, melancholic, introspective, longing, solitary walk, coffee shop",
"lyrics": "[verse]\n街燈閃爍 夜風嘆息\n[chorus]\n推開木門 香氣散開",
"audio_setting": {"sample_rate": 44100, "bitrate": 256000, "format": "mp3"},
"output_format": "url",
}
response = requests.post(
"https://api.minimax.io/v1/music_generation",
headers={"Content-Type": "application/json", "Authorization": f"Bearer {api_key}"},
json=payload,
)
print(response.json())沒有付費帳號又想用程式跑的人走開源權重那條路。官方自架文件把模型與框架版本都釘死,服務起來後用共用的語音端點,歌詞放 input、描述放 instructions。這條路要 NVIDIA CUDA 顯示卡,模型檔案約 57.4 GB,不是一般筆電跑得動的規模。
# 先照官方自架文件用 SGLang-Omni 起服務,再送出歌詞與音樂描述
curl http://127.0.0.1:8000/v1/audio/speech \
-H 'Content-Type: application/json' \
-d '{
"model": "MiniMaxAI/MiniMax-Music3",
"input": "[Verse]\nMorning light filtering through the pine\n[Chorus]\nSoftly the world begins to breathe",
"instructions": "A warm acoustic pop song with intimate female vocals, fingerpicked guitar, soft piano, and a gradual emotional build into a wide final chorus.",
"response_format": "wav",
"max_new_tokens": 750,
"stream": false
}' \
--output minimax_music3.wav商用、上架與著作權
輸出音檔能不能商用,兩份條款要分開看。MiniMax 的 App 與網站服務條款寫「我們不主張使用者投入內容與使用者生成內容的所有權」,但同時要求你授權 MiniMax 一份免權利金、永久、不可撤回、全球、非專屬的授權,範圍含重製、修改、發布、散布與取得收益,終止後仍存續。條款沒有另寫「輸出可自由商用」這句,所以上架串流平台或用在客戶案子前,商用範圍以官網條款為準。
自架開源權重是另一套規則。MiniMax-Music3 採用自家的社群授權(COMMUNITY LICENSE),允許使用、修改與再散布,商用另有兩條要求:在商業產品或服務介面上明顯標示「MiniMax-Music3」;你與關係企業由這些產品取得的年度總營收超過 2,000 萬美元時要先取得官方書面授權。著作權這塊,官方條款寫到的只有下面幾條:
- 投入內容必須是原創或已取得合法權利,不得侵害第三方的智慧財產權或人格權。
- 投入內容若包含任何個人的聲音,必須擁有完整合法權利或取得權利人授權。
- 禁止用途明文包含冒充他人或誤稱關係、損害名譽、散布不實或誤導資訊。
- 官方可能在輸出嵌入識別資訊或浮水印,不得擅自更改或移除;你有責任標示輸出是 AI 生成。
- 開源權重的可接受使用政策同樣要求:公開散布生成內容要揭露是機器生成,未經同意不得冒充他人。
同一件事其他家也在做,Google 把 Lyria 放進 Gemini 就是一例;各家的長度、費用與授權規則不一樣,要比就照官網一項一項比對。另一邊的選擇看 Lyria 3.5 進入 Gemini:AI 音樂創作有哪些新選擇?Lyria 3.5 進入 Gemini:AI 音樂創作有哪些新選擇?Google 在 2026 年 9 月 4 日宣布 Lyria 3.5 進入 Gemini App 與 API,提供人聲、純音樂、風格模板及長短曲目等選擇。這篇從生日音樂、旅行影片配樂與簡單創作出發,說明如何寫出可用的音樂需求、比較不同版本、檢查人聲與節奏,以及為什麼工具可生成音樂,不代表所有用途都已取得商用或素材授權。閱讀全文。想補背景知識,生成式 AI(Generative AI)是什麼生成式 AI(Generative AI)是什麼生成式 AI 從資料學到模式,依輸入條件產生文字、影像、聲音等內容。本文以社區二手市集宣傳素材為例,說明生成與分類、搜尋的差別,介紹語言模型、擴散與對抗生成等不同途徑,並解析內容看起來合理卻可能不忠於事實的原因。讀完能把創意需求、必須保留的資訊與人工驗收分開安排,判斷哪些產物仍只是待確認草稿。閱讀全文與 擴散模型(Diffusion Model)是什麼:從雜訊逐步生成影像擴散模型(Diffusion Model)是什麼:從雜訊逐步生成影像擴散模型先學習不同雜訊程度下的去噪關係,再透過反覆更新產生新內容。本文用植物展覽海報的示意案例,說明訓練與生成為何方向不同、文字條件如何參與,以及步數、種子和潛在空間各自控制什麼,幫你分清影像逐漸清晰、畫面符合要求與內容真實可信之間的差別,也釐清擴散模型和文字生圖的關係。閱讀全文 兩篇夠用。
MiniMax 底下的其他生成功能,本站另有三篇:
MiniMax 海螺影片生成教學:從註冊到下載第一支 AI 影片MiniMax 海螺影片生成教學:從註冊到下載第一支 AI 影片海螺 AI(Hailuo AI)是 MiniMax 的影片生成產品,網頁版與 iOS、Android App 都能用。這篇帶台灣使用者走完第一次:入口與登入方式、免費版的浮水印與排隊限制、點數與訂閱方案怎麼算、文生影片與圖生影片的操作順序、提示詞的四段寫法,以及官方公布的時長與解析度規格,最後說明服務條款怎麼寫生成內容的授權與商用。閱讀全文
MiniMax 語音合成:中文配音、有聲書與影片旁白MiniMax 語音合成:中文配音、有聲書與影片旁白把 MiniMax 的 Speech 系列當配音 AI,把文字變成音檔:網頁版與 API 兩條路的最小步驟、332 個系統音色怎麼挑、情緒與語速停頓的參數範圍、輸出格式與取樣率、每百萬字元的費用與免費額度、聲音複製要通過的驗證與授權規則,以及有聲書的分段工作流。規格與價格以官網 2026 年 9 月 14 日的頁面為準。閱讀全文
MiniMax M 系列模型:開放權重、授權條款與 API 價格MiniMax M 系列模型:開放權重、授權條款與 API 價格M 系列是 MiniMax 的文字模型線,從 M1 一路做到 M3。這篇照 2026 年 9 月 14 日官網、API 文件與 Hugging Face 官方組織頁的內容,整理現有版本與時序、參數與上下文視窗、每一代授權能不能商用、API 每百萬 token 的價格與訂閱方案、本機執行的硬體需求,並說明開放權重和開源的差別,以及 M 系列和海螺影片、語音、音樂模型的分工。閱讀全文
同主題延伸閱讀
生活分享
本機跑 Stable Diffusion 與 Flux:ComfyUI 入門
ComfyUI 是一套開源的節點式生成引擎,可以在自己的電腦上跑 Stable Diffusion 與 Flux。這篇照官方文件整理三種安裝方式與系統需求、模型檔要放進哪個子資料夾、怎麼載入官方範本完成第一張圖,以及每個節點在做什麼;並逐版本核對 Flux 與 Stable Diffusion 的授權、商用條件與官方寫的顯示記憶體需求。
生活分享
MiniMax 語音合成:中文配音、有聲書與影片旁白
把 MiniMax 的 Speech 系列當配音 AI,把文字變成音檔:網頁版與 API 兩條路的最小步驟、332 個系統音色怎麼挑、情緒與語速停頓的參數範圍、輸出格式與取樣率、每百萬字元的費用與免費額度、聲音複製要通過的驗證與授權規則,以及有聲書的分段工作流。規格與價格以官網 2026 年 9 月 14 日的頁面為準。
生活分享
MiniMax 海螺影片生成教學:從註冊到下載第一支 AI 影片
海螺 AI(Hailuo AI)是 MiniMax 的影片生成產品,網頁版與 iOS、Android App 都能用。這篇帶台灣使用者走完第一次:入口與登入方式、免費版的浮水印與排隊限制、點數與訂閱方案怎麼算、文生影片與圖生影片的操作順序、提示詞的四段寫法,以及官方公布的時長與解析度規格,最後說明服務條款怎麼寫生成內容的授權與商用。
生活分享
Figma AI 功能怎麼評估:設計生成、資料與交接
Figma AI 已包含對話式設計代理、獨立 AI 工具及與外部工具連接的工作方式,不能只沿用早期 First Draft 教學。本文以原創共享廚房預約頁為例,整理功能與席位、設計系統、內容訓練、聊天可見性及 MCP 寫入的檢查方式,並說明 beta 與 AI 點數的現況。附步驟、比較表及原創圖解,協助評估可編輯成果與交接責任,不把生成畫面當成已完成的服務。
引用本文的文章
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算
資料來源
- MiniMax API Docs:Music Generation 使用指南(官方文件) · 查證日期:
- MiniMax API Docs:Music Generation API 參考(官方文件) · 查證日期:
- MiniMax API Docs:Lyrics Generation API 參考(官方文件) · 查證日期:
- MiniMax API Docs:Music Cover Preprocess API 參考(官方文件) · 查證日期:
- MiniMax API Docs:Pay as You Go 定價頁(官方定價) · 查證日期:
- MiniMax API Docs:Rate Limits 速率限制(官方文件) · 查證日期:
- MiniMax API Docs:Self-host MiniMax Music 3 自架文件(官方文件) · 查證日期:
- MiniMax API Docs:模型發布紀錄(官方公告) · 查證日期:
- Hugging Face:MiniMaxAI/MiniMax-Music3 模型卡(官方組織頁) · 查證日期:
- Hugging Face:MiniMax-Music3 COMMUNITY LICENSE 授權原文(官方組織頁) · 查證日期:
- MiniMax Audio Music Creation Terms of Use 音樂創作使用條款(官方條款) · 查證日期:
- MiniMax App and Web Terms of Service 應用程式與網站服務條款(官方條款) · 查證日期:
- MiniMax Audio Paid Service Terms 訂閱服務條款(官方條款) · 查證日期:
- MiniMax Open Platform Terms of Service 開放平台服務條款(官方條款) · 查證日期:
- MiniMax 官方部落格:MiniMax Music 3.0 模型說明(官方公告) · 查證日期:
- MiniMax Audio 官方產品頁(官方網站) · 查證日期: