生成只是其中一步

完整歌曲會經過企劃、歌詞、音訊生成、分析、封面和影片輸出。模型常被當成核心,但實際花最多時間的是版本、素材和階段狀態。如果所有輸出都堆在同一個資料夾,幾次實驗後就無法確認哪個成品來自哪組設定。

將引擎與作品分開

大型模型權重與執行環境不適合跟每首歌一起保存,因此我把引擎、工具和歌曲工作目錄拆開。每首歌保留企劃、歌詞、音訊、分析結果與發布素材,控制流程負責協調,但不把特定模型寫死在作品資料裡。

一次暫停留下的價值

專案早期曾因模型環境、生成品質與後製整合的投入過高而暫停。這段時間沒有把實驗目錄直接丟棄,而是保留產物結構、品質紀錄與已知限制,讓後續更換模型與影片工具時不必重新整理所有素材。

從工程實驗走向頻道發布

2026 年 8 月,這套流程重新啟動並進入 Kumori Music 的正式製作:歌詞與歌曲生成後會經過人工選曲、結構確認與品質檢查,再由一致的角色和品牌規格產生視覺,最後以 Remotion 與 FFmpeg 輸出完整影片及 Shorts。專案的目標也從擴充控制台,轉為建立可以穩定完成一首作品的端到端發布流程。