Stable AI推出可透過文字描述生成44.1kHz規格、長度達3分鐘立體音訊的Stable Audio 2.0

聯合新聞網 楊又肇

推出Stable Diffusion影像生成工具的人工智慧業者Stable AI,近期宣布推出其新款語音生成模型Stable Audio 2.0,將能透過文字產生時間長度達3分鐘的44.1kHz規格立體聲音訊,相比先前版本僅能產生45秒明顯有大幅成長。

Stable Audio 2.0跟1.0版本一樣,都是透過AudioSparx收錄超過80萬組音訊資料進行訓練,除了可透過文字產生音訊內容,更可透過上傳參考音訊樣本,讓使用者透過自然語言描述方式生成不同音訊內容,並且透過風格轉換工具進行後續調整。

而Stable Audio 2.0可產生音質達44.1kHz規格的立體聲音訊,同時長度更可長達3分鐘,幾乎是多數歌曲常見長度,預期可讓更多創作者生成所需配樂、音訊內容。

目前Stable Audio 2.0已經對外免費開放使用,使用者能透過Stable AI或Google帳號登入後操作。

《原文刊登於合作媒體mashdigi,聯合新聞網獲授權轉載。》

📌 數位新聞這裡看!

 訂閱《科技玩家》YouTube頻道!
💡 追新聞》》在Google News按下追蹤,科技玩家好文不漏接!
📢 ChatGPT圖片生成新招!變身飛天小女警、柯南 10秒教學、輸入指令一次看
📢 3月便宜資費懶人包/5G上網吃到飽388!4G不限速500有找
📢 LINE免費貼圖3款!這款上班族日常必備 「狗沒拿賽」諧音超有哏
📢 F25 ACE旗艦AI洗地機開箱!輕鬆拖地、高溫洗布烘乾 還能遛狗甩尾
📢 Andy老師分手家寧一無所有!業者見「1支援」霸氣送暖:配備升滿免費送你
📢 Skype五月說掰掰!轉移Microsoft Teams教學 「上班專用」可聊天建社群

楊又肇

曾任聯合新聞網 (udn.com)數位頻道記者,目前為自由寫手與Mas...

人工智慧 AI 使用者 Stable AI 聲音 文字 模型 語音 歌曲 免費

推薦文章

留言