Google研究團隊提出可聆聽理解語音內容的AudioPaLM模型 還能自動生成口說內容

聯合新聞網 楊又肇

Google研究團隊近期提出一項名為AudioPaLM的大型自然語言模型,將能實現語音內容聆聽理解,並且自動生成口說內容。

AudioPaLM的背後是由PaLM 2與AudioLM兩種模型組合,並且對應多模運作框架,使其能聆聽、理解語言內容,並且藉由自動生成式人工智慧產生口說內容。

除了識別語音內容,並且進行自然互動之外,AudioPaLM更可對應多種語言翻譯功能,因此預期未來將能直接聆聽特定口語內容,隨即轉換成另一種語言呈現或許將能帶動更多跨語言溝通的便利性。

不過,目前此項技術仍處於研究階段,Google方面並未透露是否會將此技術應用在旗下諸如Google翻譯等服務,或是作為其他產品、服務應用。

《原文刊登於合作媒體mashdigi,聯合新聞網獲授權轉載。》

📌 蘋果新品搶鮮看!

 訂閱《科技玩家》YouTube頻道!
💡 追新聞》》在Google News按下追蹤,科技玩家好文不漏接!
📢 iPhone 18 Pro各國售價比一比!飛日韓買可能更貴 它比美國高1.7萬
📢2026蘋果發表會懶人包/6大新品重點 iPhone摺疊機74900元起
📢最貴iPhone不完美!iPhone Duo 5缺點1次看
📢 蘋果iPhone Duo可用觸控筆!對決Galaxy Z Fold8、1圖看7大比較
📢iPhone 18缺席!蘋果2階段發表「很聰明」 5大銷售策略玩心理戰
📢 iPhone 18 Pro、iPhone 17Pro買誰?一文掌握升級亮點

楊又肇

曾任聯合新聞網 (udn.com)數位頻道記者,目前為自由寫手與Mas...

人工智慧 Google

推薦文章