MioTTS 登場:僅 0.1B 參數的輕量語音模型,讓邊緣裝置也能流暢說話
探索 Aratako 最新發布的 MioTTS 專案,這是一系列基於 LLM 架構的超輕量級 TTS 模型。從極致的 0.1B 版本到高品質的 2.6B 版本,MioTTS 結合 …
Read More →
探索 Aratako 最新發布的 MioTTS 專案,這是一系列基於 LLM 架構的超輕量級 TTS 模型。從極致的 0.1B 版本到高品質的 2.6B 版本,MioTTS 結合 …
在人工智慧語音合成(TTS)的領域裡,我們經常看到各種新模型的發布,它們大多標榜著聲音更逼真、推理速度更快。但老實說,真正能讓開發者感到興奮的,往往不是只有「魚」吃,而是有人願意 …
想像一下,如果你不僅能複製任何人的聲音,還能憑空創造出從未存在過的說話者,甚至連背景的雨聲、街道的嘈雜聲都能一鍵生成,那會是什麼樣的體驗?這聽起來像是科幻電影的劇本, …

Qwen 團隊正式開源 Qwen3-TTS 系列模型,這套被稱為「全家桶」的解決方案提供了從音色克隆、創造到高擬真語音控制的完整功能。本文將詳細解析其雙軌建模技術、不同參數模型的 …
Soprano TTS 釋出訓練代碼 Soprano-Factory 與編碼器。這款超輕量級模型支援 15ms 低延遲串流,現在更能讓開發者使用自己的數據訓練專屬語音,探索邊緣運 …
在這個硬碟空間隨便都以 TB 計算、AI 模型動輒數十 GB 的環境下,你可能會覺得「大」就代表「好」。大家都在追求參數量的極致,彷彿沒有個幾十億參數都不好意思說自己是 AI。但有 …

在這個人工智慧應用日益普及的環境下,開發者與企業總是在尋找更有效率的解決方案。語音合成(Text-to-Speech, TTS)技術雖然已經相當成熟,但往往面臨著「魚與熊掌不可兼 …
語音 AI 技術終於不再被昂貴的 API 和網路延遲綁架。Neuphonic 推出的 NeuTTS Air 是一款基於 0.5B 語言模型的輕量級語音生成工具,主打在本地裝置上運 …
想要擁有真人般的 AI 語音,卻受限於硬體或生成速度嗎?MiraTTS 橫空出世,這款基於 LLM 的語音合成模型不僅只需 6GB VRAM 即可運行,更透過 Lmdeploy …

阿里雲 FunAudioLLM 團隊最新發布 CosyVoice 3,這款僅 0.5B 參數的 TTS 模型支援中英日韓等 9 種語言及 18 種方言,具備 150ms 極低延遲 …
© 2026 Communeify. All rights reserved.