微軟 VibeVoice 橫空出世:90分鐘超長語音、多人對話,AI 播客的未來已來?
探索微軟最新開源文字轉語音 (TTS) 模型 VibeVoice。它提供 1.5B 和 7B 兩種版本,支援長達 90 分鐘的語音生成、最多 4 人對話、優異的中文效果(偏向外國 …
Read More →
探索微軟最新開源文字轉語音 (TTS) 模型 VibeVoice。它提供 1.5B 和 7B 兩種版本,支援長達 90 分鐘的語音生成、最多 4 人對話、優異的中文效果(偏向外國 …
Kitten ML 團隊繼推出 25MB 的 Nano 預覽版後,再度震撼發布 Kitten TTS Mini!這款 170MB 的開源文字轉語音模型,同樣內建 8 種生動聲音, …

Boson AI 正式開源其最新的音訊基礎模型 Higgs Audio v2。這個模型僅憑預訓練就在多項評測中擊敗了 gpt-4o-mini-tts 等頂尖對手,展現了前所未有的 …

繼廣受好評的 StyleTTS 2 之後,開發者 yl4579 再度為開源社群帶來驚喜。最新發布的 DMOSpeech2 不僅是 F5-TTS 的強化版,更在速度、準確性和穩定性 …
曾由字節跳動(ByteDance)發表、卻因缺少關鍵元件而未能普及的 MegaTTS 3 聲音複製技術,如今在開源社群的努力下迎來新生。本文將帶您深入了解這項技術的來龍去脈,以及 …

探索由 Bilibili 團隊開發的革命性文字轉語音 AI — IndexTTS2。本文將深入解析它如何透過短短幾秒音檔實現影視級的聲音複製、前所未有的情緒控制,以及為何它能成為 …

Zyphra 推出 ZONOS2:首創 MoE 架構的即時 TTS 語音克隆模型 Zyphra 最新推出的 ZONOS2 是一款採用 Apache 2.0 授權的開源文字轉語音模 …

Chatterbox TTS 震撼更新:開源語音 AI 現已支援 23 種語言,免費顛覆你的聽覺體驗 聽膩了呆板的 AI 語音嗎?Resemble AI …
Play AI 最近開源了一款名為 PlayDiffusion 的創新語音編輯模型。它採用擴散模型技術,能夠對語音進行局部、精準的修改,同時保持其餘部分的完整與自然。這項技術不僅 …

AI 語音生成賽道迎來一次關鍵升級!長期在開源社群累積實力的 Fish Speech 專案,正式推出其里程碑模型 OpenAudio S1。它不僅在聲音自然度上達到新高峰,更以精 …
© 2026 Communeify. All rights reserved.