OpenMOSS 0.9B 開源語音神作:端到端多語者轉錄與語者分離技術全解析
OpenMOSS 0.9B 開源語音神作:端到端多語者轉錄與語者分離技術全解析 想一鍵搞定多人會議逐字稿?OpenMOSS 推出最新 MOSS-Transcribe-Diarize …
Read More →
OpenMOSS 0.9B 開源語音神作:端到端多語者轉錄與語者分離技術全解析 想一鍵搞定多人會議逐字稿?OpenMOSS 推出最新 MOSS-Transcribe-Diarize …
語音辨識的新標竿:Cohere Transcribe Arabic 如何破解阿拉伯語方言與語碼轉換難題 1. 前言:阿拉伯語 ASR 的挑戰與突破 在自動語音辨識(ASR)領域,阿 …
揭開 NVIDIA Nemotron 3.5 ASR 的神秘面紗:6 億參數的即時語音識別指南 探索 NVIDIA 最新的串流語音識別模型 Nemotron 3.5 ASR。本文詳 …

專為企業生產環境打造!開源語音辨識新選擇 Cohere-transcribe 如何以 2B 參數達成 3 倍推理效率 處理大量音訊資料時,伺服器帳單總是讓人心驚肉跳嗎?大家可能都經 …
這款全新的語音模型不只具備 40 億參數的精巧體積,更以驚人的低延遲和 Apache 2.0 開源授權,打破了目前語音轉錄市場的既有規則,為開發者帶來了前所未有的本地端運算潛力。 …
長期以來,OpenAI 的 Whisper 系列模型幾乎成了開源語音識別(ASR)領域的標準答案。每當開發者需要處理語音轉文字的任務時,腦中浮現的第一個名字通常都是它。但坦白說,這 …

擺脫切碎的錄音檔!Microsoft VibeVoice ASR 挑戰一小時不間斷的精準轉錄 如果你曾經試著用 AI 來處理長篇會議記錄或 Podcast 逐字稿,這情況可能讓人感 …
OpenMOSS 團隊於 2026 年初重磅發布 MOSS-Transcribe-Diarize,這是一款端到端的多模態大型語言模型。它不僅能精準進行語音轉錄,還解決了長久以來「 …
GLM-ASR-Nano-2512 以 1.5B 參數量的輕量化設計,在多項語音識別基準測試中擊敗了 OpenAI Whisper V3。這款開源模型不僅在粵語等方言識別上表現出 …

Meta AI 發表了革命性的 Omnilingual ASR 技術,支援超過 1600 種語言的語音辨識,特別是那些資源稀少的語言。這項開源技術不僅打破了技術瓶頸,更希望透過社 …
© 2026 Communeify. All rights reserved.