🎙️ 台語(台灣閩南語)語音辨識 Demo
使用 MediaTek-Research/Breeze-ASR-26
(基於 openai/whisper-large-v2 微調,1.54 B 參數,~10,000 小時合成的台語語音訓練)做台語 ASR。
由 MediaTek Research(聯發科技)團隊開發,屬於 Breeze Taigi 框架的一部分。 在 Taigi ASR Benchmark 上 CER 約 30.13 %,跟教育部台灣台語輸入法(30.70 %)相當,遠勝前一代 Breeze ASR 25(49.99 %)。
使用方式
- 上傳音訊檔(wav / mp3 / m4a / ogg / flac 都支援)
- 或點麥克風 icon 直接錄音
- 按「開始辨識」等待幾秒
⚠️ 重要:模型輸出的都是國語漢字,不是台語正字。如果需要台語正字,需要另外翻譯。
🔌 程式呼叫(API):請參考 repo 內的 ADAPT.md,說明如何從瀏覽器或 Node.js 經 gradio_client 呼叫本 Space 的 /transcribe endpoint。
技術細節
- 模型參數量:~1.54 B(Whisper-large-v2 微調)
- 推論精度:bf16(VRAM ~3 GB)
- Hardware:HF ZeroGPU (RTX PRO 6000 Blackwell)
- 推論框架:
transformerspipeline - License:Apache 2.0(商用 OK)