🎙️ 台語(台灣閩南語)語音辨識 Demo

使用 MediaTek-Research/Breeze-ASR-26 (基於 openai/whisper-large-v2 微調,1.54 B 參數,~10,000 小時合成的台語語音訓練)做台語 ASR。

MediaTek Research(聯發科技)團隊開發,屬於 Breeze Taigi 框架的一部分。 在 Taigi ASR Benchmark 上 CER 約 30.13 %,跟教育部台灣台語輸入法(30.70 %)相當,遠勝前一代 Breeze ASR 25(49.99 %)。


使用方式

  1. 上傳音訊檔(wav / mp3 / m4a / ogg / flac 都支援)
  2. 或點麥克風 icon 直接錄音
  3. 按「開始辨識」等待幾秒

⚠️ 重要:模型輸出的都是國語漢字,不是台語正字。如果需要台語正字,需要另外翻譯。


🔌 程式呼叫(API):請參考 repo 內的 ADAPT.md,說明如何從瀏覽器或 Node.js 經 gradio_client 呼叫本 Space 的 /transcribe endpoint。


技術細節

  • 模型參數量:~1.54 B(Whisper-large-v2 微調)
  • 推論精度:bf16(VRAM ~3 GB)
  • Hardware:HF ZeroGPU (RTX PRO 6000 Blackwell)
  • 推論框架:transformers pipeline
  • License:Apache 2.0(商用 OK)