Superwhisper 开源6億參數小模型,專門整理語音轉寫
2026-08-20 14:35:17
幣界網消息,Superwhisper 發布了首個開源模型 s1-mini,該模型約有6億個參數,基於 qwen3-0.6b 進行微調,專門負責整理語音轉寫的草稿,能夠完全在本地設備上運行。s1-mini 本身不負責聽音頻,而是依賴 whisper、parakeet 等語音識別模型將聲音轉成文字後再進行處理。該模型會刪除口頭填充詞,處理說錯的內容,補上標點和大小寫,并將口述的數字、日期、時間、金額和郵箱改成正常的書面格式。目前模型僅支持英文,官方量化版本約462Mib,可在普通筆電 CPU 上運行,並提供 gguf 以接入 llama.cpp、ollama 和 lm、studio。官方在7519條英文測試數據上測得94.8%的準確率,s1-mini 早在6月就進入 Superwhisper 進行實驗性測試,處理速度可達到約200 token /s。
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。
關注HKWDB官方帳號,及時關注最新動態









