語音輸入
語音輸入是籤名循環的第三類輸入通道——前兩類是鍵盤和粘貼。按住一個熱鍵說話,松手後有三種落點:把這段話聽寫上屏、讓它命中的片段原地展開、或者作爲指令送進 AI。全程不搶前臺焦點。

開始之前
語音的總開關預設關閉,且必須先配好一臺識別服務,按下熱鍵才會有反應。三步:
- 打開總開關:設定 → 語音輸入 → 啓用語音輸入。
- 設定熱鍵:點輸入框後按下要錄制的鍵,允許單獨使用 Control 這類修飾鍵。留空表示不佔用鍵位。
- 配置識別渠道(關鍵):在「語音識別」裏添加一個 OpenAI 兼容的聽寫服務,填端點、API Key 與模型名;模型要填語音識別模型(如 whisper、gpt-4o-transcribe),填對話模型會失敗。也可以下載本機模型走離線識別,見下文。
麥克風權限只會詢問一次;未授權時按熱鍵不會錄音。
跳過第 3 步就按熱鍵,膠囊會提示「尚未配置識別服務」。這是設計如此:CodeExpander 沒有自建識別後端,音頻只發往你自己填的端點。
說完之後的三種落點
| 模式 | 結果 |
|---|---|
| 展開片段 | 按縮寫、標題或語音別名匹配片段並原地展開。沒命中時可選「改爲聽寫上屏」或「僅提示,不上屏」 |
| 聽寫 | 把識別文字插入光標處。若整句恰好是某條縮寫,仍會展開片段 |
| 語音 → AI | 單獨配一個熱鍵,說完直接送進搜尋窗的 AI 對話 |
「按住說話」與「點按開始/再按停止」兩種方式都支持;點按模式下靜音超過 10 秒會自動取消。
語音別名:說中文也能命中
片段編輯器裏的語音別名字段(逗號分隔)讓同一個片段有多個口語叫法。例如給 /cs 這條片段加上別名「客服話術」,之後嘴上說「客服話術」就能展開它,而不用念出縮寫。
長句聽寫未命中片段時,可以開關一個後處理:靜默整理標點後再上屏,不打開搜尋窗。預設關閉。
本機識別(離線)
不想把音頻發到雲端時,可以下載本機模型,音頻不出電腦:
| 平臺 | 本機識別 |
|---|---|
| macOS(Apple Silicon) | 支持。下載 Qwen3-ASR 0.6B 模型(約 1.2 GB)後離線識別 |
| macOS(Intel) | 暫不支持,可用雲識別 |
| Windows | 本機引擎暫未提供,可用雲識別 |
本機模型首次加載需要 30–90 秒,之後會保持一段時間常駐;長期不用會自動釋放。
隱私
- 音頻只駐內存,不落盤、不留歷史。
- 音頻只發往你自己配置的識別端點;CodeExpander 沒有自建識別後端。
- 語音不佔 Pro 名額,也不限次數。
- 系統密碼框等安全輸入場景會被攔截,此時文字會放進剪貼簿,需要你手動粘貼。
相關連結
最後更新於