Skip to Content
文件⚡ 核心功能🎙️ 語音輸入

語音輸入

語音輸入是籤名循環的第三類輸入通道——前兩類是鍵盤和粘貼。按住一個熱鍵說話,松手後有三種落點:把這段話聽寫上屏、讓它命中的片段原地展開、或者作爲指令送進 AI。全程不搶前臺焦點。

CodeExpander Pro 語音輸入


開始之前

語音的總開關預設關閉,且必須先配好一臺識別服務,按下熱鍵才會有反應。三步:

  1. 打開總開關:設定 → 語音輸入 → 啓用語音輸入。
  2. 設定熱鍵:點輸入框後按下要錄制的鍵,允許單獨使用 Control 這類修飾鍵。留空表示不佔用鍵位。
  3. 配置識別渠道(關鍵):在「語音識別」裏添加一個 OpenAI 兼容的聽寫服務,填端點、API Key 與模型名;模型要填語音識別模型(如 whisper、gpt-4o-transcribe),填對話模型會失敗。也可以下載本機模型走離線識別,見下文。

麥克風權限只會詢問一次;未授權時按熱鍵不會錄音。

跳過第 3 步就按熱鍵,膠囊會提示「尚未配置識別服務」。這是設計如此:CodeExpander 沒有自建識別後端,音頻只發往你自己填的端點。

說完之後的三種落點

模式結果
展開片段按縮寫、標題或語音別名匹配片段並原地展開。沒命中時可選「改爲聽寫上屏」或「僅提示,不上屏」
聽寫把識別文字插入光標處。若整句恰好是某條縮寫,仍會展開片段
語音 → AI單獨配一個熱鍵,說完直接送進搜尋窗的 AI 對話

「按住說話」與「點按開始/再按停止」兩種方式都支持;點按模式下靜音超過 10 秒會自動取消。

語音別名:說中文也能命中

片段編輯器裏的語音別名字段(逗號分隔)讓同一個片段有多個口語叫法。例如給 /cs 這條片段加上別名「客服話術」,之後嘴上說「客服話術」就能展開它,而不用念出縮寫。

長句聽寫未命中片段時,可以開關一個後處理:靜默整理標點後再上屏,不打開搜尋窗。預設關閉。

本機識別(離線)

不想把音頻發到雲端時,可以下載本機模型,音頻不出電腦:

平臺本機識別
macOS(Apple Silicon)支持。下載 Qwen3-ASR 0.6B 模型(約 1.2 GB)後離線識別
macOS(Intel)暫不支持,可用雲識別
Windows本機引擎暫未提供,可用雲識別

本機模型首次加載需要 30–90 秒,之後會保持一段時間常駐;長期不用會自動釋放。

隱私

  • 音頻只駐內存,不落盤、不留歷史。
  • 音頻只發往你自己配置的識別端點;CodeExpander 沒有自建識別後端。
  • 語音不佔 Pro 名額,也不限次數。
  • 系統密碼框等安全輸入場景會被攔截,此時文字會放進剪貼簿,需要你手動粘貼。

相關連結

  • 快速展開 —— 語音展開復用的是同一套片段匹配
  • FillIn —— 含變數的片段會在展開前彈出表單
  • 搜尋窗 —— 語音 → AI 送進的就是這個視窗
最後更新於