科技

AI 語音輸入法:人類進入“不打字”時代

作者 WEIWEI · 來源

一週前,我下載了一款名為 Typeless 的 AI 語音輸入法。當時,我沒意識到它會徹底改變我的工作方式。

從 2025 年下半年開始,AI 語音輸入法成為新風口。豆包輸入法主打語音輸入,智譜推出智譜 AI 輸入法,搜狗也在 1 月 27 日宣佈其語音識別率達 98%,日均語音使用次數近 20 億次,穩居行業第一。海外產品如 Wispr Flow 融資 8100 萬美元,而 Typeless 在 Product Hunt 上長期高居榜單,多平臺版本相繼推出,初創企業和個人開發者也紛紛加入,如閃電說、LazyTyper、Spokenly、秒言等。

我原以為這只是又一次 AI 嚐鮮,但結果卻是自 ChatGPT 以來,最讓我眼前一亮的產品。不到一週,我已經放棄了 20 多年的打字習慣,完全轉向語音輸入。這篇文章的初稿,正是通過 Typeless 完成:53 分鐘輸入 5500 字,每分鐘 155 字,節省約 2.5 小時。

01 更快更準,AI 語音輸入降維打擊
即便我是一名資深打字愛好者,每分鐘打字最高約八九十字,語音輸入卻能輕鬆達到 150 字/分鐘,頂尖使用者甚至能達到 250 字/分鐘,超過 2013 年全國漢字輸入大賽冠軍的 175 字。準確率也非常高:中文語音輸入糾錯率僅 6.67%,鍵盤輸入高達 17.73%。

AI 大模型加持下,語音輸入不只是轉錄,它是“語音意圖輸入法”。它可識別語氣詞、糾正語法、調整語句邏輯,甚至根據環境和需求翻譯潤色。即便輸出有錯,也可以直接用語音修改,例如 Typeless 可快速糾正同音字錯誤。

語音輸入也不尷尬。在辦公室中,我輕聲低語,左右同事甚至未察覺。20 分貝以下,準確率依然可達 97%。目前的侷限主要是短語或單字準確率低於長句,顯然大模型理解長語境更精準。

02 突破輸入框,重塑超級入口
AI 語音輸入不僅替代打字,還可能成為跨 App、系統級的超級入口。未來,你不再需要獨立輸入法,系統級 AI 助手即可完成語音輸入,貫穿虛擬與現實的交流介面,類似未來版的 Siri。蘋果也計劃 2026 年 6 月推出全新版 AI 助手,實現對話式互動和核心應用整合。

03 打字只是歷史遺留,語音才是本源
打字僅出現 150 年,而口語存在十幾萬年。打字屬於“系統 2”,依賴學習和刻意訓練;語音屬於“系統 1”,是直覺本能。中文輸入更復雜,五筆、拼音、注音等輸入法各有優劣,但都未解決效率與門檻矛盾。大模型成熟後,AI 語音幾乎必然成為主流輸入方式。

使用 AI 語音輸入後,我獲得了兩個意外驚喜:

  1. 改變寫作方式:可以隨時隨地完成寫作,告別久坐辦公模式。
  2. 提升與 AI 互動效率:長提示詞一次說完即可獲得理想答案,減少多輪輸入。

未來的一代,或許根本不理解為什麼我們還要在螢幕上打字——語音輸入才是人類最自然的交流方式。