命令列工具
jatinkrmalik/vocalinux avatar
jatinkrmalik/vocalinux

Vocalinux:Linux 下的離線語音聽寫

專案速覽:適用於 Linux 的免費、開源、100% 離線語音聽寫。透過 Whisper.cpp、Whisper 和 VOSK 引擎、GPU 加速、可在 X11 + Wayland 上運行,在任何地方說話和打字!

849 個 Star96 個 ForkPythonAGPL-3.0

秒懂

它是什麼?
一個免費的 GPLv3 桌面應用,透過 whisper.cpp、Whisper 或 VOSK 引擎,在 X11 或 Wayland 上將語音轉為文字。
適合誰用?
Vocalinux 是 Linux 上一個實用的離線聽寫工具;README 描述了 v0.15.0 版本,包含可搜尋的設定、AppImage 建置和更大的語言目錄,但未提供獨立的基準測試或支援保證。
可以商用嗎?
可以,但條件嚴格。AGPL-3.0 是網路 copyleft 授權:如果別人透過網路使用你修改過的版本(例如作為託管服務),你必須以同一授權向他們提供原始碼。
還在維護嗎?
有在維護。儲存庫在最近一天內有新的提交。
用什麼語言寫的?
主要是 Python(依據 GitHub 的語言統計)。

以上回答依據專案的 GitHub 資料(最近同步於 2026年9月20日)與我們的分析,不構成法律意見。

開源專案深度解析

圍繞三個離線引擎建置的桌面聽寫應用

README 將 Vocalinux 描述為一個免費的 GPLv3 授權的桌面應用,允許你在 X11 或 Wayland 上的任何應用中透過完全離線的語音辨識進行聽寫。它提供三種引擎選擇:whisper.cpp(預設)、OpenAI Whisper 和 VOSK。該專案聲稱透過 Vulkan 實現自動 GPU 加速,支援可自訂的鍵盤快捷鍵(切換或按住說話),並且不需要網際網路連線。倉庫中繼資料將其列為 Python 編寫,撰寫時擁有 711 個星標和 78 個分叉,主頁為 vocalinux.com。README 沒有提供這些效能聲明或使用者數量的獨立驗證。

三個引擎,一條離線路徑

README 指出 whisper.cpp 是預設引擎,被描述為高效能的 C++ 語音辨識,並透過 Vulkan 支援任何 GPU。OpenAI Whisper 基於 PyTorch,僅限 NVIDIA GPU,而 VOSK 輕量級,適用於舊系統。安裝程式會自動偵測硬體並推薦引擎,並下載模型(預設 whisper.cpp tiny 模型約 74MB)。當 onnxruntime 可用時,應用還附帶 Silero VAD 用於神經語音活動偵測,否則回退到幅度閾值 VAD。README 沒有描述這些引擎選擇之外的語音辨識管線內部架構。

安裝程式、AUR、Flatpak 和原始碼

README 提供了幾種安裝路徑。推薦的互動式安裝程式是一個 curl 指令,從倉庫執行 install.sh,自動偵測硬體並推薦引擎。可以透過 --engine=whisper 或 --engine=vosk 參數指定引擎。Arch Linux 使用者可以使用 yay -S vocalinux 從 AUR 安裝。倉庫中包含了 Flatpak 清單,可從原始碼建置,但 README 註明 Flathub 發布正在進行中。原始碼安裝需要複製倉庫並執行 install.sh,可選 --with-whisper 參數。GitHub Releases 也提供 nightly 版本,但 README 警告這些版本可能不穩定,生產環境建議使用 beta 版。README 沒有列出官方的 .deb 或 .rpm 套件;.deb 在路線圖上。

聽寫模式和命令列選項

README 描述了兩種啟動模式:切換模式(雙擊快捷鍵,預設 Ctrl)和按住說話模式(按住鍵)。它列出了語音指令,如「new line」、「period」、「comma」、「question mark」、「exclamation mark」、「delete that」和「capitalize」。命令列選項包括 --engine、--model、--wayland、--debug 和 --start-minimized 等。設定檔儲存在 ~/.config/vocalinux/config.json,範例顯示了 engine、model_size、vad_sensitivity 和 silence_timeout。README 沒有列出除了所示之外的全部 CLI 旗標,也沒有記錄每個指令的確切行為。

v0.15.0 版本的新功能

README 的「What's New」部分詳細介紹了 v0.15.0 版本。它用可搜尋的側邊欄導覽取代了七個標籤頁的設定筆記本,為 x86_64 和 aarch64 新增了自包含的 AppImage 建置,並將語音語言目錄擴充到約 33 種可選語言(加上自動偵測),包括匈牙利語。聽寫改進包括句後標點自動大寫和尾隨空格以防止文字黏連。新增了自動暫停和保活功能,可在設定的應用程式執行或閒置逾時後卸載模型,更智慧的 Vulkan GPU 選擇,以及針對無橋接合成器的 Wayland IBus 改進。README 還列出了錯誤修復並提供了完整變更日誌的連結。它沒有提供效能基準或所有發行版的相容性矩陣。

倉庫佈局和開發工作流程

README 概述了專案結構:原始碼位於 src/vocalinux 下,包含語音辨識、文字注入、GTK UI 和工具子目錄。測試在 tests/,開發腳本在 scripts/,檔案在 docs/。開發方面,README 建議複製倉庫,執行 ./install.sh --dev,然後啟動虛擬環境並執行 pytest。倉庫還列出了檔案檔案,如 INSTALL.md、UPDATE.md、USER_GUIDE.md 和 DISTRO_COMPATIBILITY.md。README 提到 GitHub 是主要平台,Codeberg 有唯讀鏡像。它沒有描述除 CONTRIBUTING.md 連結之外的貢獻流程。

GPLv3 和 Voca 家族

該專案根據 GPLv3 授權,如 README 和授權摘錄所述。GPLv3 文字解釋了它授予複製、分發和修改軟體的自由,並要求修改版本必須標記為已更改。授權明確聲明此免費軟體不提供任何擔保。README 還介紹了「Voca 生態系統」,包括 macOS 的 VocaMac(測試版)和 Windows 的 VocaWin(計劃中),描述為共享相同的隱私優先、純離線理念。README 沒有提供這些專案的程式碼庫或發布狀態的詳細資訊,僅列出所列內容。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第1項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第2項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第3項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第4項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第5項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第6項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第7項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第8項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第9項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第10項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第11項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第12項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第13項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

jatinkrmalik-vocalinux-deep-analysis 專案核對記錄第14項:以目前倉庫中已列出的功能和檔案為準,檢查輸入是否被接受、輸出是否落在預期位置、錯誤是否能由日誌辨識,以及重跑後訂單、商品、資料庫或命令結果是否維持一致。這項記錄只針對 jatinkrmalik-vocalinux-deep-analysis 的實際流程,文件沒有說明的性能、相容性和安全結果不作延伸判斷。

編輯結論

Vocalinux 是 Linux 上一個實用的離線聽寫工具;README 描述了 v0.15.0 版本,包含可搜尋的設定、AppImage 建置和更大的語言目錄,但未提供獨立的基準測試或支援保證。

官方來源

  1. Official documentation
  2. Official README
  3. Project repository
  4. Release notes
社群筆記

社群筆記