跳到正文
中文
FikirPilot 内容

Linux Fu:让您的声音被听见!

更新于: 2026年9月15日 · 3 分钟阅读

发布于: · 消息抵达: · 处理时长: 2 分钟

Linux Fu:让您的声音被听见!
桌面上的麦克风和笔记本电脑

尽管语音识别系统相比过去已有所进步,但手机上的解决方案大多仍会将语音数据发送至所选大型公司的服务。通过将数据保留在本地,可以在电脑上进行语音输入。尽管 Windows 提供了高级语音功能,但根据一段视频中的估计,99%的用户并未使用该功能。Linux 则拥有大量开源选项和表现出色的模型;不过,由于系统种类繁多,安装和使用可能会变得困难。

Linux 解决方案需要处理 ARM 支持、与桌面环境集成,以及利用 GPU 和处理器指令等问题。将识别出的文本传输到不同应用程序中也可能带来问题:这一操作在 X11 中很容易实现,而 Wayland 则需要采用不同的方法。

虽然 KDE Connect 可以将手机用作 Linux 电脑的键盘和鼠标,但它侧重于逐字符输入,并未提供适合语音操作的方式。此外,手机还会将数据传输到云端。Speech Note 的工作方式更像是一个带语音识别功能的记事本,并且在测试所用的系统上表现不佳。Vocalinux 则提示使用 AMD CPU 的电脑缺少 Intel 扩展,因此未能运行。

Handy 成为可以在同一台电脑上轻松运行的选择。该应用程序可使用多个模型,减少了下载和配置模型、建立系统连接或安装大量库的需求。在某些系统上,可能需要 xdotool 或 dotool。用户可以更改与模型、语言、快捷键和文本输入方式相关的设置。模型在本地运行,并可利用硬件。另一个可选的独立快捷键则可以在将语音转换为文本后,把文本发送至所选 AI 引擎进行编辑;该引擎也可以在本地运行。

为何重要

对于不希望将语音数据发送至大型公司服务的 Linux 用户而言,本地语音识别提供了云端手机解决方案之外的另一种选择。不过,ARM 支持、硬件利用、桌面集成,以及 X11 与 Wayland 之间的输入差异表明,使用体验并不仅取决于模型质量。Handy 减少了安装和配置负担,使不想处理技术细节的用户更容易使用这些工具;但在某些系统上,仍无法完全避免对额外工具的需求。将文本发送至所选 AI 引擎的选项扩展了工作流程,但数据是否会保留在本地取决于所使用的引擎。由于这项比较基于在一台特定电脑上的体验,因此尚不明确在采用不同处理器和桌面配置的环境中能否获得相同结果。

背景

Linux 在 FikirPilot 的档案中并不是一个新名字:过去 90 天内,我们发布了 4 篇提及该名称的新闻,其中最新一篇发布于 2026年9月6日。

来源: Hackaday