VibeC 是一个专为 Web Coding 场景设计的极速开源语音打字助手。
它底层基于强大的开源语音识别模型 SenseVoice 与 C++ 极速推理引擎 sherpa-onnx。通过接管系统原生的 Win + H 快捷键,实现超低延迟的“话音刚落,代码上屏”,为您带来丝滑的双手解放体验。
- 毫秒级推理:得益于
sherpa-onnx的底层 C++ 优化,普通的 Intel CPU 处理短语音识别几乎在瞬间完成(不到 0.1 秒)。 - 完全接管原生体验:深度屏蔽并接管 Windows 自带的
Win+H语音输入,提供更懂中文与中英代码混排的识别能力。 - 现代化透明 UI:按键时在屏幕中央弹出带有“赛博朋克渐变”与“完美抗锯齿”的半透明悬浮表盘。
- 双色域主题:支持暗色 (Dark) 和亮色 (Light) 主题,完美适配各类黑白代码编辑器背景。
- 后台免打扰:完全托盘化运行,不占用系统任务栏。
首先,确保您的电脑上安装了 Python 3.10 或更高版本。
在终端中执行以下命令,安装必备的 Python 第三方库:
pip install pyaudio keyboard numpy sherpa-onnx PyQt5 pyinstaller注: 如果您在安装
pyaudio时遇到 C++ 编译报错,可以直接下载对应的 PyAudio 预编译 whl 轮子文件 并通过 pip 安装。
由于模型文件体积较大,并未直接包含在代码中。初次使用请按照以下步骤手动下载:
- 下载模型包:点击前往 GitHub Releases 下载模型 (约 300MB)
- 解压缩:将下载好的压缩包解压。
- 放置模型:将解压后名为
sherpa-onnx-sense-voice-zh-en-ja-ko-yue-2024-07-17的整个文件夹,原封不动地移动到项目根目录,也就是必须要与demo_sensevoice.py文件放在同一个文件夹下。
打开终端,进入代码所在目录执行:
python demo_sensevoice.py(如果快捷键由于权限不足无法触发全局响应,请尝试以管理员身份运行终端或 IDE 再执行代码)
- 唤醒录音:在任何软件(记事本、VSCode、IDE 甚至游戏中)里,将光标定位在想打字的地方,单击一次键盘上的
Win + H。此时屏幕中央会瞬间弹出一个悬浮表盘,并伴有高音“滴”的提示音。 - 开始讲话:对着麦克风自由地说出您的代码逻辑或日常文本。程序最长支持单次 60 秒的录音保护。
- 结束并上屏:再次单击
Win + H。表盘立即消失,系统伴有低音“滴”声提示,稍等不到一秒钟,识别出的文字会自动键入在您的鼠标光标处。
程序启动后,会在 Windows 屏幕右下角的系统托盘区生成一个“青色小圆球”图标。
- 右键 -> 📝 使用说明:查看快捷键提示。
- 右键 -> 🎨 切换主题:在明亮模式 (深海蓝-翡翠绿渐变) 和黑暗模式 (青-紫渐变) 间一键来回切换。
- 右键 -> ❌ 完全退出:安全干净地退出后台驻留程序。
如果您希望将它做成一个双击即用的独立可执行软件,彻底告别黑色的终端控制台窗口,可使用以下命令进行一键打包:
python -m PyInstaller -F -w demo_sensevoice.py(参数释义:-F 压成单文件,-w 隐藏黑色控制台窗口)
打包后食用说明:
- 打包完成后,进入新生成的
dist文件夹,您会找到demo_sensevoice.exe。 - 【极其重要】 将刚才下载的模型文件夹(
sherpa-onnx-sense-voice...)完整复制到dist文件夹中,使其与 exe 文件处于同一级目录下。 - 以后只需要双击
demo_sensevoice.exe,它将彻底隐藏在系统后台默默工作,即开即用!