我不想再点来点去了,于是做了个 Windows 语音助手
我一直觉得,电脑上的 AI 最有用的地方,不是陪你聊天,而是能真的帮你做事。
比如你正在写东西,突然想打开微信、查一下天气、打开浏览器搜资料,最好不用停下手里的活,也不用在一堆窗口里找图标。
所以我把一个原本主要适配 Mac 的开源语音助手项目,改造成了 Windows 版本,取名叫知言,类似苹果Siri助手,但是它更智能。
项目地址:
https://github.com/dqtx760/zhiyan-Voice-Agent/
它能做什么?
- 说“打开微信”“打开 Chrome”,直接启动应用;
- 说“北京明天天气怎么样”,查询后语音回答;
- 说“帮我创建一个文件夹”,执行基础文件操作;
- 说“调低一点音量”,直接控制系统;
- 也可以把它当作一个可以语音提问的 AI 助手。
两种使用方式
第一种是快捷键。
按住你设置的快捷键开始说话,松开后自动提交。它在回答时,你再按住快捷键,就能直接打断并问下一个问题。
第二种是语音唤醒。
说出唤醒词后,知言开始聆听。它回答完以后会继续等待下一句;如果它正在说话,你再说一次唤醒词,也可以把它打断,继续说新的需求。
它不是完全离线,但关键环节在本地
唤醒词监听使用本地 Whisper,平时不会持续把环境声音上传到云端。
真正识别完整指令时,会调用你自己配置的语音识别服务;复杂问题则交给你配置的大模型处理。API Key 和 Token 保存在本机,不会放进项目仓库或安装包里。
这也是我更愿意自己折腾这类工具的原因:能力可以接入云端,但配置和控制权还在自己手里。
以上,既然看到这里了,如果对你有所帮助,还望不吝点赞与关注,这也是对我最大的鼓励与支持。
如果你也想要一个能打开应用、查信息、做简单电脑操作的语音助手,可以下载试试,欢迎一起提建议、完善它。
感谢你拨冗阅读,山高水长,我们期待下篇文章与你再见。
