编者按

0nt-one/dsh-voice-input

Voice input plugin — a mic button in the composer tool row that turns speech into text live via the browser's Web Speech API (Chrome/Edge), with language switching and optional auto-send. Zero dependencies.

这是一个 DeepSeek Harness(DSH)插件。本站汇总其 GitHub README、安装信息、维护状态与公开安全信号。

dsh-voice-input-web

npm version license GitHub stars

语音输入客户端插件(client plugin)——给 DeepSeek Harness Web GUI 的聊天输入框工具行加一个麦克风按钮:点击开始说话,浏览器 Web Speech API(Chrome / Edge 内置,免费、无需 API 密钥)把语音实时转成文字填入输入框

dsh-voice-input-web 运行效果预览

功能

  • 麦克风按钮位于输入框工具行右侧(发送按钮左侧,conversation.input.right 插槽)
  • 点击开始/停止聆听;聆听时按钮红色脉冲,上方浮层实时显示转写中间结果
  • 每段识别完成的最终文本自动追加到输入框草稿,可继续编辑后发送
  • 浮层内可一键切换识别语言:中文 / English / 自动
  • 可选自动发送:localStorage 设置 dsh-voice-input-web.autoSend = "1" 后,一段语音识别完成即自动发送
  • 零依赖、零密钥、无服务端改动;识别完全在浏览器本地进行

与其他方案对比

方案转写方式依赖成本
本插件(Web Speech API)浏览器系统语音服务免费
dsh-voiceagent 工具(OpenAI 兼容 ASR)需 ASR API keySTT 收费
dsh-voice-input(SenseVoice)本地离线转写需模型/服务免费、离线

安装

方式一:npm 包(推荐)

dsh plugin --profile web add dsh-voice-input-web

方式二:离线安装(GitHub 源码)

  1. 将本包放入 web profile 的 node_modules:

    ~/.dsh/profiles/web/node_modules/dsh-voice-input-web/
    
  2. ~/.dsh/profiles/web/cordis.patch.yml 追加:

    - insert:
        - id: dsh-voice-input-web
          name: 'dsh-voice-input-web'
    
  3. 重启 dsh --profile web,浏览器刷新页面。按钮出现在输入框工具行。

安装后插件 id / 包目录名 / localStorage key 统一使用 dsh-voice-input-webdsh-voice-input 在 npm 上已被同名 SenseVoice 方案占用)。

配置(localStorage)

key默认说明
dsh-voice-input-web.langzh-CN / en-US / autozh-CN识别语言
dsh-voice-input-web.autoSend"1" / "0""0"识别完成后自动发送

兼容性

  • 需要 Chrome / Edge(或任何支持 webkitSpeechRecognition 的浏览器);Firefox 不支持 Web Speech API,会显示提示
  • 页面需在 localhost / 127.0.0.1 或 HTTPS 下访问(浏览器安全限制)
  • 语音识别需要联网(由浏览器调用系统语音服务)

License

MIT

REPOSITORY SIGNALS

安全与安装证据

该分数只基于公开仓库元数据与本站登记的安装证据,不等同于代码安全审计。

来源可追溯

来自公开插件目录,并链接到公开 GitHub 仓库。

许可证

仓库声明 MIT 许可证。

维护活跃度

最近 180 天内有代码更新。

安装证据

尚未登记可复验的精确安装元数据,请按仓库说明手动检查。

安装生命周期脚本

已检查的包元数据未声明安装生命周期脚本。