← 返回列表
D

@opensquad/dsh-voice-input

v0.3.3 · 1 天前发布

SenseVoice 语音输入插件 for DeepSeek Harness:在对话输入框旁添加麦克风按钮,录音后调用本地 SenseVoice 服务转成文本填入输入框。首次使用自动下载模型并显示进度,后端由插件自动启动。

deepseek-harnessdsh-plugincordissensevoicevoiceasrspeech-to-textvoice-input

README

@opensquad/dsh-voice-input

DeepSeek Harness 语音输入插件:在 Web 对话输入框旁添加一个麦克风按钮,录音后调用本地 SenseVoice 服务转写成文本,自动填入输入框。首次使用会引导下载模型并显示实时进度。

英文版 / English: README_EN.md

功能

  • 🎤 输入框旁麦克风按钮,一键录音转文字

  • ⬇️ 首次使用自动下载模型(约 230MB),按钮上显示圆环进度 + 实时百分比

  • ⚙ 独立管理按钮:查看/卸载已安装的语音模型

  • 自动拉起本地 SenseVoice 服务(模型就绪时)
  • 依赖

    这是一个全自动插件:Python 后端(依赖安装 + 进程启动)由插件在 dsh 启动时自动完成,首次使用模型也自动下载。 你只需要:

    | 前置 | 说明 |
    | --- | --- |
    | Python 3.10+ | 唯一需要手动装的软依赖(插件会自动 pip install 其余依赖) |
    | ffmpeg(可选/推荐) | 仅用于异常音频的兜底转码,正常使用不需要;winget install ffmpeg 或官网安装并加入 PATH |

    手动安装 Python 3.10+

    插件会自动安装剩下的 Python 依赖(flask / onnxruntime 等),你只需装好 Python 本身。

    1. 打开 python.org/downloads,下载最新的 **Py

    查看完整 README →

    版本兼容矩阵

    DSH 版本状态说明
    dsh@0.1.0-rc.6 ✅ 兼容 cordis patch ✅
    dsh@0.1.0 ✅ 兼容 标准 patch ✅
    dsh@0.2.0 ⚠️ 待验证 待实测(API 可能在变)
    dsh@0.3.0+ ❓ 未知 尚未发布

    💡 兼容矩阵每周末自动跑实测,欢迎 PR 修正

    元数据

    License
    MIT
    npm
    @opensquad/dsh-voice-input
    Repo
    git+https://github.com/opensquad-ai/dsh-voice-input.git
    Engines
    {"node":">=22.19.0"}
    Weekly DL
    0
    Monthly DL
    0
    dsh.bundle
    {"bundle":{"patch":"./cordis.patch.yml"},"client":{"platform":"web","inject":["@deepseek-ai/dsh-client-runtime"]}}