跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 6 个插件

Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

DeepSeek Harness Web UI 全双工语音对话:按钮或 Ctrl+Shift+V 进入,持续聆听(停顿自动发送)或按住说话,zipformer2 流式识别入可编辑草稿、可选唤醒词;回复按句 Edge TTS 朗读并显示实时字幕,开口即打断播放与回合(真 barge-in);识别模型本地推理、Edge TTS 在线合成,无需 API Key。

1510小时前视觉、语音与多模态MIT
C

dsh-bilibili

czx2244/dsh-bilibili

B站视频分析工具:提取元数据、字幕文稿(必剪/本地 ASR 兜底)、评论与弹幕,抓取清晰关键帧并可选本地视觉描述。

92个月前工具与能力MIT
H

dsh-voice

haoku123/dsh-voice

Web UI 全双工语音对话:点按切换或按住说话(发送键或 `Ctrl`)并显示实时字幕,宿主端 SenseVoice(sherpa-onnx)转写,回复按句流式朗读,开口说话即打断播放与正在运行的回合(真 barge-in),无需 API key。

4上个月视觉、语音与多模态MIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

输入框上的单手、免键盘输入:鼠标在输入框按住、说话、松手,文字直接进草稿;上滑取消,不留半句。不用去瞄麦克风按钮,也不用记快捷键,手始终不用离开输入区——另一只手正忙的时候,这一点才是关键。识别完全在本机完成(SenseVoice + sherpa-onnx),无需 API key,音频不出本机。

323小时前视觉、语音与多模态MIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

dsh web 语音助手:说出唤醒词(如「小鲸」)即可免手听写,说话内容自动转成文字填入输入框;支持口述编辑指令(发送、清空、换行、停止朗读),并可用中文朗读 AI 回复。语音识别基于 sherpa-onnx WASM 在浏览器本地运行,离线可用、无需 API Key。

3上个月视觉、语音与多模态MIT
Q

dsh-voice-mode

qishuilalala/dsh-voice-mode

DeepSeek Harness 全双工语音模式:流式识别写入草稿、按句朗读并配实时字幕、开口即打断;识别在本地推理,无需 API Key。

0上个月视觉、语音与多模态MIT