跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 76 个插件

W

dsh-opencode-go-usage

wawo77/dsh-opencode-go-usage

DSH 网页界面的桌宠用量小窗:悬浮的骨骼动画角色用气泡报出套餐用量,按 DSH 里配置的 provider 自动匹配(OpenCode Go / Command Code / DeepSeek 官方),套餐制显示百分比、按量计费显示余额,取不到官方数字时降级为本地 token 统计;可拖动、滚轮缩放(90–260px),音效现场合成,HTTP 路由只开 loopback。

317天前用量与计费MIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

输入框上的单手、免键盘输入:鼠标在输入框按住、说话、松手,文字直接进草稿;上滑取消,不留半句。不用去瞄麦克风按钮,也不用记快捷键,手始终不用离开输入区——另一只手正忙的时候,这一点才是关键。识别完全在本机完成(SenseVoice + sherpa-onnx),无需 API key,音频不出本机。

3昨天视觉、语音与多模态MIT
N

dsh-plugin-speech

nakamuraia/dsh-plugin-speech

在 DeepSeek Harness 中朗读助手回复:支持多种 TTS 服务并边生成边流式播放。

318天前视觉、语音与多模态MIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

dsh web 语音助手:说出唤醒词(如「小鲸」)即可免手听写,说话内容自动转成文字填入输入框;支持口述编辑指令(发送、清空、换行、停止朗读),并可用中文朗读 AI 回复。语音识别基于 sherpa-onnx WASM 在浏览器本地运行,离线可用、无需 API Key。

3上个月视觉、语音与多模态MIT
D

dsh-whale-pet

dleaf6211-hash/dsh-whale-pet

DeepSeek Harness 的鲸鱼娘桌宠:浏览器悬浮桌宠与 Windows 桌面桌宠共享一套数据,实时余额木牌、任务通知、摸头互动、19 句预合成带情感的台词朗读,空闲节奏随是否在场自适应。

317天前娱乐MIT
L

dsh-voco

lgquan/dsh-voco

为 DSH 提供持续语音对话,支持免提监听、按住说话、语音识别、TTS 语音回复和后台 Agent 任务委派。

3上个月视觉、语音与多模态MIT
T

dsh-gsv

taoruiliu19/dsh-gsv

将本地高性能 TTS 引擎 GSV-TTS-Lite 实时接入 DeepSeek Harness:语音预设、自动朗读、引擎配置助手、朗读按钮与设置面板。

3上个月视觉、语音与多模态MIT
L

Deepseek-Continuity

linxuhao/deepseek-continuity

本地生成图像/配音/音乐/音效并听写,同一性锁定:角色、动物、道具与配音角色定妆定声一次,之后每次调用复用同一份参考;退化产物(接近纯色的图、静音的音频)被拒绝而不是当成成功返回;生成的台词可以听写回文字,好让吞掉结尾的克隆暴露出来。空闲时引擎卸载显存,生图与听写也可改指向任意 OpenAI 形状的 API 而不用本地 Vulkan 后端。

312天前视觉、语音与多模态MIT
N

voco-input-sh

nothree-code/voco-input-sh

Web UI 语音输入:输入框麦克风按钮驱动本地 VocoType 离线识别,识别结果自动插入输入框(自动部署/防重复/持续输入)。

320天前视觉、语音与多模态MIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Web UI 语音输入:输入框旁麦克风按钮语音转文字填入输入框;支持浏览器 Web Speech API 本地识别(零配置、无需密钥)与 OpenAI 兼容 Whisper API(OpenAI/Groq),模型与语言可在设置中选择。

3上个月视觉、语音与多模态MIT
J

dsh-voice

jesse-njx/dsh-voice

语音输入、语音输出:把口述音频转写为用户消息(transcribe),让 agent 朗读回复(speak),本地优先,音频存于 ~/.dsh/voice。

32个月前视觉、语音与多模态MIT
Q

dsh-mic-input

qt-chen/dsh-mic-input

输入框麦克风语音输入:浏览器 Web Speech API 实时转写,自动去重/续听、智能标点,支持语言与自动发送设置。

32个月前视觉、语音与多模态MIT
B

dsh-voice-call

biliye/dsh-voice-call

DSH Web GUI 的个人语音通话助手:可拖拽悬浮球通话面板、浏览器端 VAD(停顿自动发送)、FunASR HTTP 或流式语音识别、MiniMax / OpenAI 兼容 TTS 语音回复、可开关的唤醒词模式(沉默自动休眠),以及把任务分发给独立子代理会话并跟踪进度、停止与完成播报。

25天前视觉、语音与多模态MIT
M

dsh-voice-chat

maoyuching/dsh-voice-chat

豆包式语音对话插件:聊天框麦克风按钮(按住说话)语音转文字并自动发送,AI 回复自动朗读。可选 LLM 转述精简(长回复压缩成口语再播,跟随当前对话模型)、朗读前清洗 markdown/emoji/特殊符号、Edge TTS 多种音色、静音自动结束时长可调,设置嵌入 DSH 自带设置弹窗(voice chat 类目)。

28天前视觉、语音与多模态MIT
G

dsh-tts

goodandready/dsh-tts

在 DeepSeek Harness 网页 UI 中朗读智能体回复,采用服务商回退链(OpenAI、ElevenLabs、Google、Azure、Groq、Deepgram、OpenRouter、Edge、Piper、eSpeak),某个服务商失败或被限流时自动切换到下一个,而不是直接静音。

26天前视觉、语音与多模态MIT
T

dsh-deepseek-pet

txlznbzsdj-collab/dsh-deepseek-pet

浮动在 DSH Web 页面上的 DeepSeek 蓝色小鲸鱼桌宠:可拖拽,说话气泡与心情姿势随互动切换,模型可调用 pet_say 工具让它开口,对话开始/结束时自动进入思考与庆祝状态。

22个月前娱乐MIT
P

dsh-voice-call

pandapolo/dsh-voice-call

agent 主动打来的语音电话:`offer_call` 向人类振铃(接听/拒接/稍后再说),接听后由本地 CrispASR + Qwen3-TTS 合成并播放(9 个音色,含 2 个中文方言);拒接则把决定返回给 agent。

23天前视觉、语音与多模态MIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

朗读助手回复(仅支持 Fish Audio API,需自备 Key):逐条朗读、自动朗读开关,设置页可配模型、音色 reference_id、加密 API Key 与代理。

2前天视觉、语音与多模态MIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

每条回复旁的朗读按钮与输入框自动朗读开关,设置页可选服务商与音色:MiniMax 或任意 OpenAI 兼容的 /audio/speech 端点,可调音色、情绪、语速与模型。

122天前视觉、语音与多模态
V

dsh-live-voice

victorwads/dsh-live-voice

本地优先的 DSH 语音对话:本地语音识别与合成、可选外部供应商,支持连续对话与自动朗读

118天前视觉、语音与多模态GPL-3.0
N

dsh-dictate

navneetset/dsh-dictate

通过 OpenRouter 的 STT 接口把实时语音转写进 dsh Web 输入框,边说边插入文字,可与键盘输入混用

127天前视觉、语音与多模态MIT
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

119天前视觉、语音与多模态MIT
D

dsh-voice-talk

duoduoqian708/dsh-voice-talk

DSH Web 的语音对话模式:点一下麦克风进入全屏通话,边说边听,AI 回复边生成边朗读。界面中英双语,适配明暗主题,支持语速调节与音色切换。

120天前视觉、语音与多模态MIT
J

dsh-live-voice

jstn-1g/dsh-live-voice

DSH Web 的会话绑定单轮语音预览:提供无需凭证的本地合成演示和可选的 Qwen Audio,保持精确会话隔离,并仅在明确操作后将转写写入草稿,不会自动提交。

127天前视觉、语音与多模态MIT