跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 56 个插件

P

dsh-omi-voice

polinnizhong/dsh-omi-voice

DeepSeek Harness 对话内朗读:点一下即可朗读、暂停、继续 AI 回复,豆包 TTS 自然音色(BYOK),只读最终回答并过滤代码、表格与图形,本地引擎,插件零 Key。

74上个月视觉、语音与多模态MIT
1

dsh-plugin-tts

1624318455/dsh-plugin-tts

用免费 Edge TTS 或你自己的 RVC 音色朗读 AI 回复:消息朗读与自动朗读、长文自适应分块渐进播放(无缝衔接)、音色包仓库一键安装、便携 RVC 运行时。

213天前视觉、语音与多模态MIT
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

DeepSeek Harness Web UI 全双工语音对话:按钮或 Ctrl+Shift+V 进入,持续聆听(停顿自动发送)或按住说话,zipformer2 流式识别入可编辑草稿、可选唤醒词;回复按句 Edge TTS 朗读并显示实时字幕,开口即打断播放与回合(真 barge-in);识别模型本地推理、Edge TTS 在线合成,无需 API Key。

156天前视觉、语音与多模态MIT
P

dsh-talk

perrylink/dsh-talk

DeepSeek Harness 的语音输入输出:麦克风语音转文字与文字转语音。

155天前视觉、语音与多模态Apache-2.0
H

dsh-novel-forge

huangziyuan-general/dsh-novel-forge

小说写作护栏插件:20 个 novel_* 工具以代码强制事实账本一致性、阶段与落盘门禁、确定性机审与提案制修订;右侧栏工作台提供阅读/听书/润色/校对/全书体检/批量起草,旁路引擎让内部工序不占主对话。

134天前工作流与自动化MIT
B

dsh-voice-ai-girlfriend-plugin

beiyege-01/dsh-voice-ai-girlfriend-plugin

Web UI 语音 AI 女友:FunASR 麦克风语音输入、Qwen3-TTS 语音回复、数字人动画窗、QQ 双向聊天(文本/语音/图片推送,经 NapCat)。

1217天前视觉、语音与多模态
P

dsh-plugin-xiaomi-mimo-tts

ppy-web/dsh-plugin-xiaomi-mimo-tts

为 DSH Web 添加 Xiaomi MiMo 语音朗读,支持助手消息朗读、PCM 流式播放、预置与自定义音色、浏览器语音兜底、播放控制和可选 UI 音效。

1120小时前视觉、语音与多模态MIT
W

dsh-mmx-bridge

welsione/dsh-mmx-bridge

MiniMax 多模态桥接:一个 `mmx_bridge` 工具覆盖图片理解/生成、视频、语音合成、音乐、翻唱、联网搜索与用量查询;可选接管 `web_search`/`read_image`;对话流直接内嵌播放器与图片预览(npm: `dsh-mmx-bridge`)。

1012天前工具与能力MIT
Z

dsh-voice-input-plugin

zhangbo-cn/dsh-voice-input-plugin

输入框麦克风:点击持续监控、按住对话;浏览器语音识别逐字上屏,回复由 host Edge TTS 边生成边朗读,朗读时暂停识别防回声,点击可停止。

6上个月视觉、语音与多模态MIT
1

dsh-perlica-ding

117bs/dsh-perlica-ding

明日方舟终末地佩丽卡主题分级提示音:计划出方案 / 任务完成 / 需要你回应 / 出错四档独立音效,普通问答保持安静;系统级播放(窗口在后台也响),跨平台(Windows/macOS/Linux),支持自定义 TTS 语音。

619天前集成与远程MIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

基于 MiniMax 的多模态插件:实时语音通话模式(流式对话、悬浮胶囊 UI)、语音模式与麦克风语音输入,并提供图像/视频/音乐/语音生成与视觉检查工具。

5上个月视觉、语音与多模态MIT
Y

dsh-tts-bridge

yuuyuko-uu/dsh-tts-bridge

用 DeepSeek 网页端自带的朗读,把 DSH 里的对话念出来,靠一个小浏览器扩展驱动。

413小时前视觉、语音与多模态
S

dsh-voice

stardustlc666/dsh-voice

语音五工具:edge-tts 免费微软神经语音合成、OpenAI 兼容 ASR 转写、音色清单、批量音色试听与健康自检。

4前天视觉、语音与多模态MIT
H

dsh-voice

haoku123/dsh-voice

Web UI 全双工语音对话:点按切换或按住说话(发送键或 `Ctrl`)并显示实时字幕,宿主端 SenseVoice(sherpa-onnx)转写,回复按句流式朗读,开口说话即打断播放与正在运行的回合(真 barge-in),无需 API key。

4上个月视觉、语音与多模态MIT
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

Web UI 免费语音闭环:浏览器语音识别输入(实时中间结果上屏)+ 助手回复朗读与自动朗读,零配置、免 API key。

4上个月视觉、语音与多模态MIT
L

dsh-plugin-notify-sound

ldchaowin/dsh-plugin-notify-sound

按工作区定制的任务完成铃声,以及审批、提问、计划评审、目标受阻、任务失败等需要人介入事件的注意提示音,支持内置合成音、语音播报与自定义音频。

42个月前集成与远程MIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

面向 DSH 的全模态工作站:analyze_image 走有序多卡片 VLM 故障转移链;六个视觉工具箱工具(局部放大、色调采样、像素比对、OCR、元素检测、内联展示)共用同一套图片来源解析;generate_image 支持 OpenAI/DashScope/ComfyUI 协议;多卡片异步 generate_video 配 /build-video-tool 构建器;speak/clone_voice 语音合成覆盖七家供应商;全部由一个自动保存的设置页驱动。

311天前视觉、语音与多模态MIT
N

dsh-plugin-speech

nakamuraia/dsh-plugin-speech

在 DeepSeek Harness 中朗读助手回复:支持多种 TTS 服务并边生成边流式播放。

316天前视觉、语音与多模态MIT
S

dsh-audiogen

shimingming520/dsh-audiogen

面向 DeepSeek Harness Web 的 AI 音频插件 —— 多厂商 TTS、音乐、音效与音色设计,含侧边栏面板、模型对比、资源库与 Agent 工具。

321天前视觉、语音与多模态Apache-2.0
L

dsh-voco

lgquan/dsh-voco

为 DSH 提供持续语音对话,支持免提监听、按住说话、语音识别、TTS 语音回复和后台 Agent 任务委派。

329天前视觉、语音与多模态MIT
T

dsh-gsv

taoruiliu19/dsh-gsv

将本地高性能 TTS 引擎 GSV-TTS-Lite 实时接入 DeepSeek Harness:语音预设、自动朗读、引擎配置助手、朗读按钮与设置面板。

329天前视觉、语音与多模态MIT
H

dsh-plugin-notify

huguangyu666/dsh-plugin-notify

通知出口:agent 主动通过桌面通知 / 中文语音 / 音效(炸裂、胜利、警报)联系你,60 秒确认窗口后语音呼叫,音量增强,设置面板。

315天前集成与远程MIT
J

dsh-voice

jesse-njx/dsh-voice

语音输入、语音输出:把口述音频转写为用户消息(transcribe),让 agent 朗读回复(speak),本地优先,音频存于 ~/.dsh/voice。

32个月前视觉、语音与多模态MIT
B

dsh-voice-call

biliye/dsh-voice-call

DSH Web GUI 的个人语音通话助手:可拖拽悬浮球通话面板、浏览器端 VAD(停顿自动发送)、FunASR HTTP 或流式语音识别、MiniMax / OpenAI 兼容 TTS 语音回复、可开关的唤醒词模式(沉默自动休眠),以及把任务分发给独立子代理会话并跟踪进度、停止与完成播报。

2前天视觉、语音与多模态MIT