跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 56 个插件

N

insta360-ai-content-studio

nicecx/insta360-ai-content-studio

Insta360 GO 3S 自动每日内容管线:BLE/WiFi 遥控拍摄鱼缸素材、无线取回、ffmpeg 质量评估与决策记录、自动剪辑(选段/旁白/配乐/字幕)、biliup 投稿(默认 dry-run)。

228天前工具与能力MIT
M

dsh-voice-chat

maoyuching/dsh-voice-chat

豆包式语音对话插件:聊天框麦克风按钮(按住说话)语音转文字并自动发送,AI 回复自动朗读。可选 LLM 转述精简(长回复压缩成口语再播,跟随当前对话模型)、朗读前清洗 markdown/emoji/特殊符号、Edge TTS 多种音色、静音自动结束时长可调,设置嵌入 DSH 自带设置弹窗(voice chat 类目)。

25天前视觉、语音与多模态MIT
G

dsh-tts

goodandready/dsh-tts

在 DeepSeek Harness 网页 UI 中朗读智能体回复,采用服务商回退链(OpenAI、ElevenLabs、Google、Azure、Groq、Deepgram、OpenRouter、Edge、Piper、eSpeak),某个服务商失败或被限流时自动切换到下一个,而不是直接静音。

23天前视觉、语音与多模态MIT
X

dsh-showreel

xiaoyuer3921/dsh-showreel

把最近一次已完成的 DSH 任务生成为可分享的竖屏战报视频:五幕可编辑故事板、Host 侧脱敏、可选 AI 润色与配音,导出 MP4/WebM 和 PNG 封面。

2上个月UI 增强MIT
P

muxiva-dsh-voice

piyotahu/muxiva-dsh-voice

由 Muxiva 编排的 DeepSeek Harness 本地优先全双工语音:麦克风、VAD、ASR、句子调度、TTS、播放与打断链路全部在 Mac 本机运行

2上个月视觉、语音与多模态Apache-2.0
P

dsh-voice-call

pandapolo/dsh-voice-call

agent 主动打来的语音电话:`offer_call` 向人类振铃(接听/拒接/稍后再说),接听后由本地 CrispASR + Qwen3-TTS 合成并播放(9 个音色,含 2 个中文方言);拒接则把决定返回给 agent。

2前天视觉、语音与多模态MIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

朗读助手回复(仅支持 Fish Audio API,需自备 Key):逐条朗读、自动朗读开关,设置页可配模型、音色 reference_id、加密 API Key 与代理。

224天前视觉、语音与多模态MIT
J

dsh-live2d-voice

john-walks-slow/dsh-live2d-voice

Live2D 实时语音会话视图:连续语音输入、流式 TTS、字幕翻译、多模型目录与独立入口

1昨天视觉、语音与多模态MIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

每条回复旁的朗读按钮与输入框自动朗读开关,设置页可选服务商与音色:MiniMax 或任意 OpenAI 兼容的 /audio/speech 端点,可调音色、情绪、语速与模型。

119天前视觉、语音与多模态
V

dsh-live-voice

victorwads/dsh-live-voice

本地优先的 DSH 语音对话:本地语音识别与合成、可选外部供应商,支持连续对话与自动朗读

115天前视觉、语音与多模态GPL-3.0
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

116天前视觉、语音与多模态MIT
G

dsh-messenger-gateway

goodandready/dsh-messenger-gateway

DeepSeek Harness 的 Telegram 桥接:双向会话、对话引导、主频道路由,以及以 Telegram 语音消息发送的 TTS 语音笔记。

14天前集成与远程MIT
A

dsh-audio-copilot

ai-yucheng/dsh-audio-copilot

为 DSH 提供 ASR 音频转写和 TTS 语音合成,让纯文本 Agent 能听能说;支持 Windows SAPI 与 OpenAI 兼容端点。

1上个月视觉、语音与多模态MIT
Z

dsh-voice

zhuiyueya/dsh-voice

Voice for DeepSeek Harness(dsh) — speech-to-text input + read-aloud TTS for text-only DeepSeek, zero API key.

12个月前视觉、语音与多模态MIT
J

sh-volume-knob

jianghu-lao-yao/sh-volume-knob

输入框话筒旁的扬声器按钮——单击翻到「你最新提问的开头」并闪烁光标,从那里读到最新回复结尾(走 dsh-tts,回退浏览器语音);按住右滑可在页面上挑选任意朗读起点,按住上滑调出竖式混音台,分别控制页内媒体音量与系统输出音量。

05天前视觉、语音与多模态MIT
L

dsh-status-chime

lijiawei255/dsh-status-chime

DSH 状态变化时读出一句简短提示——本轮完成、本轮出错、后台任务结束、后台任务失败、目标完成、目标受阻、等待批准、等待你回答——中文(默认)与英文各八条预录语音。音频由宿主进程播放(ffplay,或系统自带的 Windows PowerShell 播放器),不依赖浏览器 Web Audio。仅支持 Windows。

05天前集成与远程
F

dsh-say

fangqian616/dsh-say

让你的 DSH 用你喜欢的声音开口说话、汇报内容,过长的汇报先压缩再念。角色声线不需要自己训练:一段 3-10 秒参考音就能克隆,也能直接用别人训练好的模型;不必为此装一整套 6.4 GB 的 GPT-SoVITS —— 运行时和声线都由插件自己装好。已有 GPT-SoVITS 的话也能直接接上,两者跑的是同一套声线。

09天前视觉、语音与多模态
C

dsh-read-aloud

cccc12138/dsh-read-aloud

在每条已定稿的助手回复里、紧挨点赞按钮右侧加一个小喇叭:点击用浏览器语音引擎朗读这条回复,鼠标悬停可调倍速与音色。

012天前视觉、语音与多模态MIT
C

dsh-voice-mimo

ch1bug/dsh-voice-mimo

Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).

016天前视觉、语音与多模态MIT
2

dsh-tts-flash

2021heei/dsh-tts-flash

AI 回复流式 TTS 朗读插件,思考等待期有文字与语音同步的趣味短语反馈。内置 Edge TTS,支持任意 OpenAI 兼容云端引擎。

020天前视觉、语音与多模态MIT
C

dsh-live2d-avatar

clown139880/dsh-live2d-avatar

DSH 的 Live2D 形象舞台与桌宠:内置 Haru 示例、自定义 Cubism 2/3+ 模型加载与缩放/位置控制、页面内可拖动桌宠、可选透明置顶桌面独立桌宠窗口、按对话授权的表情 control prompt,以及默认关闭、需自部署 ASR/TTS 的语音功能。

0前天UI 增强MIT
A

dsh-reelsmaker

aayan-cloud/dsh-reelsmaker

DeepSeek Harness plugin: turn lines of narration into a finished vertical reel. Free neural voice-over, burned-in captions, no API keys.

025天前视觉、语音与多模态
D

dsh-xiaoshuang (plugin)

daixin315/dsh-xiaoshuang

小双桌面宠物人格:六层记忆、人设注入、跟随 agent 状态的视频形象、手动表情菜单与 TTS 语音回复。

025天前娱乐
K

dsh-kitt-voice

kittcat-lab/dsh-kitt-voice

Voice for the DeepSeek Harness: speak to the agent, hear it back, and see what it is doing from a floating window that stays on top of whatever you are running.

025天前视觉、语音与多模态MIT