跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 21 个插件

1

dsh-plugin-tts

1624318455/dsh-plugin-tts

用免费 Edge TTS 或你自己的 RVC 音色朗读 AI 回复:消息朗读与自动朗读、长文自适应分块渐进播放(无缝衔接)、音色包仓库一键安装、便携 RVC 运行时。

79小时前视觉、语音与多模态MIT
3

dsh-voice

3274375092/dsh-voice

语音输入插件:对着麦克风说话,识别后的文字作为普通聊天消息发送(本地模型或浏览器语音识别)。

43天前视觉、语音与多模态MIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

基于 MiniMax 的多模态插件:实时语音通话模式(流式对话、悬浮胶囊 UI)、语音模式与麦克风语音输入,并提供图像/视频/音乐/语音生成与视觉检查工具。

4昨天视觉、语音与多模态MIT
Z

adhdgofly-dsh-ext

zuoguyoupan2023/adhdgofly-dsh-ext

在 DSH Web 已渲染的 Markdown 中做词性高亮:名词绿、动词红、形容/副词紫,支持深/浅色板、词性开关与流式防抖。

414小时前UI 增强MIT
Q

dsh-mic-input

qt-chen/dsh-mic-input

输入框麦克风语音输入:浏览器 Web Speech API 实时转写,自动去重/续听、智能标点,支持语言与自动发送设置。

3前天视觉、语音与多模态MIT
T

dsh-deepseek-pet

txlznbzsdj-collab/dsh-deepseek-pet

浮动在 DSH Web 页面上的 DeepSeek 蓝色小鲸鱼桌宠:可拖拽,说话气泡与心情姿势随互动切换,模型可调用 pet_say 工具让它开口,对话开始/结束时自动进入思考与庆祝状态。

215小时前娱乐MIT
S

dsh-voice

stardustlc666/dsh-voice

语音双件套:edge-tts 免费微软神经语音合成 + OpenAI 兼容 ASR 转写。

26小时前视觉、语音与多模态MIT
N

voco-input-sh

nothree-code/voco-input-sh

Web UI 语音输入:输入框麦克风按钮驱动本地 VocoType 离线识别,识别结果自动插入输入框(自动部署/防重复/持续输入)。

220小时前视觉、语音与多模态MIT
0

dsh-voice-input

0nt-one/dsh-voice-input

输入框麦克风语音输入:浏览器 Web Speech API 实时转写(Chrome/Edge),多语言切换与可选自动发送,零依赖零密钥。

23天前视觉、语音与多模态MIT
P

dsh-voice-call

pandapolo/dsh-voice-call

agent 主动打来的语音电话:`offer_call` 向人类振铃(接听/拒接/稍后再说),接听后由本地 CrispASR + Qwen3-TTS 合成并播放(9 个音色,含 2 个中文方言);拒接则把决定返回给 agent。

1昨天视觉、语音与多模态MIT
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

Web UI 免费语音闭环:浏览器语音识别输入(实时中间结果上屏)+ 助手回复朗读与自动朗读,零配置、免 API key。

13天前视觉、语音与多模态MIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Web UI 语音输入:输入框旁麦克风按钮语音转文字填入输入框;支持浏览器 Web Speech API 本地识别(零配置、无需密钥)与 OpenAI 兼容 Whisper API(OpenAI/Groq),模型与语言可在设置中选择。

1昨天视觉、语音与多模态MIT
Z

dsh-voice

zhuiyueya/dsh-voice

Voice for DeepSeek Harness(dsh) — speech-to-text input + read-aloud TTS for text-only DeepSeek, zero API key.

14天前视觉、语音与多模态MIT
A

dsh-voice-webspeech

anweat/dsh-voice-webspeech

浏览器 Web Speech API 语音输入:零服务端、零密钥、零模型下载(Edge=Azure 语音、Chrome=Google 语音)。

15天前视觉、语音与多模态MIT
J

dsh-voice

jesse-njx/dsh-voice

语音输入、语音输出:把口述音频转写为用户消息(transcribe),让 agent 朗读回复(speak),本地优先,音频存于 ~/.dsh/voice。

15天前视觉、语音与多模态MIT
V

dsh-doubao-voice

vorpal-poem/dsh-doubao-voice

DeepSeek Harness 语音输入插件:火山引擎流式 ASR(豆包 Seed ASR),流式回填输入框。Voice input for DSH via Volcengine streaming ASR.

0前天工具与能力MIT
M

dsh-voice

motongv/dsh-voice

给 DeepSeek Harness(DSH / DeepSeek Hermes)加语音能力的社区插件:输入框语音输入(可配快捷键)+ 回答朗读(微软 Edge 神经网络音色,可换音色、可试听),无需 API Key。

03天前工具与能力MIT
P

dsh-talk

perrylink/dsh-talk

Voice-first session loop for DeepSeek Harness: a composer microphone button with browser/local speech-to-text (Web Speech, FunASR, whisper.cpp), a speak tool for text-to-speech replies (browser, edge-tts, piper), event announcements with mute, and speak-t

019小时前会话与消息Apache-2.0
N

dsh-voice-input

newdanew/dsh-voice-input

Web UI 语音输入:输入框一键麦克风按钮,基于 Web Speech API 语音转文字填入草稿,可选识别后自动发送。

03天前视觉、语音与多模态MIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

朗读助手回复(仅支持 Fish Audio API,需自备 Key):逐条朗读、自动朗读开关,设置页可配模型、音色 reference_id、加密 API Key 与代理。

0昨天视觉、语音与多模态MIT
H

dsh-voice

haoku123/dsh-voice

Web UI 全双工语音对话:输入框麦克风(RMS 端点检测)配合浏览器本地 whisper 转写,回复按句流式朗读,开口说话即打断播放与正在运行的回合(真 barge-in),无需 API key。

0前天视觉、语音与多模态MIT