跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 86 个插件

G

dsh-vision-bridge

goodandready/dsh-vision-bridge

将图片交给所选的视觉模型处理(自动改写、显式工具或混合模式),使纯文本聊天模型也能处理包含图片的对话。

1昨天视觉、语音与多模态MIT
A

dsh-image-plugins

alanzhao0128/dsh-image-plugins

DeepSeek Harness 多模态插件:通过可配置的 OpenAI 兼容或 DashScope 端点实现图像理解与图像生成。

1上个月视觉、语音与多模态MIT
Z

dsh-plugins

zjcdkj/dsh-plugins

为纯文本编码模型装上「眼睛」:通过 ctx.llm 将图片路由给 Qwen-VL(DashScope)识别后返回文本。

1上个月视觉、语音与多模态MIT
X

dsh-image-vision

xsoc1/dsh-image-vision

纯文本 DeepSeek 的聊天识图插件:view_image 工具转发任意 OpenAI 兼容 VLM(本地 Ollama 或云端),对话框粘贴/拖拽的图片自动改写为 view_image 路径标记供模型查看。

1上个月视觉、语音与多模态
W

mimo-vision

wulusai2333/mimo-vision

`describe_image` 视觉桥:经 opencode Zen API(凭据 `OPENCODE_GO_API_KEY`,免费线路优先、付费兜底)把图片发给 mimo-v2.5、返回文字描述给纯文本模型,原生格式直发,SVG/TIFF/HEIC 等格式经 ImageMagick 自动转码。

1上个月视觉、语音与多模态MIT
R

dsh-vision-subagent

ruby1304/dsh-vision-subagent

为任意 DSH 路由装上眼睛:Web 输入框贴图按意图自动聚焦分析,视觉子代理代读工作区图片,原图可随时物化编辑。

111天前视觉、语音与多模态MIT
N

dsh-auto-vision

normanfxxkingrockwell/dsh-auto-vision

为纯文本 DeepSeek Harness 主模型搭视觉桥:自动从已配置模型中挑选多模态模型,通过 vision 工具把图片描述以纯文本返回。

16天前视觉、语音与多模态MIT
L

dsh-eyes

leeminjing/dsh-eyes

为纯文本 DeepSeek 模型提供按需视觉:上传图片后,模型通过 view_image 工具调用任意 OpenAI 兼容视觉端点(默认 Qwen/DashScope)。

1上个月视觉、语音与多模态MIT
K

dsh-mindseye

kanchengw/dsh-mindseye

为 DSH 上的纯文本模型提供视觉插件:通过分层证据记忆与缓存,实现图片理解与生成的原生交互及 GUI 自动化。

123天前视觉、语音与多模态MIT
1

dsh-vision-fallback

1helloman1/dsh-vision-fallback

将聊天图片交给固定的 OpenAI 兼容视觉模型,把事实性观察交给当前主模型,并在事件回放、上下文压缩和重启时复用会话内观察。

118天前视觉、语音与多模态MIT
Z

dsh-voice

zhuiyueya/dsh-voice

Voice for DeepSeek Harness(dsh) — speech-to-text input + read-aloud TTS for text-only DeepSeek, zero API key.

1上个月视觉、语音与多模态MIT
S

multimodal-bridge

spirit4471/multimodal-bridge

DeepSeek Harness plugin bundle: qwen_vision (Qwen-VL image understanding) and qwen_generate (Qwen-Image text-to-image) tools for text-only models

1上个月视觉、语音与多模态MIT
Y

dsh-plugin-vision-toolkit

yytbit/dsh-plugin-vision-toolkit

DeepSeek Harness 视觉工具包:glance/ground/detect/crop 等 CLI 工具,让纯文本 Agent 也能理解图像。

1上个月视觉、语音与多模态MIT
C

deepsee

chang416/deepsee

DeepSee: DeepSeek Harness vision, multi-model routing, and Gemini visual self-checks before delivery

1上个月视觉、语音与多模态MIT
S

dsh-auto-pass

sujingkpo/dsh-auto-pass

延续 simon300000/dsh-auto 的 DSH WebUI 自动审批权限档位:每次审批只走一次单轮模型审查、不再起审查子代理,只自动放行审查通过的动作、其余全部转回人工审批;并会把用户确认过的决定记成项目级与全局级的允许/拒绝名单,右侧栏另有审批时间线。

0昨天安全与权限MIT
M

dsh-plugin (dsh-model-capability-editor)

mzzsfy/dsh-plugin

模型能力编辑器:在官方模型页行内可视化编辑各模型的思考档位与图片输入(多模态)声明,整组写回 settings.yaml,锚点失效时浮动入口兜底。

0前天模型与账号接入MIT
C

dsh-voice-mimo

ch1bug/dsh-voice-mimo

Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).

07天前视觉、语音与多模态MIT
C

dsh-model-modality

ct-jyjntc/dsh-model-modality

声明第三方模型是否支持图像(多模态)输入,写入所属提供方设置并通过运行时模型解析校验。

014天前模型与账号接入MIT
D

dsh-plugin-voice

doer1296/dsh-plugin-voice

DeepSeek Harness 插件:语音 + 通知出口——agent 通过云端 TTS(火山 seed-tts / 小米 MiMo V2.5,失败自动回退 SAPI)/ 桌面通知 / 提示音主动联系用户。融合 dsh-plugin-notify 的 DSH 原生深度集成与 agent-voice-mcp-minus 的云端 TTS 调优,零 Python 依赖,Windows 原生。

020天前MCP 与连接器
9

dsh-math-olympiad

988hj7tczd-oss/dsh-math-olympiad

竞赛数学解题(IMO/Putnam/USAMO/AIME):纯推理求解 + 新鲜上下文 subagent 对抗验证 + 校准信心输出(high / medium / 诚实「无把握解」);可选 LaTeX 编译 PDF。

028天前技能包MIT
B

dsh-llm-capabilities

bamboostrip/dsh-llm-capabilities

DSH plugin: auto-detect and configure model capabilities (reasoningEfforts + input modalities) for llm-pi-ai. Successor to dsh-reasoning-efforts.

026天前视觉、语音与多模态MIT
H

tokenlab-deepseek-harness-provider

hedging8563/tokenlab-deepseek-harness-provider

TokenLab provider bundle for DeepSeek Harness with native Responses, Messages and Chat routing plus full multimodal and async tools.

025天前MCP 与连接器MIT
Y

dsh-balance

yyfather/dsh-balance

DeepSeek Harness 余额与开销插件:状态栏显示 DeepSeek/MiMo 余额与花费(本会话/本次活跃/最近一次/上次对话),逐请求按模型+峰谷时段计价,支持花费超线提醒(点击设置)

029天前用量与计费MIT
Y

dsh-mimo-plugin

yyfather/dsh-mimo-plugin

MiMo (Xiaomi) tools as a DSH profile plugin: web search, image/audio/video understanding, ASR transcription, TTS, voice design and voice cloning — native agent tools with a Settings page for the API key.

029天前视觉、语音与多模态MIT