跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 78 个插件

H

dsh-her-eyes

huashenglian/dsh-her-eyes

一个可以让ai自动调用VLM(多模态模型)进行视觉分析的dsh插件。A dsh plugin that allows AI to automatically invoke VLMs (multimodal models) for visual analysis.

42个月前视觉、语音与多模态MIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

面向 DSH 的全模态工作站:analyze_image 走有序多卡片 VLM 故障转移链;六个视觉工具箱工具(局部放大、色调采样、像素比对、OCR、元素检测、内联展示)共用同一套图片来源解析;generate_image 支持 OpenAI/DashScope/ComfyUI 协议;多卡片异步 generate_video 配 /build-video-tool 构建器;speak/clone_voice 语音合成覆盖七家供应商;全部由一个自动保存的设置页驱动。

311天前视觉、语音与多模态MIT
S

dsh-llm-qwen-local

starefinger/dsh-llm-qwen-local

面向 vLLM OpenAI 兼容端点上本地部署的 Qwen 模型的 LLM 适配器插件,支持按模型多模态开关、完全可配置的推理档位,以及可在前端编辑部署配置的 Web 设置页。

36天前模型与账号接入MIT
W

visual-review

wang-bool/visual-review

在 DSH Web 聊天界面内联渲染粘贴/上传的图片,并让纯文本模型“看见”图片:visual_review 工具优先调用任意 OpenAI 兼容多模态 API,未配置时回退本机 Qwen3-VL。

3上个月视觉、语音与多模态MIT
S

dsh-plugin-multimodal

shinjiyu/dsh-plugin-multimodal

在纯文本 DeepSeek 线路上开放贴图准入,用视觉 sidecar 把附件转成文字,原生视觉模型不改写。

3上个月视觉、语音与多模态MIT
H

dsh-vision-mix

haiziyao/dsh-vision-mix

把文本、识图和生图 API 组合成一个 Mix 模型并按对话内容自动路由:纯文本走聊天模型,用户图片和 Agent 截图走识图模型,后续可继续追问同一张图;还支持图片生成与编辑及会话级调用记录。

322天前视觉、语音与多模态MIT
Y

dsh-reasoning-support

yu1ko/dsh-reasoning-support

面向 DSV4.1 的推理优化插件:先做精简上下文分析再让完整智能体执行,图片与附件进入辅助流水线

215小时前工具与能力MIT
H

dsh-open-eyes

hyper-dsh-plugins/dsh-open-eyes

为纯文本 DeepSeek 路由提供视觉桥接:通过可配置的 OpenAI Responses、Chat Completions 或 Anthropic Messages 端点分析附件与本地图片,同时保持支持图片的路由走原生路径。

224天前视觉、语音与多模态MIT
L

dsh-visibridge

lhbsaa/dsh-visibridge

结构化视觉证据(OCR/版面/语义)+ USB 摄像头拍摄工具,支持"拍-看-改"调试闭环;后端支持 Ollama、DeepSeek、小米。

2上个月视觉、语音与多模态MIT
A

dsh-multi-model-provider

alexkaiqi/dsh-multi-model-provider

为 DeepSeek Harness 注册图像/语音/视频等任务模型、辅助画像配置,并从免密钥目录中选择 Agent 模型。

2上个月模型与账号接入MIT
S

dsh-collaboration

socialist-sister/dsh-collaboration

多 agent 协作套件:用户配置的专家名册、按需持续调度(team_call/team_message/team_status/team_close)、克隆实例、星型拓扑中继、模型比较与多模态视觉桥。

2上个月工作流与自动化MIT
I

dsh-tool-visual-primitives

inkshadewoods/dsh-tool-visual-primitives

通过模式化提示分析对话图片(描述、UI、文档、定位、拓扑等),将含坐标原语(框、点、引用)的结构化证据以文本注入上下文,会话级缓存跨回放与压缩复用。

211小时前视觉、语音与多模态MIT
G

dsh-vision-bridge

goodandready/dsh-vision-bridge

将图片交给所选的视觉模型处理(自动改写、显式工具或混合模式),使纯文本聊天模型也能处理包含图片的对话。

23天前视觉、语音与多模态MIT
H

dsh-open-eyes

hyp6666/dsh-open-eyes

为纯文本 DeepSeek 路由提供视觉桥接:通过可配置的 OpenAI Responses、Chat Completions 或 Anthropic Messages 端点分析附件与本地图片,同时保持支持图片的路由走原生路径。

224天前视觉、语音与多模态MIT
5

dsh-youreyes

54xkeee/dsh-youreyes

纯文本 DeepSeek 的识图工具包:模型可主动调用的 `vision` 工具、deepseek/opencode-go 包装适配器(v4 flash/pro)、反重力额度(默认,flash/pro)/ 任意 OpenAI 兼容 VLM / Gemini / 本地 Ollama 通道、证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。

2上个月视觉、语音与多模态MIT
W

dsh-screenshot-capture

wangzhanchao883/dsh-screenshot-capture

指哪拍哪截图入库:系统级悬浮窗把新截图(或复制图片)一键存入 Obsidian 笔记,支持注释与「重点」标记、通义千问即时 OCR、按天合并,并可在晚间用 AI 整理归类、打双链并生成当日总结。

122小时前工具与能力MIT
W

dsh-file-attachment

wszhoho/dsh-file-attachment

拖拽/粘贴/上传文件和图片,非多模态模型下图片自动调用已配置 VLM 识别。

114小时前UI 增强MIT
M

dsh-bilibili

moxingovo/dsh-bilibili

DeepSeek Harness 插件:提供哔哩哔哩关键词搜索、视频元数据、字幕、直播放地址和多模态视频帧查看工具。默认匿名。

1上个月视觉、语音与多模态MIT
J

dsh-mmroute

jmxsxwyzjdwl/dsh-mmroute

纯文本模型的透明多模态路由:每一次模型调用里的每张图片先由你自己配置的多模态理解模型全量转述(逐字 OCR、数据、不确定区、防注入),vision_relook 定点复看,图片类报错自动转述重试。不内置端点、不借登录态。

123天前视觉、语音与多模态MIT
H

dsh-vision-analysis

harvey-will/dsh-vision-analysis

DeepSeek Harness 图像理解插件:8 种分析模式(描述、OCR、图表取数、UI 评审、目标检测、对比、代码生成、诊断),支持任意 OpenAI/Anthropic 兼容视觉 API,内置免费视觉模型与限流自动切换。

14天前视觉、语音与多模态MIT
E

dsh-sight

ericfetch/dsh-sight

多模态图片直传与会话图片清除:粘贴、拖入即发原图,并可移除模型可见图片。

1上个月视觉、语音与多模态MIT
Y

dsh-multimodal

yauntyour/dsh-multimodal

按文件类型串联多模态模型:先把图片、视频、音频转成提示词,再送入纯文本会话模型。

12个月前视觉、语音与多模态MIT
A

dsh-image-plugins

alanzhao0128/dsh-image-plugins

DeepSeek Harness 多模态插件:通过可配置的 OpenAI 兼容或 DashScope 端点实现图像理解与图像生成。

1上个月视觉、语音与多模态MIT
Z

dsh-plugins

zjcdkj/dsh-plugins

为纯文本编码模型装上「眼睛」:通过 ctx.llm 将图片路由给 Qwen-VL(DashScope)识别后返回文本。

1上个月视觉、语音与多模态MIT