跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 47 个插件

Y

dsh-vision-router

ysr666/dsh-vision-router

为纯文本 Agent 提供视觉能力:内置免 Key 视觉链 + 像素级视觉工具(看图问答、定位、裁剪、像素对比、取色、OCR、矢量化、抠图、截图);粘贴图片即可用。

1.1k昨天视觉、语音与多模态MIT
A

dsh-vision-toolkit

anionex/dsh-vision-toolkit

让纯文本模型处理视觉任务:粘贴图片后自动切换到 Vision Toolkit 变体,支持图片问答、多图比较、长截图 OCR、截图还原前端 UI、元素定位与像素对比。默认无需 API Key——图片经作者自建的免费服务处理,每台机器每天 100 张;也可改为指向自己的服务商。

887前天视觉、语音与多模态MIT
O

dsh-vision

oil-oil/dsh-vision

为 DeepSeek Harness 提供接近原生的图像理解能力。

242个月前视觉、语音与多模态MIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

DeepSeek 大脑 + 自动识图:GUI 附加的每张图片自动经官方 deepseek-v4-flash-vision-exp 原生识图转译,再交给纯文本的 DeepSeek 作答(纯文本 V4-Pro 也能看图);支持任意 OpenAI 兼容 VLM 与本地 Ollama 作为备选。

15上个月视觉、语音与多模态MIT
P

dsh-vision-opencode

poiuyjie/dsh-vision-opencode

给纯文本主模型加可配置识图模型:vision_read_image 工具、输入框识图模型选择器,以及纯文本路由的图片自动转文字。

1323天前视觉、语音与多模态MIT
L

dsh-vision

linenxi-ctrl/dsh-vision

外挂识图插件:鲸鱼按钮配置面板、图片识图自动回传、模型自主截图识图工具。

92个月前视觉、语音与多模态MIT
5

dsh-vision

54xkeee/dsh-vision

纯文本 DeepSeek 的识图插件:默认走豆包 Web(零成本、免 API key,经 Windows CDP 桥接驱动已登录 Chrome),另有反重力额度(flash/pro)与 Gemini 降级通道;档位自动升级、视觉证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。

72个月前视觉、语音与多模态MIT
L

dsh-drop-to-path

loudmore/dsh-drop-to-path

DSH 插件:图片与文件直达纯文本模型——图片保留原生附件体验,PDF/Office/压缩包/视频/音频显示为附件栏方块,发送时自动转为工作区路径。

62个月前UI 增强MIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

为纯文本 DSH 会话按需提供视觉能力:图片变为标记,vision_describe 工具只把图片和问题发给 OpenAI 兼容的视觉模型。

52个月前视觉、语音与多模态MIT
X

dsh-vision-hub (tool-vision)

xing666173/dsh-vision-hub

增强版视觉工具箱:14 个像素级视觉工具(看图问答/定位/检测/裁剪/像素比对/OCR/长截图OCR/矢量化/取色/抠图/截图/展示/落盘/网页截图),单一 OpenAI 兼容端点驱动,桥接标记极简、规则下沉系统提示,带内容安全识别与限流自动重试。

4上个月视觉、语音与多模态
X

dsh-vision-hub (file-drop)

xing666173/dsh-vision-hub

拖拽上传 PDF/Word/Excel/图片等文件:落盘为本地路径引用,对话里不塞 base64 大文本。

4上个月工具与能力
X

dsh-vision-hub (bridge-preview)

xing666173/dsh-vision-hub

图片桥接内联预览:对话中 \[图片: 路径] 标记渲染后自动显示图片,长指令不留在对话里。

4上个月会话与消息
1

dsh-vision-sidecar

121103qwq/dsh-vision-sidecar

为 DeepSeek Harness 提供托管视觉侧车,并持久化会话证据。

42个月前视觉、语音与多模态MIT
G

dsh-vision-bridge

gxx182/dsh-vision-bridge

将会话图片转交可配置视觉服务,并向符合条件的 DeepSeek Harness 模型路由返回纯文本分析。

42个月前视觉、语音与多模态MIT
P

dsh-agent-router

peterwangze/dsh-agent-router

DSH 多模型路由插件:为视觉/翻译/语音/子代理等专业 agent 绑定独立模型,支持多模态账号登录、健康路由与实时用量统计。

32个月前模型与账号接入MIT
T

dsh-plugins (dsh-vision)

tzhr-invest/dsh-plugins

Agent 可调用的视觉工具:通过你配置的任意 OpenAI 兼容视觉端点描述本地图片,支持多模型交叉核对,不内置任何密钥。

35天前视觉、语音与多模态MIT
M

dsh-vision-tools

moon09300731/dsh-vision-tools

DeepSeek Harness 视觉能力全家桶:vision_understand 工具(OpenAI 兼容视觉 API,默认免费智谱 GLM-4V-Flash)+ 粘贴/拖拽/按钮三入口识图。

32个月前视觉、语音与多模态MIT
H

dsh-vision-mix

haiziyao/dsh-vision-mix

把文本、识图和生图 API 组合成一个 Mix 模型并按对话内容自动路由:纯文本走聊天模型,用户图片和 Agent 截图走识图模型,后续可继续追问同一张图;还支持图片生成与编辑及会话级调用记录。

324天前视觉、语音与多模态MIT
N

dsh-vision-plugin

nexsjournal/dsh-vision-plugin

给模型目录装上「图片输入」勾选框,自定义模型声明后可直接收图;附带可选的 BYO 视觉中继。

32个月前UI 增强MIT
B

dsh-vision-plugin

bug-huntter/dsh-vision-plugin

为纯文本 DSH 模型增加可配置识图能力:开启后图片消息先由任意 OpenAI 兼容视觉模型转写为文字描述,再交给主模型处理;设置页可配置 Base URL、Model ID 与密钥,并可选择密钥的鉴权方式(OpenAI / Anthropic / Gemini / Azure 风格请求头);未填写密钥时会在发起请求前明确提示。

25天前视觉、语音与多模态MIT
G

dsh-vision-bridge

goodandready/dsh-vision-bridge

将图片交给所选的视觉模型处理(自动改写、显式工具或混合模式),使纯文本聊天模型也能处理包含图片的对话。

26天前视觉、语音与多模态MIT
X

dsh-vision

xiaoshihou514/dsh-vision

极简的原生视觉能力增强,支持免费的智谱模型或本地千问视觉模型。

2上个月视觉、语音与多模态MIT
K

dsh-vision-recognizer

kaixinbaba/dsh-vision-recognizer

视觉模型路由:把附加图片经可配置模型(15+ OpenAI 兼容与 Anthropic 供应商)转译为文字,对话仍由 DeepSeek 作答。

2上个月视觉、语音与多模态MIT
3

dsh-vision (vision-tool)

314857493/dsh-vision

给 DeepSeek Harness 的纯文本模型补上免费识图:`vision` 工具直连智谱 GLM 视觉 API 描述/OCR 图片文件(glm-4v-flash 降级链),无需任何外部 CLI。

228天前视觉、语音与多模态MIT