跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 78 个插件

L

modlens

liustack/modlens

为纯文本模型架起视觉桥梁:粘贴图片,输出结构化 JSON 证据(OCR、版面、语义)。

4.1k前天视觉、语音与多模态MIT
Y

dsh-vision-router

ysr666/dsh-vision-router

为纯文本 Agent 提供视觉能力:内置免 Key 视觉链 + 像素级视觉工具(看图问答、定位、裁剪、像素对比、取色、OCR、矢量化、抠图、截图);粘贴图片即可用。

1.1k9小时前视觉、语音与多模态MIT
T

tongflow (dsh-tongflow)

tong-io/tongflow

基于 TongFlow 的“片场”插件,用于图片、配音、音乐与视频制作:agent 为每个资产生成 TongFlow 工作流文件(.tongflow.json)并通过 TongFlow 插件执行,内嵌工作流画布,按镜头/角色/take 组织项目,附漫剧模板;以 @tongflow 开头的会话进入 Studio 界面。

1k3天前工作流与自动化AGPL-3.0
T

tongflow

tong-io/tongflow

TongFlow DSH Studio 插件:电影剧组式项目模型、Agent 编写的 TongFlow 工作流、确定性媒体生成和嵌入式画布。

870上个月视觉、语音与多模态AGPL-3.0
O

watch-skill

oxbshw/watch-skill

把视频、音频与屏幕活动转成带时间戳的可检索证据(DeepWatch)。

37815天前视觉、语音与多模态MIT
Z

dsh-crew

zseven-w/dsh-crew

从 Claude Code / Codex 派发任务给 DSH Agent:原生子代理进度、按能力分层预设的宿主内工作会话,以及为纯文本 Harness 提供视觉与图像生成的多模态桥。

1535天前集成与远程MIT
V

ark-cli

volcengine/ark-cli

火山方舟 Ark provider 插件:在原生 pi-ai 适配器上注册 Agent Plan、Coding Plan 与后付费路由,让 Ark 模型出现在模型选择器中

112上个月模型与账号接入Apache-2.0
S

dsh-AuthInOne

stormycry-cryp/dsh-authinone

为 DeepSeek Harness 47f 提供账号登录、API 与自定义 Provider 配置、模型切换、纯文本模型图片兜底,以及 Token 与费用归因。

1042个月前模型与账号接入MIT
S

dsh-design-qa

sunxin-ai/dsh-design-qa

给纯文本模型的设计稿保真判定:`deepseek_vision` 工具从任意 OpenAI 兼容视觉路由借来一只眼,让模型判断实现与设计稿是否一致——并附上支撑该判定的基准(4 组夹具、23 处注入缺陷、逐格原始输出)与其依赖的提问纪律。

4423天前视觉、语音与多模态MIT
J

picturereader

jing-hy/picturereader

给纯文本模型的"读图"能力:图片降分辨率+降色深+结构/色彩指纹渲染成文本网格喂回对话,模型像多模态一样自主缩放、取样、OCR 读图;纯本地零外部模型依赖,附读图方法论 skill 与可选 PaddleOCR。

3711天前视觉、语音与多模态MIT
O

dsh-vision

oil-oil/dsh-vision

为 DeepSeek Harness 提供接近原生的图像理解能力。

242个月前视觉、语音与多模态MIT
J

dsh-visual-plugin

jyh20030112/dsh-visual-plugin

给纯文本模型装上眼睛:把用户图片转发给任意 OpenAI 兼容的视觉模型生成描述,并在 Web UI 右侧面板展示结果。

1628天前视觉、语音与多模态MIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

DeepSeek 大脑 + 自动识图:GUI 附加的每张图片自动经官方 deepseek-v4-flash-vision-exp 原生识图转译,再交给纯文本的 DeepSeek 作答(纯文本 V4-Pro 也能看图);支持任意 OpenAI 兼容 VLM 与本地 Ollama 作为备选。

14上个月视觉、语音与多模态MIT
W

dsh-mmx-bridge

welsione/dsh-mmx-bridge

MiniMax 多模态桥接:一个 `mmx_bridge` 工具覆盖图片理解/生成、视频、语音合成、音乐、翻唱、联网搜索与用量查询;可选接管 `web_search`/`read_image`;对话流直接内嵌播放器与图片预览(npm: `dsh-mmx-bridge`)。

1012天前工具与能力MIT
M

dsh-provider-qoder

mo-n/dsh-provider-qoder

将 Qoder 订阅接入 DeepSeek Harness,支持国际版与中国区、多模态与工具调用。

914小时前模型与账号接入MIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

视觉语言网关:注册支持图片输入的 DeepSeek provider 路由,图片先由可配置 VL 模型(默认 Qwen-VL)描述成文字再发送。

919天前视觉、语音与多模态MIT
M

dsh-iris

mokuyoaxis/dsh-iris

面向 DeepSeek Harness 的媒体与视觉工作台:文生图、图/文生视频、语音合成与转写、图像问答与元素定位、长图 OCR、像素比对、HTML 截图验证、视频摘要;支持 DashScope 与 OpenAI 兼容供应商,含模型池与工作台客户端。

79天前工具与能力MIT
5

dsh-vision

54xkeee/dsh-vision

纯文本 DeepSeek 的识图插件:默认走豆包 Web(零成本、免 API key,经 Windows CDP 桥接驱动已登录 Chrome),另有反重力额度(flash/pro)与 Gemini 降级通道;档位自动升级、视觉证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。

7上个月视觉、语音与多模态MIT
Y

deepseek-harness-plugins (vision-bridge)

yinxe/deepseek-harness-plugins

让纯文本模型也能看图:消息中出现图片占位符时模型调用 vision_describe 工具,插件把本轮图片引用与提问一起转交给多模态视觉模型识别,主模型失败时自动用备用模型重试。配置在设置页完成并通过官方 settings API 持久化到 settings.yaml,热重载不丢。

56天前视觉、语音与多模态MIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

为纯文本 DSH 会话按需提供视觉能力:图片变为标记,vision_describe 工具只把图片和问题发给 OpenAI 兼容的视觉模型。

5上个月视觉、语音与多模态MIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

基于 MiniMax 的多模态插件:实时语音通话模式(流式对话、悬浮胶囊 UI)、语音模式与麦克风语音输入,并提供图像/视频/音乐/语音生成与视觉检查工具。

5上个月视觉、语音与多模态MIT
G

deepseek-vision

gou-gee/deepseek-vision

DeepSeek Harness 原生视觉 Bundle:粘贴或拖入图片,通过托管的 deepseek-vision-mcp 调用 OpenAI 兼容视觉模型。

4上个月MCP 与连接器MIT
G

deepseek-vision (dsh-plugin-deepseek-vision)

gou-gee/deepseek-vision

面向纯文本 DeepSeek 的视觉 MCP + DSH 插件:analyze_image / analyze_clipboard / compare_images / vision_status 四个工具、可视化配置页、默认免费 GLM-4.6V-Flash、结果缓存与限流容错,Key 不入日志。

423天前视觉、语音与多模态MIT
F

dsh-plugin-deepeye

favio8/dsh-plugin-deepeye

DeepEye 视觉插件:为 DeepSeek Harness(DSH)提供图像描述、OCR、VQA、UI 布局和剪贴板分析。

42个月前视觉、语音与多模态