插件
浏览、筛选并安装 DeepSeek-Harness 插件。
共 86 个插件
modlens
liustack/modlens
为纯文本模型架起视觉桥梁:粘贴图片,输出结构化 JSON 证据(OCR、版面、语义)。
dsh-vision-router
ysr666/dsh-vision-router
为纯文本 Agent 提供视觉能力:内置免 Key 视觉链 + 像素级视觉工具(看图问答、定位、裁剪、像素对比、取色、OCR、矢量化、抠图、截图);粘贴图片即可用。
tongflow (dsh-tongflow)
tong-io/tongflow
基于 TongFlow 的“片场”插件,用于图片、配音、音乐与视频制作:agent 为每个资产生成 TongFlow 工作流文件(.tongflow.json)并通过 TongFlow 插件执行,内嵌工作流画布,按镜头/角色/take 组织项目,附漫剧模板;以 @tongflow 开头的会话进入 Studio 界面。
tongflow
tong-io/tongflow
TongFlow DSH Studio 插件:电影剧组式项目模型、Agent 编写的 TongFlow 工作流、确定性媒体生成和嵌入式画布。
watch-skill
oxbshw/watch-skill
把视频、音频与屏幕活动转成带时间戳的可检索证据(DeepWatch)。
dsh-crew
zseven-w/dsh-crew
从 Claude Code / Codex 派发任务给 DSH Agent:原生子代理进度、按能力分层预设的宿主内工作会话,以及为纯文本 Harness 提供视觉与图像生成的多模态桥。
ark-cli (ark-managed-agents)
volcengine/ark-cli
新增 Managed Agents 设置页,并通过 MCP 工具向方舟云端 Managed Agents 派发长任务、取回轨迹与产物。
ark-cli (ark-plan-api)
volcengine/ark-cli
在 DSH 原生模型选择器中注册方舟 Agent Plan、Coding Plan 与后付费模型路由。
ark-cli
volcengine/ark-cli
火山方舟 Ark provider 插件:在原生 pi-ai 适配器上注册 Agent Plan、Coding Plan 与后付费路由,让 Ark 模型出现在模型选择器中
dsh-AuthInOne
stormycry-cryp/dsh-authinone
为 DeepSeek Harness 47f 提供账号登录、API 与自定义 Provider 配置、模型切换、纯文本模型图片兜底,以及 Token 与费用归因。
dsh-design-qa
sunxin-ai/dsh-design-qa
给纯文本模型的设计稿保真判定:`deepseek_vision` 工具从任意 OpenAI 兼容视觉路由借来一只眼,让模型判断实现与设计稿是否一致——并附上支撑该判定的基准(4 组夹具、23 处注入缺陷、逐格原始输出)与其依赖的提问纪律。
picturereader
jing-hy/picturereader
给纯文本模型的"读图"能力:图片降分辨率+降色深+结构/色彩指纹渲染成文本网格喂回对话,模型像多模态一样自主缩放、取样、OCR 读图;纯本地零外部模型依赖,附读图方法论 skill 与可选 PaddleOCR。
dsh-vision
oil-oil/dsh-vision
为 DeepSeek Harness 提供接近原生的图像理解能力。
dsh-ros2
stvli/dsh-ros2
面向 DeepSeek Harness 的 ROS2 调试工具集与机器人状态视觉分析:节点/话题/服务/动作/接口/TF 枚举、全图拓扑 JSON、依赖检查,审批门控的构建与自定义消息骨架生成,GUI 截图与多模态视觉观察,以及无头 RViz2 离屏渲染(低模 + 直读像素 + GPU 直通,动作渲染 30Hz)与并行 VLM 实时分析。
dsh-visual-plugin
jyh20030112/dsh-visual-plugin
给纯文本模型装上眼睛:把用户图片转发给任意 OpenAI 兼容的视觉模型生成描述,并在 Web UI 右侧面板展示结果。
dsh-vision-proxy
flyvhidbwo/dsh-vision-proxy
DeepSeek 大脑 + 自动识图:GUI 附加的每张图片自动经官方 deepseek-v4-flash-vision-exp 原生识图转译,再交给纯文本的 DeepSeek 作答(纯文本 V4-Pro 也能看图);支持任意 OpenAI 兼容 VLM 与本地 Ollama 作为备选。
dsh-mmx-bridge
welsione/dsh-mmx-bridge
MiniMax 多模态桥接:一个 `mmx_bridge` 工具覆盖图片理解/生成、视频、语音合成、音乐、翻唱、联网搜索与用量查询;可选接管 `web_search`/`read_image`;对话流直接内嵌播放器与图片预览(npm: `dsh-mmx-bridge`)。
dsh-deepseek-vision
siegfly/dsh-deepseek-vision
视觉语言网关:注册支持图片输入的 DeepSeek provider 路由,图片先由可配置 VL 模型(默认 Qwen-VL)描述成文字再发送。
dsh-plugin-xiaomi-mimo-tts
ppy-web/dsh-plugin-xiaomi-mimo-tts
为 DSH Web 助手回复提供小米 MiMo 语音朗读,支持预置音色和自定义音色。
dsh-vision
54xkeee/dsh-vision
纯文本 DeepSeek 的识图插件:默认走豆包 Web(零成本、免 API key,经 Windows CDP 桥接驱动已登录 Chrome),另有反重力额度(flash/pro)与 Gemini 降级通道;档位自动升级、视觉证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。
deepseek-harness-plugins (vision-bridge)
yinxe/deepseek-harness-plugins
让纯文本模型也能看图:消息中出现图片占位符时模型调用 vision_describe 工具,插件把本轮图片引用与提问一起转交给多模态视觉模型识别,主模型失败时自动用备用模型重试。配置在设置页完成并通过官方 settings API 持久化到 settings.yaml,热重载不丢。
dsh-vision-bridge
sfyyy/dsh-vision-bridge
为纯文本 DSH 会话按需提供视觉能力:图片变为标记,vision_describe 工具只把图片和问题发给 OpenAI 兼容的视觉模型。
dsh-guide-dog
atropinoltt/dsh-guide-dog
基于 MiniMax 的多模态插件:实时语音通话模式(流式对话、悬浮胶囊 UI)、语音模式与麦克风语音输入,并提供图像/视频/音乐/语音生成与视觉检查工具。
dsh-opencode-free-models (dsh-opencode-free-models)
yu-wenchao/dsh-opencode-free-models
DSH free model provider plugin with 20+ models including Gemini, MiMo, GLM, etc.