跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 86 个插件

1

dsh-wsl-media

173787247/dsh-wsl-media

本地媒体/文档管线:ffprobe、抽音轨、缩略图、PDF、ASR、pandoc、OCR、exif(allowRoots 含 IM inbox)。

123小时前开发与插件工具MIT
T

Mimir (mimir-skin)

tommyhedgerow/mimir

把一节课发布进 DSH 对话:依赖主干、题目与库里的图,用库自己的配色绘制。

15天前UI 增强MIT
X

computer-user-vision

xie129716/computer-user-vision

computer-user 分叉的 Windows 电脑操作插件:13 个 computer_* 工具,读取屏幕并驱动鼠标键盘。模型支持图像输入时截图直接作为图片返回,附精确的图像→屏幕映射,无需外接 OCR;控件以 UI Automation 引用返回,点击落在精确矩形上;Ctrl+Alt+Esc 可阻断所有调用。

116天前工具与能力MIT
W

dsh-screenshot-capture

wangzhanchao883/dsh-screenshot-capture

指哪拍哪截图入库:系统级悬浮窗把新截图(或复制图片)一键存入 Obsidian 笔记,支持注释与「重点」标记、通义千问即时 OCR、按天合并,并可在晚间用 AI 整理归类、打双链并生成当日总结。

1前天工具与能力MIT
Z

dsh-file-convert

zzy-12345678/dsh-file-convert

本地优先文件转换插件:支持图片、PDF(含 OCR)、数据、音视频和 Office 文档的 26 种转换,提供 7 个工具且无需 API Key。

1上个月视觉、语音与多模态
J

dsh-mmroute

jmxsxwyzjdwl/dsh-mmroute

纯文本模型的透明多模态路由:每一次模型调用里的每张图片先由你自己配置的多模态理解模型全量转述(逐字 OCR、数据、不确定区、防注入),vision_relook 定点复看,图片类报错自动转述重试。不内置端点、不借登录态。

124天前视觉、语音与多模态MIT
C

aura-vision

ck-epsilon/aura-vision

免费视觉识别插件:自适应切块长文档识别,支持历史收藏与 MD/Word/长图/Excel 导出。

1上个月视觉、语音与多模态MIT
H

dsh-vision-analysis

harvey-will/dsh-vision-analysis

DeepSeek Harness 图像理解插件:8 种分析模式(描述、OCR、图表取数、UI 评审、目标检测、对比、代码生成、诊断),支持任意 OpenAI/Anthropic 兼容视觉 API,内置免费视觉模型与限流自动切换。

115小时前视觉、语音与多模态MIT
H

dsh-open-file

hyper-dsh-plugins/dsh-open-file

为 DeepSeek Harness 提供工作区文件上传、读取、OCR 与渲染工具。

1上个月视觉、语音与多模态MIT
Z

dsh-plugins

zjcdkj/dsh-plugins

为纯文本编码模型装上「眼睛」:通过 ctx.llm 将图片路由给 Qwen-VL(DashScope)识别后返回文本。

1上个月视觉、语音与多模态MIT
H

dsh-open-file

hyp6666/dsh-open-file

工作区限定的任意格式文件上传、读取、本地 OCR 与页面渲染,把各类文档带进 DeepSeek Harness 对话。

1上个月视觉、语音与多模态MIT
L

dsh-eyes

leeminjing/dsh-eyes

为纯文本 DeepSeek 模型提供按需视觉:上传图片后,模型通过 view_image 工具调用任意 OpenAI 兼容视觉端点(默认 Qwen/DashScope)。

1上个月视觉、语音与多模态MIT
G

dsh-tool-vision

gloryxpnv/dsh-tool-vision

本地优先的结构化视觉插件:图片交给本地 OpenAI 兼容 VLM,返回 JSON 证据(摘要、逐字 OCR、版面区域、实体/关系、配色、显式不确定项),带反幻觉回退与可选粘贴/上传桥;零云端成本,图片不出本机。

12个月前视觉、语音与多模态MIT
M

lookover (dsh-look)

mengxiaoxian/lookover

macOS 场景感知探针:拉模型零轮询的 look 工具,读取最前非自身窗口(应用信息、AX 标题/选中文本、按需本地 OCR),支持召唤热键按下瞬间抓取快照注入对话。

09天前视觉、语音与多模态MIT
M

lookover (dsh-expmem)

mengxiaoxian/lookover

个人经验记忆:把真实解决过的问题存为带来源、可纠正、有适用条件的案例,新任务中自动召回复用,纠正与删除会级联影响后续召回。

09天前记忆MIT
N

vision-exp-tile

nicholaskin/vision-exp-tile

Large-image recognition for vision-exp models: lossless 800×800 tile recognition (smart/pipeline/full), local OCR with preprocessing & handwriting routing, optional multi-vendor GPU (DirectML/CUDA/OpenVINO) with auto CPU fallback.

020天前视觉、语音与多模态MIT
J

dsh-markitdown

jiekesu967/dsh-markitdown

提供 markitdown 工具,把 PDF、Word、Excel、PowerPoint、HTML、CSV、EPUB 与网址转成 Markdown:能找到真实的 Microsoft MarkItDown 时驱动它,否则使用内置的零依赖转换器。

017小时前工具与能力MIT
L

dsh-file-upload-local

lubenweimeiyoukaig/dsh-file-upload-local

本地文件上传:回形针按钮与拖拽上传、按会话隔离存储到 .dsh-uploads,并提供 read_document 工具分页读文本、对图片 OCR。

026天前工具与能力MIT
H

dsh-maclens

harzva/dsh-maclens

苹果设备端 Vision 工具:本地 OCR(含中文)、图像分类、人脸检测、文档版面分析与综合描述,100% 离线、无需 API key,支持长截图切片。

0上个月视觉、语音与多模态MIT
J

linkdigest-mcp

jcaiagent7143-ui/linkdigest-mcp

把小红书、抖音、TikTok、YouTube 或 X 链接转成文本:带时间戳的转写、屏幕文字、逐图描述与 OCR、正文与元数据。通过 streamable HTTP 挂载托管的 MCP 服务。

025天前工具与能力MIT
L

dsh-file-attach

lucasxingg/dsh-file-attach

Drag-and-drop PDF, Office, images, and text/code files into DSH conversations. The host extracts (and OCRs) them into the prompt; attach_* tools cover notebook cells, PDF-page OCR, image describe, and save.

0上个月视觉、语音与多模态MIT
S

dsh-vision-link

sprainjinyu/dsh-vision-link

轻量、保持路由的 DSH 视觉链路:由配置好的视觉模型看图,而你所选文本模型继续掌控推理与最终回答

0上个月视觉、语音与多模态
R

dsh-omni-vision

renji004/dsh-omni-vision

为纯文本模型装上本地眼睛:eyes_render 在 Web 界面画布上绘制文字/图形/Mermaid,eyes_paste 接收用户粘贴的图片,eyes_ocr 用 Windows 自带 OCR 离线读文字,eyes_analyze 把像素解析成结构化数据,全程无需视觉模型。

0上个月视觉、语音与多模态MIT
V

dsh-ocr-bridge

vuvanmai936-dot/dsh-ocr-bridge

把图片粘贴进 DSH 聊天,先由免费本地后端(macOS Vision / Tesseract)识别文字,再交给纯文本 DeepSeek 模型回答。

0上个月视觉、语音与多模态