跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 964 个插件

H

dsh-kimicode-swarm

hongyue0721/dsh-kimicode-swarm

Kimi Code 风格 swarm:批量并行子 Agent 调度(自适应并发)、/swarm 命令与聊天内实时进度条。

1昨天工作流与自动化MIT
Z

commercial-ui-ux-codex-skill

zjsthmjialin/commercial-ui-ux-codex-skill

注册 commercial-ui-ux 技能:以任务为中心的商业界面 UI/UX/GUI 设计、审查、修复与实现(SaaS、仪表盘、后台、表单、表格、设计系统),带参考文档体系与质量门禁。

18天前技能包
F

dsh-wechat-mp-studio

funcwei/dsh-wechat-mp-studio

微信公众号内容生产工作台:防低创作度结构轮换写作法、低创作度整改实战、祝福图视觉基线、gpt-image 配图管线与 OCR 验收、小绿书草稿网页接口实测参数。

18天前技能包MIT
A

skill-bartender

akqwpeter-prog/skill-bartender

任务到技能配对元技能:懒人阶梯最小化加载、可编辑路由表、隔离-SkillSpector 扫描-人工确认的安装流程。

18天前技能包MIT
Z

pdf-background-gray-codex-skill

zjsthmjialin/pdf-background-gray-codex-skill

注册 remove-pdf-background-gray 技能:去除扫描 PDF 的灰色/米白底色,保持分辨率、页面几何与抗锯齿文字边缘(无损 Flate 写回),核心为单文件 Python 脚本(pypdf + Pillow + numpy)。

18天前技能包MIT
Z

inspiration-deck-workshop

zjsthmjialin/inspiration-deck-workshop

注册灵感演示工坊技能:本地静态 HTML 演示文稿(6 套 deck 模板、25+ 布局、23 套主题与动效展示馆),带 validate 校验与 PNG/PDF 导出 CLI 和 smoke 测试,零运行时依赖。

18天前技能包MIT
G

dsh-mermaid-render

genius-alray/dsh-mermaid-render

Web UI 对话 mermaid 渲染插件:将消息中的 mermaid 代码块渲染为可交互图表卡片(缩放 / 适应宽度 / 全屏查看 / 预览代码切换),复用官方组件原语,渲染失败时保留原代码块并内联展示错误。

18天前UI 增强
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

Web UI 免费语音闭环:浏览器语音识别输入(实时中间结果上屏)+ 助手回复朗读与自动朗读,零配置、免 API key。

19天前视觉、语音与多模态MIT
B

dsh-voice-ai-girlfriend-plugin

beiyege-01/dsh-voice-ai-girlfriend-plugin

Web UI 语音 AI 女友:FunASR 麦克风语音输入、Qwen3-TTS 语音回复、数字人动画窗、QQ 双向聊天(文本/语音/图片推送,经 NapCat)。

1前天视觉、语音与多模态
X

dsh-image-vision

xsoc1/dsh-image-vision

纯文本 DeepSeek 的聊天识图插件:view_image 工具转发任意 OpenAI 兼容 VLM(本地 Ollama 或云端),对话框粘贴/拖拽的图片自动改写为 view_image 路径标记供模型查看。

19天前视觉、语音与多模态
W

mimo-vision

wulusai2333/mimo-vision

`describe_image` 视觉桥:经 opencode Zen API(凭据 `OPENCODE_GO_API_KEY`,免费线路优先、付费兜底)把图片发给 mimo-v2.5、返回文字描述给纯文本模型,原生格式直发,SVG/TIFF/HEIC 等格式经 ImageMagick 自动转码。

18天前视觉、语音与多模态MIT
W

dsh-tool-vision

wanshichenguang/dsh-tool-vision

面向模型的 image_describe(识图)工具(DashScope OpenAI 兼容接口,qwen3.7-flash)+ 粘贴桥:纯文本模型会话里粘贴的图片在发送时自动转为文件路径并在聊天记录中回显,不再触发图片准入拦截。自带 DASHSCOPE_API_KEY;端点/模型/预算可配置,重定向防护 HTTP 客户端,所有 Agent 预设均可用。

17天前视觉、语音与多模态MIT
T

dsh-plugins (dsh-vision)

tzhr-invest/dsh-plugins

Agent 可调用的视觉工具:通过你配置的任意 OpenAI 兼容视觉端点描述本地图片,支持多模型交叉核对,不内置任何密钥。

17天前视觉、语音与多模态MIT
N

dsh-auto-vision

normanfxxkingrockwell/dsh-auto-vision

为纯文本 DeepSeek Harness 主模型搭视觉桥:自动从已配置模型中挑选多模态模型,通过 vision 工具把图片描述以纯文本返回。

16天前视觉、语音与多模态MIT
M

dsh-unsloth-hands

microherox/dsh-unsloth-hands

把重复的文本与视觉(OCR、图像分析、对比)劳动交给本地运行的 Unsloth Desktop(Unsloth Studio)服务器:unsloth_run 与 unsloth_vision 两个工具,纯 HTTP 客户端,不拉起也不持有任何进程。

13天前视觉、语音与多模态MIT
M

dsh-koboldcpp-hands

microherox/dsh-koboldcpp-hands

给在线模型装上本地双手:koboldcpp_run 与 koboldcpp_vision 工具把重复的文本与视觉(OCR、图像分析、对比)劳动交给本地 KoboldCpp(llama.cpp)服务器,并按需拉起与管理服务器生命周期。

13天前视觉、语音与多模态MIT
L

dsh-plugin-grok2api-media-tool

lsjspl/dsh-plugin-grok2api-media-tool

让 dsh 通过 grok2api 的 API 获得生成图片与视频能力。

16天前视觉、语音与多模态
L

dsh-eyes

leeminjing/dsh-eyes

为纯文本 DeepSeek 模型提供按需视觉:上传图片后,模型通过 view_image 工具调用任意 OpenAI 兼容视觉端点(默认 Qwen/DashScope)。

18天前视觉、语音与多模态MIT
K

dsh-mindseye

kanchengw/dsh-mindseye

为 DSH 上的纯文本模型提供视觉能力:支持图片理解与生成的原生交互、分层证据记忆与缓存,以及 GUI 自动化。

1昨天视觉、语音与多模态MIT
K

dsh-vision-recognizer

kaixinbaba/dsh-vision-recognizer

视觉模型路由:把附加图片经可配置模型(15+ OpenAI 兼容与 Anthropic 供应商)转译为文字,对话仍由 DeepSeek 作答。

14天前视觉、语音与多模态MIT
G

dsh-tool-vision

gloryxpnv/dsh-tool-vision

本地优先的结构化视觉插件:图片交给本地 OpenAI 兼容 VLM,返回 JSON 证据(摘要、逐字 OCR、版面区域、实体/关系、配色、显式不确定项),带反幻觉回退与可选粘贴/上传桥;零云端成本,图片不出本机。

19天前视觉、语音与多模态MIT
E

dsh-plugin-mm-vision

elohia/dsh-plugin-mm-vision

通感编码器(Synesthesia Encoder):调用视觉模型把图片翻译成紧凑的结构化空间文字(画布/元素/百分比坐标),让纯文本 LLM 获得像素级看图能力(`mm_vision` 工具)。

111天前视觉、语音与多模态MIT
C

dsh-deepseek-vision

cheng-cheng9669/dsh-deepseek-vision

复用 DeepSeek 网页端识图模式给纯文本模型补上看图能力:deepseek_vision 工具调用本地 deepseek-vision-cli 浏览器自动化(手动登录助手、自动开启深度思考、用后自动关窗),把图片描述以文字返回给模型。

18天前视觉、语音与多模态MIT
3

dsh-vision (vision-tool)

314857493/dsh-vision

给 DeepSeek Harness 的纯文本模型补上免费识图:`vision` 工具直连智谱 GLM 视觉 API 描述/OCR 图片文件(glm-4v-flash 降级链),无需任何外部 CLI。

15天前视觉、语音与多模态MIT