跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 2485 个插件

S

dsh-ppt

stardustlc666/dsh-ppt

演示文稿技能与工具:一句话或一篇文档生成 HTML 放映与可编辑 PPTX,内置 5 套主题,可配置默认主题/语言,中英双语。

1昨天工具与能力MIT
G

dsh-mermaid-render

genius-alray/dsh-mermaid-render

Web UI 对话 mermaid 渲染插件:将消息中的 mermaid 代码块渲染为可交互图表卡片(缩放 / 适应宽度 / 全屏查看 / 预览代码切换),复用官方组件原语,渲染失败时保留原代码块并内联展示错误。

13天前UI 增强
P

dsh-voice-call

pandapolo/dsh-voice-call

agent 主动打来的语音电话:`offer_call` 向人类振铃(接听/拒接/稍后再说),接听后由本地 CrispASR + Qwen3-TTS 合成并播放(9 个音色,含 2 个中文方言);拒接则把决定返回给 agent。

1前天视觉、语音与多模态MIT
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

Web UI 免费语音闭环:浏览器语音识别输入(实时中间结果上屏)+ 助手回复朗读与自动朗读,零配置、免 API key。

13天前视觉、语音与多模态MIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Web UI 语音输入:输入框旁麦克风按钮语音转文字填入输入框;支持浏览器 Web Speech API 本地识别(零配置、无需密钥)与 OpenAI 兼容 Whisper API(OpenAI/Groq),模型与语言可在设置中选择。

1前天视觉、语音与多模态MIT
A

dsh-sound

ai-galaxy-gpu/dsh-sound

六类事件独立提示音:回合完成、审批、提问、计划评审、目标受阻、任务失败各有独立声音与音量,可在 Web 设置面板配置(内置合成音 / 静音 / 本地音频文件)。

13天前集成与远程MIT
X

dsh-image-vision

xsoc1/dsh-image-vision

纯文本 DeepSeek 的聊天识图插件:view_image 工具转发任意 OpenAI 兼容 VLM(本地 Ollama 或云端),对话框粘贴/拖拽的图片自动改写为 view_image 路径标记供模型查看。

14天前视觉、语音与多模态
W

mimo-vision

wulusai2333/mimo-vision

`describe_image` 视觉桥:经 opencode Zen API(凭据 `OPENCODE_GO_API_KEY`,免费线路优先、付费兜底)把图片发给 mimo-v2.5、返回文字描述给纯文本模型,原生格式直发,SVG/TIFF/HEIC 等格式经 ImageMagick 自动转码。

13天前视觉、语音与多模态MIT
W

dsh-tool-vision

wanshichenguang/dsh-tool-vision

通过 DashScope OpenAI 兼容视觉接口提供 image_describe 识图工具;在纯文本模型会话中,将粘贴图片保存为模型可读取的本地路径,并在聊天记录中回显图片。

1前天视觉、语音与多模态MIT
T

dsh-plugins (dsh-vision)

tzhr-invest/dsh-plugins

Agent 可调用的视觉工具:通过你配置的任意 OpenAI 兼容视觉端点描述本地图片,支持多模型交叉核对,不内置任何密钥。

1前天视觉、语音与多模态MIT
P

dsh-screenshot

paicat1/dsh-screenshot

DeepSeek Harness (dsh) 的独立截图工具。浏览器快捷键一键截图,并提供面向智能体的截图加读取能力,让智能体能看到并分析任意屏幕区域。

1前天视觉、语音与多模态MIT
N

dsh-auto-vision

normanfxxkingrockwell/dsh-auto-vision

为纯文本 DeepSeek Harness 主模型搭视觉桥:自动从已配置模型中挑选多模态模型,通过 vision 工具把图片描述以纯文本返回。

1昨天视觉、语音与多模态MIT
M

dsh-koboldcpp-hands

microherox/dsh-koboldcpp-hands

给在线模型装上本地双手:koboldcpp_run 与 koboldcpp_vision 工具把重复的文本与视觉(OCR、图像分析、对比)劳动交给本地 KoboldCpp(llama.cpp)服务器,并按需拉起与管理服务器生命周期。

1昨天视觉、语音与多模态MIT
L

dsh-plugin-grok2api-media-tool

lsjspl/dsh-plugin-grok2api-media-tool

让 dsh 通过 grok2api 的 API 获得生成图片与视频能力。

1昨天视觉、语音与多模态
L

dsh-eyes

leeminjing/dsh-eyes

为纯文本 DeepSeek 模型提供按需视觉:上传图片后,模型通过 view_image 工具调用任意 OpenAI 兼容视觉端点(默认 Qwen/DashScope)。

13天前视觉、语音与多模态MIT
K

dsh-mindseye

kanchengw/dsh-mindseye

为纯文本 DeepSeek Harness 模型提供视觉能力:原生图片粘贴、分层证据记忆与缓存、意图驱动的工具选择。

122小时前视觉、语音与多模态MIT
G

dsh-tool-vision

gloryxpnv/dsh-tool-vision

本地优先的结构化视觉插件:图片交给本地 OpenAI 兼容 VLM,返回 JSON 证据(摘要、逐字 OCR、版面区域、实体/关系、配色、显式不确定项),带反幻觉回退与可选粘贴/上传桥;零云端成本,图片不出本机。

14天前视觉、语音与多模态MIT
E

dsh-plugin-mm-vision

elohia/dsh-plugin-mm-vision

通感编码器(Synesthesia Encoder):调用视觉模型把图片翻译成紧凑的结构化空间文字(画布/元素/百分比坐标),让纯文本 LLM 获得像素级看图能力(`mm_vision` 工具)。

15天前视觉、语音与多模态MIT
C

dsh-deepseek-vision

cheng-cheng9669/dsh-deepseek-vision

复用 DeepSeek 网页端识图模式给纯文本模型补上看图能力:deepseek_vision 工具调用本地 deepseek-vision-cli 浏览器自动化(手动登录助手、自动开启深度思考、用后自动关窗),把图片描述以文字返回给模型。

13天前视觉、语音与多模态MIT
5

dsh-youreyes

54xkeee/dsh-youreyes

纯文本 DeepSeek 的识图工具包:模型可主动调用的 `vision` 工具、deepseek/opencode-go 包装适配器(v4 flash/pro)、反重力额度(默认,flash/pro)/ 任意 OpenAI 兼容 VLM / Gemini / 本地 Ollama 通道、证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。

1昨天视觉、语音与多模态MIT
3

dsh-vision (vision-tool)

314857493/dsh-vision

给 DeepSeek Harness 的纯文本模型补上免费识图:`vision` 工具直连智谱 GLM 视觉 API 描述/OCR 图片文件(glm-4v-flash 降级链),无需任何外部 CLI。

1前天视觉、语音与多模态MIT
3

dsh-vision (vision-route)

314857493/dsh-vision

注册 `deepseek-vision` 路由:Web GUI 直接粘贴图片,由免费智谱 GLM 视觉模型转译为文字后,再交给 DeepSeek 适配器作答。

1前天视觉、语音与多模态MIT
1

dsh-vision-fallback

1helloman1/dsh-vision-fallback

将聊天图片交给固定的 OpenAI 兼容视觉模型,把事实性观察交给当前主模型,并在事件回放、上下文压缩和重启时复用会话内观察。

1昨天视觉、语音与多模态MIT
Y

dsh-sxs-anti-bot-http

yangyunsong023/dsh-sxs-anti-bot-http

反爬 HTTP 工具:UA 池轮换、指数退避重试、反爬墙检测(验证码/安全验证)与自适应限流,提炼自 SXS 生产采集体系(每日数百万请求)——工具:`sxs_fetch` / `sxs_fetch_json` / `sxs_rate_status`。

13天前工具与能力MIT