跳过主要内容

插件

浏览、筛选并安装 DeepSeek-Harness 插件。

共 14 个插件

F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

DeepSeek 大脑 + 自动识图:GUI 附加的每张图片自动经官方 deepseek-v4-flash-vision-exp 原生识图转译,再交给纯文本的 DeepSeek 作答(纯文本 V4-Pro 也能看图);支持任意 OpenAI 兼容 VLM 与本地 Ollama 作为备选。

14上个月视觉、语音与多模态MIT
M

dsh-iris

mokuyoaxis/dsh-iris

面向 DeepSeek Harness 的媒体与视觉工作台:文生图、图/文生视频、语音合成与转写、图像问答与元素定位、长图 OCR、像素比对、HTML 截图验证、视频摘要;支持 DashScope 与 OpenAI 兼容供应商,含模型池与工作台客户端。

710天前工具与能力MIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

面向 DSH 的全模态工作站:analyze_image 走有序多卡片 VLM 故障转移链;六个视觉工具箱工具(局部放大、色调采样、像素比对、OCR、元素检测、内联展示)共用同一套图片来源解析;generate_image 支持 OpenAI/DashScope/ComfyUI 协议;多卡片异步 generate_video 配 /build-video-tool 构建器;speak/clone_voice 语音合成覆盖七家供应商;全部由一个自动保存的设置页驱动。

311天前视觉、语音与多模态MIT
M

dsh-ui-mockup

mackwan84/dsh-ui-mockup

ui_mockup 工具 Consumer:研讨阶段生成 UI 线框图/高保真草图,落盘设计稿并提示确认后锁定设计规格;含客户端卡片、图片路由与 i18n

219天前视觉、语音与多模态MIT
M

dsh-ui-mockup (ui-mockup)

mackwan84/dsh-ui-mockup

在 DeepSeek Harness 中使用可切换的阿里云百炼与火山方舟图像服务生成 UI 线框图和高保真设计稿。

213天前UI 增强MIT
C

dsh-bailian-models

croissantts/dsh-bailian-models

阿里百炼(DashScope)模型目录预设与自动适配:36 个模型的上下文窗口、推理档位与思考预算声明

114天前模型与账号接入MIT
N

dsh-imgdraw

ninjasln-labs/dsh-imgdraw

DeepSeek Harness 文生图:draw_image 工具、生图弹窗(四宫格、下载/保留/删除)、/imgdraw 路由;后端 DashScope。

125天前视觉、语音与多模态MIT
R

dsh-image-gen

randomix777/dsh-image-gen

dsh-image-gen 优化版:支持批量生图(count 参数)、画廊分页懒加载、请求超时/重试,兼容 7 个提供商:Gemini/OpenAI/Seedream/通义万相/Agnes/智谱 GLM/Stability AI。

13天前工作流与自动化Apache-2.0
Y

dsh-video-gen

yang-wudi/dsh-video-gen

通过阿里通义万相、火山引擎 Seedance、Google Veo 与 OpenAI Sora 生成文生视频与图生视频,结果保存到会话工作区,内置视频画廊(网格、灯箱、下载、删除),DSH 重启后仍可播放。

1上个月视觉、语音与多模态
S

dsh-voice-input-cn

schumchanvi/dsh-voice-input-cn

国内可用的输入框语音输入。需要先启动本地 Python bridge(pip install dashscope websockets,运行 bridge/voice-bridge.py)——只装插件不可用。浏览器麦克风采集 16kHz PCM 流式转发给 bridge,由阿里云 DashScope ASR(paraformer-realtime-v2)识别;识别文字在光标处实时填入草稿,静音自动停止,可选识别后自动发送。

113天前视觉、语音与多模态MIT
A

dsh-image-plugins

alanzhao0128/dsh-image-plugins

DeepSeek Harness 多模态插件:通过可配置的 OpenAI 兼容或 DashScope 端点实现图像理解与图像生成。

1上个月视觉、语音与多模态MIT
Z

dsh-plugins

zjcdkj/dsh-plugins

为纯文本编码模型装上「眼睛」:通过 ctx.llm 将图片路由给 Qwen-VL(DashScope)识别后返回文本。

1上个月视觉、语音与多模态MIT
W

dsh-tool-vision

wanshichenguang/dsh-tool-vision

面向模型的 image_describe(识图)工具(DashScope OpenAI 兼容接口,qwen3.7-flash)+ 粘贴桥:纯文本模型会话里粘贴的图片在发送时自动转为文件路径并在聊天记录中回显,不再触发图片准入拦截。自带 DASHSCOPE_API_KEY;端点/模型/预算可配置,重定向防护 HTTP 客户端,所有 Agent 预设均可用。

1上个月视觉、语音与多模态MIT
L

dsh-eyes

leeminjing/dsh-eyes

为纯文本 DeepSeek 模型提供按需视觉:上传图片后,模型通过 view_image 工具调用任意 OpenAI 兼容视觉端点(默认 Qwen/DashScope)。

1上个月视觉、语音与多模态MIT