본문으로 건너뛰기

플러그인

DeepSeek-Harness 플러그인을 찾아보고, 필터링하고, 설치하세요.

플러그인 86개 찾음

N

vision-exp-tile

nicholas023/vision-exp-tile

vision-exp 모델용 대용량 이미지 인식: 무손실 800×800 타일 인식(smart/pipeline/full), 전처리 및 손글씨 라우팅을 포함한 로컬 OCR, DirectML/CUDA/OpenVINO 선택적 멀티벤더 GPU(CPU 자동 폴백).

5지난달비전, 음성 및 멀티모달MIT
B

dsh-ocr-local

balcoz/dsh-ocr-local

DeepSeek Harness용 로컬 OCR: 이미지를 붙여넣기/첨부하여 PP-OCRv5 + ONNX Runtime으로 텍스트를 추출, 완전 오프라인. TUI (cc-tui) 및 Web 지원.

52개월 전비전, 음성 및 멀티모달
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

텍스트 전용 DSH 세션을 위한 온디맨드 비전: 이미지는 마커로 변환되며, vision_describe 도구가 이미지와 질문만 OpenAI 호환 비전 모델로 전송합니다

52개월 전비전, 음성 및 멀티모달MIT
E

canvas-workbench

elangan1997-cmyk/canvas-workbench

로컬 이미지 생성 워크벤치, 구독료 제로: 자체 API로 이미지 생성(모든 OpenAI 호환 인터페이스, 구독료 0), 캔버스 레이아웃 + 이미지 편집/지우개/배경 제거/OCR/벡터 변환, 편집 가능한 PSD/AI 출력 제공, Photoshop/Illustrator 레이어 양방향 브리지

43일 전비전, 음성 및 멀티모달MIT
L

dsh-attachment-formats

linkingoscar/dsh-attachment-formats

DeepSeek Harness Web 플러그인 — PDF 텍스트 레이어 및 스캔 PDF OCR, Office docx/xlsx/pptx를 Markdown으로, TIFF/epub 및 긴 문서 인덱스 카드.

4그저께도구 및 기능Apache-2.0
X

dsh-vision-hub (tool-vision)

xing666173/dsh-vision-hub

강화된 비전 툴박스: 단일 OpenAI 호환 엔드포인트로 구동되는 14개의 픽셀 레벨 비전 툴(describe, ground, detect, crop, pixel-diff, OCR, long-screenshot OCR, vectorize, colors, cutout, screenshot, present, materialize, html-screenshot), 깔끔한 [图片: path] 브리지 마커, 콘텐츠 안전 분류 및 속도 제한 자동 재시도.

4지난달비전, 음성 및 멀티모달
X

dsh-vision-hub (file-drop)

xing666173/dsh-vision-hub

PDF, Word, Excel 및 이미지에 대한 드래그 앤 드롭 파일 업로드: 드롭된 파일은 로컬 디렉터리에 저장되고 경로로 참조되며, 채팅에 base64 블로트가 없습니다.

4지난달도구 및 기능
X

dsh-vision-hub (bridge-preview)

xing666173/dsh-vision-hub

[图片: path] 이미지 브리지 마커의 인라인 미리보기: 마커가 렌더링된 후 이미지가 채팅에 자동으로 표시되어 긴 지시문이 대화에 들어가지 않습니다.

4지난달세션 및 메시지
M

dsh-nuphus-mcp

mrpulor-gh/dsh-nuphus-mcp

nuphus-mcp 공식 DSH 플러그인(nuphus-mcp 메인테이너 제작): PaddleOCR 요소 인식 및 Chrome CDP 브라우징을 갖춘 데스크톱 및 브라우저 자동화(38개 도구), 영구 stdio MCP 자식 프로세스를 통해 동작

4지난달도구 및 기능MIT
G

deepseek-vision

gou-gee/deepseek-vision

DeepSeek Harness 네이티브 비전 번들: 이미지 붙여넣기 또는 드래그, 호스팅되는 deepseek-vision-mcp를 통해 OpenAI 호환 비전 모델 호출.

42개월 전MCP 및 커넥터MIT
N

free-vision-skill

niyongsheng/free-vision-skill

macOS Vision Framework를 통한 완전 로컬 이미지 이해 및 OCR: `ocr_image`(텍스트, 표 레이아웃 + 좌표) 및 `view_image`(장면, 얼굴, QR) — 여러 이미지를 웹 입력 상자에 붙여넣거나 path/URL/base64로 전달 가능. 이미지는 Mac 밖으로 나가지 않습니다.

4지난달비전, 음성 및 멀티모달MIT
G

deepseek-vision (dsh-plugin-deepseek-vision)

gou-gee/deepseek-vision

텍스트 전용 DeepSeek용 비전 MCP 및 DSH 번들: analyze_image, analyze_clipboard, compare_images 및 vision_status 도구, 비주얼 설정 페이지, 기본적으로 무료 GLM-4.6V-Flash, 결과 캐싱 및 속도 제한 허용 오차; 키는 로그에 남지 않음.

426일 전비전, 음성 및 멀티모달MIT
C

dsh-learning-mode

chplus0/dsh-learning-mode

Learning Mode 에이전트 프리셋: 코딩하면서 가르치는 코딩 에이전트 - 구체적인 시나리오 기반 설명, 소크라테스식 가이드, TODO(你) 연습 빈칸, Claude Code의 Learning 출력 스타일을 모델로 함. `dsh plugin add` (npm의 dsh-learning-mode)로 설치 가능.

42개월 전도구 및 기능
F

dsh-plugin-deepeye

favio8/dsh-plugin-deepeye

DeepSeek Harness(DSH)용 DeepEye 비전 플러그인으로, 이미지 설명, OCR, VQA, UI 레이아웃, 클립보드 분석을 지원합니다.

42개월 전비전, 음성 및 멀티모달
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

DSH용 옴니모달 워크스테이션: 순서가 지정된 다중 카드 VLM 페일오버 체인을 통한 analyze_image, 동일한 이미지 리졸버를 공유하는 6종 비전 툴킷(확대, 색상 샘플링, 픽셀 diff, OCR, 요소 감지, 인라인 표시), OpenAI/DashScope/ComfyUI 프로토콜을 통한 generate_image, /build-video-tool 빌더가 있는 다중 카드 비동기 generate_video, 7개 provider를 통한 speak/clone_voice TTS를 제공하며, 모두 자동 저장 설정 페이지 하나로 구동됩니다.

314일 전비전, 음성 및 멀티모달MIT
X

dsh-image-vision

xiaoyuink/dsh-image-vision

모든 DSH 모델을 위한 이미지 이해: vision, OCR, grounding, 크롭 도구와 병리조직학, 세포생물학, 해부학, 임상 이미지, 과학 도표용 도메인 프리셋.

329일 전비전, 음성 및 멀티모달
Y

dsh-ui-spec

yumimanji/dsh-ui-spec

OCR, 결정론적 기하학, 씬 그래프, 에셋 및 렌더링 비교를 사용하여 UI 스크린샷을 구현 등급 웹 사양으로 변환하는 DeepSeek Harness 플러그인입니다.

32개월 전비전, 음성 및 멀티모달MIT
F

dsh-wechat-mp-studio

funcwei/dsh-wechat-mp-studio

WeChat 공식 계정 콘텐츠 스튜디오: 획일화 회피를 위한 로테이션 작성, 창의성이 낮을 때의 복구 플레이북, 축복 이미지 시각 기준선, OCR 수용이 포함된 gpt-image 파이프라인, 그리고 실측한 xiaolvshu 초안 웹 API를 제공합니다.

32개월 전스킬MIT
O

dsh-paddle-ocr

omdsh-dev/dsh-paddle-ocr

32개월 전비전, 음성 및 멀티모달BSD-3-Clause
Y

dsh-md-convert

yakoylp/dsh-md-convert

Office 문서 및 PDF(스캔된 PDF 포함)를 CPU 우선 라우팅 OCR 파이프라인(RapidOCR/SLANet/FormulaNet)을 통해 구조적으로 형식화된 Markdown으로 변환합니다.

222일 전워크플로 및 자동화MIT
L

dsh-visibridge

lhbsaa/dsh-visibridge

구조화된 비전 증거(OCR/레이아웃/의미) 외에 "촬영-확인-조정" 디버그 루프용 USB 카메라 캡처 도구를 제공합니다. 백엔드: Ollama, DeepSeek, Xiaomi.

2지난달비전, 음성 및 멀티모달MIT
F

auto-mouse

fish121380/auto-mouse

Codex, DeepSeek Harness, MCP 클라이언트용 Windows 데스크톱 UI 컨텍스트 선택기: 호버 강조, UI Automation, 스크린샷, 로컬 OCR로 창·UI 요소·화면 영역을 선택한 뒤 Markdown/JSON 컨텍스트를 출력 전에 검토·승인.

2지난달도구 및 기능MIT
G

dsh-vision-bridge

goodandready/dsh-vision-bridge

이미지를 선택한 비전 모델로 라우팅합니다 — 자동 재작성, 명시적 도구, 또는 하이브리드 방식 — 그래서 텍스트 전용 채팅 모델이 그림이 포함된 턴에서 실패하지 않습니다.

26일 전비전, 음성 및 멀티모달MIT
3

dsh-vision (vision-tool)

314857493/dsh-vision

DeepSeek Harness용 모델 호출형 `vision` 도구입니다. 무료 Zhipu GLM vision API 를 직접 호출해 이미지 파일을 설명하고 OCR 하며(glm-4v-flash 폴백 체인 포함), 외부 CLI 는 필요하지 않습니다.

228일 전비전, 음성 및 멀티모달MIT