플러그인
DeepSeek-Harness 플러그인을 찾아보고, 필터링하고, 설치하세요.
플러그인 86개 찾음
modlens
liustack/modlens
텍스트 전용 모델을 위한 비전 브리지: 이미지를 붙여넣으면 구조화된 JSON 증거(OCR, 레이아웃, 의미 분석)를 반환합니다.
dsh-vision-router
ysr666/dsh-vision-router
텍스트 전용 에이전트를 위한 무료 비전 기능: 키 없이 사용 가능한 내장 비전 체인과 픽셀 도구(Q&A, 그라운딩, 자르기, 픽셀 비교, 색상, OCR, SVG 트레이스, 컷아웃, 스크린샷)를 제공하며, 이미지를 붙여넣기만 하면 됩니다.
dsh-vision-toolkit
anionex/dsh-vision-toolkit
텍스트 전용 모델에 비전 기능 추가: 이미지를 붙여넣으면 모델이 Vision Toolkit 변형으로 전환되어 이미지 Q&A, 다중 이미지 비교, 긴 스크린샷 OCR, 스크린샷 기반 UI 재현, 요소 그라운딩, 픽셀 차이를 지원합니다. 기본적으로 API 키가 필요 없으며, 작성자가 호스팅하는 무료 서비스로 머신당 하루 100장까지 처리 가능합니다. 자체 공급자로 변경하도록 구성할 수 있습니다.
Invoice-Downloader (dsh-invoice-downloader)
ethanyoq/invoice-downloader
DeepSeek Harness용 로컬 IMAP 청구서 다운로드, OCR, 아카이브, Excel 출장비 정산 요약.
watch-skill
oxbshw/watch-skill
기존 DeepSeek Harness 프로필에 설치할 수 있는 DeepWatch의 기능입니다.
dsh-ios
zseven-w/dsh-ios
대화 안에 살아 있는 iOS 시뮬레이터 또는 USB 연결 iPhone: 부팅, 빌드, 접근성 식별자 또는 OCR 텍스트로 UI 조작, 목록 행 작업, SwiftUI 프리뷰 핫 리로드를 위한 22개 에이전트 도구와, 탭하고 드래그할 수 있는 스트리밍 사이드바 패널이 있다.
dsh-android
zseven-w/dsh-android
대화 안의 살아 있는 Android 기기 — 에뮬레이터 또는 USB 폰을 adb로 완전히 제어: 스트리밍, Gradle 빌드 및 실행, UI 트리 또는 OCR 상호작용, logcat, 프로세스와 메모리를 위한 20개 에이전트 도구, 그리고 세 개 버튼의 내비게이션 패널이 있다.
invoice-downloader
ethanyoq/invoice-downloader
DeepSeek Harness용 로컬 IMAP 송장 다운로드, OCR, 아카이브 및 Excel 요약 번들
dsh-openmaic
thu-maic/dsh-openmaic
OpenMAIC: 강의실, 슬라이드, 인터랙티브 위젯, 소크라테스식 교수법을 제공합니다.
dsh-openbiliclaw
whiteguo233/dsh-openbiliclaw
DSH용 OpenBiliClaw 소비자 패널: 추천, 저장 목록, 소크라테스식 대화, 프로필 보기, Agent Bridge 도구.
picturereader
jing-hy/picturereader
텍스트 전용 모델을 위한 이미지 "읽기": 다운스케일 + 색 심도 축소 + 구조/색상 지문을 텍스트 그리드로 변환하여 대화에 다시 전달함으로써, 모델이 멀티모달 모델처럼 자율적으로 확대, 샘플링, OCR을 수행할 수 있게 합니다. 외부 모델 의존성 없이 완전히 로컬에서 동작하며, 이미지 읽기 방법론 스킬과 선택적 PaddleOCR을 함께 제공합니다.
dsh-computer-use-win
yu-tao-li/dsh-computer-use-win
DeepSeek Harness용 Windows 컴퓨터 사용: PowerShell UIA 백엔드를 통한 MCP stdio 서버, 22개의 데스크톱 도구(UIA 트리, 스크린샷, 입력, OCR, 윈도우 관리, 페일세이프) 노출.
dsh-vision-proxy
flyvhidbwo/dsh-vision-proxy
DeepSeek 브레인 + 자동 이미지 전사: GUI에서 이미지를 첨부하면 기본적으로 공식 deepseek-v4-flash-vision-exp로 전사됩니다(순수 텍스트 V4-Pro 브레인도 이미지를 볼 수 있음). 대안으로 OpenAI 호환 VLM 또는 로컬 Ollama 사용 가능.
dsh-pdf-mineru
yurzi/dsh-pdf-mineru
MinerU 기반의 제공자 독립적인 DSH 문서 파싱으로, 기본 백그라운드 작업, 변경 불가 결과, 안전한 요청 병합을 지원한다.
dsh-docs
sqhao-o/dsh-docs
DeepSeek Harness를 위한 로컬 PDF, Office, 이미지 및 OCR 문서 인텔리전스.
DSH-FormatForge (dsh-formatforge)
tianbuyu-wwx/dsh-formatforge
FormatForge: 드래그 앤 드롭 수신함, ff_translate/ff_formats/ff_result 도구, CLI를 통해 30개 이상의 파일 형식(PDF, DOCX, PPTX, XLSX, EML, EPUB, TOML, 아카이브)을 AI가 읽을 수 있는 텍스트로 벼려냅니다. 스캔 PDF는 로컬 OCR 또는 세션 모델용 향상 힌트로 폴백합니다.
dsh-vision
linenxi-ctrl/dsh-vision
DeepSeek Harness용 외부 비전 플러그인: 고래 버튼 설정 패널, 자동 답변이 포함된 이미지 인식, 에이전트 스크린샷/인식 도구를 제공합니다.
dsh-free-vision
fuzzysoul/dsh-free-vision
텍스트 전용 모델용 무료 비전 브리지: 무료 티어 제공자(Qwen3-VL-Flash, Doubao, DeepSeek-OCR)를 통한 이미지 이해, OCR, UI 및 디버그 분석, 설정 GUI 포함.
dsh-iris
mokuyoaxis/dsh-iris
DeepSeek Harness용 미디어 및 비전 워크스페이스입니다. 이미지·비디오·음성 생성, 이미지 Q&A와 요소 위치 찾기, 긴 이미지 OCR, 픽셀 diff, HTML 스크린샷 검증, 비디오 요약을 제공하며 DashScope 및 OpenAI 호환 제공자, 모델 풀, 워크벤치 클라이언트를 지원합니다.
dsh-vision
54xkeee/dsh-vision
텍스트 전용 DeepSeek을 위한 비전 기능으로, 기본값은 Doubao Web 경유(무료, API 키 불필요 — Windows CDP 브리지를 통해 로그인된 Chrome을 구동), Antigravity IDE 쿼터(flash/pro) 또는 Gemini 폴백을 지원. 자동 디테일 단계 상승, 컴팩션 후 재수화가 가능한 비전 증거 메모리, 콘텐츠 해시 캐시, 이중 언어 클라이언트 패널을 제공합니다.
dsh-learning-mode (plugin)
chplus0/dsh-learning-mode
Learning Mode 에이전트 프리셋: 코딩하는 동안 가르치는 코딩 에이전트 - 구체적인 시나리오 기반 설명, 소크라테식 안내, TODO(당신) 연습 빈칸, Claude Code의 Learning 출력 스타일 모델링; dsh plugin add (dsh-learning-mode on npm)을 통해 설치 가능.
macos-computer-use-kit
sur-cai/macos-computer-use-kit
DeepSeek Harness를 위한 AX 우선 macOS 컴퓨터 사용: 안정적인 참조가 있는 접근성 스냅샷, 백그라운드 입력, 유니코드 입력, 메뉴, 앱, set-of-mark 스크린샷, 온디바이스 OCR, 검증된 작업, 그리고 선택적 Jev(TypeSafe System One) 시맨틱 가드 — 1
macos-computer-use-kit (dsh)
sur-cai/macos-computer-use-kit
DeepSeek Harness용 AX 우선 macOS 컴퓨터 사용: 안정적 ref를 쓰는 접근성 스냅샷, 백그라운드 입력, 유니코드 타이핑, 메뉴와 앱, set-of-mark 스크린샷, 온디바이스 OCR, 검증된 동작 — macos-cu CLI에 브리지된 11개 도구.
dsh-ocr-local
grelvan/dsh-ocr-local
텍스트 전용 경로용 로컬 OCR 폴백: 세션 모델이 이미지를 수용할 수 없다고 선언하면 첨부된 이미지가 로컬에 캐시되고 해당 경로가 주입되어 모델이 ocr_image를 호출할 수 있음 — PP-OCRv5 + ONNX Runtime을 CPU에서 실행, API 키 불필요, 이미지가 기기를 떠나지 않음. 모델이 이미지를 볼 수 있을 때는 조용함.