본문으로 건너뛰기

플러그인

DeepSeek-Harness 플러그인을 찾아보고, 필터링하고, 설치하세요.

플러그인 45개 찾음

F

dsh-memory

furongjun-1999/dsh-memory

화이트박스 AGI 아키텍처 탐구: 메타인지(자기인식 루프), 지속적 학습(지식 플라이휠), 월드 모델(조건 공간, 시공간 메모리 그래프), 자기 개선(부트스트랩 규율), 제로 LLM 화이트박스 파이프라인, 감사 가능한 신뢰 가드레일.

30815시간 전메모리MIT
B

DSH-Plugins-Marketplace

bradegithub/dsh-plugins-marketplace

GitHub 토픽 기반 플러그인 및 스킬 마켓플레이스: 자동 수집된 레지스트리(전체 dsh-plugin 토픽과 스킬 인덱스, 2시간마다 CI로 갱신)를 탐색하는 설정 페이지로, 원클릭 설치, 유형 감지, 설치 스크립트 및 호스트 섀도우 의존성 안전 확인, 환경 변수 키 관리, STANDARD.md 인식 사양을 제공합니다.

1694시간 전개발 및 플러그인 도구MIT
F

dsh-prompt-enhancer

fishsb/dsh-prompt-enhancer

작성기용 원클릭 프롬프트 강화(5가지 모드, 메모리 체인, 멀티 모델 폴백) 및 음성 인식(클라우드 Qwen3-ASR / 오프라인 SenseVoice, 무음 시 자동 정지), 원클릭 DSH 서비스 재시작 포함.

825일 전도구 및 기능
P

dsh-voice-scribe

pensivefei/dsh-voice-scribe

웹 UI용 음성 입력: Alt(또는 Alt+Space)를 눌러 받아쓰기 시작/중지, 브라우저 Web Speech(제로 구성) 또는 OpenAI 호환 클라우드 ASR, DSH 구성 LLM을 통한 선택적 다듬기, 설정 UI.

343일 전비전, 음성 및 멀티모달MIT
W

dsh-ears

wiziscool/dsh-ears

DeepSeek Harness(dsh)용 음성 입력 플러그인: 컴포저의 마이크 버튼으로 음성을 초안 텍스트로 변환하며, 다양한 음성 인식 백엔드 선택, dsh 자체 LLM 경로를 통한 선택적 다듬기, 네이티브 설정 페이지를 지원합니다.

2123시간 전비전, 음성 및 멀티모달MIT
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

DeepSeek Harness Web UI용 풀 듀플렉스 음성 모드: 토글(2초 일시정지 자동 전송) 또는 zipformer2 스트리밍 ASR로 편집 가능한 초안으로의 홀드 투 토크 받아쓰기, 선택 가능한 웨이크 워드 지원; 라이브 캡션이 포함된 문장별 Edge TTS 읽어주기, 말하는 동안 재생과 실행 중인 턴을 중단(진짜 barge-in). 온디바이스 ASR, API 키 불필요.

158시간 전비전, 음성 및 멀티모달MIT
L

dsh-vision

linenxi-ctrl/dsh-vision

DeepSeek Harness용 외부 비전 플러그인: 고래 버튼 설정 패널, 자동 답변이 포함된 이미지 인식, 에이전트 스크린샷/인식 도구를 제공합니다.

92개월 전비전, 음성 및 멀티모달MIT
A

dsh-highres-vision

azwosile/dsh-highres-vision

DeepSeek Harness 네이티브 비전 모델 deepseek-v4-flash-vision-exp를 위해 이미지 허용 한도를 32 MiB / 8192 px / 600장으로 상향하고, 큰 이미지를 타일로 분할한 뒤 호스트의 read_image 도구를 통해 전체 이미지와 800x800 타일을 반환하는 highres_read 도구를 추가합니다.

822일 전비전, 음성 및 멀티모달MIT
3

dsh-voice

3274375092/dsh-voice

DeepSeek Harness용 음성 입력: 마이크에 말하면 인식된 텍스트가 일반 채팅 메시지로 제출됩니다. 로컬 또는 브라우저 음성 인식 사용.

8그저께비전, 음성 및 멀티모달MIT
5

dsh-vision

54xkeee/dsh-vision

텍스트 전용 DeepSeek을 위한 비전 기능으로, 기본값은 Doubao Web 경유(무료, API 키 불필요 — Windows CDP 브리지를 통해 로그인된 Chrome을 구동), Antigravity IDE 쿼터(flash/pro) 또는 Gemini 폴백을 지원. 자동 디테일 단계 상승, 컴팩션 후 재수화가 가능한 비전 증거 메모리, 콘텐츠 해시 캐시, 이중 언어 클라이언트 패널을 제공합니다.

72개월 전비전, 음성 및 멀티모달MIT
G

dsh-tool-see-image

gugu123a/dsh-tool-see-image

DSH용 see_image 도구를 제공합니다. 이미지 파일을 구성 가능한 OpenAI 호환 비전 모델로 전송하고 그 설명을 텍스트 전용 모델에 전달합니다.

5지난달도구 및 기능MIT
N

vision-exp-tile

nicholas023/vision-exp-tile

vision-exp 모델용 대용량 이미지 인식: 무손실 800×800 타일 인식(smart/pipeline/full), 전처리 및 손글씨 라우팅을 포함한 로컬 OCR, DirectML/CUDA/OpenVINO 선택적 멀티벤더 GPU(CPU 자동 폴백).

5지난달비전, 음성 및 멀티모달MIT
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

웹 UI를 위한 무료 음성 클로즈드 루프: 브라우저 SpeechRecognition 마이크 입력으로 실시간 임시 결과를 표시하고, 읽어주기 스피커 버튼과 어시스턴트 응답 자동 읽기를 제공합니다. 설정 불필요, API 키도 불필요.

42개월 전비전, 음성 및 멀티모달MIT
S

dsh-linghun

syyr1987/dsh-linghun

DeepSeek Harness의 판단 코어: 모든 결정에 출처와 근거를 부여하고 계획을 끝까지 밀어붙이는 인지 루프, 실행 경험을 재사용 가능한 지식으로 압축하는 해마 메모리, 사용자 정의 가능한 페르소나 카드(이름·성격·소통 방식). DSH ^0.1.0-rc.7 필요.

314시간 전메모리
A

dsh-j-space

anonyjcy/dsh-j-space

J-Space Cognition Suite SV1 네이티브 에이전트 프리셋 및 독립 실행형 Cordis 플러그인: 13개 모듈, 영속 컨트롤러, 분리된 워크스페이스.

33일 전메모리MIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

DSH용 옴니모달 워크스테이션: 순서가 지정된 다중 카드 VLM 페일오버 체인을 통한 analyze_image, 동일한 이미지 리졸버를 공유하는 6종 비전 툴킷(확대, 색상 샘플링, 픽셀 diff, OCR, 요소 감지, 인라인 표시), OpenAI/DashScope/ComfyUI 프로토콜을 통한 generate_image, /build-video-tool 빌더가 있는 다중 카드 비동기 generate_video, 7개 provider를 통한 speak/clone_voice TTS를 제공하며, 모두 자동 저장 설정 페이지 하나로 구동됩니다.

314일 전비전, 음성 및 멀티모달MIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

컴포저를 위한 한 손, 키보드 없는 입력: 입력 상자에서 마우스를 길게 누르고 말한 뒤 놓으면 텍스트가 초안에 들어가고, 위로 밀면 반쯤 남은 문장 없이 취소됩니다. 겨냥할 마이크 버튼도, 외울 단축키도 없으며 손이 입력 영역을 떠날 필요가 없습니다. 다른 손이 바쁠 때 유용합니다. 인식은 완전히 오프라인으로 실행됩니다(SenseVoice + sherpa-onnx, API 키 불필요, 오디오는 기기를 떠나지 않음).

322시간 전비전, 음성 및 멀티모달MIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

dsh 웹용 음성 비서: 웨이크 문구(예: "小鲸")를 말하면 핸즈프리 받아쓰기가 활성화되어 말한 내용이 자동으로 전사되어 채팅 상자에 입력됩니다. 음성 편집 명령(전송, 지우기, 줄 바꿈, 읽기 중지)을 지원하고 비서의 답변을 중국어로 소리 내어 읽습니다. 음성 인식은 sherpa-onnx WASM을 통해 브라우저에서 로컬로 실행되므로 API 키 없이 오프라인에서 작동합니다.

3지난달비전, 음성 및 멀티모달MIT
L

dsh-voco

lgquan/dsh-voco

DSH를 위한 핸즈프리 듣기, 푸시 투 토크, 음성 인식, TTS 응답 및 백그라운드 Agent 위임을 갖춘 연속 음성 대화.

3지난달비전, 음성 및 멀티모달MIT
X

dsh-image-vision

xiaoyuink/dsh-image-vision

모든 DSH 모델을 위한 이미지 이해: vision, OCR, grounding, 크롭 도구와 병리조직학, 세포생물학, 해부학, 임상 이미지, 과학 도표용 도메인 프리셋.

329일 전비전, 음성 및 멀티모달
N

voco-input-sh

nothree-code/voco-input-sh

웹 UI용 음성 입력: 로컬 VocoType 오프라인 음성 인식을 구동하고 인식된 텍스트를 작성창에 자동 삽입하는 마이크 버튼(자동 배포, 중복 제거, 연속 받아쓰기).

319일 전비전, 음성 및 멀티모달MIT
W

visual-review

wang-bool/visual-review

붙여넣거나 업로드한 이미지를 DSH Web 채팅 안에서 인라인으로 렌더링하고, 텍스트 전용 모델에 시각 기능을 제공합니다. 모델이 호출할 수 있는 visual_review 도구는 먼저 OpenAI 호환 멀티모달 API를 사용하고, 실패하면 로컬 Qwen3-VL 워커로 폴백합니다.

32개월 전비전, 음성 및 멀티모달MIT
M

dsh-vision-tools

moon09300731/dsh-vision-tools

DeepSeek Harness용 완전한 비전 기능 번들입니다. vision_understand 도구(OpenAI 호환 비전 API, 기본적으로 무료 Zhipu GLM-4V-Flash)와 이미지 인식을 위한 붙여넣기/드래그 앤 드롭/버튼 진입점을 제공합니다.

32개월 전비전, 음성 및 멀티모달MIT
B

dsh-voice-call

biliye/dsh-voice-call

DSH 웹 GUI의 음성 통화 도우미: 드래그 가능한 플로팅 통화 볼, 발화마다 일시정지 후 전송하는 브라우저 측 VAD, FunASR HTTP 또는 스트리밍 음성 인식, MiniMax 또는 OpenAI 호환 TTS 응답, 자동 절전이 있는 선택적 웨이크 워드 모드, 그리고 진행·중지·음성 완료 보고가 있는 별도 서브에이전트 세션으로의 작업 파견.

25일 전비전, 음성 및 멀티모달MIT