본문으로 건너뛰기

플러그인

DeepSeek-Harness 플러그인을 찾아보고, 필터링하고, 설치하세요.

플러그인 18개 찾음

F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

DeepSeek 브레인 + 자동 이미지 전사: GUI에서 이미지를 첨부하면 기본적으로 공식 deepseek-v4-flash-vision-exp로 전사됩니다(순수 텍스트 V4-Pro 브레인도 이미지를 볼 수 있음). 대안으로 OpenAI 호환 VLM 또는 로컬 Ollama 사용 가능.

16지난달비전, 음성 및 멀티모달MIT
R

dsh-plugin-call-me

radres/dsh-plugin-call-me

CallKit을 통해 전화를 겁니다: `call_me`, `text_me` 도구를 제공하며, 선택적으로 턴 종료 및 승인 시 전화를 걸어 음성 답변을 세션으로 다시 받아쓸 수 있습니다.

7그저께통합 및 원격MIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

dsh 웹용 음성 비서: 웨이크 문구(예: "小鲸")를 말하면 핸즈프리 받아쓰기가 활성화되어 말한 내용이 자동으로 전사되어 채팅 상자에 입력됩니다. 음성 편집 명령(전송, 지우기, 줄 바꿈, 읽기 중지)을 지원하고 비서의 답변을 중국어로 소리 내어 읽습니다. 음성 인식은 sherpa-onnx WASM을 통해 브라우저에서 로컬로 실행되므로 API 키 없이 오프라인에서 작동합니다.

3지난달비전, 음성 및 멀티모달MIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

웹 UI용 음성-텍스트 변환 음성 입력: 컴포저의 마이크 버튼이 브라우저 Web Speech API(제로 설정) 또는 OpenAI 호환 Whisper API(OpenAI / Groq)를 통해 발화를 초안으로 전사하며, 선택 가능한 모델 및 언어가 Settings에 포함됩니다.

3지난달비전, 음성 및 멀티모달MIT
J

dsh-voice

jesse-njx/dsh-voice

음성으로 입력하고 음성으로 답변 받기: 받아쓰기 음성이 사용자 메시지로 변환(transcribe)되고, 에이전트가 답변을 소리 내어 읽어줌(speak), ~/.dsh/voice 아래 로컬 우선 저장

32개월 전비전, 음성 및 멀티모달MIT
B

dsh-vision-plugin

bug-huntter/dsh-vision-plugin

텍스트 전용 DSH 모델용 구성 가능한 이미지 인식: 이미지 메시지는 먼저 OpenAI 호환 비전 모델(Base URL, 모델 ID 및 API 키는 설정 섹션에서 지정)로 전사된 다음, 이미지 입력 지원이 광고되면서 텍스트로 메인 모델에 전달됩니다. API 키 인증 체계는 선택 가능 — OpenAI, Anthropic, Gemini 또는 Azure 스타일 요청 헤더 — 키가 없으면 요청 전송 전에 보고됩니다.

27일 전비전, 음성 및 멀티모달MIT
K

dsh-vision-recognizer

kaixinbaba/dsh-vision-recognizer

첨부된 이미지를 구성 가능한 모델(15개 이상의 OpenAI 호환 및 Anthropic 공급업체)을 통해 텍스트로 변환하고, DeepSeek이 계속 답변하는 동안 처리하는 비전 제공업체 경로.

22개월 전비전, 음성 및 멀티모달MIT
3

dsh-vision (vision-route)

314857493/dsh-vision

`deepseek-vision` 제공자 라우트를 등록합니다. Web GUI 는 붙여넣은 이미지를 받아 무료 Zhipu GLM vision API 로 텍스트로 변환한 뒤 DeepSeek 어댑터에 전달합니다.

2지난달비전, 음성 및 멀티모달MIT
X

dsh-vision-bridge

ximengxiaolan/dsh-vision-bridge

컴포저에 첨부된 이미지를 텍스트 전용 DeepSeek 모델에 전달하기 전에 OpenAI 호환 비전 모델이 텍스트로 변환

22개월 전비전, 음성 및 멀티모달MIT
J

dsh-mmroute

jmxsxwyzjdwl/dsh-mmroute

텍스트 전용 모델을 위한 투명한 멀티모달 라우팅: 모든 모델 호출의 모든 이미지가 자체 멀티모달 이해기로 완전히 전사되며(축자 OCR, 데이터, 불확실 영역, 주입 방어), vision_relook을 통한 집중 재확인과 이미지 관련 실패 시 자동 재시도를 제공합니다. 번들 엔드포인트나 차용한 로그인이 없습니다.

128일 전비전, 음성 및 멀티모달MIT
A

dsh-audio-copilot

ai-yucheng/dsh-audio-copilot

DeepSeek Harness용 오디오 코파일럿: 오디오 전사(ASR) 및 음성 합성(TTS) — 텍스트 전용 에이전트에 귀와 목소리를 제공합니다. Windows 로컬 SAPI TTS 즉시 사용 가능; OpenAI 호환 ASR/TTS 엔드포인트 구성 가능. 컴포저 내 음성 입력 포함

12개월 전비전, 음성 및 멀티모달MIT
3

dsh-vision

314857493/dsh-vision

DeepSeek Harness 플러그인: 이미지 입력을 선언하는 `deepseek-vision` 라우트로, 무료 Zhipu GLM 비전 모델을 통해 붙여넣은 이미지를 전사한 뒤 DeepSeek 어댑터로 위임합니다.

12개월 전비전, 음성 및 멀티모달MIT
C

dsh-voice-mimo

ch1bug/dsh-voice-mimo

Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).

021일 전비전, 음성 및 멀티모달MIT
M

dsh-voice-input-en

mohith-das/dsh-voice-input-en

Minimal English-only voice input for the DeepSeek Harness Web UI: a mic button in the composer that transcribes speech into the draft via the browser's native SpeechRecognition API. No dependencies, no subprocess, no network calls beyond whatever the brow

0지난달비전, 음성 및 멀티모달MIT
S

dsh-vision-pro-bridge

shainedemo/dsh-vision-pro-bridge

Vision bridge for text-only DeepSeek models: transcribes attached images with deepseek-v4-flash-vision-exp before they reach deepseek-v4-pro, with no third-party dependencies.

0지난달비전, 음성 및 멀티모달MIT
J

dsh-autovision

junkrat9527/dsh-autovision

Vision for text-only dsh models: paste an image and a configured multimodal model transcribes it to text automatically — transparent twin routing, an agent-callable read-image tool, no built-in keys or relay.

02개월 전비전, 음성 및 멀티모달MIT
N

dsh-voice-input

newdanew/dsh-voice-input

Voice input for the web UI: a mic button in the composer that transcribes speech into the draft via the Web Speech API, with an optional auto-send toggle.

02개월 전비전, 음성 및 멀티모달MIT
E

dsh-plugin-image-input

elohia/dsh-plugin-image-input

Image-to-text input for the Web UI: paste or drag an image and it is transcribed into structured text and sent, giving text-only LLMs image-input takeover (OpenAI-compatible vision API).

02개월 전비전, 음성 및 멀티모달MIT