플러그인
DeepSeek-Harness 플러그인을 찾아보고, 필터링하고, 설치하세요.
플러그인 18개 찾음
dsh-vision-proxy
flyvhidbwo/dsh-vision-proxy
DeepSeek 브레인 + 자동 이미지 전사: GUI에서 이미지를 첨부하면 기본적으로 공식 deepseek-v4-flash-vision-exp로 전사됩니다(순수 텍스트 V4-Pro 브레인도 이미지를 볼 수 있음). 대안으로 OpenAI 호환 VLM 또는 로컬 Ollama 사용 가능.
dsh-plugin-call-me
radres/dsh-plugin-call-me
CallKit을 통해 전화를 겁니다: `call_me`, `text_me` 도구를 제공하며, 선택적으로 턴 종료 및 승인 시 전화를 걸어 음성 답변을 세션으로 다시 받아쓸 수 있습니다.
dsh-voice-assistant
supersyh-sss/dsh-voice-assistant
dsh 웹용 음성 비서: 웨이크 문구(예: "小鲸")를 말하면 핸즈프리 받아쓰기가 활성화되어 말한 내용이 자동으로 전사되어 채팅 상자에 입력됩니다. 음성 편집 명령(전송, 지우기, 줄 바꿈, 읽기 중지)을 지원하고 비서의 답변을 중국어로 소리 내어 읽습니다. 음성 인식은 sherpa-onnx WASM을 통해 브라우저에서 로컬로 실행되므로 API 키 없이 오프라인에서 작동합니다.
dsh-stt-input
baisama-cloud/dsh-stt-input
웹 UI용 음성-텍스트 변환 음성 입력: 컴포저의 마이크 버튼이 브라우저 Web Speech API(제로 설정) 또는 OpenAI 호환 Whisper API(OpenAI / Groq)를 통해 발화를 초안으로 전사하며, 선택 가능한 모델 및 언어가 Settings에 포함됩니다.
dsh-voice
jesse-njx/dsh-voice
음성으로 입력하고 음성으로 답변 받기: 받아쓰기 음성이 사용자 메시지로 변환(transcribe)되고, 에이전트가 답변을 소리 내어 읽어줌(speak), ~/.dsh/voice 아래 로컬 우선 저장
dsh-vision-plugin
bug-huntter/dsh-vision-plugin
텍스트 전용 DSH 모델용 구성 가능한 이미지 인식: 이미지 메시지는 먼저 OpenAI 호환 비전 모델(Base URL, 모델 ID 및 API 키는 설정 섹션에서 지정)로 전사된 다음, 이미지 입력 지원이 광고되면서 텍스트로 메인 모델에 전달됩니다. API 키 인증 체계는 선택 가능 — OpenAI, Anthropic, Gemini 또는 Azure 스타일 요청 헤더 — 키가 없으면 요청 전송 전에 보고됩니다.
dsh-vision-recognizer
kaixinbaba/dsh-vision-recognizer
첨부된 이미지를 구성 가능한 모델(15개 이상의 OpenAI 호환 및 Anthropic 공급업체)을 통해 텍스트로 변환하고, DeepSeek이 계속 답변하는 동안 처리하는 비전 제공업체 경로.
dsh-vision (vision-route)
314857493/dsh-vision
`deepseek-vision` 제공자 라우트를 등록합니다. Web GUI 는 붙여넣은 이미지를 받아 무료 Zhipu GLM vision API 로 텍스트로 변환한 뒤 DeepSeek 어댑터에 전달합니다.
dsh-vision-bridge
ximengxiaolan/dsh-vision-bridge
컴포저에 첨부된 이미지를 텍스트 전용 DeepSeek 모델에 전달하기 전에 OpenAI 호환 비전 모델이 텍스트로 변환
dsh-mmroute
jmxsxwyzjdwl/dsh-mmroute
텍스트 전용 모델을 위한 투명한 멀티모달 라우팅: 모든 모델 호출의 모든 이미지가 자체 멀티모달 이해기로 완전히 전사되며(축자 OCR, 데이터, 불확실 영역, 주입 방어), vision_relook을 통한 집중 재확인과 이미지 관련 실패 시 자동 재시도를 제공합니다. 번들 엔드포인트나 차용한 로그인이 없습니다.
dsh-audio-copilot
ai-yucheng/dsh-audio-copilot
DeepSeek Harness용 오디오 코파일럿: 오디오 전사(ASR) 및 음성 합성(TTS) — 텍스트 전용 에이전트에 귀와 목소리를 제공합니다. Windows 로컬 SAPI TTS 즉시 사용 가능; OpenAI 호환 ASR/TTS 엔드포인트 구성 가능. 컴포저 내 음성 입력 포함
dsh-vision
314857493/dsh-vision
DeepSeek Harness 플러그인: 이미지 입력을 선언하는 `deepseek-vision` 라우트로, 무료 Zhipu GLM 비전 모델을 통해 붙여넣은 이미지를 전사한 뒤 DeepSeek 어댑터로 위임합니다.
dsh-voice-mimo
ch1bug/dsh-voice-mimo
Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).
dsh-voice-input-en
mohith-das/dsh-voice-input-en
Minimal English-only voice input for the DeepSeek Harness Web UI: a mic button in the composer that transcribes speech into the draft via the browser's native SpeechRecognition API. No dependencies, no subprocess, no network calls beyond whatever the brow
dsh-vision-pro-bridge
shainedemo/dsh-vision-pro-bridge
Vision bridge for text-only DeepSeek models: transcribes attached images with deepseek-v4-flash-vision-exp before they reach deepseek-v4-pro, with no third-party dependencies.
dsh-autovision
junkrat9527/dsh-autovision
Vision for text-only dsh models: paste an image and a configured multimodal model transcribes it to text automatically — transparent twin routing, an agent-callable read-image tool, no built-in keys or relay.
dsh-voice-input
newdanew/dsh-voice-input
Voice input for the web UI: a mic button in the composer that transcribes speech into the draft via the Web Speech API, with an optional auto-send toggle.
dsh-plugin-image-input
elohia/dsh-plugin-image-input
Image-to-text input for the Web UI: paste or drag an image and it is transcribed into structured text and sent, giving text-only LLMs image-input takeover (OpenAI-compatible vision API).