본문으로 건너뛰기

플러그인

DeepSeek-Harness 플러그인을 찾아보고, 필터링하고, 설치하세요.

플러그인 25개 찾음

P

dsh-omi-voice

polinnizhong/dsh-omi-voice

DeepSeek Harness용 채팅 내 읽어주기: 자연스러운 Doubao TTS 음성(BYOK)으로 AI 응답을 탭하여 읽고, 일시정지하고, 재개합니다. 코드·표·다이어그램은 제외하고 최종 답변만 읽습니다. 로컬 엔진이며 플러그인은 API 키를 저장하지 않습니다.

74지난달비전, 음성 및 멀티모달MIT
1

dsh-plugin-tts

1624318455/dsh-plugin-tts

무료 Edge TTS 또는 사용자 자신의 RVC 음성 모델로 어시스턴트의 답변을 소리 내어 읽어줍니다: 읽어주기 버튼 + 자동 읽기, 적응형 청크 분할 점진적 재생(끊김 없는 긴 낭독), 레지스트리에서 보이스팩 원클릭 설치, 휴대용 RVC 런타임을 제공합니다.

219일 전비전, 음성 및 멀티모달MIT
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

DeepSeek Harness Web UI용 풀 듀플렉스 음성 모드: 토글(2초 일시정지 자동 전송) 또는 zipformer2 스트리밍 ASR로 편집 가능한 초안으로의 홀드 투 토크 받아쓰기, 선택 가능한 웨이크 워드 지원; 라이브 캡션이 포함된 문장별 Edge TTS 읽어주기, 말하는 동안 재생과 실행 중인 턴을 중단(진짜 barge-in). 온디바이스 ASR, API 키 불필요.

16그저께비전, 음성 및 멀티모달MIT
P

dsh-talk

perrylink/dsh-talk

DeepSeek Harness용 음성 I/O — 마이크와 오디오 출력을 통한 음성-텍스트 및 텍스트-음성 변환.

1622시간 전비전, 음성 및 멀티모달Apache-2.0
P

dsh-plugin-xiaomi-mimo-tts

ppy-web/dsh-plugin-xiaomi-mimo-tts

DSH Web에 Xiaomi MiMo 텍스트 음성 변환을 추가합니다: 어시스턴트 메시지 읽어 주기, PCM 스트리밍, 프리셋 및 사용자 정의 음성 디자인, 브라우저 음성 폴백, 재생 컨트롤, 선택적 UI 사운드.

125일 전비전, 음성 및 멀티모달MIT
Y

dsh-tts-bridge

yuuyuko-uu/dsh-tts-bridge

작은 브라우저 확장이 구동하는 DeepSeek 웹 페이지의 내장 읽어주기 기능을 사용하여 DSH 대화를 소리 내어 읽습니다.

53일 전비전, 음성 및 멀티모달
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

DSH용 옴니모달 워크스테이션: 순서가 지정된 다중 카드 VLM 페일오버 체인을 통한 analyze_image, 동일한 이미지 리졸버를 공유하는 6종 비전 툴킷(확대, 색상 샘플링, 픽셀 diff, OCR, 요소 감지, 인라인 표시), OpenAI/DashScope/ComfyUI 프로토콜을 통한 generate_image, /build-video-tool 빌더가 있는 다중 카드 비동기 generate_video, 7개 provider를 통한 speak/clone_voice TTS를 제공하며, 모두 자동 저장 설정 페이지 하나로 구동됩니다.

417일 전비전, 음성 및 멀티모달MIT
N

dsh-plugin-speech

nakamuraia/dsh-plugin-speech

DeepSeek Harness에서 어시스턴트 응답을 음성으로 읽기: 스트리밍 재생이 가능한 텍스트 음성 변환 제공자.

321일 전비전, 음성 및 멀티모달MIT
L

dsh-voco

lgquan/dsh-voco

DSH를 위한 핸즈프리 듣기, 푸시 투 토크, 음성 인식, TTS 응답 및 백그라운드 Agent 위임을 갖춘 연속 음성 대화.

3지난달비전, 음성 및 멀티모달MIT
T

dsh-gsv

taoruiliu19/dsh-gsv

DeepSeek Harness용 실시간 로컬 TTS: 음성 프리셋, 자동 읽기, 엔진 설정 어시스턴트, 읽어주기 버튼 및 GSV-TTS-Lite 엔진용 설정 패널.

3지난달비전, 음성 및 멀티모달MIT
L

Deepseek-Continuity

linxuhao/deepseek-continuity

로컬 이미지, 음성, 음악 및 SFX 생성과 전사. 고정 ID 기능: 캐릭터, 동물, 객체 및 배우 음성을 한 번 정의하면 이후 모든 호출에서 재사용됩니다. 퇴화된 출력(거의 평평한 이미지, 무음 오디오)은 성공으로 반환되지 않고 거부되며, 생성된 줄은 텍스트로 다시 읽을 수 있어 끝을 삼킨 클론이 드러납니다. 엔진은 유휴 시 언로드되며, 이미지 생성과 전사는 로컬 Vulkan 백엔드 대신 OpenAI 호환 API를 가리키도록 설정할 수 있습니다.

314일 전비전, 음성 및 멀티모달MIT
J

dsh-voice

jesse-njx/dsh-voice

음성으로 입력하고 음성으로 답변 받기: 받아쓰기 음성이 사용자 메시지로 변환(transcribe)되고, 에이전트가 답변을 소리 내어 읽어줌(speak), ~/.dsh/voice 아래 로컬 우선 저장

32개월 전비전, 음성 및 멀티모달MIT
B

dsh-voice-call

biliye/dsh-voice-call

DSH 웹 GUI의 음성 통화 도우미: 드래그 가능한 플로팅 통화 볼, 발화마다 일시정지 후 전송하는 브라우저 측 VAD, FunASR HTTP 또는 스트리밍 음성 인식, MiniMax 또는 OpenAI 호환 TTS 응답, 자동 절전이 있는 선택적 웨이크 워드 모드, 그리고 진행·중지·음성 완료 보고가 있는 별도 서브에이전트 세션으로의 작업 파견.

24일 전비전, 음성 및 멀티모달MIT
P

dsh-voice-call

pandapolo/dsh-voice-call

에이전트가 시작하는 음성 통화: `offer_call`이 사람에게 전화를 울리고(接听/拒接/稍后再说), 수락된 통화는 CrispASR + Qwen3-TTS(화자 9명, 중국어 방언 2개)로 로컬에서 합성·재생되며, 거절된 통화는 그 결정을 에이전트에 돌려줍니다.

26일 전비전, 음성 및 멀티모달MIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

Fish Audio API만 사용해 어시스턴트 답변을 음성으로 읽어 줍니다(키는 직접 준비): 메시지별 읽어주기, 자동 읽기 토글, 모델·음성 reference_id·암호화된 API 키·프록시를 설정하는 페이지를 제공합니다.

2어제비전, 음성 및 멀티모달MIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.

124일 전비전, 음성 및 멀티모달
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

120일 전비전, 음성 및 멀티모달GPL-3.0
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

122일 전비전, 음성 및 멀티모달MIT
Z

dsh-voice

zhuiyueya/dsh-voice

DeepSeek Harness(dsh)용 음성 기능 — 텍스트 전용 DeepSeek을 위한 음성-텍스트 입력 + TTS 읽어주기, API 키 불필요

12개월 전비전, 음성 및 멀티모달MIT
F

dsh-say

fangqian616/dsh-say

Speaks your agent's reports in a voice you choose, compressing long reports before speaking. Character voices need no training - a 3-10 second reference clip clones one, and community-trained models work too - and no 6.4 GB GPT-SoVITS install: the plugin installs its own runtime and voice. An existing GPT-SoVITS can be used instead, and it is the same voice model.

014일 전비전, 음성 및 멀티모달
L

dsh-voice-alert

loyalchiiina/dsh-voice-alert

Speaks or plays a sound at the end of every turn and plays a failure cue when a tool call or a turn errors. Ships 20 built-in effects (10 alert chimes + 10 nature sounds) and defaults to effect mode, so it needs no API key and no audio files; an optional Volcengine voice-clone route generates the three announcement clips in one click. Plays through winmm/waveOut as-is, never changing the system volume or mute state. Windows only.

06일 전비전, 음성 및 멀티모달MIT
C

dsh-voice-mimo

ch1bug/dsh-voice-mimo

Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).

021일 전비전, 음성 및 멀티모달MIT
K

dsh-kitt-voice

kittcat-lab/dsh-kitt-voice

Voice for the DeepSeek Harness: speak to the agent, hear it back, and see what it is doing from a floating window that stays on top of whatever you are running.

0지난달비전, 음성 및 멀티모달MIT
G

dsh-plugins

genesis-agents/dsh-plugins

A source library for DeepSeek Harness: 72 feeds on an hourly timer, a reader with transcripts and translation, and a publisher that turns what it collects into a podcast, a digest, or a report

0지난달워크플로 및 자동화MIT