플러그인
DeepSeek-Harness 플러그인을 찾아보고, 필터링하고, 설치하세요.
플러그인 56개 찾음
dsh-omi-voice
polinnizhong/dsh-omi-voice
DeepSeek Harness용 채팅 내 읽어주기: 자연스러운 Doubao TTS 음성(BYOK)으로 AI 응답을 탭하여 읽고, 일시정지하고, 재개합니다. 코드·표·다이어그램은 제외하고 최종 답변만 읽습니다. 로컬 엔진이며 플러그인은 API 키를 저장하지 않습니다.
dsh-plugin-tts
1624318455/dsh-plugin-tts
무료 Edge TTS 또는 사용자 자신의 RVC 음성 모델로 어시스턴트의 답변을 소리 내어 읽어줍니다: 읽어주기 버튼 + 자동 읽기, 적응형 청크 분할 점진적 재생(끊김 없는 긴 낭독), 레지스트리에서 보이스팩 원클릭 설치, 휴대용 RVC 런타임을 제공합니다.
dsh-talk
perrylink/dsh-talk
DeepSeek Harness용 음성 I/O — 마이크와 오디오 출력을 통한 음성-텍스트 및 텍스트-음성 변환.
dsh-novel-forge
huangziyuan-general/dsh-novel-forge
소설 작성 가드레일: 20개의 novel_* 도구가 사실 원장 일관성, 단계 및 장 게이트, 결정론적 메트릭 기반 기계 감사, 제안 전용 수정을 강제하고, 우측 패널 워크벤치는 읽기, TTS 재생, 윤문, 교정, 연속성 검사 및 일괄 초안을 다루며, 우회 엔진이 내부 단계를 메인 대화 외부에서 실행합니다.
dsh-voice-mode (dsh-voice-mode)
qishuilalala/dsh-voice-mode
DeepSeek Harness Web UI용 풀 듀플렉스 음성 모드: 토글(2초 일시정지 자동 전송) 또는 zipformer2 스트리밍 ASR로 편집 가능한 초안으로의 홀드 투 토크 받아쓰기, 선택 가능한 웨이크 워드 지원; 라이브 캡션이 포함된 문장별 Edge TTS 읽어주기, 말하는 동안 재생과 실행 중인 턴을 중단(진짜 barge-in). 온디바이스 ASR, API 키 불필요.
dsh-voice-ai-girlfriend-plugin
beiyege-01/dsh-voice-ai-girlfriend-plugin
웹 UI용 음성 AI 여자친구: FunASR 마이크 입력, Qwen3-TTS 음성 응답, 동반 애니메이션 창, 그리고 NapCat을 통한 양방향 QQ 채팅(텍스트/음성/이미지 푸시).
dsh-plugin-xiaomi-mimo-tts
ppy-web/dsh-plugin-xiaomi-mimo-tts
DSH Web에 Xiaomi MiMo 텍스트 음성 변환을 추가합니다: 어시스턴트 메시지 읽어 주기, PCM 스트리밍, 프리셋 및 사용자 정의 음성 디자인, 브라우저 음성 폴백, 재생 컨트롤, 선택적 UI 사운드.
dsh-mmx-bridge
welsione/dsh-mmx-bridge
MiniMax 멀티모달 브리지: 하나의 `mmx_bridge` 도구로 이미지 이해/생성, 동영상, TTS, 음악, 커버, 웹 검색, 할당량을 처리합니다. `web_search`/`read_image` 선택적 대체 지원. 웹 GUI 내 인라인 플레이어/이미지 미리보기 제공(npm: `dsh-mmx-bridge`).
dsh-voice-input-plugin
zhangbo-cn/dsh-voice-input-plugin
웹 UI용 작성창 마이크: 탭하여 실시간 전사를 모니터링하고 눌러서 말하기 기능을 제공합니다. 모델이 생성하는 동안 스트리밍되는 호스트 Edge TTS 응답 낭독, 낭독 중 에코 일시정지, 탭으로 정지 기능을 갖추고 있습니다.
dsh-perlica-ding
117bs/dsh-perlica-ding
Perlica(Arknights: Endfield) 테마의 계층형 사운드 알림: 계획 준비, 작업 완료, 입력 필요, 오류 톤; 일반 채팅에는 무음, 시스템 수준 재생(백그라운드 작동), 크로스 플랫폼(Windows/macOS/Linux), 커스텀 TTS 사운드.
dsh-guide-dog
atropinoltt/dsh-guide-dog
MiniMax 기반 멀티모달 플러그인: 실시간 음성 통화 모드(스트리밍 대화, 플로팅 도크 UI), 음성 모드 및 마이크 음성 입력, 이미지/비디오/음악/음성 생성 및 시각 검사 도구.
dsh-tts-bridge
yuuyuko-uu/dsh-tts-bridge
작은 브라우저 확장이 구동하는 DeepSeek 웹 페이지의 내장 읽어주기 기능을 사용하여 DSH 대화를 소리 내어 읽습니다.
dsh-voice
stardustlc666/dsh-voice
음성 도구: 무료 edge-tts 뉴럴 음성 합성, OpenAI 호환 ASR 변환, 음성 목록, 음성 일괄 미리보기, 상태 자가 점검.
dsh-voice
haoku123/dsh-voice
웹 UI용 전이중 음성 모드: 탭하여 토글 또는 누르고 있기(전송 키 또는 `Ctrl`)로 받아쓰기, 실시간 자막, sherpa-onnx를 통한 호스트 측 SenseVoice ASR, 문장별 음성 응답, 발화가 재생 및 실행 중인 턴을 중단(진정한 끼어들기). API 키 불필요.
dsh-chatvoice
fuzzysoul/dsh-chatvoice
웹 UI를 위한 무료 음성 클로즈드 루프: 브라우저 SpeechRecognition 마이크 입력으로 실시간 임시 결과를 표시하고, 읽어주기 스피커 버튼과 어시스턴트 응답 자동 읽기를 제공합니다. 설정 불필요, API 키도 불필요.
dsh-plugin-notify-sound
ldchaowin/dsh-plugin-notify-sound
워크스페이스별 완료 알림음과 승인/질문/계획 검토/목표 차단/작업 실패 이벤트용 주의 알림음, 내장 신디사이저, 음성(TTS), 커스텀 오디오 지원
dsh-omni-workstation
huashenglian/dsh-omni-workstation
DSH용 옴니모달 워크스테이션: 순서가 지정된 다중 카드 VLM 페일오버 체인을 통한 analyze_image, 동일한 이미지 리졸버를 공유하는 6종 비전 툴킷(확대, 색상 샘플링, 픽셀 diff, OCR, 요소 감지, 인라인 표시), OpenAI/DashScope/ComfyUI 프로토콜을 통한 generate_image, /build-video-tool 빌더가 있는 다중 카드 비동기 generate_video, 7개 provider를 통한 speak/clone_voice TTS를 제공하며, 모두 자동 저장 설정 페이지 하나로 구동됩니다.
dsh-plugin-speech
nakamuraia/dsh-plugin-speech
DeepSeek Harness에서 어시스턴트 응답을 음성으로 읽기: 스트리밍 재생이 가능한 텍스트 음성 변환 제공자.
dsh-audiogen
shimingming520/dsh-audiogen
DeepSeek Harness 웹 GUI용 AI 오디오 생성 — 다중 공급자 TTS, 음악, 음향 효과 및 음성 디자인, 사이드바 패널, 모델 비교, 리소스 라이브러리 및 Agent 도구 포함.
dsh-voco
lgquan/dsh-voco
DSH를 위한 핸즈프리 듣기, 푸시 투 토크, 음성 인식, TTS 응답 및 백그라운드 Agent 위임을 갖춘 연속 음성 대화.
dsh-gsv
taoruiliu19/dsh-gsv
DeepSeek Harness용 실시간 로컬 TTS: 음성 프리셋, 자동 읽기, 엔진 설정 어시스턴트, 읽어주기 버튼 및 GSV-TTS-Lite 엔진용 설정 패널.
dsh-plugin-notify
huguangyu666/dsh-plugin-notify
알림 발신함 기능입니다: 에이전트가 토스트/중국어 TTS 음성/효과음(폭발, 승리, 경보)으로 능동적으로 알리며, 60초 확인 창 동안 음성으로 다시 전화를 걸어주고 음량 증폭과 설정 패널을 제공합니다.
dsh-voice
jesse-njx/dsh-voice
음성으로 입력하고 음성으로 답변 받기: 받아쓰기 음성이 사용자 메시지로 변환(transcribe)되고, 에이전트가 답변을 소리 내어 읽어줌(speak), ~/.dsh/voice 아래 로컬 우선 저장
dsh-voice-call
biliye/dsh-voice-call
DSH 웹 GUI의 음성 통화 도우미: 드래그 가능한 플로팅 통화 볼, 발화마다 일시정지 후 전송하는 브라우저 측 VAD, FunASR HTTP 또는 스트리밍 음성 인식, MiniMax 또는 OpenAI 호환 TTS 응답, 자동 절전이 있는 선택적 웨이크 워드 모드, 그리고 진행·중지·음성 완료 보고가 있는 별도 서브에이전트 세션으로의 작업 파견.