Plugins
Durchsuche, filtere und installiere DeepSeek-Harness-Plugins.
125 Plugins gefunden
Deepseek-Continuity
linxuhao/deepseek-continuity
Lokale Erzeugung von Bildern, Stimmen, Musik und Soundeffekten sowie Transkription, mit fixierter Identität: Charaktere, Tiere, Objekte und Schauspielernstimmen werden einmal definiert und bei jedem späteren Aufruf wiederverwendet; degenerierte Ausgaben (nahezu flaches Bild, stilles Audio) werden abgelehnt statt als Erfolg zurückgegeben, und eine erzeugte Zeile kann als Text zurückgelesen werden, sodass ein Klon, der sein Ende verschluckt hat, sichtbar wird. Die Engines entladen sich im Leerlauf, und Bildgenerierung und Transkription können jeweils auf eine OpenAI-kompatible API statt auf das lokale Vulkan-Backend zeigen.
voco-input-sh
nothree-code/voco-input-sh
Spracheingabe für die Web UI: eine Mikrofonschaltfläche, die die lokale Offline-Spracherkennung von VocoType steuert und erkannten Text automatisch in den Editor einfügt (Auto-Deploy, Deduplizierung, kontinuierliche Diktation).
dsh-stt-input
baisama-cloud/dsh-stt-input
Speech-to-Text-Spracheingabe für die Web-UI: ein Mikrofon-Button im Composer transkribiert Sprache per Browser Web Speech API (null Konfiguration) oder eine OpenAI-kompatible Whisper-API (OpenAI / Groq) in den Entwurf, mit auswählbarem Modell und Sprache in den Settings.
dsh-plugin-notify
huguangyu666/dsh-plugin-notify
Benachrichtigungs-Outbox: Der Agent benachrichtigt proaktiv per Toast / chinesischer TTS-Stimme / Soundeffekten (Explosion, Sieg, Alarm), ruft dich bei einem 60-Sekunden-Bestätigungsfenster per Sprachanruf zurück, mit Lautstärke-Boost und Einstellungspanel.
dsh-voice
jesse-njx/dsh-voice
Sprachnotizen rein, gesprochene Antworten raus: Audio diktieren, das zu Nutzernachrichten wird (Transkription), den Agenten Antworten laut vorlesen lassen (Sprachausgabe), lokal-first unter ~/.dsh/voice.
dsh-mic-input
qt-chen/dsh-mic-input
Mikrofon-Spracheingabe für den Composer: Live-Transkription über die Web-Speech-API des Browsers, Deduplizierung/automatisches Fortsetzen, intelligente Zeichensetzung sowie Einstellungen für Sprache und automatisches Senden.
dsh-voice-call
biliye/dsh-voice-call
Sprachanruf-Assistent für die DSH-Web-GUI: eine ziehbare schwebende Anrufkugel, Browser-seitiges VAD, das jede Äußerung nach einer Pause sendet, FunASR-HTTP- oder Streaming-Spracherkennung, TTS-Antworten von MiniMax oder OpenAI-kompatibel, ein optionaler Wake-Word-Modus mit Auto-Schlaf und Aufgabenverteilung an separate Subagenten-Sitzungen mit Fortschritt, Stopp und gesprochenen Abschlussberichten.
dsh-tool-lipsync
yu-wenchao/dsh-tool-lipsync
Kostenloses Lip-Sync-Videogenerierungs-Plugin für DSH mit 3000+ Stimmen und 500+ Sprachen.
dsh-messenger-gateway
goodandready/dsh-messenger-gateway
Telegram-Brücke für DeepSeek Harness: bidirektionale Sessions, Steuerung von Konversationen, Home-Channel-Routing und TTS-Sprachnachrichten, die als Telegram-Audionachrichten gesendet werden.
dsh-voice-agent (voice-app)
wayneyu430/dsh-voice-agent
Ein konversationelles Sprach-Frontend-Agent für dsh: natürlich über ByteDance Duplex sprechen, Anfragen an Hintergrundaufgaben delegieren und deren asynchrone Ergebnisse per Stimme gemeldet bekommen.
dsh-voice-chat
maoyuching/dsh-voice-chat
Sprach-Chat im Doubao-Stil für DSH: Gedrückthalten des Mikrofons im Composer wandelt Sprache in Text um und sendet automatisch, und KI-Antworten werden vorgelesen. Optionale LLM-Verdichtung (lange Antworten werden zu kurzen gesprochenen Zeilen zusammengefasst, gemäß dem Modell der aktuellen Konversation), TTS-freundliche Textbereinigung, wählbare Edge-TTS-Stimmen, einstellbares automatisches Stoppen bei Stille, und Einstellungen direkt in den DSH-Einstellungsdialog eingebettet.
dsh-tts
goodandready/dsh-tts
Spricht die Antworten des Agenten in der DeepSeek Harness Web-UI über eine Anbieter-Fallback-Kette (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), sodass ein fehlgeschlagener oder ratenbegrenzter Anbieter auf den nächsten übergeht, statt zu schweigen.
muxiva-dsh-voice
piyotahu/muxiva-dsh-voice
Local-first-Vollduplex-Sprache für DeepSeek Harness, orchestriert von Muxiva
dsh-voice-call
pandapolo/dsh-voice-call
Vom Agenten initiierte Sprachanrufe: `offer_call` lässt beim Menschen klingeln (接听/拒接/稍后再说); angenommene Anrufe werden lokal mit CrispASR + Qwen3-TTS (9 Sprecher, 2 chinesische Dialekte) synthetisiert und abgespielt, abgelehnte Anrufe geben die Entscheidung an den Agenten zurück.
dsh-fish-tts
mari23333/dsh-fish-tts
Liest Assistentenantworten ausschließlich über die Fish Audio API vor (eigenen Schlüssel mitbringen): Vorlesen pro Nachricht, Auto-Read-Schalter und eine Einstellungsseite für Modell, Voice reference_id, verschlüsselten API-Schlüssel und Proxy.
dsh-live2d-voice
john-walks-slow/dsh-live2d-voice
Live2D session view with realtime voice: continuous voice input, streaming TTS, subtitle translation, multi-model catalog, standalone entry / Live2D 实时语音会话视图:连续语音输入、流式 TTS、字幕翻译、多模型目录、独立入口
dsh-onebot
mario841859784/dsh-onebot
QQ channel for dsh via OneBot 11 (NapCat and friends): reverse or forward WebSocket, DM and group chats, image and voice transcription, t2i text-image cards, merged forwards, and a settings page.
dsh-claude-slider
yicun0316/dsh-claude-slider
Replaces the reasoning-effort dropdown with a draggable snapping slider, and draws 13 canvas effects across five style families (thrust, fluid, fantasy, tech, texture) with three tiers that unlock as the effort level rises. Custom mode combines 10 particle forms with 8 flow trajectories; 9 accent presets and a hex picker recolor every effect, and optional key sounds cover two voice clips, a synthesized duck squeak, a mechanical click and a local audio file.
dsh-wx-bridge
zhy5/dsh-wx-bridge
Drive your local DSH from WeChat: a self-hosted iLink bridge over a persistent ACP session (context lives in DSH and is resumable), phone conversations grouped into the desktop workspace, with image recognition, file messages (Excel/Word/PDF, parsed by the agent itself) and voice transcripts. Access defaults to strict (only registered devices are served); the phone channel's permission preset is wide by design - see the README security section before sharing the bot.
dsh-multi-tts
wyr-233/dsh-multi-tts
Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.
dshgo
xiazhi88/dshgo
Proxies the loopback-only dsh web onto a LAN port so phones and other machines can reach it, with an optional access password that browsers type in and the bundled Android client unlocks with biometrics. Adds a LAN-access settings page with QR codes, inlines dsh-web-mobile (MIT, attribution kept) for the mobile layout, and the Android client in the same repository adds finish/approval notifications, voice input and a home-screen widget.
dsh-live-voice
victorwads/dsh-live-voice
Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.
dsh-minimax-asr
moluyao/dsh-minimax-asr
MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选
dsh-voice-talk
duoduoqian708/dsh-voice-talk
Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.