Zum Hauptinhalt springen

Plugins

Durchsuche, filtere und installiere DeepSeek-Harness-Plugins.

125 Plugins gefunden

L

Deepseek-Continuity

linxuhao/deepseek-continuity

Lokale Erzeugung von Bildern, Stimmen, Musik und Soundeffekten sowie Transkription, mit fixierter Identität: Charaktere, Tiere, Objekte und Schauspielernstimmen werden einmal definiert und bei jedem späteren Aufruf wiederverwendet; degenerierte Ausgaben (nahezu flaches Bild, stilles Audio) werden abgelehnt statt als Erfolg zurückgegeben, und eine erzeugte Zeile kann als Text zurückgelesen werden, sodass ein Klon, der sein Ende verschluckt hat, sichtbar wird. Die Engines entladen sich im Leerlauf, und Bildgenerierung und Transkription können jeweils auf eine OpenAI-kompatible API statt auf das lokale Vulkan-Backend zeigen.

3vor 12 TagenVision, Sprache & MultimodalMIT
N

voco-input-sh

nothree-code/voco-input-sh

Spracheingabe für die Web UI: eine Mikrofonschaltfläche, die die lokale Offline-Spracherkennung von VocoType steuert und erkannten Text automatisch in den Editor einfügt (Auto-Deploy, Deduplizierung, kontinuierliche Diktation).

3vor 19 TagenVision, Sprache & MultimodalMIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Speech-to-Text-Spracheingabe für die Web-UI: ein Mikrofon-Button im Composer transkribiert Sprache per Browser Web Speech API (null Konfiguration) oder eine OpenAI-kompatible Whisper-API (OpenAI / Groq) in den Entwurf, mit auswählbarem Modell und Sprache in den Settings.

3letzten MonatVision, Sprache & MultimodalMIT
H

dsh-plugin-notify

huguangyu666/dsh-plugin-notify

Benachrichtigungs-Outbox: Der Agent benachrichtigt proaktiv per Toast / chinesischer TTS-Stimme / Soundeffekten (Explosion, Sieg, Alarm), ruft dich bei einem 60-Sekunden-Bestätigungsfenster per Sprachanruf zurück, mit Lautstärke-Boost und Einstellungspanel.

3vor 18 TagenIntegrationen & FernzugriffMIT
J

dsh-voice

jesse-njx/dsh-voice

Sprachnotizen rein, gesprochene Antworten raus: Audio diktieren, das zu Nutzernachrichten wird (Transkription), den Agenten Antworten laut vorlesen lassen (Sprachausgabe), lokal-first unter ~/.dsh/voice.

3vor 2 MonatenVision, Sprache & MultimodalMIT
Q

dsh-mic-input

qt-chen/dsh-mic-input

Mikrofon-Spracheingabe für den Composer: Live-Transkription über die Web-Speech-API des Browsers, Deduplizierung/automatisches Fortsetzen, intelligente Zeichensetzung sowie Einstellungen für Sprache und automatisches Senden.

3vor 2 MonatenVision, Sprache & MultimodalMIT
B

dsh-voice-call

biliye/dsh-voice-call

Sprachanruf-Assistent für die DSH-Web-GUI: eine ziehbare schwebende Anrufkugel, Browser-seitiges VAD, das jede Äußerung nach einer Pause sendet, FunASR-HTTP- oder Streaming-Spracherkennung, TTS-Antworten von MiniMax oder OpenAI-kompatibel, ein optionaler Wake-Word-Modus mit Auto-Schlaf und Aufgabenverteilung an separate Subagenten-Sitzungen mit Fortschritt, Stopp und gesprochenen Abschlussberichten.

2vor 5 TagenVision, Sprache & MultimodalMIT
Y

dsh-tool-lipsync

yu-wenchao/dsh-tool-lipsync

Kostenloses Lip-Sync-Videogenerierungs-Plugin für DSH mit 3000+ Stimmen und 500+ Sprachen.

2vor 28 TagenVision, Sprache & MultimodalMIT
G

dsh-messenger-gateway

goodandready/dsh-messenger-gateway

Telegram-Brücke für DeepSeek Harness: bidirektionale Sessions, Steuerung von Konversationen, Home-Channel-Routing und TTS-Sprachnachrichten, die als Telegram-Audionachrichten gesendet werden.

2vor 3 TagenIntegrationen & FernzugriffMIT
W

dsh-voice-agent (voice-app)

wayneyu430/dsh-voice-agent

Ein konversationelles Sprach-Frontend-Agent für dsh: natürlich über ByteDance Duplex sprechen, Anfragen an Hintergrundaufgaben delegieren und deren asynchrone Ergebnisse per Stimme gemeldet bekommen.

2letzten MonatVision, Sprache & Multimodal
M

dsh-voice-chat

maoyuching/dsh-voice-chat

Sprach-Chat im Doubao-Stil für DSH: Gedrückthalten des Mikrofons im Composer wandelt Sprache in Text um und sendet automatisch, und KI-Antworten werden vorgelesen. Optionale LLM-Verdichtung (lange Antworten werden zu kurzen gesprochenen Zeilen zusammengefasst, gemäß dem Modell der aktuellen Konversation), TTS-freundliche Textbereinigung, wählbare Edge-TTS-Stimmen, einstellbares automatisches Stoppen bei Stille, und Einstellungen direkt in den DSH-Einstellungsdialog eingebettet.

2vor 8 TagenVision, Sprache & MultimodalMIT
G

dsh-tts

goodandready/dsh-tts

Spricht die Antworten des Agenten in der DeepSeek Harness Web-UI über eine Anbieter-Fallback-Kette (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), sodass ein fehlgeschlagener oder ratenbegrenzter Anbieter auf den nächsten übergeht, statt zu schweigen.

2vor 6 TagenVision, Sprache & MultimodalMIT
P

muxiva-dsh-voice

piyotahu/muxiva-dsh-voice

Local-first-Vollduplex-Sprache für DeepSeek Harness, orchestriert von Muxiva

2vor 2 MonatenVision, Sprache & MultimodalApache-2.0
P

dsh-voice-call

pandapolo/dsh-voice-call

Vom Agenten initiierte Sprachanrufe: `offer_call` lässt beim Menschen klingeln (接听/拒接/稍后再说); angenommene Anrufe werden lokal mit CrispASR + Qwen3-TTS (9 Sprecher, 2 chinesische Dialekte) synthetisiert und abgespielt, abgelehnte Anrufe geben die Entscheidung an den Agenten zurück.

2vor 3 TagenVision, Sprache & MultimodalMIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

Liest Assistentenantworten ausschließlich über die Fish Audio API vor (eigenen Schlüssel mitbringen): Vorlesen pro Nachricht, Auto-Read-Schalter und eine Einstellungsseite für Modell, Voice reference_id, verschlüsselten API-Schlüssel und Proxy.

2vorgesternVision, Sprache & MultimodalMIT
J

dsh-live2d-voice

john-walks-slow/dsh-live2d-voice

Live2D session view with realtime voice: continuous voice input, streaming TTS, subtitle translation, multi-model catalog, standalone entry / Live2D 实时语音会话视图:连续语音输入、流式 TTS、字幕翻译、多模型目录、独立入口

1vor 4 TagenVision, Sprache & MultimodalMIT
M

dsh-onebot

mario841859784/dsh-onebot

QQ channel for dsh via OneBot 11 (NapCat and friends): reverse or forward WebSocket, DM and group chats, image and voice transcription, t2i text-image cards, merged forwards, and a settings page.

1vor 8 TagenIntegrationen & FernzugriffBSD-3-Clause
Y

dsh-claude-slider

yicun0316/dsh-claude-slider

Replaces the reasoning-effort dropdown with a draggable snapping slider, and draws 13 canvas effects across five style families (thrust, fluid, fantasy, tech, texture) with three tiers that unlock as the effort level rises. Custom mode combines 10 particle forms with 8 flow trajectories; 9 accent presets and a hex picker recolor every effect, and optional key sounds cover two voice clips, a synthesized duck squeak, a mechanical click and a local audio file.

1vor 9 TagenUI-ErweiterungenMIT
Z

dsh-wx-bridge

zhy5/dsh-wx-bridge

Drive your local DSH from WeChat: a self-hosted iLink bridge over a persistent ACP session (context lives in DSH and is resumable), phone conversations grouped into the desktop workspace, with image recognition, file messages (Excel/Word/PDF, parsed by the agent itself) and voice transcripts. Access defaults to strict (only registered devices are served); the phone channel's permission preset is wide by design - see the README security section before sharing the bot.

1vor 6 TagenIntegrationen & FernzugriffMIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.

1vor 21 TagenVision, Sprache & Multimodal
X

dshgo

xiazhi88/dshgo

Proxies the loopback-only dsh web onto a LAN port so phones and other machines can reach it, with an optional access password that browsers type in and the bundled Android client unlocks with biometrics. Adds a LAN-access settings page with QR codes, inlines dsh-web-mobile (MIT, attribution kept) for the mobile layout, and the Android client in the same repository adds finish/approval notifications, voice input and a home-screen widget.

1vor 14 TagenIntegrationen & FernzugriffMIT
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

1vor 18 TagenVision, Sprache & MultimodalGPL-3.0
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

1vor 19 TagenVision, Sprache & MultimodalMIT
D

dsh-voice-talk

duoduoqian708/dsh-voice-talk

Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.

1vor 20 TagenVision, Sprache & MultimodalMIT