Zum Hauptinhalt springen

Plugins

Durchsuche, filtere und installiere DeepSeek-Harness-Plugins.

76 Plugins gefunden

W

dsh-opencode-go-usage

wawo77/dsh-opencode-go-usage

Plan-Nutzungs-Pet für die DSH-Web-GUI: eine schwebende, skelettanimierte Figur meldet das Kontingent in einer Sprechblase, gleicht den konfigurierten Anbieter automatisch ab (OpenCode Go, Command Code, DeepSeek), um einen Plan-Prozentsatz oder einen Kontostand zu zeigen, und fällt auf lokale Token-Statistiken zurück, wenn die Anbieter-API nicht verfügbar ist; verschiebbar, per Mausrad skalierbar (90-260px), synthetisierte Klickgeräusche, ausschließlich Loopback-Routen.

3vor 16 TagenNutzung & AbrechnungMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

Einhändige Eingabe ohne Tastatur für das Eingabefeld: Maustaste im Eingabefeld gedrückt halten, sprechen, loslassen – der Text landet im Entwurf, und Hochschieben bricht ab, ohne einen halben Satz zu hinterlassen. Kein Mikrofonknopf zum Anvisieren und kein Kurzbefehl zum Merken; die Hand muss den Eingabebereich nie verlassen, was gerade dann zählt, wenn die andere Hand beschäftigt ist. Die Erkennung läuft vollständig offline (SenseVoice über sherpa-onnx, kein API-Schlüssel, Audio verlässt nie den Rechner).

3vor 23 StundenVision, Sprache & MultimodalMIT
N

dsh-plugin-speech

nakamuraia/dsh-plugin-speech

Liest Assistentenantworten in DeepSeek Harness laut vor: Text-zu-Sprache-Anbieter mit Streaming-Wiedergabe.

3vor 18 TagenVision, Sprache & MultimodalMIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

Sprachassistent für dsh web: Mit dem Weckruf (z. B. „小鲸“) wird freihändiges Diktieren aktiviert – das Gesagte wird transkribiert und automatisch in das Chatfeld getippt. Unterstützt gesprochene Bearbeitungsbefehle (senden, leeren, neue Zeile, Vorlesen beenden) und liest Antworten des Assistenten auf Chinesisch vor. Die Spracherkennung läuft lokal im Browser über sherpa-onnx WASM, funktioniert also offline ohne API-Schlüssel.

3letzten MonatVision, Sprache & MultimodalMIT
D

dsh-whale-pet

dleaf6211-hash/dsh-whale-pet

Desktop-Mädchen-Wal-Haustier für DeepSeek Harness: schwebendes Browser-Maskottchen plus Windows-Desktop-Haustier, die sich ein Daten-Backend teilen, mit Echtzeit-Saldoanzeige, Aufgabenbenachrichtigungen, Kopfstreichel-Interaktion, 19 vorsynthetisierten Sprachzeilen mit Emotion pro Zeile und präsenzabhängigem Leerlauf-Gespräch.

3vor 17 TagenNur zum SpaßMIT
L

dsh-voco

lgquan/dsh-voco

Durchgängige Sprachkonversationen für DSH mit freihändigem Zuhören, Push-to-Talk, Spracherkennung, TTS-Antworten und Hintergrund-Agent-Delegation.

3letzten MonatVision, Sprache & MultimodalMIT
T

dsh-gsv

taoruiliu19/dsh-gsv

Lokales Echtzeit-TTS für DeepSeek Harness: Stimmvoreinstellungen, automatisches Vorlesen, Engine-Setup-Assistent, Vorlese-Button und ein Einstellungsbereich für die GSV-TTS-Lite-Engine.

3letzten MonatVision, Sprache & MultimodalMIT
L

Deepseek-Continuity

linxuhao/deepseek-continuity

Lokale Erzeugung von Bildern, Stimmen, Musik und Soundeffekten sowie Transkription, mit fixierter Identität: Charaktere, Tiere, Objekte und Schauspielernstimmen werden einmal definiert und bei jedem späteren Aufruf wiederverwendet; degenerierte Ausgaben (nahezu flaches Bild, stilles Audio) werden abgelehnt statt als Erfolg zurückgegeben, und eine erzeugte Zeile kann als Text zurückgelesen werden, sodass ein Klon, der sein Ende verschluckt hat, sichtbar wird. Die Engines entladen sich im Leerlauf, und Bildgenerierung und Transkription können jeweils auf eine OpenAI-kompatible API statt auf das lokale Vulkan-Backend zeigen.

3vor 12 TagenVision, Sprache & MultimodalMIT
N

voco-input-sh

nothree-code/voco-input-sh

Spracheingabe für die Web UI: eine Mikrofonschaltfläche, die die lokale Offline-Spracherkennung von VocoType steuert und erkannten Text automatisch in den Editor einfügt (Auto-Deploy, Deduplizierung, kontinuierliche Diktation).

3vor 19 TagenVision, Sprache & MultimodalMIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Speech-to-Text-Spracheingabe für die Web-UI: ein Mikrofon-Button im Composer transkribiert Sprache per Browser Web Speech API (null Konfiguration) oder eine OpenAI-kompatible Whisper-API (OpenAI / Groq) in den Entwurf, mit auswählbarem Modell und Sprache in den Settings.

3letzten MonatVision, Sprache & MultimodalMIT
J

dsh-voice

jesse-njx/dsh-voice

Sprachnotizen rein, gesprochene Antworten raus: Audio diktieren, das zu Nutzernachrichten wird (Transkription), den Agenten Antworten laut vorlesen lassen (Sprachausgabe), lokal-first unter ~/.dsh/voice.

3vor 2 MonatenVision, Sprache & MultimodalMIT
Q

dsh-mic-input

qt-chen/dsh-mic-input

Mikrofon-Spracheingabe für den Composer: Live-Transkription über die Web-Speech-API des Browsers, Deduplizierung/automatisches Fortsetzen, intelligente Zeichensetzung sowie Einstellungen für Sprache und automatisches Senden.

3vor 2 MonatenVision, Sprache & MultimodalMIT
B

dsh-voice-call

biliye/dsh-voice-call

Sprachanruf-Assistent für die DSH-Web-GUI: eine ziehbare schwebende Anrufkugel, Browser-seitiges VAD, das jede Äußerung nach einer Pause sendet, FunASR-HTTP- oder Streaming-Spracherkennung, TTS-Antworten von MiniMax oder OpenAI-kompatibel, ein optionaler Wake-Word-Modus mit Auto-Schlaf und Aufgabenverteilung an separate Subagenten-Sitzungen mit Fortschritt, Stopp und gesprochenen Abschlussberichten.

2vor 5 TagenVision, Sprache & MultimodalMIT
M

dsh-voice-chat

maoyuching/dsh-voice-chat

Sprach-Chat im Doubao-Stil für DSH: Gedrückthalten des Mikrofons im Composer wandelt Sprache in Text um und sendet automatisch, und KI-Antworten werden vorgelesen. Optionale LLM-Verdichtung (lange Antworten werden zu kurzen gesprochenen Zeilen zusammengefasst, gemäß dem Modell der aktuellen Konversation), TTS-freundliche Textbereinigung, wählbare Edge-TTS-Stimmen, einstellbares automatisches Stoppen bei Stille, und Einstellungen direkt in den DSH-Einstellungsdialog eingebettet.

2vor 8 TagenVision, Sprache & MultimodalMIT
G

dsh-tts

goodandready/dsh-tts

Spricht die Antworten des Agenten in der DeepSeek Harness Web-UI über eine Anbieter-Fallback-Kette (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), sodass ein fehlgeschlagener oder ratenbegrenzter Anbieter auf den nächsten übergeht, statt zu schweigen.

2vor 6 TagenVision, Sprache & MultimodalMIT
T

dsh-deepseek-pet

txlznbzsdj-collab/dsh-deepseek-pet

Animiertes DeepSeek-Blauwal-Desktop-Haustier auf der DSH-Webseite: verschiebbar mit Sprechblasen und Stimmungsposen, einem pet_say-Tool, über das das Modell es sprechen lassen kann, sowie Denk- und Feierstatus zu Beginn bzw. Ende eines Turns.

2vor 2 MonatenNur zum SpaßMIT
P

dsh-voice-call

pandapolo/dsh-voice-call

Vom Agenten initiierte Sprachanrufe: `offer_call` lässt beim Menschen klingeln (接听/拒接/稍后再说); angenommene Anrufe werden lokal mit CrispASR + Qwen3-TTS (9 Sprecher, 2 chinesische Dialekte) synthetisiert und abgespielt, abgelehnte Anrufe geben die Entscheidung an den Agenten zurück.

2vor 3 TagenVision, Sprache & MultimodalMIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

Liest Assistentenantworten ausschließlich über die Fish Audio API vor (eigenen Schlüssel mitbringen): Vorlesen pro Nachricht, Auto-Read-Schalter und eine Einstellungsseite für Modell, Voice reference_id, verschlüsselten API-Schlüssel und Proxy.

2vorgesternVision, Sprache & MultimodalMIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.

1vor 21 TagenVision, Sprache & Multimodal
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

1vor 18 TagenVision, Sprache & MultimodalGPL-3.0
N

dsh-dictate

navneetset/dsh-dictate

Live speech-to-text dictation into the dsh web composer via OpenRouter STT

1vor 27 TagenVision, Sprache & MultimodalMIT
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

1vor 19 TagenVision, Sprache & MultimodalMIT
D

dsh-voice-talk

duoduoqian708/dsh-voice-talk

Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.

1vor 20 TagenVision, Sprache & MultimodalMIT
J

dsh-live-voice

jstn-1g/dsh-live-voice

Consent-bound one-turn voice preview for DSH Web with a credential-free local synthetic demo, optional Qwen Audio, exact Session isolation, and explicit transcript-to-draft handoff without automatic submission.

1vor 27 TagenVision, Sprache & MultimodalMIT