Zum Hauptinhalt springen

Plugins

Durchsuche, filtere und installiere DeepSeek-Harness-Plugins.

25 Plugins gefunden

P

dsh-omi-voice

polinnizhong/dsh-omi-voice

Vorlesen im Chat für DeepSeek Harness: per Tipp AI-Antworten vorlesen, pausieren und fortsetzen mit natürlichen Doubao-TTS-Stimmen (BYOK); liest nur die endgültige Antwort, Code, Tabellen und Diagramme werden ausgefiltert; lokale Engine, das Plugin speichert keinen API-Schlüssel.

74letzten MonatVision, Sprache & MultimodalMIT
1

dsh-plugin-tts

1624318455/dsh-plugin-tts

Liest Assistentenantworten laut vor über kostenloses Edge TTS oder eigene RVC-Sprachmodelle: Vorlese-Schaltflächen + automatisches Vorlesen, adaptive blockweise progressive Wiedergabe (lückenlose Langtexte), Ein-Klick-Installation von Voice-Packs aus einer Registry sowie eine portable RVC-Laufzeitumgebung.

21vor 6 TagenVision, Sprache & MultimodalMIT
P

dsh-talk

perrylink/dsh-talk

Sprach-Ein-/Ausgabe für DeepSeek Harness — Sprache-zu-Text und Text-zu-Sprache über Mikrofon und Audioausgabe.

16vor 8 TagenVision, Sprache & MultimodalApache-2.0
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

Vollduplex-Sprachmodus für die DeepSeek Harness Web-UI: Toggle (2-Sekunden-Pause Auto-Send) oder Hold-to-Talk-Diktat in einen editierbaren Entwurf mit zipformer2-Streaming-ASR, optionalem Wake Word; Edge-TTS-Vorlesen Satz für Satz mit Live-Untertiteln, und Sprechen unterbricht Wiedergabe und laufenden Turn (echtes Barge-in). On-Device-ASR, kein API-Schlüssel.

15vor 6 StundenVision, Sprache & MultimodalMIT
P

dsh-plugin-xiaomi-mimo-tts

ppy-web/dsh-plugin-xiaomi-mimo-tts

Fügt Xiaomi MiMo Text-to-Speech zum DSH Web hinzu: Vorlesen von Assistenten-Nachrichten, PCM-Streaming, vordefiniertes und eigenes Voice-Design, Browser-Sprachausgabe als Fallback, Wiedergabesteuerung und optionale UI-Töne.

11vorgesternVision, Sprache & MultimodalMIT
Y

dsh-tts-bridge

yuuyuko-uu/dsh-tts-bridge

Liest DSH-Konversationen laut vor, indem es die integrierte Vorlesefunktion der DeepSeek-Webseite nutzt, gesteuert von einer kleinen Browser-Erweiterung.

4vor 3 TagenVision, Sprache & Multimodal
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Omnimodale Workstation für DSH: analyze_image über eine geordnete Failover-Kette aus mehreren VLM-Karten, ein Bildwerkzeugkasten mit sechs Werkzeugen (Zoom, Farbabtastung, Pixel-Diff, OCR, Elementerkennung, Anzeige im Chat), die denselben Bildauflöser nutzen, generate_image über die Protokolle OpenAI/DashScope/ComfyUI, asynchrones generate_video mit mehreren Karten samt Builder /build-video-tool und speak/clone_voice für Sprachausgabe über sieben Anbieter – alles gesteuert von einer selbst speichernden Einstellungsseite.

3vor 14 TagenVision, Sprache & MultimodalMIT
N

dsh-plugin-speech

nakamuraia/dsh-plugin-speech

Liest Assistentenantworten in DeepSeek Harness laut vor: Text-zu-Sprache-Anbieter mit Streaming-Wiedergabe.

3vor 18 TagenVision, Sprache & MultimodalMIT
L

dsh-voco

lgquan/dsh-voco

Durchgängige Sprachkonversationen für DSH mit freihändigem Zuhören, Push-to-Talk, Spracherkennung, TTS-Antworten und Hintergrund-Agent-Delegation.

3letzten MonatVision, Sprache & MultimodalMIT
T

dsh-gsv

taoruiliu19/dsh-gsv

Lokales Echtzeit-TTS für DeepSeek Harness: Stimmvoreinstellungen, automatisches Vorlesen, Engine-Setup-Assistent, Vorlese-Button und ein Einstellungsbereich für die GSV-TTS-Lite-Engine.

3letzten MonatVision, Sprache & MultimodalMIT
L

Deepseek-Continuity

linxuhao/deepseek-continuity

Lokale Erzeugung von Bildern, Stimmen, Musik und Soundeffekten sowie Transkription, mit fixierter Identität: Charaktere, Tiere, Objekte und Schauspielernstimmen werden einmal definiert und bei jedem späteren Aufruf wiederverwendet; degenerierte Ausgaben (nahezu flaches Bild, stilles Audio) werden abgelehnt statt als Erfolg zurückgegeben, und eine erzeugte Zeile kann als Text zurückgelesen werden, sodass ein Klon, der sein Ende verschluckt hat, sichtbar wird. Die Engines entladen sich im Leerlauf, und Bildgenerierung und Transkription können jeweils auf eine OpenAI-kompatible API statt auf das lokale Vulkan-Backend zeigen.

3vor 12 TagenVision, Sprache & MultimodalMIT
J

dsh-voice

jesse-njx/dsh-voice

Sprachnotizen rein, gesprochene Antworten raus: Audio diktieren, das zu Nutzernachrichten wird (Transkription), den Agenten Antworten laut vorlesen lassen (Sprachausgabe), lokal-first unter ~/.dsh/voice.

3vor 2 MonatenVision, Sprache & MultimodalMIT
B

dsh-voice-call

biliye/dsh-voice-call

Sprachanruf-Assistent für die DSH-Web-GUI: eine ziehbare schwebende Anrufkugel, Browser-seitiges VAD, das jede Äußerung nach einer Pause sendet, FunASR-HTTP- oder Streaming-Spracherkennung, TTS-Antworten von MiniMax oder OpenAI-kompatibel, ein optionaler Wake-Word-Modus mit Auto-Schlaf und Aufgabenverteilung an separate Subagenten-Sitzungen mit Fortschritt, Stopp und gesprochenen Abschlussberichten.

2vor 4 TagenVision, Sprache & MultimodalMIT
P

dsh-voice-call

pandapolo/dsh-voice-call

Vom Agenten initiierte Sprachanrufe: `offer_call` lässt beim Menschen klingeln (接听/拒接/稍后再说); angenommene Anrufe werden lokal mit CrispASR + Qwen3-TTS (9 Sprecher, 2 chinesische Dialekte) synthetisiert und abgespielt, abgelehnte Anrufe geben die Entscheidung an den Agenten zurück.

2vor 3 TagenVision, Sprache & MultimodalMIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

Liest Assistentenantworten ausschließlich über die Fish Audio API vor (eigenen Schlüssel mitbringen): Vorlesen pro Nachricht, Auto-Read-Schalter und eine Einstellungsseite für Modell, Voice reference_id, verschlüsselten API-Schlüssel und Proxy.

2vorgesternVision, Sprache & MultimodalMIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.

1vor 21 TagenVision, Sprache & Multimodal
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

1vor 17 TagenVision, Sprache & MultimodalGPL-3.0
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

1vor 19 TagenVision, Sprache & MultimodalMIT
Z

dsh-voice

zhuiyueya/dsh-voice

Sprache für DeepSeek Harness (dsh) — Sprache-zu-Text-Eingabe + Vorlese-TTS für rein textbasiertes DeepSeek, ohne API-Schlüssel.

1vor 2 MonatenVision, Sprache & MultimodalMIT
F

dsh-say

fangqian616/dsh-say

Speaks your agent's reports in a voice you choose, compressing long reports before speaking. Character voices need no training - a 3-10 second reference clip clones one, and community-trained models work too - and no 6.4 GB GPT-SoVITS install: the plugin installs its own runtime and voice. An existing GPT-SoVITS can be used instead, and it is the same voice model.

0vor 11 TagenVision, Sprache & Multimodal
L

dsh-voice-alert

loyalchiiina/dsh-voice-alert

Speaks or plays a sound at the end of every turn and plays a failure cue when a tool call or a turn errors. Ships 20 built-in effects (10 alert chimes + 10 nature sounds) and defaults to effect mode, so it needs no API key and no audio files; an optional Volcengine voice-clone route generates the three announcement clips in one click. Plays through winmm/waveOut as-is, never changing the system volume or mute state. Windows only.

0vor 4 TagenVision, Sprache & MultimodalMIT
C

dsh-voice-mimo

ch1bug/dsh-voice-mimo

Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).

0vor 19 TagenVision, Sprache & MultimodalMIT
K

dsh-kitt-voice

kittcat-lab/dsh-kitt-voice

Voice for the DeepSeek Harness: speak to the agent, hear it back, and see what it is doing from a floating window that stays on top of whatever you are running.

0vor 28 TagenVision, Sprache & MultimodalMIT
G

dsh-plugins

genesis-agents/dsh-plugins

A source library for DeepSeek Harness: 72 feeds on an hourly timer, a reader with transcripts and translation, and a publisher that turns what it collects into a podcast, a digest, or a report

0letzten MonatWorkflow-AutomatisierungMIT