Zum Hauptinhalt springen

Plugins

Durchsuche, filtere und installiere DeepSeek-Harness-Plugins.

56 Plugins gefunden

P

dsh-omi-voice

polinnizhong/dsh-omi-voice

Vorlesen im Chat für DeepSeek Harness: per Tipp AI-Antworten vorlesen, pausieren und fortsetzen mit natürlichen Doubao-TTS-Stimmen (BYOK); liest nur die endgültige Antwort, Code, Tabellen und Diagramme werden ausgefiltert; lokale Engine, das Plugin speichert keinen API-Schlüssel.

74letzten MonatVision, Sprache & MultimodalMIT
1

dsh-plugin-tts

1624318455/dsh-plugin-tts

Liest Assistentenantworten laut vor über kostenloses Edge TTS oder eigene RVC-Sprachmodelle: Vorlese-Schaltflächen + automatisches Vorlesen, adaptive blockweise progressive Wiedergabe (lückenlose Langtexte), Ein-Klick-Installation von Voice-Packs aus einer Registry sowie eine portable RVC-Laufzeitumgebung.

21vor 6 TagenVision, Sprache & MultimodalMIT
P

dsh-talk

perrylink/dsh-talk

Sprach-Ein-/Ausgabe für DeepSeek Harness — Sprache-zu-Text und Text-zu-Sprache über Mikrofon und Audioausgabe.

16vor 8 TagenVision, Sprache & MultimodalApache-2.0
H

dsh-novel-forge

huangziyuan-general/dsh-novel-forge

Leitplanken für das Romanschreiben: 20 novel_*-Tools erzwingen Faktenbuch-Konsistenz, Phasen- und Kapiteltore, maschinelle Prüfung mit deterministischen Metriken und vorschlagsbasierte Revisionen; eine Werkbank im rechten Bedienfeld deckt Lesen, TTS-Wiedergabe, Feinschliff, Korrekturlesen, Kontinuitätsprüfungen und Batch-Entwurf ab, und eine Bypass-Engine führt interne Schritte außerhalb der Hauptkonversation aus.

15vor 6 TagenWorkflow-AutomatisierungMIT
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

Vollduplex-Sprachmodus für die DeepSeek Harness Web-UI: Toggle (2-Sekunden-Pause Auto-Send) oder Hold-to-Talk-Diktat in einen editierbaren Entwurf mit zipformer2-Streaming-ASR, optionalem Wake Word; Edge-TTS-Vorlesen Satz für Satz mit Live-Untertiteln, und Sprechen unterbricht Wiedergabe und laufenden Turn (echtes Barge-in). On-Device-ASR, kein API-Schlüssel.

15vor 6 StundenVision, Sprache & MultimodalMIT
B

dsh-voice-ai-girlfriend-plugin

beiyege-01/dsh-voice-ai-girlfriend-plugin

Sprach-IA-Freundin für die Web-UI: FunASR-Mikrofoneingabe, Qwen3-TTS gesprochene Antworten, Animationsfenster für den Begleiter und Zwei-Wege-QQ-Chat (Text/Sprache/Bild-Push) via NapCat.

12vor 19 TagenVision, Sprache & Multimodal
P

dsh-plugin-xiaomi-mimo-tts

ppy-web/dsh-plugin-xiaomi-mimo-tts

Fügt Xiaomi MiMo Text-to-Speech zum DSH Web hinzu: Vorlesen von Assistenten-Nachrichten, PCM-Streaming, vordefiniertes und eigenes Voice-Design, Browser-Sprachausgabe als Fallback, Wiedergabesteuerung und optionale UI-Töne.

11vorgesternVision, Sprache & MultimodalMIT
W

dsh-mmx-bridge

welsione/dsh-mmx-bridge

MiniMax-Multimodal-Bridge: Ein einziges Tool `mmx_bridge` deckt Bildverständnis/-generierung, Video, TTS, Musik, Cover, Websuche und Kontingent ab; optionale Übernahme von `web_search`/`read_image`; eingebettete Player/Bildvorschauen direkt in der Web-GUI (npm: `dsh-mmx-bridge`).

10vor 15 TagenTools & FunktionenMIT
Z

dsh-voice-input-plugin

zhangbo-cn/dsh-voice-input-plugin

Composer-Mikrofon für die Web-UI: Tippen zum Überwachen der Live-Transkription und Gedrückthalten zum Sprechen, mit Host-Edge-TTS-Antwortvorlesung, die gestreamt wird, während das Modell generiert, Echo-Pause während des Vorlesens und Tippen zum Stoppen.

6letzten MonatVision, Sprache & MultimodalMIT
1

dsh-perlica-ding

117bs/dsh-perlica-ding

Perlica- (Arknights: Endfield) thematisierte abgestufte Klangbenachrichtigungen: planbereit, Aufgabe erledigt, Eingabe erforderlich und Fehlertöne; stumm bei normalem Chat, Wiedergabe auf Systemebene (funktioniert im Hintergrund), plattformübergreifend (Windows/macOS/Linux), benutzerdefinierte TTS-Klänge.

6vor 21 TagenIntegrationen & FernzugriffMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

MiniMax-betriebenes multimodales Plugin: Echtzeit-Sprachanrufmodus (Streaming-Gespräch, schwebende Dock-UI), Sprachmodus und Mikrofon-Spracheingabe, sowie Bild-/Video-/Musik-/Sprachgenerierung und visuelle Inspektionstools.

5vor 2 MonatenVision, Sprache & MultimodalMIT
Y

dsh-tts-bridge

yuuyuko-uu/dsh-tts-bridge

Liest DSH-Konversationen laut vor, indem es die integrierte Vorlesefunktion der DeepSeek-Webseite nutzt, gesteuert von einer kleinen Browser-Erweiterung.

4vor 3 TagenVision, Sprache & Multimodal
S

dsh-voice

stardustlc666/dsh-voice

Sprachwerkzeuge: kostenlose neuronale Sprachsynthese mit edge-tts, OpenAI-kompatible ASR-Transkription, Stimmliste, Massenvorschau der Stimmen und Integritäts-Selbstprüfung.

4vor 6 StundenVision, Sprache & MultimodalMIT
H

dsh-voice

haoku123/dsh-voice

Full-Duplex-Sprachmodus für die Web-UI: Tippen zum Umschalten oder Halten zum Sprechen zum Diktieren (Senden-Taste oder `Ctrl`) mit Live-Untertiteln, hostseitige SenseVoice-ASR über sherpa-onnx, satzweise gesprochene Antworten und Sprechen unterbricht die Wiedergabe und den laufenden Zug (echtes Hineinreden). Kein API-Schlüssel erforderlich.

4letzten MonatVision, Sprache & MultimodalMIT
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

Kostenlose geschlossene Sprachschleife für die Web-UI: Mikrofoneingabe über die Browser-SpeechRecognition mit Live-Zwischenergebnissen plus Vorlese-Lautsprecherschaltflächen und automatisches Vorlesen der Antworten des Assistenten, ganz ohne Konfiguration und ohne API-Schlüssel.

4vor 2 MonatenVision, Sprache & MultimodalMIT
L

dsh-plugin-notify-sound

ldchaowin/dsh-plugin-notify-sound

Arbeitsbereichsbezogene Abschlussklingeltöne sowie Hinweistöne für Genehmigung, Rückfrage, Plan-Review, blockiertes Ziel und fehlgeschlagene Aufgaben, mit integriertem Synthesizer, Sprachausgabe (TTS) und eigenem Audio.

4vor 2 MonatenIntegrationen & FernzugriffMIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Omnimodale Workstation für DSH: analyze_image über eine geordnete Failover-Kette aus mehreren VLM-Karten, ein Bildwerkzeugkasten mit sechs Werkzeugen (Zoom, Farbabtastung, Pixel-Diff, OCR, Elementerkennung, Anzeige im Chat), die denselben Bildauflöser nutzen, generate_image über die Protokolle OpenAI/DashScope/ComfyUI, asynchrones generate_video mit mehreren Karten samt Builder /build-video-tool und speak/clone_voice für Sprachausgabe über sieben Anbieter – alles gesteuert von einer selbst speichernden Einstellungsseite.

3vor 14 TagenVision, Sprache & MultimodalMIT
N

dsh-plugin-speech

nakamuraia/dsh-plugin-speech

Liest Assistentenantworten in DeepSeek Harness laut vor: Text-zu-Sprache-Anbieter mit Streaming-Wiedergabe.

3vor 18 TagenVision, Sprache & MultimodalMIT
S

dsh-audiogen

shimingming520/dsh-audiogen

KI-Audioerzeugung für die DeepSeek Harness Web-GUI — Multi-Vendor-TTS, Musik, Soundeffekte und Voice-Design mit Seitenleisten-Panel, Modellvergleich, Ressourcenbibliothek und Agent-Tools.

3vor 24 TagenVision, Sprache & MultimodalApache-2.0
L

dsh-voco

lgquan/dsh-voco

Durchgängige Sprachkonversationen für DSH mit freihändigem Zuhören, Push-to-Talk, Spracherkennung, TTS-Antworten und Hintergrund-Agent-Delegation.

3letzten MonatVision, Sprache & MultimodalMIT
T

dsh-gsv

taoruiliu19/dsh-gsv

Lokales Echtzeit-TTS für DeepSeek Harness: Stimmvoreinstellungen, automatisches Vorlesen, Engine-Setup-Assistent, Vorlese-Button und ein Einstellungsbereich für die GSV-TTS-Lite-Engine.

3letzten MonatVision, Sprache & MultimodalMIT
H

dsh-plugin-notify

huguangyu666/dsh-plugin-notify

Benachrichtigungs-Outbox: Der Agent benachrichtigt proaktiv per Toast / chinesischer TTS-Stimme / Soundeffekten (Explosion, Sieg, Alarm), ruft dich bei einem 60-Sekunden-Bestätigungsfenster per Sprachanruf zurück, mit Lautstärke-Boost und Einstellungspanel.

3vor 18 TagenIntegrationen & FernzugriffMIT
J

dsh-voice

jesse-njx/dsh-voice

Sprachnotizen rein, gesprochene Antworten raus: Audio diktieren, das zu Nutzernachrichten wird (Transkription), den Agenten Antworten laut vorlesen lassen (Sprachausgabe), lokal-first unter ~/.dsh/voice.

3vor 2 MonatenVision, Sprache & MultimodalMIT
B

dsh-voice-call

biliye/dsh-voice-call

Sprachanruf-Assistent für die DSH-Web-GUI: eine ziehbare schwebende Anrufkugel, Browser-seitiges VAD, das jede Äußerung nach einer Pause sendet, FunASR-HTTP- oder Streaming-Spracherkennung, TTS-Antworten von MiniMax oder OpenAI-kompatibel, ein optionaler Wake-Word-Modus mit Auto-Schlaf und Aufgabenverteilung an separate Subagenten-Sitzungen mit Fortschritt, Stopp und gesprochenen Abschlussberichten.

2vor 4 TagenVision, Sprache & MultimodalMIT