Zum Hauptinhalt springen

Plugins

Durchsuche, filtere und installiere DeepSeek-Harness-Plugins.

76 Plugins gefunden

O

watch-skill

oxbshw/watch-skill

Die Funktionen von DeepWatch, installierbar in ein bestehendes DeepSeek Harness-Profil

378vor 18 TagenVision, Sprache & MultimodalMIT
P

dsh-omi-voice

polinnizhong/dsh-omi-voice

Vorlesen im Chat für DeepSeek Harness: per Tipp AI-Antworten vorlesen, pausieren und fortsetzen mit natürlichen Doubao-TTS-Stimmen (BYOK); liest nur die endgültige Antwort, Code, Tabellen und Diagramme werden ausgefiltert; lokale Engine, das Plugin speichert keinen API-Schlüssel.

74letzten MonatVision, Sprache & MultimodalMIT
P

dsh-voice-scribe

pensivefei/dsh-voice-scribe

Spracheingabe für die Web-UI: Alt (oder Alt+Space) drücken, um das Diktat zu starten/stoppen, Browser Web Speech (Zero-Config) oder OpenAI-kompatible Cloud-ASR, optionale Politur durch das DSH-konfigurierte LLM, Einstellungs-UI.

34vor 3 TagenVision, Sprache & MultimodalMIT
C

dsh-live2d-pets

cyanfish-x/dsh-live2d-pets

Live2D-Desktop-Haustier-Overlay für die DSH Web-GUI: spiegelt den Agentenstatus (Denken, Leerlauf, Fehler, Fertig, Warten auf Genehmigung) mit Bewegungen und Sprechblasen, Touch-Reaktionen pro Teil, Drag-to-Dock, umschaltbare Personas und benutzerdefinierte Modelle per URL oder lokalem Pfad.

27vor 9 TagenNur zum Spaß
W

dsh-ears

wiziscool/dsh-ears

Spracheingabe-Plugin für DeepSeek Harness (dsh): Eine Mikrofon-Schaltfläche im Composer wandelt Sprache in einen Entwurfstranskript um, mit wählbaren Spracherkennungs-Backends, optionaler Nachbearbeitung über die eigenen LLM-Routen von dsh und einer nativen Einstellungsseite.

21vor 22 StundenVision, Sprache & MultimodalMIT
1

dsh-plugin-tts

1624318455/dsh-plugin-tts

Liest Assistentenantworten laut vor über kostenloses Edge TTS oder eigene RVC-Sprachmodelle: Vorlese-Schaltflächen + automatisches Vorlesen, adaptive blockweise progressive Wiedergabe (lückenlose Langtexte), Ein-Klick-Installation von Voice-Packs aus einer Registry sowie eine portable RVC-Laufzeitumgebung.

21vor 6 TagenVision, Sprache & MultimodalMIT
A

dsh-whale-girl-live2d

andersen216/dsh-whale-girl-live2d

Ein Live2D-Walmädchen als Begleiter für die DeepSeek Harness Web UI: das Modell bleibt auf dem Bildschirm und reagiert darauf, was der Agent gerade wirklich tut (Denken, Tool-Aufrufe, streamender Text, Fehler, Turn-Ende); Klick auf sie sendet dem Agent eine Nachricht, und die Antwort streamt in eine Sprechblase; Rechtsklick öffnet ein Menü mit Ausdrücken, Verkleidungs-Items, Schreibtischszenen und Einmal-Animationen — jede Aktion aus dem Hotkey-Blatt des Original-Modellautors übernommen, sodass nichts kollidiert und alles von selbst ausläuft. Nicht-kommerzielle Modell-Assets (CC BY-NC-SA 4.0), MIT-Code, von Andersen216 (https://github.com/Andersen216).

20gesternNur zum SpaßMIT
P

dsh-talk

perrylink/dsh-talk

Sprach-Ein-/Ausgabe für DeepSeek Harness — Sprache-zu-Text und Text-zu-Sprache über Mikrofon und Audioausgabe.

16vor 8 TagenVision, Sprache & MultimodalApache-2.0
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

Vollduplex-Sprachmodus für die DeepSeek Harness Web-UI: Toggle (2-Sekunden-Pause Auto-Send) oder Hold-to-Talk-Diktat in einen editierbaren Entwurf mit zipformer2-Streaming-ASR, optionalem Wake Word; Edge-TTS-Vorlesen Satz für Satz mit Live-Untertiteln, und Sprechen unterbricht Wiedergabe und laufenden Turn (echtes Barge-in). On-Device-ASR, kein API-Schlüssel.

15vor 7 StundenVision, Sprache & MultimodalMIT
P

dsh-plugin-xiaomi-mimo-tts

ppy-web/dsh-plugin-xiaomi-mimo-tts

Fügt Xiaomi MiMo Text-to-Speech zum DSH Web hinzu: Vorlesen von Assistenten-Nachrichten, PCM-Streaming, vordefiniertes und eigenes Voice-Design, Browser-Sprachausgabe als Fallback, Wiedergabesteuerung und optionale UI-Töne.

11vor 3 TagenVision, Sprache & MultimodalMIT
3

dsh-voice

3274375092/dsh-voice

Spracheingabe für DeepSeek Harness: Sprechen Sie ins Mikrofon und der erkannte Text wird als normale Chat-Nachricht übermittelt, über lokale oder Browser-Spracherkennung.

8vorgesternVision, Sprache & MultimodalMIT
A

dsh-web-whale-maid

acidgr/dsh-web-whale-maid

Wal-Dienstmädchen im Anime-Stil als Desktop-Haustier für die DeepSeek Harness (dsh) Web-UI: LLM-Dialoge in Echtzeit, 8 Stimmungsanimationen, System mit Sättigungsreserve, dauerhafte Sprechblase und mobil angepasste Schrank-Oberfläche.

7vor 22 TagenNur zum SpaßMIT
M

dsh-iris

mokuyoaxis/dsh-iris

Medien- und Vision-Workspace für DeepSeek Harness: Erzeugung von Bildern, Videos und Sprache, Fragen und Antworten zu Bildern sowie Lokalisierung von Elementen, OCR für lange Bilder, Pixel-Diff, Verifikation von HTML-Screenshots und Zusammenfassung von Videos, mit DashScope- und OpenAI-kompatiblen Anbietern, Modellpools und einem Workbench-Client.

7gesternTools & FunktionenMIT
M

dsh-alert-sound

machine-126/dsh-alert-sound

Audio- und Sprachwarnungen für die dsh Web GUI: unterschiedliche Töne und optionale Sprachausgabe für Genehmigungen, Fragen, Abschlüsse und Fehler.

7vor 10 TagenIntegrationen & FernzugriffMIT
Z

adhdgofly-dsh-ext

zuoguyoupan2023/adhdgofly-dsh-ext

Hebt Wortarten hervor (Substantive grün, Verben rot, Adjektive/Adverbien lila) im gerenderten DSH-Web-Markdown, mit hellen/dunklen Paletten, Umschaltern und stream-bewussten Aktualisierungen.

6vor 27 TagenUI-ErweiterungenMIT
F

liang-desktop-pet (liang-harness-plugin)

flycat43/liang-desktop-pet

Ziehbarer Charakterbegleiter für das Webprofil von DeepSeek Harness mit sechs visuellen und expressiven Stufen, vier Aufgabenmodi, Chat der aktuellen Sitzung, öffentlichen Zusammenfassungen der Schlussfolgerungen und Browser-Sprachsynthese.

5letzten MonatNur zum SpaßMIT
C

dsh-qq-onebot-bridge

cheesehaqi/dsh-qq-onebot-bridge

Bidirektionale QQ-Brücke über OneBot v11 (Reverse WebSocket): Sitzungen pro Gruppe und pro Privat-Chat, @-zitierte Sprach-Speech-to-Text, private Bild-/Animations-Sticker-Anzeige, Gesichts- und Sticker-Tools.

5vor 19 TagenIntegrationen & FernzugriffMIT
0

dsh-voice-input

0nt-one/dsh-voice-input

Mikrofon-Schaltfläche in der Composer-Werkzeugleiste: Web-Speech-API-Sprache-zu-Text (Chrome/Edge), Sprachwechsel und optionaler Auto-Send, ohne Abhängigkeiten.

5vor 2 MonatenVision, Sprache & MultimodalMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

MiniMax-betriebenes multimodales Plugin: Echtzeit-Sprachanrufmodus (Streaming-Gespräch, schwebende Dock-UI), Sprachmodus und Mikrofon-Spracheingabe, sowie Bild-/Video-/Musik-/Sprachgenerierung und visuelle Inspektionstools.

5vor 2 MonatenVision, Sprache & MultimodalMIT
Y

Herta-dsh

yunmengyuan/herta-dsh

Installiert Herta als DeepSeek-Harness-Agenten: ein Preset mit ihren Persona- und Gedächtnis-Prompt-Abschnitten, sechs Gedächtnis- und Sprachwerkzeugen, einer narrativen Ebene, die ihr Denken von dem trennt, was sie sagt, 80 mitgelieferten Sprachclips, Offline- und MiniMax-Sprachsynthese sowie zwei Konversationsansichten, die die Sitzung mit ihren eigenen Komponenten rendern.

4vor 6 StundenIntegrationen & FernzugriffMIT
Y

dsh-tts-bridge

yuuyuko-uu/dsh-tts-bridge

Liest DSH-Konversationen laut vor, indem es die integrierte Vorlesefunktion der DeepSeek-Webseite nutzt, gesteuert von einer kleinen Browser-Erweiterung.

4vor 3 TagenVision, Sprache & Multimodal
S

dsh-voice

stardustlc666/dsh-voice

Sprachwerkzeuge: kostenlose neuronale Sprachsynthese mit edge-tts, OpenAI-kompatible ASR-Transkription, Stimmliste, Massenvorschau der Stimmen und Integritäts-Selbstprüfung.

4vor 7 StundenVision, Sprache & MultimodalMIT
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

Kostenlose geschlossene Sprachschleife für die Web-UI: Mikrofoneingabe über die Browser-SpeechRecognition mit Live-Zwischenergebnissen plus Vorlese-Lautsprecherschaltflächen und automatisches Vorlesen der Antworten des Assistenten, ganz ohne Konfiguration und ohne API-Schlüssel.

4vor 2 MonatenVision, Sprache & MultimodalMIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Omnimodale Workstation für DSH: analyze_image über eine geordnete Failover-Kette aus mehreren VLM-Karten, ein Bildwerkzeugkasten mit sechs Werkzeugen (Zoom, Farbabtastung, Pixel-Diff, OCR, Elementerkennung, Anzeige im Chat), die denselben Bildauflöser nutzen, generate_image über die Protokolle OpenAI/DashScope/ComfyUI, asynchrones generate_video mit mehreren Karten samt Builder /build-video-tool und speak/clone_voice für Sprachausgabe über sieben Anbieter – alles gesteuert von einer selbst speichernden Einstellungsseite.

3vor 14 TagenVision, Sprache & MultimodalMIT