Passer au contenu principal

Plugins

Parcourez, filtrez et installez des plugins DeepSeek-Harness.

76 plugins trouvés

W

dsh-opencode-go-usage

wawo77/dsh-opencode-go-usage

Mascotte d'usage du forfait pour l'interface web DSH : un personnage flottant à animation squelettique annonce le quota dans une bulle de dialogue, en identifiant automatiquement le fournisseur configuré (OpenCode Go, Command Code, DeepSeek) pour afficher un pourcentage de forfait ou un solde de compte, et en se rabattant sur les statistiques locales de tokens lorsque l'API du fournisseur est indisponible ; déplaçable, redimensionnable à la molette (90-260px), sons de clic synthétisés, routes en loopback uniquement.

3il y a 16 joursUtilisation et facturationMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

Saisie à une main, sans clavier, pour la zone de rédaction : maintenez le bouton de la souris enfoncé sur la zone de saisie, parlez, relâchez — le texte atterrit dans le brouillon, et glisser vers le haut annule sans laisser une phrase à moitié écrite. Pas de bouton micro à viser ni de raccourci à mémoriser ; la main n'a jamais à quitter la zone de saisie, ce qui est tout l'intérêt quand l'autre main est occupée. La reconnaissance fonctionne entièrement hors ligne (SenseVoice via sherpa-onnx, aucune clé API, l'audio ne quitte jamais la machine).

3il y a 20 heuresVision, voix et multimodalMIT
N

dsh-plugin-speech

nakamuraia/dsh-plugin-speech

Lit à voix haute les réponses de l'assistant dans DeepSeek Harness : fournisseurs de synthèse texte-vers-parole avec lecture en streaming.

3il y a 18 joursVision, voix et multimodalMIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

Assistant vocal pour dsh web : prononcez la phrase de réveil (par ex. « 小鲸 ») pour activer la dictée mains libres — ce que vous dites est transcrit et saisi automatiquement dans la zone de chat. Prend en charge les commandes d'édition vocales (envoyer, effacer, nouvelle ligne, arrêter la lecture) et lit à voix haute les réponses de l'assistant en chinois. La reconnaissance vocale s'exécute localement dans le navigateur via sherpa-onnx WASM, elle fonctionne donc hors ligne sans clé API.

3le mois dernierVision, voix et multimodalMIT
D

dsh-whale-pet

dleaf6211-hash/dsh-whale-pet

Animal de compagnie de bureau fille-baleine pour DeepSeek Harness : mascotte flottante du navigateur plus animal de bureau Windows partageant un même backend de données, avec tableau de solde en temps réel, notifications de tâches, interaction de caresse sur la tête, 19 répliques vocales pré-synthétisées avec émotion par réplique et parole en veille sensible à la présence.

3il y a 17 joursJuste pour le plaisirMIT
L

dsh-voco

lgquan/dsh-voco

Conversations vocales continues pour DSH avec écoute mains libres, push-to-talk, reconnaissance vocale, réponses TTS et délégation d'Agent en arrière-plan.

3le mois dernierVision, voix et multimodalMIT
T

dsh-gsv

taoruiliu19/dsh-gsv

TTS local en temps réel pour DeepSeek Harness : préréglages vocaux, lecture automatique, assistant de configuration du moteur, bouton de lecture à voix haute et panneau de réglages pour le moteur GSV-TTS-Lite.

3le mois dernierVision, voix et multimodalMIT
L

Deepseek-Continuity

linxuhao/deepseek-continuity

Génération locale d'images, de voix, de musique et d'effets sonores, plus transcription, avec identité épinglée : les personnages, animaux, objets et voix d'acteurs sont définis une fois et réutilisés à chaque appel ultérieur ; les sorties dégénérées (image presque plate, audio silencieux) sont rejetées au lieu d'être renvoyées comme succès, et une ligne générée peut être relue comme texte, ce qui rend visible un clone qui aurait avalé sa fin. Les moteurs se déchargent en veille, et la génération d'images et la transcription peuvent chacune être dirigées vers une API de type OpenAI au lieu du backend Vulkan local.

3il y a 12 joursVision, voix et multimodalMIT
N

voco-input-sh

nothree-code/voco-input-sh

Saisie vocale pour l'interface Web : un bouton micro qui lance la reconnaissance vocale hors ligne locale VocoType et insère automatiquement le texte reconnu dans le compositeur (déploiement automatique, déduplication, dictée continue).

3il y a 19 joursVision, voix et multimodalMIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Saisie vocale de reconnaissance vocale pour l'interface Web : un bouton micro dans le compositeur transcrit la parole en brouillon via l'API Web Speech du navigateur (sans configuration) ou une API Whisper compatible OpenAI (OpenAI / Groq), avec modèle et langue sélectionnables dans Paramètres.

3le mois dernierVision, voix et multimodalMIT
J

dsh-voice

jesse-njx/dsh-voice

Notes vocales en entrée, réponses parlées en sortie : dictez de l'audio qui devient des messages utilisateur (transcription), faites lire les réponses à voix haute par l'agent (synthèse vocale), local-first sous ~/.dsh/voice.

3il y a 2 moisVision, voix et multimodalMIT
Q

dsh-mic-input

qt-chen/dsh-mic-input

Saisie vocale au micro pour le composeur : transcription en direct via la Web Speech API du navigateur, déduplication/poursuite automatique, ponctuation intelligente, réglages de langue et d'envoi automatique.

3il y a 2 moisVision, voix et multimodalMIT
B

dsh-voice-call

biliye/dsh-voice-call

Assistant d'appel vocal pour l'interface web DSH : une boule d'appel flottante et déplaçable, un VAD côté navigateur qui envoie chaque prise de parole après une pause, la reconnaissance vocale FunASR HTTP ou en streaming, des réponses TTS MiniMax ou compatibles OpenAI, un mode optionnel à mot d'éveil avec mise en veille automatique, et la répartition de tâches vers des sessions de sous-agents séparées avec progression, arrêt et rapports de fin parlés.

2il y a 4 joursVision, voix et multimodalMIT
M

dsh-voice-chat

maoyuching/dsh-voice-chat

Chat vocal façon Doubao pour DSH : maintenir le micro du composeur convertit la parole en texte et l'envoie automatiquement, et les réponses de l'IA sont lues à voix haute. Condensation optionnelle par LLM (les longues réponses sont résumées en courtes phrases parlées, en suivant le modèle de la conversation en cours), nettoyage du texte adapté au TTS, voix Edge TTS sélectionnables, arrêt automatique au silence réglable et réglages intégrés à la boîte de dialogue des paramètres de DSH.

2il y a 8 joursVision, voix et multimodalMIT
G

dsh-tts

goodandready/dsh-tts

Lit les réponses de l'agent dans l'interface web de DeepSeek Harness via une chaîne de secours de fournisseurs (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), de sorte qu'un fournisseur en échec ou limité en débit bascule vers le suivant au lieu de rester silencieux.

2il y a 6 joursVision, voix et multimodalMIT
T

dsh-deepseek-pet

txlznbzsdj-collab/dsh-deepseek-pet

Animal de bureau animé baleine bleue DeepSeek flottant sur la page Web DSH : déplaçable avec des bulles et des poses d'humeur, un outil pet_say pour que le modèle le fasse parler, et des états de réflexion et de célébration de début/fin.

2il y a 2 moisJuste pour le plaisirMIT
P

dsh-voice-call

pandapolo/dsh-voice-call

Appels vocaux initiés par l’agent : `offer_call` fait sonner l’humain (接听/拒接/稍后再说) ; les appels acceptés sont synthétisés et lus localement via CrispASR + Qwen3-TTS (9 voix, 2 dialectes chinois), et les appels refusés renvoient la décision à l’agent.

2il y a 3 joursVision, voix et multimodalMIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

Lit à voix haute les réponses de l’assistant uniquement via l’API Fish Audio (clé à fournir soi-même) : lecture par message, bascule de lecture automatique et page de réglages pour le modèle, le reference_id de la voix, la clé API chiffrée et le proxy.

2avant-hierVision, voix et multimodalMIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.

1il y a 21 joursVision, voix et multimodal
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

1il y a 18 joursVision, voix et multimodalGPL-3.0
N

dsh-dictate

navneetset/dsh-dictate

Live speech-to-text dictation into the dsh web composer via OpenRouter STT

1il y a 27 joursVision, voix et multimodalMIT
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

1il y a 19 joursVision, voix et multimodalMIT
D

dsh-voice-talk

duoduoqian708/dsh-voice-talk

Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.

1il y a 20 joursVision, voix et multimodalMIT
J

dsh-live-voice

jstn-1g/dsh-live-voice

Consent-bound one-turn voice preview for DSH Web with a credential-free local synthetic demo, optional Qwen Audio, exact Session isolation, and explicit transcript-to-draft handoff without automatic submission.

1il y a 27 joursVision, voix et multimodalMIT