Passer au contenu principal

Plugins

Parcourez, filtrez et installez des plugins DeepSeek-Harness.

4 plugins trouvés

Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

Mode voix duplex intégral pour l'interface Web DeepSeek Harness : bascule (envoi automatique après 2 s de pause) ou dictée push-to-talk dans un brouillon modifiable avec ASR streaming zipformer2, mot de réveil optionnel ; lecture phrase par phrase via Edge TTS avec sous-titres en direct, et la parole interrompt la lecture et le tour en cours (vrai barge-in). ASR sur appareil, aucune clé API requise.

12il y a 23 heuresVision, voix et multimodalMIT
Z

dsh-voice-input-plugin

zhangbo-cn/dsh-voice-input-plugin

Micro du compositeur pour l'interface web : appuyez pour surveiller la transcription en direct et maintenez pour parler, avec une lecture de réponse par Edge TTS de l'hôte diffusée pendant que le modèle génère, une pause d'écho pendant la lecture, et un appui pour arrêter.

5il y a 27 joursVision, voix et multimodalMIT
H

dsh-voice

haoku123/dsh-voice

Mode vocal full-duplex pour l'interface web : dictée par pression pour basculer ou maintien (touche d'envoi ou `Ctrl`) avec sous-titres en direct, ASR SenseVoice côté hôte via sherpa-onnx, réponses parlées phrase par phrase, et parler interrompt la lecture et le tour en cours (vraie interruption). Aucune clé API.

4il y a 29 joursVision, voix et multimodalMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

Saisie à une main, sans clavier, pour la zone de rédaction : maintenez le bouton de la souris enfoncé sur la zone de saisie, parlez, relâchez — le texte atterrit dans le brouillon, et glisser vers le haut annule sans laisser une phrase à moitié écrite. Pas de bouton micro à viser ni de raccourci à mémoriser ; la main n'a jamais à quitter la zone de saisie, ce qui est tout l'intérêt quand l'autre main est occupée. La reconnaissance fonctionne entièrement hors ligne (SenseVoice via sherpa-onnx, aucune clé API, l'audio ne quitte jamais la machine).

3il y a 10 joursVision, voix et multimodalMIT