Saltar al contenido principal

Plugins

Explora, filtra e instala plugins de DeepSeek-Harness.

4 plugins encontrados

Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

Modo de voz dúplex completo para la interfaz web de DeepSeek Harness: conmutación (envío automático tras pausa de 2 s) o dictado pulsar-para-hablar en un borrador editable con ASR en streaming zipformer2, palabra de activación opcional; lectura en voz alta Edge TTS oración por oración con subtítulos en vivo, y la voz interrumpe la reproducción y el turno en curso (barge-in real). ASR en el dispositivo, sin clave de API.

12ayerVisión, voz y multimodalMIT
Z

dsh-voice-input-plugin

zhangbo-cn/dsh-voice-input-plugin

Micrófono del compositor para la interfaz web: pulsa para monitorizar la transcripción en vivo y mantén pulsado para hablar, con lectura de respuesta mediante Edge TTS del host que se transmite mientras el modelo genera, pausa de eco durante la lectura y pulsa para detener.

5hace 27 díasVisión, voz y multimodalMIT
H

dsh-voice

haoku123/dsh-voice

Modo de voz full-dúplex para la interfaz web: dictado con toque para alternar o mantener pulsado (tecla de envío o `Ctrl`) con subtítulos en vivo, ASR SenseVoice del lado del host mediante sherpa-onnx, respuestas habladas oración por oración, y hablar interrumpe la reproducción y el turno en curso (verdadera interrupción). Sin clave de API.

4hace 29 díasVisión, voz y multimodalMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

Entrada con una sola mano y sin teclado para el compositor: mantén pulsado el ratón sobre el cuadro de entrada, habla y suelta — el texto aparece en el borrador, y deslizar hacia arriba cancela sin dejar media frase. No hay botón de micrófono al que apuntar ni atajo que recordar; la mano nunca tiene que salir del área de entrada, que es justo lo importante cuando la otra mano está ocupada. El reconocimiento se ejecuta totalmente sin conexión (SenseVoice mediante sherpa-onnx, sin clave de API, el audio nunca sale del equipo).

3hace 10 díasVisión, voz y multimodalMIT