Plugins
Explora, filtra e instala plugins de DeepSeek-Harness.
25 plugins encontrados
dsh-omi-voice
polinnizhong/dsh-omi-voice
Lectura en voz alta dentro del chat para DeepSeek Harness: toca para leer, pausar y reanudar las respuestas de la IA con voces naturales de Doubao TTS (BYOK); lee solo la respuesta final, con código, tablas y diagramas filtrados; motor local, el complemento no guarda ninguna clave de API.
dsh-plugin-tts
1624318455/dsh-plugin-tts
Lee en voz alta las respuestas del asistente mediante Edge TTS gratuito o tus propios modelos de voz RVC: botones de lectura en voz alta + lectura automática, reproducción progresiva por fragmentos adaptativa (lecturas largas sin cortes), instalación de paquetes de voz con un clic desde un registro y un runtime RVC portátil.
dsh-talk
perrylink/dsh-talk
Entrada/salida de voz para DeepSeek Harness: reconocimiento de voz a texto y texto a voz a través del micrófono y la salida de audio.
dsh-voice-mode (dsh-voice-mode)
qishuilalala/dsh-voice-mode
Modo de voz dúplex completo para la interfaz web de DeepSeek Harness: conmutación (envío automático tras pausa de 2 s) o dictado pulsar-para-hablar en un borrador editable con ASR en streaming zipformer2, palabra de activación opcional; lectura en voz alta Edge TTS oración por oración con subtítulos en vivo, y la voz interrumpe la reproducción y el turno en curso (barge-in real). ASR en el dispositivo, sin clave de API.
dsh-plugin-xiaomi-mimo-tts
ppy-web/dsh-plugin-xiaomi-mimo-tts
Añade texto a voz Xiaomi MiMo a DSH Web con lectura en voz alta de los mensajes del asistente, streaming PCM, diseño de voz predefinido y personalizado, respaldo con la voz del navegador, controles de reproducción y sonidos de interfaz opcionales.
dsh-tts-bridge
yuuyuko-uu/dsh-tts-bridge
Lee las conversaciones de DSH en voz alta utilizando la lectura en voz alta integrada de la página web de DeepSeek, controlada por una pequeña extensión del navegador.
dsh-omni-workstation
huashenglian/dsh-omni-workstation
Estación de trabajo omnimodal para DSH: analyze_image sobre una cadena ordenada de conmutación por error VLM de varias tarjetas, un conjunto de seis herramientas de visión (zoom, muestreo de color, diferencia de píxeles, OCR, detección de elementos y visualización en línea) que comparten el mismo resolutor de imágenes, generate_image mediante los protocolos OpenAI/DashScope/ComfyUI, generate_video asíncrono con varias tarjetas y un constructor /build-video-tool, y speak/clone_voice TTS en siete proveedores, todo gobernado por una única página de ajustes con autoguardado.
dsh-plugin-speech
nakamuraia/dsh-plugin-speech
Lee en voz alta las respuestas del asistente en DeepSeek Harness: proveedores de texto a voz con reproducción en streaming.
dsh-voco
lgquan/dsh-voco
Conversaciones de voz continuas para DSH con escucha manos libres, pulsar para hablar, reconocimiento de voz, respuestas TTS y delegación de Agent en segundo plano.
dsh-gsv
taoruiliu19/dsh-gsv
TTS local en tiempo real para DeepSeek Harness: preajustes de voz, lectura automática, asistente de configuración del motor, botón de lectura en voz alta y un panel de ajustes para el motor GSV-TTS-Lite.
Deepseek-Continuity
linxuhao/deepseek-continuity
Generación local de imagen, voz, música y efectos de sonido, además de transcripción, con identidad fijada: los personajes, animales, objetos y voces de actores se definen una vez y se reutilizan en cada llamada posterior; la salida degenerada (una imagen casi plana, audio silencioso) se rechaza en lugar de devolverse como éxito, y una línea generada puede leerse de vuelta como texto para que un clon que se tragó su final se haga visible. Los motores se descargan cuando están inactivos, y la generación de imágenes y la transcripción pueden apuntar cada una a una API con forma de OpenAI en lugar del backend local Vulkan.
dsh-voice
jesse-njx/dsh-voice
Notas de voz de entrada, respuestas habladas de salida: dicta audio que se convierte en mensajes de usuario (transcribir), haz que el agente lea las respuestas en voz alta (hablar), con prioridad local bajo ~/.dsh/voice.
dsh-voice-call
biliye/dsh-voice-call
Asistente de llamadas de voz para la GUI web de DSH: una bola de llamada flotante y arrastrable, VAD en el navegador que envía cada intervención tras una pausa, reconocimiento de voz FunASR HTTP o en streaming, respuestas TTS de MiniMax o compatibles con OpenAI, un modo opcional de palabra de activación con auto-suspensión y despacho de tareas a sesiones de subagente separadas con progreso, parada e informes hablados de finalización.
dsh-voice-call
pandapolo/dsh-voice-call
Llamadas de voz iniciadas por el agente: `offer_call` hace sonar al humano (接听/拒接/稍后再说); las llamadas aceptadas se sintetizan y reproducen localmente con CrispASR + Qwen3-TTS (9 voces, 2 dialectos chinos), y las rechazadas devuelven la decisión al agente.
dsh-fish-tts
mari23333/dsh-fish-tts
Lee en voz alta las respuestas del asistente solo mediante la API de Fish Audio (lleva tu propia clave): lectura por mensaje, interruptor de autolectura y una página de ajustes para el modelo, el reference_id de la voz, la clave de API cifrada y el proxy.
dsh-multi-tts
wyr-233/dsh-multi-tts
Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.
dsh-live-voice
victorwads/dsh-live-voice
Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.
dsh-minimax-asr
moluyao/dsh-minimax-asr
MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选
dsh-voice
zhuiyueya/dsh-voice
Voz para DeepSeek Harness (dsh): entrada de voz a texto y lectura en voz alta mediante TTS para DeepSeek de solo texto, sin necesidad de clave de API.
dsh-say
fangqian616/dsh-say
Speaks your agent's reports in a voice you choose, compressing long reports before speaking. Character voices need no training - a 3-10 second reference clip clones one, and community-trained models work too - and no 6.4 GB GPT-SoVITS install: the plugin installs its own runtime and voice. An existing GPT-SoVITS can be used instead, and it is the same voice model.
dsh-voice-alert
loyalchiiina/dsh-voice-alert
Speaks or plays a sound at the end of every turn and plays a failure cue when a tool call or a turn errors. Ships 20 built-in effects (10 alert chimes + 10 nature sounds) and defaults to effect mode, so it needs no API key and no audio files; an optional Volcengine voice-clone route generates the three announcement clips in one click. Plays through winmm/waveOut as-is, never changing the system volume or mute state. Windows only.
dsh-voice-mimo
ch1bug/dsh-voice-mimo
Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).
dsh-kitt-voice
kittcat-lab/dsh-kitt-voice
Voice for the DeepSeek Harness: speak to the agent, hear it back, and see what it is doing from a floating window that stays on top of whatever you are running.
dsh-plugins
genesis-agents/dsh-plugins
A source library for DeepSeek Harness: 72 feeds on an hourly timer, a reader with transcripts and translation, and a publisher that turns what it collects into a podcast, a digest, or a report