Plugins
Explora, filtra e instala plugins de DeepSeek-Harness.
125 plugins encontrados
Deepseek-Continuity
linxuhao/deepseek-continuity
Generación local de imagen, voz, música y efectos de sonido, además de transcripción, con identidad fijada: los personajes, animales, objetos y voces de actores se definen una vez y se reutilizan en cada llamada posterior; la salida degenerada (una imagen casi plana, audio silencioso) se rechaza en lugar de devolverse como éxito, y una línea generada puede leerse de vuelta como texto para que un clon que se tragó su final se haga visible. Los motores se descargan cuando están inactivos, y la generación de imágenes y la transcripción pueden apuntar cada una a una API con forma de OpenAI en lugar del backend local Vulkan.
voco-input-sh
nothree-code/voco-input-sh
Entrada por voz para la interfaz web: un botón de micrófono que activa el reconocimiento de voz local sin conexión VocoType y auto inserta el texto reconocido en el compositor (despliegue automático, deduplicación, dictado continuo).
dsh-stt-input
baisama-cloud/dsh-stt-input
Entrada de voz con conversión voz a texto para la interfaz web: un botón de micrófono en el compositor transcribe el habla al borrador mediante la API Web Speech del navegador (sin configuración) o una API Whisper compatible con OpenAI (OpenAI / Groq), con un modelo e idioma seleccionables en Ajustes.
dsh-plugin-notify
huguangyu666/dsh-plugin-notify
Bandeja de salida de notificaciones: el agente te avisa de forma proactiva mediante toast, voz TTS en chino o efectos de sonido (explosión, victoria, alarma); una ventana de confirmación de 60 s te llama por voz, con refuerzo de volumen y panel de ajustes.
dsh-voice
jesse-njx/dsh-voice
Notas de voz de entrada, respuestas habladas de salida: dicta audio que se convierte en mensajes de usuario (transcribir), haz que el agente lea las respuestas en voz alta (hablar), con prioridad local bajo ~/.dsh/voice.
dsh-mic-input
qt-chen/dsh-mic-input
Entrada de voz por micrófono para el editor: transcripción en vivo mediante la Web Speech API del navegador, deduplicación/continuación automática, puntuación inteligente, y ajustes de idioma y envío automático.
dsh-voice-call
biliye/dsh-voice-call
Asistente de llamadas de voz para la GUI web de DSH: una bola de llamada flotante y arrastrable, VAD en el navegador que envía cada intervención tras una pausa, reconocimiento de voz FunASR HTTP o en streaming, respuestas TTS de MiniMax o compatibles con OpenAI, un modo opcional de palabra de activación con auto-suspensión y despacho de tareas a sesiones de subagente separadas con progreso, parada e informes hablados de finalización.
dsh-tool-lipsync
yu-wenchao/dsh-tool-lipsync
Plugin gratuito de generación de video con lip-sync para DSH con más de 3000 voces y más de 500 idiomas.
dsh-messenger-gateway
goodandready/dsh-messenger-gateway
Puente de Telegram para DeepSeek Harness: sesiones bidireccionales, dirección de conversaciones, enrutamiento por canal principal y notas de voz TTS enviadas como mensajes de audio de Telegram.
dsh-voice-agent (voice-app)
wayneyu430/dsh-voice-agent
Un agente frontal de voz conversacional para dsh: habla con naturalidad mediante ByteDance Duplex, delega solicitudes a tareas en segundo plano y escucha sus resultados asíncronos informados por voz.
dsh-voice-chat
maoyuching/dsh-voice-chat
Chat de voz estilo Doubao para DSH: mantener pulsado el micrófono del compositor convierte la voz en texto y la envía automáticamente, y las respuestas de la IA se leen en voz alta. Condensado opcional por LLM (las respuestas largas se resumen en frases habladas cortas siguiendo el modelo de la conversación actual), limpieza de texto apta para TTS, voces Edge TTS seleccionables, parada automática por silencio ajustable y ajustes integrados en el diálogo de configuración de DSH.
dsh-tts
goodandready/dsh-tts
Reproduce las respuestas del agente en la interfaz web de DeepSeek Harness mediante una cadena de respaldo de proveedores (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), de modo que un proveedor que falle o tenga límite de tasa pase al siguiente en lugar de quedar en silencio.
muxiva-dsh-voice
piyotahu/muxiva-dsh-voice
Voz dúplex completa local-first para DeepSeek Harness, orquestada por Muxiva
dsh-voice-call
pandapolo/dsh-voice-call
Llamadas de voz iniciadas por el agente: `offer_call` hace sonar al humano (接听/拒接/稍后再说); las llamadas aceptadas se sintetizan y reproducen localmente con CrispASR + Qwen3-TTS (9 voces, 2 dialectos chinos), y las rechazadas devuelven la decisión al agente.
dsh-fish-tts
mari23333/dsh-fish-tts
Lee en voz alta las respuestas del asistente solo mediante la API de Fish Audio (lleva tu propia clave): lectura por mensaje, interruptor de autolectura y una página de ajustes para el modelo, el reference_id de la voz, la clave de API cifrada y el proxy.
dsh-live2d-voice
john-walks-slow/dsh-live2d-voice
Live2D session view with realtime voice: continuous voice input, streaming TTS, subtitle translation, multi-model catalog, standalone entry / Live2D 实时语音会话视图:连续语音输入、流式 TTS、字幕翻译、多模型目录、独立入口
dsh-onebot
mario841859784/dsh-onebot
QQ channel for dsh via OneBot 11 (NapCat and friends): reverse or forward WebSocket, DM and group chats, image and voice transcription, t2i text-image cards, merged forwards, and a settings page.
dsh-claude-slider
yicun0316/dsh-claude-slider
Replaces the reasoning-effort dropdown with a draggable snapping slider, and draws 13 canvas effects across five style families (thrust, fluid, fantasy, tech, texture) with three tiers that unlock as the effort level rises. Custom mode combines 10 particle forms with 8 flow trajectories; 9 accent presets and a hex picker recolor every effect, and optional key sounds cover two voice clips, a synthesized duck squeak, a mechanical click and a local audio file.
dsh-wx-bridge
zhy5/dsh-wx-bridge
Drive your local DSH from WeChat: a self-hosted iLink bridge over a persistent ACP session (context lives in DSH and is resumable), phone conversations grouped into the desktop workspace, with image recognition, file messages (Excel/Word/PDF, parsed by the agent itself) and voice transcripts. Access defaults to strict (only registered devices are served); the phone channel's permission preset is wide by design - see the README security section before sharing the bot.
dsh-multi-tts
wyr-233/dsh-multi-tts
Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.
dshgo
xiazhi88/dshgo
Proxies the loopback-only dsh web onto a LAN port so phones and other machines can reach it, with an optional access password that browsers type in and the bundled Android client unlocks with biometrics. Adds a LAN-access settings page with QR codes, inlines dsh-web-mobile (MIT, attribution kept) for the mobile layout, and the Android client in the same repository adds finish/approval notifications, voice input and a home-screen widget.
dsh-live-voice
victorwads/dsh-live-voice
Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.
dsh-minimax-asr
moluyao/dsh-minimax-asr
MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选
dsh-voice-talk
duoduoqian708/dsh-voice-talk
Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.