Plugins
Explora, filtra e instala plugins de DeepSeek-Harness.
15 plugins encontrados
dsh-ears
wiziscool/dsh-ears
Plugin de entrada de voz para DeepSeek Harness (dsh): un botón de micrófono en el compositor convierte el habla en un borrador transcrito, con opción de backends de reconocimiento de voz, pulido opcional mediante las rutas LLM propias de dsh y una página de configuración nativa.
dsh-bilibili
czx2244/dsh-bilibili
Análisis de vídeos de Bilibili: metadatos, transcripción (con respaldo ASR vía Bijian/sherpa-onnx/whisper.cpp), comentarios, danmaku y fotogramas clave nítidos con descripciones de visión local opcionales.
dsh-video-understand
ilps2/dsh-video-understand
Herramienta de comprensión de video de bajo coste: una herramienta video_understand convierte un enlace de Bilibili / BV / video local en una capa de información AVIS (ASR + estructura de escenas + seguimiento de objetos + etiquetas YOLO) y devuelve un resumen + Q&A. Incluye enrutamiento dinámico entre capas guiado por preguntas (L0 ASR / L1 seguimiento de objetos / L2 VLM de fotograma clave), reutilización de la capa semántica para preguntas repetidas y un tope de presupuesto por pregunta. Motor Python: la capa principal necesita faster-whisper / opencv / yt-dlp (~200-300MB); la capa semántica opcional añade ~2GB de torch / transformers / ultralytics. Un doctor --fix incluido configura el venv e instala ambos.
dsh-voice
goodandready/dsh-voice
Entrada de voz para la interfaz web: dictado segmentado por pausas y mensajes de voz, cada uno con su propia cadena de respaldo de proveedores (Deepgram, Groq, HuggingFace, whisper.cpp local o un endpoint compatible con OpenAI).
dsh-voice
stardustlc666/dsh-voice
Herramientas de voz: síntesis de voz neuronal gratuita con edge-tts, transcripción ASR compatible con OpenAI, lista de voces, vista previa de voces por lotes y autodiagnóstico de estado.
dsh-stt-input
baisama-cloud/dsh-stt-input
Entrada de voz con conversión voz a texto para la interfaz web: un botón de micrófono en el compositor transcribe el habla al borrador mediante la API Web Speech del navegador (sin configuración) o una API Whisper compatible con OpenAI (OpenAI / Groq), con un modelo e idioma seleccionables en Ajustes.
dsh-watch-video
zeshuochen/dsh-watch-video
Transcripción de vídeo que prioriza los subtítulos con exportación a SRT, controles de trabajos cancelables y un respaldo faster-whisper large-v3 cuando no hay subtítulos disponibles.
dsh-wsl-im
173787247/dsh-wsl-im
Bridges Feishu, WeCom, DingTalk, QQ, Slack, Discord, Telegram and Mattermost into dsh agents (outbound WS/Stream/Gateway/long-poll/webhook), with im_status, optional local Whisper ASR, plain-text outbound for QQ/DingTalk/Telegram/Mattermost, and env CSV allowlists (DSH_IM_*_ALLOWED_USER_IDS). Empty allowedUserIds means EVERYONE can drive your agent — set a whitelist before exposing a bot.
dsh-live-voice
victorwads/dsh-live-voice
Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.
dsh-voice
zhuiyueya/dsh-voice
Voz para DeepSeek Harness (dsh): entrada de voz a texto y lectura en voz alta mediante TTS para DeepSeek de solo texto, sin necesidad de clave de API.
dsh-video-to-notes
yll-kb/dsh-video-to-notes
Opt-in DeepSeek Harness skill bundle that turns course, lecture, tutorial, documentary, meeting, and talk videos into structured study notes.
dsh-asr-voice
bittersmilezzz/dsh-asr-voice
开口即成文 · Speak-to-prompt for DeepSeek Harness:云端 ASR 语音识别 + 提示词优化 + 填入草稿/自动发送,跨平台 macOS / Windows。
dsh-kitt-voice
kittcat-lab/dsh-kitt-voice
Voice for the DeepSeek Harness: speak to the agent, hear it back, and see what it is doing from a floating window that stays on top of whatever you are running.
dsh-voice
navid-kianfar/dsh-voice
Dictate prompts into the DeepSeek Harness Web Client — a microphone in the composer, with swappable transcription: hosted Whisper API, self-hosted server, or a fully offline whisper.cpp binary.
dsh-video-understand
zeshuochen/dsh-video-understand
Subtitle-first video transcription and deterministic extractive Markdown summaries, with a faster-whisper large-v3 fallback when subtitles are unavailable.