Saltar al contenido principal

Plugins

Explora, filtra e instala plugins de DeepSeek-Harness.

15 plugins encontrados

W

dsh-ears

wiziscool/dsh-ears

Plugin de entrada de voz para DeepSeek Harness (dsh): un botón de micrófono en el compositor convierte el habla en un borrador transcrito, con opción de backends de reconocimiento de voz, pulido opcional mediante las rutas LLM propias de dsh y una página de configuración nativa.

21ayerVisión, voz y multimodalMIT
C

dsh-bilibili

czx2244/dsh-bilibili

Análisis de vídeos de Bilibili: metadatos, transcripción (con respaldo ASR vía Bijian/sherpa-onnx/whisper.cpp), comentarios, danmaku y fotogramas clave nítidos con descripciones de visión local opcionales.

9hace 2 mesesHerramientas y funcionesMIT
I

dsh-video-understand

ilps2/dsh-video-understand

Herramienta de comprensión de video de bajo coste: una herramienta video_understand convierte un enlace de Bilibili / BV / video local en una capa de información AVIS (ASR + estructura de escenas + seguimiento de objetos + etiquetas YOLO) y devuelve un resumen + Q&A. Incluye enrutamiento dinámico entre capas guiado por preguntas (L0 ASR / L1 seguimiento de objetos / L2 VLM de fotograma clave), reutilización de la capa semántica para preguntas repetidas y un tope de presupuesto por pregunta. Motor Python: la capa principal necesita faster-whisper / opencv / yt-dlp (~200-300MB); la capa semántica opcional añade ~2GB de torch / transformers / ultralytics. Un doctor --fix incluido configura el venv e instala ambos.

8el mes pasadoHerramientas y funciones
G

dsh-voice

goodandready/dsh-voice

Entrada de voz para la interfaz web: dictado segmentado por pausas y mensajes de voz, cada uno con su propia cadena de respaldo de proveedores (Deepgram, Groq, HuggingFace, whisper.cpp local o un endpoint compatible con OpenAI).

8ayerVisión, voz y multimodalMIT
S

dsh-voice

stardustlc666/dsh-voice

Herramientas de voz: síntesis de voz neuronal gratuita con edge-tts, transcripción ASR compatible con OpenAI, lista de voces, vista previa de voces por lotes y autodiagnóstico de estado.

4hace 10 horasVisión, voz y multimodalMIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Entrada de voz con conversión voz a texto para la interfaz web: un botón de micrófono en el compositor transcribe el habla al borrador mediante la API Web Speech del navegador (sin configuración) o una API Whisper compatible con OpenAI (OpenAI / Groq), con un modelo e idioma seleccionables en Ajustes.

3el mes pasadoVisión, voz y multimodalMIT
Z

dsh-watch-video

zeshuochen/dsh-watch-video

Transcripción de vídeo que prioriza los subtítulos con exportación a SRT, controles de trabajos cancelables y un respaldo faster-whisper large-v3 cuando no hay subtítulos disponibles.

2el mes pasadoVisión, voz y multimodal
1

dsh-wsl-im

173787247/dsh-wsl-im

Bridges Feishu, WeCom, DingTalk, QQ, Slack, Discord, Telegram and Mattermost into dsh agents (outbound WS/Stream/Gateway/long-poll/webhook), with im_status, optional local Whisper ASR, plain-text outbound for QQ/DingTalk/Telegram/Mattermost, and env CSV allowlists (DSH_IM_*_ALLOWED_USER_IDS). Empty allowedUserIds means EVERYONE can drive your agent — set a whitelist before exposing a bot.

1hace 3 díasDesarrollo y herramientas de pluginsMIT
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

1hace 18 díasVisión, voz y multimodalGPL-3.0
Z

dsh-voice

zhuiyueya/dsh-voice

Voz para DeepSeek Harness (dsh): entrada de voz a texto y lectura en voz alta mediante TTS para DeepSeek de solo texto, sin necesidad de clave de API.

1hace 2 mesesVisión, voz y multimodalMIT
Y

dsh-video-to-notes

yll-kb/dsh-video-to-notes

Opt-in DeepSeek Harness skill bundle that turns course, lecture, tutorial, documentary, meeting, and talk videos into structured study notes.

0hace 12 díasVisión, voz y multimodalMIT
B

dsh-asr-voice

bittersmilezzz/dsh-asr-voice

开口即成文 · Speak-to-prompt for DeepSeek Harness:云端 ASR 语音识别 + 提示词优化 + 填入草稿/自动发送,跨平台 macOS / Windows。

0hace 17 díasVisión, voz y multimodalMIT
K

dsh-kitt-voice

kittcat-lab/dsh-kitt-voice

Voice for the DeepSeek Harness: speak to the agent, hear it back, and see what it is doing from a floating window that stays on top of whatever you are running.

0hace 28 díasVisión, voz y multimodalMIT
N

dsh-voice

navid-kianfar/dsh-voice

Dictate prompts into the DeepSeek Harness Web Client — a microphone in the composer, with swappable transcription: hosted Whisper API, self-hosted server, or a fully offline whisper.cpp binary.

0el mes pasadoVisión, voz y multimodalMIT
Z

dsh-video-understand

zeshuochen/dsh-video-understand

Subtitle-first video transcription and deterministic extractive Markdown summaries, with a faster-whisper large-v3 fallback when subtitles are unavailable.

0el mes pasadoVisión, voz y multimodal