Vai al contenuto principale

Plugin

Sfoglia, filtra e installa i plugin di DeepSeek-Harness.

15 plugin trovati

W

dsh-ears

wiziscool/dsh-ears

Plugin di input vocale per DeepSeek Harness (dsh): un pulsante microfono nel compositore converte il parlato in una bozza trascritta, con scelta di backend di riconoscimento vocale, rifinitura opzionale tramite i percorsi LLM propri di dsh e una pagina delle impostazioni nativa.

21ieriVisione, voce e multimodaleMIT
C

dsh-bilibili

czx2244/dsh-bilibili

Analisi dei video Bilibili: metadati, trascrizione (fallback ASR tramite Bijian/sherpa-onnx/whisper.cpp), commenti, danmaku e fotogrammi chiave nitidi con descrizioni visive locali opzionali.

92 mesi faStrumenti e capacitàMIT
I

dsh-video-understand

ilps2/dsh-video-understand

Strumento a basso costo per la comprensione dei video: un tool video_understand trasforma un link Bilibili / BV / un video locale in un layer informativo AVIS (ASR + struttura delle scene + tracking degli oggetti + etichette YOLO) e restituisce summary + Q&A. Routing dinamico tra layer guidato dalle domande (L0 ASR / L1 tracking oggetti / L2 VLM su keyframe), riuso del layer semantico per domande ripetute, tetto di budget per singola domanda. Motore Python: il layer base richiede faster-whisper / opencv / yt-dlp (~200-300MB); il layer semantico opzionale aggiunge ~2GB di torch / transformers / ultralytics. Un doctor --fix incluso configura il venv e installa entrambi.

8mese scorsoStrumenti e capacità
G

dsh-voice

goodandready/dsh-voice

Input vocale per la Web UI: dettatura segmentata dalle pause e messaggi vocali, ciascuno con la propria catena di fallback del provider (Deepgram, Groq, HuggingFace, whisper.cpp locale o endpoint compatibile con OpenAI).

8ieriVisione, voce e multimodaleMIT
S

dsh-voice

stardustlc666/dsh-voice

Strumenti vocali: sintesi vocale neurale gratuita con edge-tts, trascrizione ASR compatibile con OpenAI, elenco delle voci, anteprima batch delle voci e autodiagnosi dello stato.

410 ore faVisione, voce e multimodaleMIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Input vocale speech-to-text per la web UI: un pulsante microfono nel composer trascrive il parlato nella bozza tramite la Web Speech API del browser (zero-config) o un'API Whisper compatibile OpenAI (OpenAI / Groq), con modello e lingua selezionabili nelle Impostazioni.

3mese scorsoVisione, voce e multimodaleMIT
Z

dsh-watch-video

zeshuochen/dsh-watch-video

Trascrizione video con priorità ai sottotitoli, esportazione SRT, controlli di processo annullabili e fallback a faster-whisper large-v3 quando i sottotitoli non sono disponibili.

2mese scorsoVisione, voce e multimodale
1

dsh-wsl-im

173787247/dsh-wsl-im

Bridges Feishu, WeCom, DingTalk, QQ, Slack, Discord, Telegram and Mattermost into dsh agents (outbound WS/Stream/Gateway/long-poll/webhook), with im_status, optional local Whisper ASR, plain-text outbound for QQ/DingTalk/Telegram/Mattermost, and env CSV allowlists (DSH_IM_*_ALLOWED_USER_IDS). Empty allowedUserIds means EVERYONE can drive your agent — set a whitelist before exposing a bot.

13 giorni faSviluppo e strumenti per pluginMIT
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

118 giorni faVisione, voce e multimodaleGPL-3.0
Z

dsh-voice

zhuiyueya/dsh-voice

Voce per DeepSeek Harness (dsh) — input speech-to-text + lettura ad alta voce TTS per DeepSeek solo testo, senza chiave API

12 mesi faVisione, voce e multimodaleMIT
Y

dsh-video-to-notes

yll-kb/dsh-video-to-notes

Opt-in DeepSeek Harness skill bundle that turns course, lecture, tutorial, documentary, meeting, and talk videos into structured study notes.

012 giorni faVisione, voce e multimodaleMIT
B

dsh-asr-voice

bittersmilezzz/dsh-asr-voice

开口即成文 · Speak-to-prompt for DeepSeek Harness:云端 ASR 语音识别 + 提示词优化 + 填入草稿/自动发送,跨平台 macOS / Windows。

017 giorni faVisione, voce e multimodaleMIT
K

dsh-kitt-voice

kittcat-lab/dsh-kitt-voice

Voice for the DeepSeek Harness: speak to the agent, hear it back, and see what it is doing from a floating window that stays on top of whatever you are running.

028 giorni faVisione, voce e multimodaleMIT
N

dsh-voice

navid-kianfar/dsh-voice

Dictate prompts into the DeepSeek Harness Web Client — a microphone in the composer, with swappable transcription: hosted Whisper API, self-hosted server, or a fully offline whisper.cpp binary.

0mese scorsoVisione, voce e multimodaleMIT
Z

dsh-video-understand

zeshuochen/dsh-video-understand

Subtitle-first video transcription and deterministic extractive Markdown summaries, with a faster-whisper large-v3 fallback when subtitles are unavailable.

0mese scorsoVisione, voce e multimodale