Плагины
Находите, фильтруйте и устанавливайте плагины DeepSeek-Harness.
Найдено плагинов: 125
Deepseek-Continuity
linxuhao/deepseek-continuity
Локальная генерация изображений, голоса, музыки и звуковых эффектов, а также транскрипция с закреплённой идентичностью: персонажи, животные, объекты и голоса актёров определяются один раз и повторно используются при каждом последующем вызове; вырожденный вывод (почти плоское изображение, беззвучное аудио) отклоняется, а не возвращается как успешный, а сгенерированную строку можно прочитать обратно как текст, чтобы клон, проглотивший свою концовку, стал виден. Движки выгружаются в простое, а генерация изображений и транскрипция могут каждая указывать на API в форме OpenAI вместо локального Vulkan-бэкенда.
voco-input-sh
nothree-code/voco-input-sh
Голосовой ввод для Web UI: кнопка микрофона, которая запускает локальное офлайн-распознавание речи VocoType и автоматически вставляет распознанный текст в composer (авторазвертывание, дедупликация, непрерывная диктовка).
dsh-stt-input
baisama-cloud/dsh-stt-input
Голосовой ввод с распознаванием речи для Web UI: кнопка микрофона в композиторе транскрибирует речь в черновик через Web Speech API браузера (без настройки) или совместимый с OpenAI Whisper API (OpenAI / Groq), с выбором модели и языка в Настройках.
dsh-plugin-notify
huguangyu666/dsh-plugin-notify
Исходящий ящик уведомлений: агент проактивно уведомляет через toast / голос TTS на китайском / звуковые эффекты (взрыв, победа, тревога), окно подтверждения 60 секунд перезванивает вам голосом, усиление громкости, панель настроек.
dsh-voice
jesse-njx/dsh-voice
Голосовые заметки на входе, озвученные ответы на выходе: надиктуйте аудио, которое становится сообщением пользователя (транскрипция), пусть агент читает ответы вслух (озвучивание), локально в ~/.dsh/voice.
dsh-mic-input
qt-chen/dsh-mic-input
Голосовой ввод с микрофона для composer: транскрипция в реальном времени через Web Speech API браузера, дедупликация/автопродолжение, умная пунктуация, настройки языка и автоотправки.
dsh-voice-call
biliye/dsh-voice-call
Голосовой ассистент звонков для веб-GUI DSH: перетаскиваемый плавающий шар звонка, VAD на стороне браузера, отправляющий каждую фразу после паузы, распознавание речи FunASR по HTTP или потоково, ответы TTS от MiniMax или совместимые с OpenAI, необязательный режим слова-активатора с автосном и отправка задач в отдельные сессии субагентов с прогрессом, остановкой и озвученными отчётами о завершении.
dsh-tool-lipsync
yu-wenchao/dsh-tool-lipsync
Бесплатный плагин генерации видео с липсинком для DSH с 3000+ голосами и 500+ языками.
dsh-messenger-gateway
goodandready/dsh-messenger-gateway
Telegram-мост для DeepSeek Harness: двунаправленные сессии, управление ходом диалога, маршрутизация по домашнему каналу и голосовые заметки TTS, отправляемые как аудиосообщения Telegram.
dsh-voice-agent (voice-app)
wayneyu430/dsh-voice-agent
Разговорный голосовой фронтенд-агент для dsh: говорите естественно через ByteDance Duplex, делегируйте запросы фоновым задачам и слышите их асинхронные результаты, сообщаемые голосом.
dsh-voice-chat
maoyuching/dsh-voice-chat
Голосовой чат в стиле Doubao для DSH: удержание микрофона в поле ввода преобразует речь в текст и отправляет автоматически, а ответы ИИ озвучиваются. Необязательное сжатие с помощью LLM (длинные ответы сводятся к коротким озвучиваемым репликам в соответствии с моделью текущего диалога), очистка текста для TTS, выбираемые голоса Edge TTS, настраиваемая автоостановка по тишине, а настройки встроены в диалог настроек DSH.
dsh-tts
goodandready/dsh-tts
Озвучивает ответы агента в веб-интерфейсе DeepSeek Harness через цепочку отката между провайдерами (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), так что сбойный или ограниченный по частоте провайдер передаёт эстафету следующему, а не замолкает.
muxiva-dsh-voice
piyotahu/muxiva-dsh-voice
Локально-ориентированная полнодуплексная голосовая связь для DeepSeek Harness, оркестрируемая Muxiva
dsh-voice-call
pandapolo/dsh-voice-call
Голосовые звонки, инициируемые агентом: `offer_call` звонит человеку (接听/拒接/稍后再说); принятые звонки синтезируются и воспроизводятся локально через CrispASR + Qwen3-TTS (9 голосов, 2 китайских диалекта), а отклонённые возвращают решение агенту.
dsh-fish-tts
mari23333/dsh-fish-tts
Озвучивает ответы ассистента только через Fish Audio API (ключ нужен свой): чтение по каждому сообщению, переключатель автопрочтения и страница настроек для модели, voice reference_id, зашифрованного API-ключа и прокси.
dsh-live2d-voice
john-walks-slow/dsh-live2d-voice
Live2D session view with realtime voice: continuous voice input, streaming TTS, subtitle translation, multi-model catalog, standalone entry / Live2D 实时语音会话视图:连续语音输入、流式 TTS、字幕翻译、多模型目录、独立入口
dsh-onebot
mario841859784/dsh-onebot
QQ channel for dsh via OneBot 11 (NapCat and friends): reverse or forward WebSocket, DM and group chats, image and voice transcription, t2i text-image cards, merged forwards, and a settings page.
dsh-claude-slider
yicun0316/dsh-claude-slider
Replaces the reasoning-effort dropdown with a draggable snapping slider, and draws 13 canvas effects across five style families (thrust, fluid, fantasy, tech, texture) with three tiers that unlock as the effort level rises. Custom mode combines 10 particle forms with 8 flow trajectories; 9 accent presets and a hex picker recolor every effect, and optional key sounds cover two voice clips, a synthesized duck squeak, a mechanical click and a local audio file.
dsh-wx-bridge
zhy5/dsh-wx-bridge
Drive your local DSH from WeChat: a self-hosted iLink bridge over a persistent ACP session (context lives in DSH and is resumable), phone conversations grouped into the desktop workspace, with image recognition, file messages (Excel/Word/PDF, parsed by the agent itself) and voice transcripts. Access defaults to strict (only registered devices are served); the phone channel's permission preset is wide by design - see the README security section before sharing the bot.
dsh-multi-tts
wyr-233/dsh-multi-tts
Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.
dshgo
xiazhi88/dshgo
Proxies the loopback-only dsh web onto a LAN port so phones and other machines can reach it, with an optional access password that browsers type in and the bundled Android client unlocks with biometrics. Adds a LAN-access settings page with QR codes, inlines dsh-web-mobile (MIT, attribution kept) for the mobile layout, and the Android client in the same repository adds finish/approval notifications, voice input and a home-screen widget.
dsh-live-voice
victorwads/dsh-live-voice
Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.
dsh-minimax-asr
moluyao/dsh-minimax-asr
MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选
dsh-voice-talk
duoduoqian708/dsh-voice-talk
Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.