Перейти к основному содержимому

Плагины

Находите, фильтруйте и устанавливайте плагины DeepSeek-Harness.

Найдено плагинов: 125

L

Deepseek-Continuity

linxuhao/deepseek-continuity

Локальная генерация изображений, голоса, музыки и звуковых эффектов, а также транскрипция с закреплённой идентичностью: персонажи, животные, объекты и голоса актёров определяются один раз и повторно используются при каждом последующем вызове; вырожденный вывод (почти плоское изображение, беззвучное аудио) отклоняется, а не возвращается как успешный, а сгенерированную строку можно прочитать обратно как текст, чтобы клон, проглотивший свою концовку, стал виден. Движки выгружаются в простое, а генерация изображений и транскрипция могут каждая указывать на API в форме OpenAI вместо локального Vulkan-бэкенда.

312 дней назадЗрение, голос и мультимодальностьMIT
N

voco-input-sh

nothree-code/voco-input-sh

Голосовой ввод для Web UI: кнопка микрофона, которая запускает локальное офлайн-распознавание речи VocoType и автоматически вставляет распознанный текст в composer (авторазвертывание, дедупликация, непрерывная диктовка).

319 дней назадЗрение, голос и мультимодальностьMIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Голосовой ввод с распознаванием речи для Web UI: кнопка микрофона в композиторе транскрибирует речь в черновик через Web Speech API браузера (без настройки) или совместимый с OpenAI Whisper API (OpenAI / Groq), с выбором модели и языка в Настройках.

3в прошлом месяцеЗрение, голос и мультимодальностьMIT
H

dsh-plugin-notify

huguangyu666/dsh-plugin-notify

Исходящий ящик уведомлений: агент проактивно уведомляет через toast / голос TTS на китайском / звуковые эффекты (взрыв, победа, тревога), окно подтверждения 60 секунд перезванивает вам голосом, усиление громкости, панель настроек.

318 дней назадИнтеграции и удалённый доступMIT
J

dsh-voice

jesse-njx/dsh-voice

Голосовые заметки на входе, озвученные ответы на выходе: надиктуйте аудио, которое становится сообщением пользователя (транскрипция), пусть агент читает ответы вслух (озвучивание), локально в ~/.dsh/voice.

32 месяца назадЗрение, голос и мультимодальностьMIT
Q

dsh-mic-input

qt-chen/dsh-mic-input

Голосовой ввод с микрофона для composer: транскрипция в реальном времени через Web Speech API браузера, дедупликация/автопродолжение, умная пунктуация, настройки языка и автоотправки.

32 месяца назадЗрение, голос и мультимодальностьMIT
B

dsh-voice-call

biliye/dsh-voice-call

Голосовой ассистент звонков для веб-GUI DSH: перетаскиваемый плавающий шар звонка, VAD на стороне браузера, отправляющий каждую фразу после паузы, распознавание речи FunASR по HTTP или потоково, ответы TTS от MiniMax или совместимые с OpenAI, необязательный режим слова-активатора с автосном и отправка задач в отдельные сессии субагентов с прогрессом, остановкой и озвученными отчётами о завершении.

25 дней назадЗрение, голос и мультимодальностьMIT
Y

dsh-tool-lipsync

yu-wenchao/dsh-tool-lipsync

Бесплатный плагин генерации видео с липсинком для DSH с 3000+ голосами и 500+ языками.

228 дней назадЗрение, голос и мультимодальностьMIT
G

dsh-messenger-gateway

goodandready/dsh-messenger-gateway

Telegram-мост для DeepSeek Harness: двунаправленные сессии, управление ходом диалога, маршрутизация по домашнему каналу и голосовые заметки TTS, отправляемые как аудиосообщения Telegram.

23 дня назадИнтеграции и удалённый доступMIT
W

dsh-voice-agent (voice-app)

wayneyu430/dsh-voice-agent

Разговорный голосовой фронтенд-агент для dsh: говорите естественно через ByteDance Duplex, делегируйте запросы фоновым задачам и слышите их асинхронные результаты, сообщаемые голосом.

2в прошлом месяцеЗрение, голос и мультимодальность
M

dsh-voice-chat

maoyuching/dsh-voice-chat

Голосовой чат в стиле Doubao для DSH: удержание микрофона в поле ввода преобразует речь в текст и отправляет автоматически, а ответы ИИ озвучиваются. Необязательное сжатие с помощью LLM (длинные ответы сводятся к коротким озвучиваемым репликам в соответствии с моделью текущего диалога), очистка текста для TTS, выбираемые голоса Edge TTS, настраиваемая автоостановка по тишине, а настройки встроены в диалог настроек DSH.

28 дней назадЗрение, голос и мультимодальностьMIT
G

dsh-tts

goodandready/dsh-tts

Озвучивает ответы агента в веб-интерфейсе DeepSeek Harness через цепочку отката между провайдерами (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), так что сбойный или ограниченный по частоте провайдер передаёт эстафету следующему, а не замолкает.

26 дней назадЗрение, голос и мультимодальностьMIT
P

muxiva-dsh-voice

piyotahu/muxiva-dsh-voice

Локально-ориентированная полнодуплексная голосовая связь для DeepSeek Harness, оркестрируемая Muxiva

22 месяца назадЗрение, голос и мультимодальностьApache-2.0
P

dsh-voice-call

pandapolo/dsh-voice-call

Голосовые звонки, инициируемые агентом: `offer_call` звонит человеку (接听/拒接/稍后再说); принятые звонки синтезируются и воспроизводятся локально через CrispASR + Qwen3-TTS (9 голосов, 2 китайских диалекта), а отклонённые возвращают решение агенту.

23 дня назадЗрение, голос и мультимодальностьMIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

Озвучивает ответы ассистента только через Fish Audio API (ключ нужен свой): чтение по каждому сообщению, переключатель автопрочтения и страница настроек для модели, voice reference_id, зашифрованного API-ключа и прокси.

2позавчераЗрение, голос и мультимодальностьMIT
J

dsh-live2d-voice

john-walks-slow/dsh-live2d-voice

Live2D session view with realtime voice: continuous voice input, streaming TTS, subtitle translation, multi-model catalog, standalone entry / Live2D 实时语音会话视图:连续语音输入、流式 TTS、字幕翻译、多模型目录、独立入口

14 дня назадЗрение, голос и мультимодальностьMIT
M

dsh-onebot

mario841859784/dsh-onebot

QQ channel for dsh via OneBot 11 (NapCat and friends): reverse or forward WebSocket, DM and group chats, image and voice transcription, t2i text-image cards, merged forwards, and a settings page.

18 дней назадИнтеграции и удалённый доступBSD-3-Clause
Y

dsh-claude-slider

yicun0316/dsh-claude-slider

Replaces the reasoning-effort dropdown with a draggable snapping slider, and draws 13 canvas effects across five style families (thrust, fluid, fantasy, tech, texture) with three tiers that unlock as the effort level rises. Custom mode combines 10 particle forms with 8 flow trajectories; 9 accent presets and a hex picker recolor every effect, and optional key sounds cover two voice clips, a synthesized duck squeak, a mechanical click and a local audio file.

19 дней назадУлучшения UIMIT
Z

dsh-wx-bridge

zhy5/dsh-wx-bridge

Drive your local DSH from WeChat: a self-hosted iLink bridge over a persistent ACP session (context lives in DSH and is resumable), phone conversations grouped into the desktop workspace, with image recognition, file messages (Excel/Word/PDF, parsed by the agent itself) and voice transcripts. Access defaults to strict (only registered devices are served); the phone channel's permission preset is wide by design - see the README security section before sharing the bot.

16 дней назадИнтеграции и удалённый доступMIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.

121 день назадЗрение, голос и мультимодальность
X

dshgo

xiazhi88/dshgo

Proxies the loopback-only dsh web onto a LAN port so phones and other machines can reach it, with an optional access password that browsers type in and the bundled Android client unlocks with biometrics. Adds a LAN-access settings page with QR codes, inlines dsh-web-mobile (MIT, attribution kept) for the mobile layout, and the Android client in the same repository adds finish/approval notifications, voice input and a home-screen widget.

114 дней назадИнтеграции и удалённый доступMIT
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

118 дней назадЗрение, голос и мультимодальностьGPL-3.0
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

119 дней назадЗрение, голос и мультимодальностьMIT
D

dsh-voice-talk

duoduoqian708/dsh-voice-talk

Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.

120 дней назадЗрение, голос и мультимодальностьMIT