Плагины
Находите, фильтруйте и устанавливайте плагины DeepSeek-Harness.
Найдено плагинов: 25
dsh-omi-voice
polinnizhong/dsh-omi-voice
Озвучивание в чате для DeepSeek Harness: нажатием читайте, ставьте на паузу и возобновляйте ответы ИИ естественными голосами Doubao TTS (BYOK); читается только итоговый ответ, код, таблицы и диаграммы отфильтровываются; локальный движок, плагин не хранит API-ключ.
dsh-plugin-tts
1624318455/dsh-plugin-tts
Озвучивает ответы ассистента через бесплатный Edge TTS или собственные голосовые модели RVC: кнопки озвучивания + автоозвучивание, адаптивное поблочное прогрессивное воспроизведение (длинные тексты без пауз), установка голосовых пакетов из реестра в один клик и портативная среда выполнения RVC.
dsh-talk
perrylink/dsh-talk
Голосовой ввод/вывод для DeepSeek Harness — распознавание речи и синтез речи через микрофон и аудиовыход.
dsh-voice-mode (dsh-voice-mode)
qishuilalala/dsh-voice-mode
Полнодуплексный голосовой режим для Web UI DeepSeek Harness: переключатель (автоотправка после паузы 2 с) или удержание для диктовки в редактируемый черновик через потоковое распознавание zipformer2, опциональное слово активации; побуквенное чтение Edge TTS с живыми субтитрами, а речь прерывает воспроизведение и текущий ход (настоящее barge-in). Локальное распознавание, без API-ключа.
dsh-plugin-xiaomi-mimo-tts
ppy-web/dsh-plugin-xiaomi-mimo-tts
Добавляет синтез речи Xiaomi MiMo в DSH Web: чтение вслух сообщений ассистента, потоковая передача PCM, готовые и пользовательские голоса, резервный синтез речи браузера, элементы управления воспроизведением и необязательные звуки интерфейса.
dsh-tts-bridge
yuuyuko-uu/dsh-tts-bridge
Озвучивает разговоры DSH, используя встроенное чтение вслух на веб-странице DeepSeek, управляемое небольшим расширением браузера.
dsh-omni-workstation
huashenglian/dsh-omni-workstation
Мультимодальная рабочая станция для DSH: analyze_image по упорядоченной цепочке переключения из нескольких карт VLM, набор из шести инструментов зрения (масштабирование, выбор цвета, попиксельное сравнение, OCR, обнаружение элементов, встроенный показ) с общим распознавателем изображений, generate_image по протоколам OpenAI/DashScope/ComfyUI, асинхронный generate_video с несколькими картами и конструктором /build-video-tool, а также TTS speak/clone_voice по семи провайдерам — всё управляется одной автосохраняемой страницей настроек.
dsh-plugin-speech
nakamuraia/dsh-plugin-speech
Озвучивает ответы ассистента в DeepSeek Harness: провайдеры преобразования текста в речь с потоковым воспроизведением.
dsh-voco
lgquan/dsh-voco
Непрерывные голосовые разговоры для DSH с прослушиванием без рук, push-to-talk, распознаванием речи, ответами TTS и делегированием Agent в фоне.
dsh-gsv
taoruiliu19/dsh-gsv
Локальный TTS в реальном времени для DeepSeek Harness: голосовые пресеты, автоматическое чтение, ассистент настройки движка, кнопка озвучивания и панель настроек для движка GSV-TTS-Lite.
Deepseek-Continuity
linxuhao/deepseek-continuity
Локальная генерация изображений, голоса, музыки и звуковых эффектов, а также транскрипция с закреплённой идентичностью: персонажи, животные, объекты и голоса актёров определяются один раз и повторно используются при каждом последующем вызове; вырожденный вывод (почти плоское изображение, беззвучное аудио) отклоняется, а не возвращается как успешный, а сгенерированную строку можно прочитать обратно как текст, чтобы клон, проглотивший свою концовку, стал виден. Движки выгружаются в простое, а генерация изображений и транскрипция могут каждая указывать на API в форме OpenAI вместо локального Vulkan-бэкенда.
dsh-voice
jesse-njx/dsh-voice
Голосовые заметки на входе, озвученные ответы на выходе: надиктуйте аудио, которое становится сообщением пользователя (транскрипция), пусть агент читает ответы вслух (озвучивание), локально в ~/.dsh/voice.
dsh-voice-call
biliye/dsh-voice-call
Голосовой ассистент звонков для веб-GUI DSH: перетаскиваемый плавающий шар звонка, VAD на стороне браузера, отправляющий каждую фразу после паузы, распознавание речи FunASR по HTTP или потоково, ответы TTS от MiniMax или совместимые с OpenAI, необязательный режим слова-активатора с автосном и отправка задач в отдельные сессии субагентов с прогрессом, остановкой и озвученными отчётами о завершении.
dsh-voice-call
pandapolo/dsh-voice-call
Голосовые звонки, инициируемые агентом: `offer_call` звонит человеку (接听/拒接/稍后再说); принятые звонки синтезируются и воспроизводятся локально через CrispASR + Qwen3-TTS (9 голосов, 2 китайских диалекта), а отклонённые возвращают решение агенту.
dsh-fish-tts
mari23333/dsh-fish-tts
Озвучивает ответы ассистента только через Fish Audio API (ключ нужен свой): чтение по каждому сообщению, переключатель автопрочтения и страница настроек для модели, voice reference_id, зашифрованного API-ключа и прокси.
dsh-multi-tts
wyr-233/dsh-multi-tts
Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.
dsh-live-voice
victorwads/dsh-live-voice
Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.
dsh-minimax-asr
moluyao/dsh-minimax-asr
MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选
dsh-voice
zhuiyueya/dsh-voice
Голос для DeepSeek Harness (dsh) — ввод речи в текст + озвучивание через TTS для текстовых моделей DeepSeek, без API-ключа.
dsh-say
fangqian616/dsh-say
Speaks your agent's reports in a voice you choose, compressing long reports before speaking. Character voices need no training - a 3-10 second reference clip clones one, and community-trained models work too - and no 6.4 GB GPT-SoVITS install: the plugin installs its own runtime and voice. An existing GPT-SoVITS can be used instead, and it is the same voice model.
dsh-voice-alert
loyalchiiina/dsh-voice-alert
Speaks or plays a sound at the end of every turn and plays a failure cue when a tool call or a turn errors. Ships 20 built-in effects (10 alert chimes + 10 nature sounds) and defaults to effect mode, so it needs no API key and no audio files; an optional Volcengine voice-clone route generates the three announcement clips in one click. Plays through winmm/waveOut as-is, never changing the system volume or mute state. Windows only.
dsh-voice-mimo
ch1bug/dsh-voice-mimo
Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).
dsh-kitt-voice
kittcat-lab/dsh-kitt-voice
Voice for the DeepSeek Harness: speak to the agent, hear it back, and see what it is doing from a floating window that stays on top of whatever you are running.
dsh-plugins
genesis-agents/dsh-plugins
A source library for DeepSeek Harness: 72 feeds on an hourly timer, a reader with transcripts and translation, and a publisher that turns what it collects into a podcast, a digest, or a report