Плагины
Находите, фильтруйте и устанавливайте плагины DeepSeek-Harness.
Найдено плагинов: 56
dsh-omi-voice
polinnizhong/dsh-omi-voice
Озвучивание в чате для DeepSeek Harness: нажатием читайте, ставьте на паузу и возобновляйте ответы ИИ естественными голосами Doubao TTS (BYOK); читается только итоговый ответ, код, таблицы и диаграммы отфильтровываются; локальный движок, плагин не хранит API-ключ.
dsh-plugin-tts
1624318455/dsh-plugin-tts
Озвучивает ответы ассистента через бесплатный Edge TTS или собственные голосовые модели RVC: кнопки озвучивания + автоозвучивание, адаптивное поблочное прогрессивное воспроизведение (длинные тексты без пауз), установка голосовых пакетов из реестра в один клик и портативная среда выполнения RVC.
dsh-talk
perrylink/dsh-talk
Голосовой ввод/вывод для DeepSeek Harness — распознавание речи и синтез речи через микрофон и аудиовыход.
dsh-novel-forge
huangziyuan-general/dsh-novel-forge
Ограничители написания романов: 20 инструментов novel_* обеспечивают согласованность книги фактов, шлюзы фаз и глав, машинную проверку с детерминированными метриками и редакции исключительно в виде предложений; рабочая панель правой боковой панели охватывает чтение, воспроизведение TTS, полировку, корректуру, проверки непрерывности и пакетное составление черновиков, а механизм обхода выполняет внутренние шаги вне основного диалога.
dsh-voice-mode (dsh-voice-mode)
qishuilalala/dsh-voice-mode
Полнодуплексный голосовой режим для Web UI DeepSeek Harness: переключатель (автоотправка после паузы 2 с) или удержание для диктовки в редактируемый черновик через потоковое распознавание zipformer2, опциональное слово активации; побуквенное чтение Edge TTS с живыми субтитрами, а речь прерывает воспроизведение и текущий ход (настоящее barge-in). Локальное распознавание, без API-ключа.
dsh-voice-ai-girlfriend-plugin
beiyege-01/dsh-voice-ai-girlfriend-plugin
Голосовая AI-девушка для Web UI: микрофонный ввод через FunASR, голосовые ответы Qwen3-TTS, окно анимации компаньона и двусторонний QQ-чат (текст/голос/изображение push) через NapCat.
dsh-plugin-xiaomi-mimo-tts
ppy-web/dsh-plugin-xiaomi-mimo-tts
Добавляет синтез речи Xiaomi MiMo в DSH Web: чтение вслух сообщений ассистента, потоковая передача PCM, готовые и пользовательские голоса, резервный синтез речи браузера, элементы управления воспроизведением и необязательные звуки интерфейса.
dsh-mmx-bridge
welsione/dsh-mmx-bridge
Мультимодальный мост MiniMax: единый инструмент `mmx_bridge` охватывает понимание/генерацию изображений, видео, TTS, музыку, обложки, веб-поиск и квоты; опциональная замена `web_search`/`read_image`; встроенные плееры/предпросмотр изображений прямо в веб-интерфейсе (npm: `dsh-mmx-bridge`).
dsh-voice-input-plugin
zhangbo-cn/dsh-voice-input-plugin
Микрофон composer для веб-интерфейса: нажатие для мониторинга живой транскрипции и удержание для разговора, с озвучиванием ответа через хостовый Edge TTS, транслируемым во время генерации моделью, паузой эха во время чтения и нажатием для остановки.
dsh-perlica-ding
117bs/dsh-perlica-ding
Многоуровневые звуковые уведомления в тематике Perlica (Arknights: Endfield): тоны готовности плана, завершения задачи, необходимости вашего ввода и ошибки; тишина для обычного чата, воспроизведение на системном уровне (работает в фоне), кроссплатформенно (Windows/macOS/Linux), пользовательские звуки TTS.
dsh-guide-dog
atropinoltt/dsh-guide-dog
Мультимодальный плагин на базе MiniMax: режим голосового вызова в реальном времени (потоковая беседа, плавающий интерфейс дока), голосовой режим и ввод голоса через микрофон, а также инструменты генерации изображений/видео/музыки/речи и визуального анализа.
dsh-tts-bridge
yuuyuko-uu/dsh-tts-bridge
Озвучивает разговоры DSH, используя встроенное чтение вслух на веб-странице DeepSeek, управляемое небольшим расширением браузера.
dsh-voice
stardustlc666/dsh-voice
Голосовые инструменты: бесплатный нейросетевой синтез речи edge-tts, совместимая с OpenAI транскрипция ASR, список голосов, пакетное прослушивание голосов и самопроверка состояния.
dsh-voice
haoku123/dsh-voice
Полнодуплексный голосовой режим для веб-интерфейса: диктовка касанием для переключения или удержанием (клавиша отправки или `Ctrl`) с живыми субтитрами, хостовая SenseVoice ASR через sherpa-onnx, ответы вслух предложение за предложением, а речь прерывает воспроизведение и текущий ход (истинное перебивание). Ключ API не требуется.
dsh-chatvoice
fuzzysoul/dsh-chatvoice
Бесплатный голосовой замкнутый цикл для веб-интерфейса: ввод с микрофона через SpeechRecognition браузера с промежуточными результатами в реальном времени, плюс кнопки динамика для озвучивания и автоматическое чтение ответов ассистента, без настройки и без API-ключа.
dsh-plugin-notify-sound
ldchaowin/dsh-plugin-notify-sound
Мелодии завершения для каждого рабочего пространства плюс звуки внимания для событий подтверждения, вопроса, проверки плана, блокировки цели и сбоя задачи, со встроенным синтезатором, голосом (TTS) и собственным звуком.
dsh-omni-workstation
huashenglian/dsh-omni-workstation
Мультимодальная рабочая станция для DSH: analyze_image по упорядоченной цепочке переключения из нескольких карт VLM, набор из шести инструментов зрения (масштабирование, выбор цвета, попиксельное сравнение, OCR, обнаружение элементов, встроенный показ) с общим распознавателем изображений, generate_image по протоколам OpenAI/DashScope/ComfyUI, асинхронный generate_video с несколькими картами и конструктором /build-video-tool, а также TTS speak/clone_voice по семи провайдерам — всё управляется одной автосохраняемой страницей настроек.
dsh-plugin-speech
nakamuraia/dsh-plugin-speech
Озвучивает ответы ассистента в DeepSeek Harness: провайдеры преобразования текста в речь с потоковым воспроизведением.
dsh-audiogen
shimingming520/dsh-audiogen
ИИ-генерация аудио для веб-интерфейса DeepSeek Harness — мультивендорный TTS, музыка, звуковые эффекты и дизайн голоса с боковой панелью, сравнением моделей, библиотекой ресурсов и инструментами Agent.
dsh-voco
lgquan/dsh-voco
Непрерывные голосовые разговоры для DSH с прослушиванием без рук, push-to-talk, распознаванием речи, ответами TTS и делегированием Agent в фоне.
dsh-gsv
taoruiliu19/dsh-gsv
Локальный TTS в реальном времени для DeepSeek Harness: голосовые пресеты, автоматическое чтение, ассистент настройки движка, кнопка озвучивания и панель настроек для движка GSV-TTS-Lite.
dsh-plugin-notify
huguangyu666/dsh-plugin-notify
Исходящий ящик уведомлений: агент проактивно уведомляет через toast / голос TTS на китайском / звуковые эффекты (взрыв, победа, тревога), окно подтверждения 60 секунд перезванивает вам голосом, усиление громкости, панель настроек.
dsh-voice
jesse-njx/dsh-voice
Голосовые заметки на входе, озвученные ответы на выходе: надиктуйте аудио, которое становится сообщением пользователя (транскрипция), пусть агент читает ответы вслух (озвучивание), локально в ~/.dsh/voice.
dsh-voice-call
biliye/dsh-voice-call
Голосовой ассистент звонков для веб-GUI DSH: перетаскиваемый плавающий шар звонка, VAD на стороне браузера, отправляющий каждую фразу после паузы, распознавание речи FunASR по HTTP или потоково, ответы TTS от MiniMax или совместимые с OpenAI, необязательный режим слова-активатора с автосном и отправка задач в отдельные сессии субагентов с прогрессом, остановкой и озвученными отчётами о завершении.