Перейти к основному содержимому

Плагины

Находите, фильтруйте и устанавливайте плагины DeepSeek-Harness.

Найдено плагинов: 76

W

dsh-opencode-go-usage

wawo77/dsh-opencode-go-usage

Питомец использования плана для web GUI DSH: плавающий персонаж со скелетной анимацией сообщает квоту в облачке речи, автоматически подстраиваясь под настроенного провайдера (OpenCode Go, Command Code, DeepSeek), показывая процент плана или баланс счёта, с откатом к локальной статистике токенов, когда API провайдера недоступен; перетаскиваемый, масштабируемый колесом (90–260px), синтезированные звуки кликов, маршруты только loopback.

316 дней назадИспользование и биллингMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

Ввод одной рукой и без клавиатуры для поля ввода: зажмите кнопку мыши на поле ввода, говорите, отпустите — текст попадает в черновик, а сдвиг вверх отменяет ввод, не оставляя недописанной фразы. Не нужно целиться в кнопку микрофона и запоминать горячую клавишу; рука никогда не покидает область ввода, что важно, когда вторая рука занята. Распознавание работает полностью офлайн (SenseVoice через sherpa-onnx, без API-ключа, звук не покидает машину).

320 часов назадЗрение, голос и мультимодальностьMIT
N

dsh-plugin-speech

nakamuraia/dsh-plugin-speech

Озвучивает ответы ассистента в DeepSeek Harness: провайдеры преобразования текста в речь с потоковым воспроизведением.

318 дней назадЗрение, голос и мультимодальностьMIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

Голосовой ассистент для dsh web: произнесите фразу активации (например, «小鲸»), чтобы включить диктовку без рук — сказанное распознаётся и автоматически вводится в поле чата. Поддерживает голосовые команды редактирования (отправить, очистить, новая строка, остановить чтение) и читает ответы ассистента вслух на китайском. Распознавание речи выполняется локально в браузере через sherpa-onnx WASM, поэтому работает офлайн без API-ключа.

3в прошлом месяцеЗрение, голос и мультимодальностьMIT
D

dsh-whale-pet

dleaf6211-hash/dsh-whale-pet

Десктопный питомец «кит-девушка» для DeepSeek Harness: плавающий маскот в браузере плюс Windows-десктопный питомец, использующие общий бэкенд данных, с панелью баланса в реальном времени, уведомлениями о задачах, взаимодействием поглаживания головы, 19 предварительно синтезированными голосовыми репликами с эмоцией для каждой реплики и простаивающей речью с учётом присутствия.

317 дней назадДля удовольствияMIT
L

dsh-voco

lgquan/dsh-voco

Непрерывные голосовые разговоры для DSH с прослушиванием без рук, push-to-talk, распознаванием речи, ответами TTS и делегированием Agent в фоне.

3в прошлом месяцеЗрение, голос и мультимодальностьMIT
T

dsh-gsv

taoruiliu19/dsh-gsv

Локальный TTS в реальном времени для DeepSeek Harness: голосовые пресеты, автоматическое чтение, ассистент настройки движка, кнопка озвучивания и панель настроек для движка GSV-TTS-Lite.

3в прошлом месяцеЗрение, голос и мультимодальностьMIT
L

Deepseek-Continuity

linxuhao/deepseek-continuity

Локальная генерация изображений, голоса, музыки и звуковых эффектов, а также транскрипция с закреплённой идентичностью: персонажи, животные, объекты и голоса актёров определяются один раз и повторно используются при каждом последующем вызове; вырожденный вывод (почти плоское изображение, беззвучное аудио) отклоняется, а не возвращается как успешный, а сгенерированную строку можно прочитать обратно как текст, чтобы клон, проглотивший свою концовку, стал виден. Движки выгружаются в простое, а генерация изображений и транскрипция могут каждая указывать на API в форме OpenAI вместо локального Vulkan-бэкенда.

312 дней назадЗрение, голос и мультимодальностьMIT
N

voco-input-sh

nothree-code/voco-input-sh

Голосовой ввод для Web UI: кнопка микрофона, которая запускает локальное офлайн-распознавание речи VocoType и автоматически вставляет распознанный текст в composer (авторазвертывание, дедупликация, непрерывная диктовка).

319 дней назадЗрение, голос и мультимодальностьMIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Голосовой ввод с распознаванием речи для Web UI: кнопка микрофона в композиторе транскрибирует речь в черновик через Web Speech API браузера (без настройки) или совместимый с OpenAI Whisper API (OpenAI / Groq), с выбором модели и языка в Настройках.

3в прошлом месяцеЗрение, голос и мультимодальностьMIT
J

dsh-voice

jesse-njx/dsh-voice

Голосовые заметки на входе, озвученные ответы на выходе: надиктуйте аудио, которое становится сообщением пользователя (транскрипция), пусть агент читает ответы вслух (озвучивание), локально в ~/.dsh/voice.

32 месяца назадЗрение, голос и мультимодальностьMIT
Q

dsh-mic-input

qt-chen/dsh-mic-input

Голосовой ввод с микрофона для composer: транскрипция в реальном времени через Web Speech API браузера, дедупликация/автопродолжение, умная пунктуация, настройки языка и автоотправки.

32 месяца назадЗрение, голос и мультимодальностьMIT
B

dsh-voice-call

biliye/dsh-voice-call

Голосовой ассистент звонков для веб-GUI DSH: перетаскиваемый плавающий шар звонка, VAD на стороне браузера, отправляющий каждую фразу после паузы, распознавание речи FunASR по HTTP или потоково, ответы TTS от MiniMax или совместимые с OpenAI, необязательный режим слова-активатора с автосном и отправка задач в отдельные сессии субагентов с прогрессом, остановкой и озвученными отчётами о завершении.

24 дня назадЗрение, голос и мультимодальностьMIT
M

dsh-voice-chat

maoyuching/dsh-voice-chat

Голосовой чат в стиле Doubao для DSH: удержание микрофона в поле ввода преобразует речь в текст и отправляет автоматически, а ответы ИИ озвучиваются. Необязательное сжатие с помощью LLM (длинные ответы сводятся к коротким озвучиваемым репликам в соответствии с моделью текущего диалога), очистка текста для TTS, выбираемые голоса Edge TTS, настраиваемая автоостановка по тишине, а настройки встроены в диалог настроек DSH.

28 дней назадЗрение, голос и мультимодальностьMIT
G

dsh-tts

goodandready/dsh-tts

Озвучивает ответы агента в веб-интерфейсе DeepSeek Harness через цепочку отката между провайдерами (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), так что сбойный или ограниченный по частоте провайдер передаёт эстафету следующему, а не замолкает.

26 дней назадЗрение, голос и мультимодальностьMIT
T

dsh-deepseek-pet

txlznbzsdj-collab/dsh-deepseek-pet

Анимированный desktop pet в виде синего кита DeepSeek, плавающий на странице DSH Web: перетаскивается, имеет речевые пузыри и позы настроения, инструмент pet_say, чтобы модель заставляла его говорить, а также состояния thinking и celebrating в начале/конце хода.

22 месяца назадДля удовольствияMIT
P

dsh-voice-call

pandapolo/dsh-voice-call

Голосовые звонки, инициируемые агентом: `offer_call` звонит человеку (接听/拒接/稍后再说); принятые звонки синтезируются и воспроизводятся локально через CrispASR + Qwen3-TTS (9 голосов, 2 китайских диалекта), а отклонённые возвращают решение агенту.

23 дня назадЗрение, голос и мультимодальностьMIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

Озвучивает ответы ассистента только через Fish Audio API (ключ нужен свой): чтение по каждому сообщению, переключатель автопрочтения и страница настроек для модели, voice reference_id, зашифрованного API-ключа и прокси.

2позавчераЗрение, голос и мультимодальностьMIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.

121 день назадЗрение, голос и мультимодальность
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

118 дней назадЗрение, голос и мультимодальностьGPL-3.0
N

dsh-dictate

navneetset/dsh-dictate

Live speech-to-text dictation into the dsh web composer via OpenRouter STT

127 дней назадЗрение, голос и мультимодальностьMIT
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

119 дней назадЗрение, голос и мультимодальностьMIT
D

dsh-voice-talk

duoduoqian708/dsh-voice-talk

Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.

120 дней назадЗрение, голос и мультимодальностьMIT
J

dsh-live-voice

jstn-1g/dsh-live-voice

Consent-bound one-turn voice preview for DSH Web with a credential-free local synthetic demo, optional Qwen Audio, exact Session isolation, and explicit transcript-to-draft handoff without automatic submission.

127 дней назадЗрение, голос и мультимодальностьMIT