Перейти к основному содержимому

Плагины

Находите, фильтруйте и устанавливайте плагины DeepSeek-Harness.

Найдено плагинов: 86

G

deepseek-vision

gou-gee/deepseek-vision

Родной визуальный бандл DeepSeek Harness: вставьте или перетащите изображение, вызвав размещённый deepseek-vision-mcp для вызова совместимой с OpenAI визуальной модели.

4в прошлом месяцеMCP и коннекторыMIT
S

dsh-digipet

swaylq/dsh-digipet

Игра-тамагочи в стиле Дигимонов: вылупите яйцо, питающееся реальной работой (ходы, вызовы инструментов, ошибки), и развивайте его по четырём ветвящимся линиям, зависящим от вашего стиля работы; ноль токенов, невидимо для модели.

4в прошлом месяцеДля удовольствияMIT
G

deepseek-vision (dsh-plugin-deepseek-vision)

gou-gee/deepseek-vision

Vision MCP и бандл DSH для текстового DeepSeek: инструменты analyze_image, analyze_clipboard, compare_images и vision_status, страница визуальных настроек, бесплатный GLM-4.6V-Flash по умолчанию, кэширование результатов и устойчивость к ограничению скорости; ключи не попадают в логи.

414 дней назадЗрение, голос и мультимодальностьMIT
F

dsh-plugin-deepeye

favio8/dsh-plugin-deepeye

Плагин зрения DeepEye для DeepSeek Harness (DSH): описание изображений, OCR, VQA, разметка UI и анализ буфера обмена.

4в прошлом месяцеЗрение, голос и мультимодальность
H

dsh-her-eyes

huashenglian/dsh-her-eyes

Плагин dsh, позволяющий AI автоматически вызывать VLM (мультимодальные модели) для визуального анализа.

4в прошлом месяцеЗрение, голос и мультимодальностьMIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Мультимодальная рабочая станция для DSH: analyze_image по упорядоченной цепочке переключения из нескольких карт VLM, набор из шести инструментов зрения (масштабирование, выбор цвета, попиксельное сравнение, OCR, обнаружение элементов, встроенный показ) с общим распознавателем изображений, generate_image по протоколам OpenAI/DashScope/ComfyUI, асинхронный generate_video с несколькими картами и конструктором /build-video-tool, а также TTS speak/clone_voice по семи провайдерам — всё управляется одной автосохраняемой страницей настроек.

3позавчераЗрение, голос и мультимодальностьMIT
M

dsh-iris

mokuyoaxis/dsh-iris

Рабочая среда для медиа и компьютерного зрения в DeepSeek Harness: генерация изображений, видео и речи, вопросы и ответы по изображениям и поиск элементов, OCR длинных изображений, попиксельное сравнение, проверка HTML-скриншотов и суммаризация видео, с провайдерами DashScope и OpenAI-совместимыми, пулами моделей и клиентом рабочего места.

314 часов назадИнструменты и функцииMIT
W

dsh-model-capabilities

wjz-p/dsh-model-capabilities

Добавляет селектор модальностей ввода в настройки пользовательских моделей в DeepSeek Harness Web UI.

3в прошлом месяцеМодели и провайдерыMIT
W

visual-review

wang-bool/visual-review

Показывает вставленные или загруженные изображения прямо в чате DSH Web и даёт зрение моделям только с текстом: вызываемый моделью инструмент visual_review сначала обращается к любой совместимой с OpenAI мультимодальной API, а при сбое переходит на локальный воркер Qwen3-VL.

3в прошлом месяцеЗрение, голос и мультимодальностьMIT
S

dsh-plugin-multimodal

shinjiyu/dsh-plugin-multimodal

Объявляет вставку изображений на текстовых маршрутах DeepSeek, описывает вложения с помощью визуального сайдкара и оставляет нативные модели зрения нетронутыми.

3в прошлом месяцеЗрение, голос и мультимодальностьMIT
H

dsh-vision-mix

haiziyao/dsh-vision-mix

Объединяет текстовые, зрительные и генеративные API изображений в одну Mix-модель с автоматической маршрутизацией: текстовые запросы идут в чат-модель, изображения пользователя и скриншоты агента — в зрительную модель, продолжения используют то же изображение сессии, а агенты могут генерировать или редактировать изображения с историей вызовов в рамках сессии.

313 дней назадЗрение, голос и мультимодальностьMIT
L

dsh-visibridge

lhbsaa/dsh-visibridge

Структурированные визуальные доказательства (OCR/разметка/семантика), а также инструмент захвата с USB-камеры для цикла отладки «снимок-анализ-корректировка»; бэкенды: Ollama, DeepSeek, Xiaomi.

228 дней назадЗрение, голос и мультимодальностьMIT
S

dsh-llm-qwen-local

starefinger/dsh-llm-qwen-local

Плагин-адаптер LLM для локально развёрнутых моделей Qwen за совместимым с OpenAI эндпоинтом vLLM, с переключателем мультимодальности для каждой модели, полностью настраиваемыми уровнями усилий рассуждения и веб-страницей настроек для изменения развёртывания из фронтенда.

26 дней назадМодели и провайдерыMIT
A

dsh-multi-model-provider

alexkaiqi/dsh-multi-model-provider

Для DeepSeek Harness: регистрация моделей, помощь с портретами и выбор модели Agent из каталога без секретов.

228 дней назадМодели и провайдерыMIT
S

dsh-collaboration

socialist-sister/dsh-collaboration

Набор для совместной работы нескольких агентов: настраиваемый пользователем список специалистов, постоянная диспетчеризация по запросу (team_call/team_message/team_status/team_close), клонированные экземпляры, ретранслятор со звездообразной топологией, сравнение моделей и мультимодальный визуальный мост.

2в прошлом месяцеПроцессы и автоматизацияMIT
I

dsh-tool-visual-primitives

inkshadewoods/dsh-tool-visual-primitives

Анализирует изображения из диалогов с помощью мод-специфичных промптов (caption, UI, document, grounding, topology и т.д.) и внедряет структурированные доказательства с примитивами координат (боксы, точки, ссылки) в виде текста, с кэшированием на уровне сессии для повторного использования при replay и compaction.

210 дней назадЗрение, голос и мультимодальностьMIT
H

dsh-open-eyes

hyp6666/dsh-open-eyes

Визуальный мост для текстовых маршрутов DeepSeek, который анализирует прикреплённые и локальные изображения через настраиваемые endpoints OpenAI Responses, Chat Completions или Anthropic Messages, оставляя image-capable маршруты нативными.

215 дней назадЗрение, голос и мультимодальностьMIT
5

dsh-youreyes

54xkeee/dsh-youreyes

Набор инструментов vision для текстового DeepSeek: вызываемый моделью инструмент `vision`, обёртки-адаптеры для deepseek/opencode-go (v4 flash/pro), квота Antigravity IDE (default, flash/pro) / любой совместимый с OpenAI VLM / Gemini / локальные каналы Ollama, память доказательств с ре-гидратацией после компактации, кеш хеша содержимого и двуязычная клиентская панель.

2в прошлом месяцеЗрение, голос и мультимодальностьMIT
W

dsh-file-attachment

wszhoho/dsh-file-attachment

Drag-and-drop / paste / upload files and images; on non-multimodal models images are auto-described by a configured VLM.

13 дня назадУлучшения UIMIT
M

dsh-bilibili

moxingovo/dsh-bilibili

DeepSeek Harness plugin: Bilibili keyword video search, video metadata, subtitle transcripts, direct play URLs, and multimodal frame viewing (bilibili_search / bilibili_video / bilibili_subtitles / bilibili_playurl / bilibili_frames). Anonymous by default

127 дней назадЗрение, голос и мультимодальностьMIT
J

dsh-mmroute

jmxsxwyzjdwl/dsh-mmroute

Transparent multimodal routing for text-only models: every image in every model call is fully transcribed (verbatim OCR, data, uncertainty zones, injection-hardened) by your own multimodal understander, with focused re-look via vision_relook and automatic retry on image-related failures. No bundled endpoints, no borrowed logins.

114 дней назадЗрение, голос и мультимодальностьMIT
H

dsh-vision-analysis

harvey-will/dsh-vision-analysis

DeepSeek Harness vision plugin: 8 analysis modes (describe, OCR, chart data, UI review, object detection, compare, code-gen, debug), any OpenAI- or Anthropic-compatible vision API, with a built-in free vision model and automatic rate-limit failover.

111 дней назадЗрение, голос и мультимодальностьMIT
E

dsh-sight

ericfetch/dsh-sight

DeepSeek Harness plugin: direct multimodal image transfer declarations + per-session image clearing (surface replace), with a settings page and composer controls.

1в прошлом месяцеЗрение, голос и мультимодальностьMIT
Y

dsh-multimodal

yauntyour/dsh-multimodal

Per-file-type multimodal chains: preset processing models per wildcard convert image/video/audio files into prompt tokens before they reach the text-only session model, with per-preset fallback chains and a Multimodal settings page.

1в прошлом месяцеЗрение, голос и мультимодальностьMIT