Перейти к основному содержимому

Плагины

Находите, фильтруйте и устанавливайте плагины DeepSeek-Harness.

Найдено плагинов: 86

L

modlens

liustack/modlens

Мост зрения для текстовых моделей: вставьте изображение — получите структурированные JSON-данные (OCR, разметка, семантика).

4k3 дня назадЗрение, голос и мультимодальностьMIT
Y

dsh-vision-router

ysr666/dsh-vision-router

Бесплатное зрение для текстовых агентов: встроенная цепочка распознавания без ключей API плюс пиксельные инструменты (вопрос-ответ, grounding, обрезка, попиксельное сравнение, цвета, OCR, трассировка в SVG, вырезание, скриншоты); просто вставьте изображение.

1.1kвчераЗрение, голос и мультимодальностьMIT
T

tongflow (dsh-tongflow)

tong-io/tongflow

Студия съёмочной группы TongFlow для производства изображений, озвучки, музыки и видео: агент создаёт файлы рабочих процессов TongFlow для каждого ресурса (.tongflow.json), которые выполняются через плагины TongFlow, со встроенным холстом рабочих процессов, макетом проекта по кадрам/персонажам/дублям и шаблоном манга-драмы; сессии, начинающиеся с @tongflow, открывают представление «Студия».

1k14 часов назадПроцессы и автоматизацияAGPL-3.0
T

tongflow

tong-io/tongflow

Студийный плагин TongFlow для DeepSeek Harness (dsh): модель проекта в стиле съёмочной группы, рабочие процессы TongFlow, создаваемые агентом, детерминированная генерация медиа, встроенный холст.

870в прошлом месяцеЗрение, голос и мультимодальностьAGPL-3.0
O

watch-skill

oxbshw/watch-skill

Возможности DeepWatch, устанавливаемые в существующий профиль DeepSeek Harness

3786 дней назадЗрение, голос и мультимодальностьMIT
Z

dsh-crew

zseven-w/dsh-crew

Распределяйте задачи агентам DSH из Claude Code или Codex: нативный прогресс подагентов, рабочие сессии на хосте с предустановками по уровням и мультимодальный мост для зрения и генерации изображений.

1497 дней назадИнтеграции и удалённый доступMIT
V

ark-cli (ark-managed-agents)

volcengine/ark-cli

Добавляет вкладку настроек Managed Agents и MCP tools для передачи длительных задач агентов в Ark cloud Managed Agents.

1333 дня назадИнструменты и функцииApache-2.0
V

ark-cli (ark-plan-api)

volcengine/ark-cli

Регистрирует маршруты Ark Agent Plan, Coding Plan и postpaid model в нативном селекторе моделей DSH.

1333 дня назадМодели и провайдерыApache-2.0
V

ark-cli

volcengine/ark-cli

Плагин провайдера Volcengine Ark для DeepSeek Harness (DSH): регистрирует маршруты Agent Plan, Coding Plan и постоплаты на нативном адаптере pi-ai, чтобы модели Ark появлялись в средстве выбора моделей.

11225 дней назадМодели и провайдерыApache-2.0
S

dsh-AuthInOne

stormycry-cryp/dsh-authinone

Добавляет вход в аккаунт, настройку API и пользовательского Provider, переключение моделей, запасной вариант изображения для текстовых моделей, а также распределение токенов/затрат в DeepSeek Harness 47f.

104в прошлом месяцеМодели и провайдерыMIT
S

dsh-design-qa

sunxin-ai/dsh-design-qa

QA по соответствию дизайну для текстовых моделей: инструмент `deepseek_vision` заимствует «глаз» из любого OpenAI-compatible vision route, чтобы модель могла определить, соответствует ли реализация макету; вместе с бенчмарком, стоящим за этим суждением (четыре fixture, 23 внедренных дефекта, raw transcripts) и дисциплиной вопросов, на которой это основано.

4414 дней назадЗрение, голос и мультимодальностьMIT
J

picturereader

jing-hy/picturereader

«Чтение» изображений для текстовых моделей: уменьшение масштаба + снижение глубины цвета + отпечатки структуры/цвета преобразуются в текстовые сетки, возвращаемые в диалог, что позволяет модели самостоятельно масштабировать, сэмплировать и распознавать текст (OCR), как мультимодальная модель; полностью локально, без зависимости от внешних моделей, поставляется с навыком методологии чтения изображений и опциональным PaddleOCR.

36позавчераЗрение, голос и мультимодальностьMIT
O

dsh-vision

oil-oil/dsh-vision

Понимание изображений для DeepSeek Harness, близкое к нативному

24в прошлом месяцеЗрение, голос и мультимодальностьMIT
S

dsh-ros2

stvli/dsh-ros2

Набор инструментов отладки ROS2 и визуального анализа состояния робота для DeepSeek Harness: перечисление узлов/топиков/сервисов/действий/интерфейсов/TF, JSON-топология всего графа, проверки rosdep, одобряемые сборки и скаффолдинг пользовательских сообщений, скриншоты GUI и мультимодальное визуальное наблюдение, а также внеэкранный рендеринг headless RViz2 (low-poly меши, прямое чтение пикселей, сквозной GPU — рендеринг движения на 30 Гц) с параллельным VLM-анализом в реальном времени.

215 дней назадИнструменты и функцииMIT
J

dsh-visual-plugin

jyh20030112/dsh-visual-plugin

Наделяет текстовые модели зрением: пересылает изображения пользователя в совместимую с OpenAI модель зрения и показывает описания на правой панели веб-интерфейса.

1619 дней назадЗрение, голос и мультимодальностьMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

Мозг DeepSeek + автоматическая транскрипция изображений: прикрепляйте изображения в GUI, и каждое по умолчанию транскрибируется через официальную модель deepseek-v4-flash-vision-exp (чисто текстовый мозг V4-Pro тоже может видеть изображения), в качестве альтернатив — любая VLM, совместимая с OpenAI, или локальный Ollama.

1426 дней назадЗрение, голос и мультимодальностьMIT
W

dsh-mmx-bridge

welsione/dsh-mmx-bridge

Мультимодальный мост MiniMax: единый инструмент `mmx_bridge` охватывает понимание/генерацию изображений, видео, TTS, музыку, обложки, веб-поиск и квоты; опциональная замена `web_search`/`read_image`; встроенные плееры/предпросмотр изображений прямо в веб-интерфейсе (npm: `dsh-mmx-bridge`).

103 дня назадИнструменты и функцииMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Маршрут провайдера шлюза «зрение-язык»: вставленные изображения описываются настраиваемой VL-моделью (по умолчанию Qwen-VL) перед отправкой в DeepSeek.

910 дней назадЗрение, голос и мультимодальностьMIT
P

dsh-plugin-xiaomi-mimo-tts

ppy-web/dsh-plugin-xiaomi-mimo-tts

Добавляет управление синтезом речи Xiaomi MiMo для финализированных сообщений ассистента, с предустановленными голосами и созданием пользовательских голосов.

7вчераЗрение, голос и мультимодальностьMIT
5

dsh-vision

54xkeee/dsh-vision

Зрение для текстового DeepSeek по умолчанию через Doubao Web (бесплатно, без API-ключа — управляет вашим авторизованным Chrome через мост Windows CDP), с квотой Antigravity IDE (flash/pro) или резервным вариантом Gemini; автоматическое повышение уровня детализации, память визуальных доказательств с регидратацией после сжатия, кеш по хешу контента и двуязычная клиентская панель.

7в прошлом месяцеЗрение, голос и мультимодальностьMIT
Y

deepseek-harness-plugins (vision-bridge)

yinxe/deepseek-harness-plugins

Позволяет текстовым моделям видеть изображения: когда приходит картинка с заглушкой вида \[image omitted because this model accepts text only], модель вызывает инструмент vision_describe, и плагин передаёт ссылку на изображение вместе с вопросом мультимодальной модели, повторяя попытку с резервной моделью при сбое. Настраивается на странице настроек и сохраняется через официальный API настроек.

522 часа назадЗрение, голос и мультимодальностьMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Визуальная обработка по запросу для текстовых сеансов DSH: изображения становятся маркерами, а инструмент vision_describe отправляет только изображение и вопрос в модель визуального анализа, совместимую с OpenAI

5в прошлом месяцеЗрение, голос и мультимодальностьMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

Мультимодальный плагин на базе MiniMax: режим голосового вызова в реальном времени (потоковая беседа, плавающий интерфейс дока), голосовой режим и ввод голоса через микрофон, а также инструменты генерации изображений/видео/музыки/речи и визуального анализа.

5в прошлом месяцеЗрение, голос и мультимодальностьMIT
Y

dsh-opencode-free-models (dsh-opencode-free-models)

yu-wenchao/dsh-opencode-free-models

Плагин бесплатных провайдеров моделей для DSH с более чем 20 моделями, включая Gemini, MiMo, GLM и другие.

418 дней назадМодели и провайдеры