Перейти к основному содержимому

Плагины

Находите, фильтруйте и устанавливайте плагины DeepSeek-Harness.

Найдено плагинов: 47

Y

dsh-vision-router

ysr666/dsh-vision-router

Бесплатное зрение для текстовых агентов: встроенная цепочка распознавания без ключей API плюс пиксельные инструменты (вопрос-ответ, grounding, обрезка, попиксельное сравнение, цвета, OCR, трассировка в SVG, вырезание, скриншоты); просто вставьте изображение.

1.1kвчераЗрение, голос и мультимодальностьMIT
A

dsh-vision-toolkit

anionex/dsh-vision-toolkit

Зрение для текстовых моделей: вставьте изображение, и модель переключится на вариант Vision Toolkit для вопросов-ответов по изображениям, сравнения нескольких изображений, OCR длинных скриншотов, воспроизведения UI по скриншоту, привязки элементов и пиксельной разницы. По умолчанию ключ API не требуется — изображения обрабатываются бесплатным сервисом автора, 100 на машину в день; можно настроить на собственного провайдера.

887позавчераЗрение, голос и мультимодальностьMIT
O

dsh-vision

oil-oil/dsh-vision

Понимание изображений для DeepSeek Harness, близкое к нативному

242 месяца назадЗрение, голос и мультимодальностьMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

Мозг DeepSeek + автоматическая транскрипция изображений: прикрепляйте изображения в GUI, и каждое по умолчанию транскрибируется через официальную модель deepseek-v4-flash-vision-exp (чисто текстовый мозг V4-Pro тоже может видеть изображения), в качестве альтернатив — любая VLM, совместимая с OpenAI, или локальный Ollama.

15в прошлом месяцеЗрение, голос и мультимодальностьMIT
P

dsh-vision-opencode

poiuyjie/dsh-vision-opencode

Добавляет настраиваемую модель зрения к текстовым основным моделям: инструмент vision_read_image, селектор модели зрения на панели композитора и автоматическое преобразование изображения в текст для текстовых маршрутов.

1323 дня назадЗрение, голос и мультимодальностьMIT
L

dsh-vision

linenxi-ctrl/dsh-vision

Внешний плагин зрения для DeepSeek Harness: панель настроек с кнопкой-китом, распознавание изображений с авто-ответом и инструменты агента для скриншотов/распознавания.

92 месяца назадЗрение, голос и мультимодальностьMIT
5

dsh-vision

54xkeee/dsh-vision

Зрение для текстового DeepSeek по умолчанию через Doubao Web (бесплатно, без API-ключа — управляет вашим авторизованным Chrome через мост Windows CDP), с квотой Antigravity IDE (flash/pro) или резервным вариантом Gemini; автоматическое повышение уровня детализации, память визуальных доказательств с регидратацией после сжатия, кеш по хешу контента и двуязычная клиентская панель.

72 месяца назадЗрение, голос и мультимодальностьMIT
L

dsh-drop-to-path

loudmore/dsh-drop-to-path

Плагин DSH: изображения и файлы напрямую доступны текстовым моделям — изображения сохраняют нативный опыт вложений, PDF/Office/архивы/видео/аудио отображаются квадратными плашками в панели вложений, при отправке автоматически превращаются в путь workspace; в паре с dsh-vision-toolkit — вставил и сразу видишь изображение.

62 месяца назадУлучшения UIMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Визуальная обработка по запросу для текстовых сеансов DSH: изображения становятся маркерами, а инструмент vision_describe отправляет только изображение и вопрос в модель визуального анализа, совместимую с OpenAI

52 месяца назадЗрение, голос и мультимодальностьMIT
X

dsh-vision-hub (tool-vision)

xing666173/dsh-vision-hub

Расширенный набор инструментов vision: 14 пиксельных vision-инструментов (describe, ground, detect, crop, pixel-diff, OCR, OCR длинных скриншотов, vectorize, colors, cutout, screenshot, present, materialize, html-screenshot) на одном OpenAI-совместимом эндпоинте, с чистыми маркерами [图片: path], классификацией безопасности контента и авто-ретраем при лимите запросов.

4в прошлом месяцеЗрение, голос и мультимодальность
X

dsh-vision-hub (file-drop)

xing666173/dsh-vision-hub

Загрузка файлов drag-and-drop для PDF, Word, Excel и изображений: сброшенные файлы сохраняются в локальный каталог и упоминаются по пути, без раздувания base64 в чате.

4в прошлом месяцеИнструменты и функции
X

dsh-vision-hub (bridge-preview)

xing666173/dsh-vision-hub

Встроенный предпросмотр для маркеров изображения [图片: path]: после рендера маркера изображение автоматически показывается в чате, не загромождая беседу длинными инструкциями.

4в прошлом месяцеСеансы и сообщения
1

dsh-vision-sidecar

121103qwq/dsh-vision-sidecar

Размещённый бесплатный vision-компаньон для DeepSeek Harness с устойчивым хранением доказательств по сессии

42 месяца назадЗрение, голос и мультимодальностьMIT
G

dsh-vision-bridge

gxx182/dsh-vision-bridge

Связывает изображения сеанса с настраиваемыми провайдерами визуального анализа и возвращает только текстовый анализ подходящим маршрутам моделей DeepSeek Harness.

42 месяца назадЗрение, голос и мультимодальностьMIT
P

dsh-agent-router

peterwangze/dsh-agent-router

Плагин мультимодельной маршрутизации для DeepSeek Harness: доверьте профессиональные задачи профессиональным агентам — настраивайте специализированных агентов (зрение/перевод/голос/субагент и т.д.) и привязывайте их к независимым моделям; вход в мультимодальные аккаунты в один клик, маршрутизация по состоянию пула аккаунтов и статистика использования в реальном времени.

32 месяца назадМодели и провайдерыMIT
T

dsh-plugins (dsh-vision)

tzhr-invest/dsh-plugins

Вызываемый агентом vision-инструмент, который описывает локальные изображения через любой настраиваемый OpenAI-совместимый vision endpoint, с опциональной перекрёстной проверкой несколькими моделями и без встроенных ключей.

35 дней назадЗрение, голос и мультимодальностьMIT
M

dsh-vision-tools

moon09300731/dsh-vision-tools

Полный пакет возможностей компьютерного зрения для DeepSeek Harness: инструмент vision_understand (API зрения, совместимые с OpenAI, по умолчанию бесплатный Zhipu GLM-4V-Flash), а также точки входа вставки/перетаскивания/кнопки для распознавания изображений.

32 месяца назадЗрение, голос и мультимодальностьMIT
H

dsh-vision-mix

haiziyao/dsh-vision-mix

Объединяет текстовые, зрительные и генеративные API изображений в одну Mix-модель с автоматической маршрутизацией: текстовые запросы идут в чат-модель, изображения пользователя и скриншоты агента — в зрительную модель, продолжения используют то же изображение сессии, а агенты могут генерировать или редактировать изображения с историей вызовов в рамках сессии.

325 дней назадЗрение, голос и мультимодальностьMIT
N

dsh-vision-plugin

nexsjournal/dsh-vision-plugin

Устанавливает флажок ввода изображения в каталог Models, чтобы пользовательская модель могла объявить ввод изображений и получать изображения напрямую; включает опциональный ретранслятор BYO vision.

32 месяца назадУлучшения UIMIT
B

dsh-vision-plugin

bug-huntter/dsh-vision-plugin

Настраиваемое распознавание изображений для текстовых моделей DSH: изображения сначала транскрибируются моделью vision, совместимой с OpenAI (базовый URL, идентификатор модели и API-ключ задаются в разделе настроек), а затем передаются основной модели в виде текста, при этом заявляется поддержка ввода изображений. Схема аутентификации по API-ключу выбирается (заголовки запросов в стиле OpenAI, Anthropic, Gemini или Azure), а отсутствие ключа сообщается до отправки любого запроса.

25 дней назадЗрение, голос и мультимодальностьMIT
G

dsh-vision-bridge

goodandready/dsh-vision-bridge

Направляет изображения в выбранную вами модель компьютерного зрения — авто-перезапись, явные инструменты или гибридный режим — чтобы текстовый чат-модель не срывала ход, в котором есть картинка.

26 дней назадЗрение, голос и мультимодальностьMIT
X

dsh-vision

xiaoshihou514/dsh-vision

Нативное расширение возможностей зрения, использующее либо Zhipu (бесплатно), либо Qwen-VL (локально).

2в прошлом месяцеЗрение, голос и мультимодальностьMIT
K

dsh-vision-recognizer

kaixinbaba/dsh-vision-recognizer

Маршрут визуального поставщика, который преобразует прикреплённые изображения в текст через настраиваемую модель (более 15 совместимых с OpenAI и Anthropic поставщиков), пока DeepSeek продолжает отвечать.

2в прошлом месяцеЗрение, голос и мультимодальностьMIT
3

dsh-vision (vision-tool)

314857493/dsh-vision

Вызываемый моделью инструмент `vision` для DeepSeek Harness: описывает и распознаёт текст на файлах изображений, напрямую вызывая бесплатный Zhipu GLM vision API (цепочка fallback glm-4v-flash), без внешнего CLI.

228 дней назадЗрение, голос и мультимодальностьMIT