Перейти к основному содержимому

Плагины

Находите, фильтруйте и устанавливайте плагины DeepSeek-Harness.

Найдено плагинов: 86

N

vision-exp-tile

nicholas023/vision-exp-tile

Распознавание крупных изображений для моделей vision-exp: распознавание плиток 800×800 без потерь (smart/pipeline/full), локальный OCR с предобработкой и маршрутизацией рукописного текста, опциональный мультивендорный GPU (DirectML/CUDA/OpenVINO) с автоматическим переходом на CPU.

5в прошлом месяцеЗрение, голос и мультимодальностьMIT
B

dsh-ocr-local

balcoz/dsh-ocr-local

Локальный OCR для DeepSeek Harness: вставьте или прикрепите изображение, получите его текст через PP-OCRv5 + ONNX Runtime, полностью офлайн. TUI (cc-tui) и Web.

52 месяца назадЗрение, голос и мультимодальность
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Визуальная обработка по запросу для текстовых сеансов DSH: изображения становятся маркерами, а инструмент vision_describe отправляет только изображение и вопрос в модель визуального анализа, совместимую с OpenAI

52 месяца назадЗрение, голос и мультимодальностьMIT
E

canvas-workbench

elangan1997-cmyk/canvas-workbench

Локальный графический рабочий стол, без абонентской платы: используйте собственный API для генерации изображений (любой OpenAI-совместимый интерфейс, без подписки), вёрстка холста + ретушь/стирание/удаление фона/OCR/векторизация, редактируемые PSD/AI на выходе, двусторонний мост на уровне слоёв Photoshop/Illustrator

43 дня назадЗрение, голос и мультимодальностьMIT
L

dsh-attachment-formats

linkingoscar/dsh-attachment-formats

Веб-плагин DeepSeek Harness — текстовый слой PDF и OCR сканированных PDF, конвертация Office docx/xlsx/pptx в Markdown, индекс-карточки TIFF/epub и длинных документов.

43 дня назадИнструменты и функцииApache-2.0
X

dsh-vision-hub (tool-vision)

xing666173/dsh-vision-hub

Расширенный набор инструментов vision: 14 пиксельных vision-инструментов (describe, ground, detect, crop, pixel-diff, OCR, OCR длинных скриншотов, vectorize, colors, cutout, screenshot, present, materialize, html-screenshot) на одном OpenAI-совместимом эндпоинте, с чистыми маркерами [图片: path], классификацией безопасности контента и авто-ретраем при лимите запросов.

4в прошлом месяцеЗрение, голос и мультимодальность
X

dsh-vision-hub (file-drop)

xing666173/dsh-vision-hub

Загрузка файлов drag-and-drop для PDF, Word, Excel и изображений: сброшенные файлы сохраняются в локальный каталог и упоминаются по пути, без раздувания base64 в чате.

4в прошлом месяцеИнструменты и функции
X

dsh-vision-hub (bridge-preview)

xing666173/dsh-vision-hub

Встроенный предпросмотр для маркеров изображения [图片: path]: после рендера маркера изображение автоматически показывается в чате, не загромождая беседу длинными инструкциями.

4в прошлом месяцеСеансы и сообщения
M

dsh-nuphus-mcp

mrpulor-gh/dsh-nuphus-mcp

Официальный плагин DSH для nuphus-mcp (от мейнтейнеров nuphus-mcp): автоматизация рабочего стола и браузера (38 инструментов) с распознаванием элементов PaddleOCR и просмотром через Chrome CDP, через постоянный дочерний процесс stdio MCP.

4в прошлом месяцеИнструменты и функцииMIT
G

deepseek-vision

gou-gee/deepseek-vision

Родной визуальный бандл DeepSeek Harness: вставьте или перетащите изображение, вызвав размещённый deepseek-vision-mcp для вызова совместимой с OpenAI визуальной модели.

42 месяца назадMCP и коннекторыMIT
N

free-vision-skill

niyongsheng/free-vision-skill

Полностью локальное понимание изображений и OCR через Vision Framework macOS: `ocr_image` (текст, макет таблицы + координаты) и `view_image` (сцена, лица, QR) — вставьте несколько изображений в поле ввода в веб-интерфейсе или передайте путь/URL/base64; изображения никогда не покидают ваш Mac.

4в прошлом месяцеЗрение, голос и мультимодальностьMIT
G

deepseek-vision (dsh-plugin-deepseek-vision)

gou-gee/deepseek-vision

Vision MCP и бандл DSH для текстового DeepSeek: инструменты analyze_image, analyze_clipboard, compare_images и vision_status, страница визуальных настроек, бесплатный GLM-4.6V-Flash по умолчанию, кэширование результатов и устойчивость к ограничению скорости; ключи не попадают в логи.

426 дней назадЗрение, голос и мультимодальностьMIT
C

dsh-learning-mode

chplus0/dsh-learning-mode

Пресет агента Learning Mode: кодирующий агент, который обучает во время кодирования — конкретные сценарные объяснения, сократическое руководство и TODO(你) практические пропуски, смоделированные по стилю вывода Learning Claude Code; устанавливается через dsh plugin add (dsh-learning-mode в npm).

42 месяца назадИнструменты и функции
F

dsh-plugin-deepeye

favio8/dsh-plugin-deepeye

Плагин зрения DeepEye для DeepSeek Harness (DSH): описание изображений, OCR, VQA, разметка UI и анализ буфера обмена.

42 месяца назадЗрение, голос и мультимодальность
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Мультимодальная рабочая станция для DSH: analyze_image по упорядоченной цепочке переключения из нескольких карт VLM, набор из шести инструментов зрения (масштабирование, выбор цвета, попиксельное сравнение, OCR, обнаружение элементов, встроенный показ) с общим распознавателем изображений, generate_image по протоколам OpenAI/DashScope/ComfyUI, асинхронный generate_video с несколькими картами и конструктором /build-video-tool, а также TTS speak/clone_voice по семи провайдерам — всё управляется одной автосохраняемой страницей настроек.

314 дней назадЗрение, голос и мультимодальностьMIT
X

dsh-image-vision

xiaoyuink/dsh-image-vision

Понимание изображений для любой модели DSH: инструменты зрения, OCR, grounding и кадрирования с доменными пресетами для гистопатологии, клеточной биологии, анатомии, клинических изображений и научных иллюстраций.

329 дней назадЗрение, голос и мультимодальность
Y

dsh-ui-spec

yumimanji/dsh-ui-spec

Плагин DeepSeek Harness, который превращает скриншоты UI в веб-спецификации уровня реализации с помощью OCR, детерминированной геометрии, графов сцены, ассетов и сравнения рендеринга.

32 месяца назадЗрение, голос и мультимодальностьMIT
F

dsh-wechat-mp-studio

funcwei/dsh-wechat-mp-studio

Контент-студия для официальных аккаунтов WeChat: ротационное написание против однообразия, playbook устранения низкой креативности, визуальный базовый уровень для благословляющих изображений, gpt-image конвейер с приёмкой по OCR и измеренный web API черновиков xiaolvshu.

32 месяца назадНавыкиMIT
O

dsh-paddle-ocr

omdsh-dev/dsh-paddle-ocr

32 месяца назадЗрение, голос и мультимодальностьBSD-3-Clause
Y

dsh-md-convert

yakoylp/dsh-md-convert

Преобразует документы Office и PDF (включая отсканированные) в структурно форматированный Markdown через конвейер OCR с маршрутизацией с приоритетом CPU (RapidOCR/SLANet/FormulaNet).

222 дня назадПроцессы и автоматизацияMIT
L

dsh-visibridge

lhbsaa/dsh-visibridge

Структурированные визуальные доказательства (OCR/разметка/семантика), а также инструмент захвата с USB-камеры для цикла отладки «снимок-анализ-корректировка»; бэкенды: Ollama, DeepSeek, Xiaomi.

2в прошлом месяцеЗрение, голос и мультимодальностьMIT
F

auto-mouse

fish121380/auto-mouse

Селектор контекста UI рабочего стола Windows для Codex, DeepSeek Harness и клиентов MCP: выбор окон, элементов UI или областей экрана с подсветкой при наведении, UI Automation, скриншотами и локальным OCR с последующей проверкой и утверждением контекста Markdown/JSON перед выводом.

2в прошлом месяцеИнструменты и функцииMIT
G

dsh-vision-bridge

goodandready/dsh-vision-bridge

Направляет изображения в выбранную вами модель компьютерного зрения — авто-перезапись, явные инструменты или гибридный режим — чтобы текстовый чат-модель не срывала ход, в котором есть картинка.

26 дней назадЗрение, голос и мультимодальностьMIT
3

dsh-vision (vision-tool)

314857493/dsh-vision

Вызываемый моделью инструмент `vision` для DeepSeek Harness: описывает и распознаёт текст на файлах изображений, напрямую вызывая бесплатный Zhipu GLM vision API (цепочка fallback glm-4v-flash), без внешнего CLI.

228 дней назадЗрение, голос и мультимодальностьMIT