Перейти к основному содержимому

Плагины

Находите, фильтруйте и устанавливайте плагины DeepSeek-Harness.

Найдено плагинов: 7

S

dsh-design-qa

sunxin-ai/dsh-design-qa

QA по соответствию дизайну для текстовых моделей: инструмент `deepseek_vision` заимствует «глаз» из любого OpenAI-compatible vision route, чтобы модель могла определить, соответствует ли реализация макету; вместе с бенчмарком, стоящим за этим суждением (четыре fixture, 23 внедренных дефекта, raw transcripts) и дисциплиной вопросов, на которой это основано.

4426 дней назадЗрение, голос и мультимодальностьMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Маршрут провайдера шлюза «зрение-язык»: вставленные изображения описываются настраиваемой VL-моделью (по умолчанию Qwen-VL) перед отправкой в DeepSeek.

921 день назадЗрение, голос и мультимодальностьMIT
W

visual-review

wang-bool/visual-review

Показывает вставленные или загруженные изображения прямо в чате DSH Web и даёт зрение моделям только с текстом: вызываемый моделью инструмент visual_review сначала обращается к любой совместимой с OpenAI мультимодальной API, а при сбое переходит на локальный воркер Qwen3-VL.

32 месяца назадЗрение, голос и мультимодальностьMIT
X

dsh-vision

xiaoshihou514/dsh-vision

Нативное расширение возможностей зрения, использующее либо Zhipu (бесплатно), либо Qwen-VL (локально).

2в прошлом месяцеЗрение, голос и мультимодальностьMIT
Z

dsh-plugins

zjcdkj/dsh-plugins

Внешний плагин DeepSeek Harness: даёт текстовой модели кодинга зрение, маршрутизируя изображения в маршрут Qwen-VL (DashScope) через ctx.llm и возвращая текст.

1в прошлом месяцеЗрение, голос и мультимодальностьMIT
S

multimodal-bridge

spirit4471/multimodal-bridge

Набор плагинов DeepSeek Harness: инструменты qwen_vision (понимание изображений через Qwen-VL) и qwen_generate (text-to-image через Qwen-Image) для текстовых моделей

12 месяца назадЗрение, голос и мультимодальностьMIT
L

dsh-mingmu

lab-sku/dsh-mingmu

明眸 VisionBridge - Визуальный мост собственной разработки: когда слепая модель получает изображения, она автоматически вызывает визуальную модель для распознавания и передаёт распознанный текст обратно в основную модель; незаметно, настраиваемо, без потерь при обновлении.

02 месяца назадЗрение, голос и мультимодальностьMIT