Saltar al contenido principal

Plugins

Explora, filtra e instala plugins de DeepSeek-Harness.

45 plugins encontrados

F

dsh-memory

furongjun-1999/dsh-memory

Exploración de arquitectura AGI de caja blanca: metacognición (bucle de autocognición), aprendizaje continuo (volante de conocimiento), modelo del mundo (espacio de condiciones, grafo de memoria espaciotemporal), auto-mejora (disciplina bootstrap), pipeline de caja blanca zero-LLM y barandillas de confianza auditables.

308hace 15 horasMemoriaMIT
B

DSH-Plugins-Marketplace

bradegithub/dsh-plugins-marketplace

Mercado de complementos y habilidades impulsado por temas de GitHub: una página de configuración que explora el registro recopilado automáticamente (todo el tema dsh-plugin más el índice de habilidades, actualizado por CI cada 2 horas) con instalación en un clic, detección de tipo, confirmaciones de seguridad para scripts de instalación y dependencias sombra del host, gestión de claves de entorno y la especificación de reconocimiento STANDARD.md.

169hace 4 horasDesarrollo y herramientas de pluginsMIT
F

dsh-prompt-enhancer

fishsb/dsh-prompt-enhancer

Mejora de prompts con un clic (5 modos, cadena de memoria, fallback multimodelo) más reconocimiento de voz (Qwen3-ASR en la nube / SenseVoice sin conexión, parada automática en silencio) para el compositor, con reinicio del servicio DSH con un clic.

82hace 5 díasHerramientas y funciones
P

dsh-voice-scribe

pensivefei/dsh-voice-scribe

Entrada de voz para la interfaz web: pulsa Alt (o Alt+Space) para iniciar/detener el dictado, Web Speech del navegador (sin configuración) o ASR en la nube compatible con OpenAI, pulido opcional mediante el LLM configurado en DSH, interfaz de ajustes.

34hace 3 díasVisión, voz y multimodalMIT
W

dsh-ears

wiziscool/dsh-ears

Plugin de entrada de voz para DeepSeek Harness (dsh): un botón de micrófono en el compositor convierte el habla en un borrador transcrito, con opción de backends de reconocimiento de voz, pulido opcional mediante las rutas LLM propias de dsh y una página de configuración nativa.

21hace 23 horasVisión, voz y multimodalMIT
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

Modo de voz dúplex completo para la interfaz web de DeepSeek Harness: conmutación (envío automático tras pausa de 2 s) o dictado pulsar-para-hablar en un borrador editable con ASR en streaming zipformer2, palabra de activación opcional; lectura en voz alta Edge TTS oración por oración con subtítulos en vivo, y la voz interrumpe la reproducción y el turno en curso (barge-in real). ASR en el dispositivo, sin clave de API.

15hace 8 horasVisión, voz y multimodalMIT
L

dsh-vision

linenxi-ctrl/dsh-vision

Plugin de visión externo para DeepSeek Harness: panel de configuración con botón de ballena, reconocimiento de imágenes con respuesta automática, y herramientas de captura y reconocimiento para el agente.

9hace 2 mesesVisión, voz y multimodalMIT
A

dsh-highres-vision

azwosile/dsh-highres-vision

Para el modelo de visión nativo de DeepSeek Harness deepseek-v4-flash-vision-exp, eleva los límites de admisión de imágenes a 32 MiB / 8192 px / 600 imágenes y añade una herramienta highres_read que divide en mosaicos las imágenes grandes y luego devuelve la imagen completa más mosaicos de 800x800 a través de la herramienta read_image del host.

8hace 22 díasVisión, voz y multimodalMIT
3

dsh-voice

3274375092/dsh-voice

Entrada de voz para DeepSeek Harness: habla al micrófono y el texto reconocido se envía como un mensaje de chat normal, mediante reconocimiento de voz local o del navegador.

8anteayerVisión, voz y multimodalMIT
5

dsh-vision

54xkeee/dsh-vision

Visión para DeepSeek de solo texto mediante Doubao Web de forma predeterminada (sin costo, sin clave de API: controla tu Chrome con sesión iniciada a través de un puente CDP de Windows), con cuota de Antigravity IDE (flash/pro) o alternativa a Gemini; escalado automático de detalle, memoria de evidencia visual con rehidratación tras compactación, caché por hash de contenido y un panel de cliente bilingüe.

7hace 2 mesesVisión, voz y multimodalMIT
G

dsh-tool-see-image

gugu123a/dsh-tool-see-image

Proporciona la herramienta see_image para DSH: envía un archivo de imagen a un modelo de visión compatible con OpenAI configurable y transmite su descripción de vuelta a un modelo de solo texto.

5el mes pasadoHerramientas y funcionesMIT
N

vision-exp-tile

nicholas023/vision-exp-tile

Reconocimiento de imágenes grandes para modelos vision-exp: reconocimiento por mosaicos 800×800 sin pérdida (smart/pipeline/full), OCR local con preprocesamiento y enrutamiento de escritura a mano, GPU multivendor opcional (DirectML/CUDA/OpenVINO) con fallback automático a CPU.

5el mes pasadoVisión, voz y multimodalMIT
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

Bucle de voz gratuito para la interfaz web: entrada de micrófono con SpeechRecognition del navegador con resultados provisionales en vivo, además de botones de altavoz para leer en voz alta y lectura automática de las respuestas del asistente, sin configuración y sin clave de API.

4hace 2 mesesVisión, voz y multimodalMIT
S

dsh-linghun

syyr1987/dsh-linghun

Un núcleo de juicio para DeepSeek Harness: un bucle cognitivo que da origen y atribución a cada decisión y lleva la planificación hasta el cierre, memoria hipocampal que condensa la experiencia en conocimiento reutilizable, y una tarjeta de persona personalizable (nombre, personalidad, estilo de comunicación). Requiere DSH ^0.1.0-rc.7.

3hace 14 horasMemoria
A

dsh-j-space

anonyjcy/dsh-j-space

Preset de agente nativo J-Space Cognition Suite SV1 y plugin Cordis independiente: 13 módulos, controlador persistente y espacio de trabajo desacoplado.

3hace 3 díasMemoriaMIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Estación de trabajo omnimodal para DSH: analyze_image sobre una cadena ordenada de conmutación por error VLM de varias tarjetas, un conjunto de seis herramientas de visión (zoom, muestreo de color, diferencia de píxeles, OCR, detección de elementos y visualización en línea) que comparten el mismo resolutor de imágenes, generate_image mediante los protocolos OpenAI/DashScope/ComfyUI, generate_video asíncrono con varias tarjetas y un constructor /build-video-tool, y speak/clone_voice TTS en siete proveedores, todo gobernado por una única página de ajustes con autoguardado.

3hace 14 díasVisión, voz y multimodalMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

Entrada con una sola mano y sin teclado para el compositor: mantén pulsado el ratón sobre el cuadro de entrada, habla y suelta — el texto aparece en el borrador, y deslizar hacia arriba cancela sin dejar media frase. No hay botón de micrófono al que apuntar ni atajo que recordar; la mano nunca tiene que salir del área de entrada, que es justo lo importante cuando la otra mano está ocupada. El reconocimiento se ejecuta totalmente sin conexión (SenseVoice mediante sherpa-onnx, sin clave de API, el audio nunca sale del equipo).

3hace 22 horasVisión, voz y multimodalMIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

Asistente de voz para dsh web: di la frase de activación (p. ej. «小鲸») para activar el dictado manos libres — lo que dices se transcribe y se escribe automáticamente en el cuadro de chat. Admite comandos de edición hablados (enviar, borrar, nueva línea, detener la lectura) y lee en voz alta las respuestas del asistente en chino. El reconocimiento de voz se ejecuta localmente en el navegador mediante sherpa-onnx WASM, así que funciona sin conexión y sin clave de API.

3el mes pasadoVisión, voz y multimodalMIT
L

dsh-voco

lgquan/dsh-voco

Conversaciones de voz continuas para DSH con escucha manos libres, pulsar para hablar, reconocimiento de voz, respuestas TTS y delegación de Agent en segundo plano.

3el mes pasadoVisión, voz y multimodalMIT
X

dsh-image-vision

xiaoyuink/dsh-image-vision

Comprensión de imágenes para cualquier modelo de DSH: herramientas de visión, OCR, grounding y recorte con presets de dominio para histopatología, biología celular, anatomía, imágenes clínicas y figuras científicas.

3hace 29 díasVisión, voz y multimodal
N

voco-input-sh

nothree-code/voco-input-sh

Entrada por voz para la interfaz web: un botón de micrófono que activa el reconocimiento de voz local sin conexión VocoType y auto inserta el texto reconocido en el compositor (despliegue automático, deduplicación, dictado continuo).

3hace 19 díasVisión, voz y multimodalMIT
W

visual-review

wang-bool/visual-review

Renderiza en línea las imágenes pegadas o subidas dentro del chat de DSH Web y da visión a los modelos solo de texto: la herramienta visual_review, invocable por el modelo, llama primero a cualquier API multimodal compatible con OpenAI y, si falla, recurre a un worker local de Qwen3-VL.

3hace 2 mesesVisión, voz y multimodalMIT
M

dsh-vision-tools

moon09300731/dsh-vision-tools

Paquete completo de capacidades de visión para DeepSeek Harness: una herramienta vision_understand (APIs de visión compatibles con OpenAI, Zhipu GLM-4V-Flash gratuito por defecto) además de puntos de entrada de pegar/arrastrar y soltar/botón para reconocimiento de imágenes.

3hace 2 mesesVisión, voz y multimodalMIT
B

dsh-voice-call

biliye/dsh-voice-call

Asistente de llamadas de voz para la GUI web de DSH: una bola de llamada flotante y arrastrable, VAD en el navegador que envía cada intervención tras una pausa, reconocimiento de voz FunASR HTTP o en streaming, respuestas TTS de MiniMax o compatibles con OpenAI, un modo opcional de palabra de activación con auto-suspensión y despacho de tareas a sesiones de subagente separadas con progreso, parada e informes hablados de finalización.

2hace 5 díasVisión, voz y multimodalMIT