Plugins
Explora, filtra e instala plugins de DeepSeek-Harness.
24 plugins encontrados
dsh-design-qa
sunxin-ai/dsh-design-qa
QA de fidelidad de diseño para modelos solo de texto: una herramienta `deepseek_vision` toma prestado un ojo de cualquier ruta de visión compatible con OpenAI, de modo que el modelo pueda juzgar si una implementación coincide con su maqueta — se entrega con el benchmark detrás de ese juicio (cuatro fixtures, 23 defectos inyectados, transcripciones en bruto) y la disciplina de cuestionamiento de la que depende.
oh-my-knowledge
lizhiyao/oh-my-knowledge
OMK — Observe. Measure. Know. Cambios de conocimiento respaldados por evidencia para aplicaciones de IA.
dsh-budget
perrylink/dsh-budget
Presupuestos de uso y topes de coste por plugin en la cascada llm/stream: contabilidad de uso por modelo, presupuestos de sesión y mensuales con transiciones de aviso/bloqueo, ventanas de latencia y una estimación de huella de carbono.
dsh-excel-chat (bundle)
hccccc01333/dsh-excel-chat
Hable con Excel en DeepSeek Harness: cree, edite, repare y verifique hojas de cálculo mediante conversación, con comprobaciones automáticas de salud de fórmulas después de cada edición.
dsh-engram
skepsun/dsh-engram
Captura automática sin LLM y un índice simbólico \[ENGRAM\] con divulgación progresiva, un protocolo de tareas/evidencias ESR-lite (esr_task / esr_node / esr_close / esr_link) y telemetría de uso por workspace con un benchmark de recuerdo sin conexión (npm run eval).
dsh-excel-chat
hccccc01333/dsh-excel-chat
Habla con Excel en DeepSeek Harness: crea, edita, repara y verifica hojas de cálculo mediante conversación, con comprobaciones automáticas de salud de fórmulas tras cada edición.
dsh-plugin-mlquant-benchmark
initial-d/dsh-plugin-mlquant-benchmark
Herramientas DSH para reproducir y validar el benchmark de CPU del protocolo v1 de ml-quant-trading, y luego redactar un informe listo para issue. Requiere un clon local de initial-d/ml-quant-trading (defínelo como workspace o repoPath) además de Python y PyTorch; este plugin no descarga el repositorio ni instala sus dependencias.
dsh-plan-lattice
1052326311/dsh-plan-lattice
Agrega contratos de ejecución persistentes, grafos de trabajo recursivos, aclaración crítica y compuertas de evidencia para tareas largas o poco especificadas de Harness.
belief-merge (belief-merge)
alizeli/belief-merge
Fusiona el contexto de otras sesiones en el turno actual: resolución de conflictos ponderada por evidencia, retractación de afirmaciones cuyas premisas fueron retractadas, etiquetado de confianza que resiste la inyección de prompts entre sesiones, y empaquetado acotado por presupuesto. Incluye un benchmark.
dsh-models-radar
hi-fangj/dsh-models-radar
Muestra los puntos de referencia de capacidad de modelos de CodexRadar en una página de Ajustes y muestra la puntuación DeepSWE del modelo de la sesión seleccionada junto al compositor.
dsh-verification (dsh-verification)
bpc-oss/dsh-verification
Puerta de verificación para agentes de DSH: cada criterio de aceptación debe estar respaldado por evidencia real de herramientas con sello del servidor antes de que la puerta de finalización deje pasar un objetivo (auditoría consultiva, puerta de aplicación, permisos duraderos).
euthyna
slow-stack/euthyna
Security-audit facts AI coding agents cannot compute, plus a verdict gate: euthyna history attributes deleted lines to commits and flags those from security fixes (--origins finds the first introducer), euthyna coverage reports which changed symbols no test ever invoked, and euthyna gate checks each finding against six gates, downgrading any without evidence to an observation.
dsh-jev-verify
xienda/dsh-jev-verify
TypeSafe Jev (modelo de decisión System One) para DeepSeek Harness, de principio a fin: jev_decision (choice/score/noul, en paralelo, respuestas tipadas + confianza), una tarjeta en Ajustes > Plugins para la API key y los conmutadores, vistas de herramientas en línea que muestran cada decisión en la conversación (respuesta, confianza, latencia, coste), un autoguard (comprobaciones deterministas + de riesgo/bucle con Jev), un panel local /jev y un benchmark de verificación en línea (96,3% en 27 preguntas etiquetadas, mediana ~283 ms en jev-latest, 2026-09-21). Honesto por diseño: solo API real, sin fallback simulado.
novelAssist-dsh (plugin)
fenghuolinshan/novelassist-dsh
Long-form novel writing plugin: each book is a git repository of frontmatter files, with 39 DSH domain tools and a web writing UI. Deep import drafts candidates, AI adoption into canonical assets requires DSH approval, and deterministic continuity checks ship with a report-only benchmark. Independent open source (MIT), not an official DeepSeek product; requires Node >= 24.11.0 and currently targets DSH 0.1.2-rc.1.
dsh-context-compression-improved
drscrewdriver/dsh-context-compression-improved
Same-origin in mechanism with the two loudest lines in context compression. The code-skeleton gate follows the skeletonization approach of Headroom (Apache-2.0), whose published headline is 20% fewer tokens for coding agents and 60–95% fewer tokens for JSON, same answers. The estimator channel follows TokenPilot (arXiv:2606.17016), which reports up to 60% lower cost for long-session agents. Both figures are theirs, quoted as-is; this plugin ships no benchmark of its own and claims no reduction of its own. What it adds for DeepSeek Harness: choose a compression profile, set the Auto Compact trigger level and toggle code-skeleton compression from one settings section, with exact DeepSeek V4 tokenizer measurement, same-revision count verification, and fail-open behaviour that keeps the original tool results on unsupported models.
neoxider-mcp-hub
neoxider/neoxider-mcp-hub
One MCP tool instead of every schema you own — a lazy capability broker that cuts resident tool context by a measured 94.4%. Search, inspect, enable and call MCP servers and skills on demand.
dsh-plugin-compare
yminghua/dsh-plugin-compare
Compares existing DSH sessions or runs controlled A/B trials between agent presets, showing aligned timelines, paired metric deltas, explicit success checks, and exportable reports.
dsh-pianist
laplace-bit/dsh-pianist
Piano performance plugin: ask the agent to play a piece and it renders on a Canvas2D grand piano with real Salamander Grand samples, an immersive stage, and an interactive 88-key keyboard.
dsh-experience-library
libiwolve/dsh-experience-library
Experience validation layer for DSH: zero-token collection of tool-failure/retry/search signals, AI refinement into verified skill books (three-layer verification), looked up at task start. Ships 10 trial skills and benchmark data (complex-task success 100% vs 60% bare).
dsh-model-arena
hj01857655/dsh-model-arena
Run the same prompt through every model you have, and see the difference without squinting.
dsh-livebench-panel
vithrive/dsh-livebench-panel
DSH web plugin: a LiveBench tab in the Trajectory view (right of 对话/轨迹). Run LiveBench evaluations against every model configured in the DeepSeek Harness — pick provider/model, category, task, release and question range from dropdowns, watch progress, and
dsh-model-manager
ansonfishing/dsh-model-manager
Control panel for local LLM inference servers in the DSH web view: service registry with health checks and stop controls, named parameter profiles for llama.cpp, SGLang and vLLM with pre-save KV/VRAM validation, GPU detection, and tok/s benchmarks.
dsh-plugin-abtest
morriaty-the-murderer/dsh-plugin-abtest
Paired experiments and promotion gates for DSH plugins.
dsh-eval
hccccc01333/dsh-eval
Plataforma de evaluación de agentes: benchmarks en YAML, orquestación de ejecuciones headless, métricas basadas en trazas e informes de ejecución