プラグイン
DeepSeek-Harness プラグインを閲覧・絞り込み・インストールできます。
86 件のプラグインが見つかりました
modlens
liustack/modlens
テキスト専用モデル向けのビジョンブリッジ: 画像を貼り付けると、構造化された JSON エビデンス(OCR、レイアウト、セマンティクス)を取得。
dsh-vision-router
ysr666/dsh-vision-router
テキスト専用エージェント向けの無料ビジョン機能: キー不要の内蔵ビジョンチェーンとピクセルツール群(Q&A、グラウンディング、クロップ、ピクセル差分、カラー、OCR、SVG トレース、切り抜き、スクリーンショット)。画像を貼り付けるだけで使用可能。
dsh-vision-toolkit
anionex/dsh-vision-toolkit
テキスト専用モデルに視覚機能を追加:画像を貼り付けると、モデルがVision Toolkitバリアントに切り替わり、画像Q&A、複数画像比較、ロングスクリーンショットOCR、スクリーンショットからのUI再現、要素グラウンディング、ピクセル差分に対応します。デフォルトではAPIキー不要で、作者がホストする無料サービスにより1マシンあたり1日100枚まで処理可能。独自の_provider_への切り替えも設定できます。
Invoice-Downloader (dsh-invoice-downloader)
ethanyoq/invoice-downloader
DeepSeek Harness向けのローカルIMAP請求書ダウンロード、OCR、アーカイブ、Excel出張費精算サマリー。
watch-skill
oxbshw/watch-skill
DeepWatch の機能を、既存の DeepSeek Harness プロファイルにインストールできるようにします。
dsh-ios
zseven-w/dsh-ios
会話の中にあるライブ iOS Simulator または USB 接続 iPhone: 起動、ビルド、アクセシビリティIDまたは OCR テキストで UI を操作、リスト行アクションと SwiftUI preview のホットリロード、さらにタップやドラッグできるストリーミングサイドバーパネルを備えた 22 の agent tools。
dsh-android
zseven-w/dsh-android
会話の中にあるライブ Android デバイス — エミュレータまたは USB 接続 phone を adb 経由で完全制御: ストリーミング、Gradle build/run、UI-tree または OCR での操作、logcat、process と memory、さらに 3 ボタンのナビゲーションパネルを含む 20 の agent tools。
invoice-downloader
ethanyoq/invoice-downloader
DeepSeek Harness用のローカルIMAP請求書ダウンロード、OCR、アーカイブ、Excelサマリーバンドル
dsh-openmaic
thu-maic/dsh-openmaic
OpenMAIC: 教室、スライド、インタラクティブウィジェット、ソクラテス式教授法。
dsh-openbiliclaw
whiteguo233/dsh-openbiliclaw
DSH 向け OpenBiliClaw コンシューマーパネル:おすすめ、保存リスト、ソクラテス式対話、プロフィール表示、Agent Bridge ツール。
picturereader
jing-hy/picturereader
テキストのみのモデルのための画像「読み取り」:ダウンスケール+色深度削減+構造/色のフィンガープリントをテキストグリッドに変換して会話に戻すことで、モデルはマルチモーダルモデルのように自律的にズーム、サンプリング、OCR を行えます。完全にローカルで動作し、外部モデルへの依存はゼロ。画像読み取りの方法論スキルとオプションの PaddleOCR を同梱しています。
dsh-computer-use-win
yu-tao-li/dsh-computer-use-win
DeepSeek Harness 向け Windows コンピュータユース: PowerShell UIA バックエンド上の MCP stdio サーバー。22 個のデスクトップツール(UIA ツリー、スクリーンショット、タイプ入力、OCR、ウィンドウ管理、フェイルセーフ)を公開。
dsh-vision-proxy
flyvhidbwo/dsh-vision-proxy
DeepSeek ブレイン + 自動画像文字起こし:GUI で画像を添付すると、デフォルトで公式の deepseek-v4-flash-vision-exp により文字起こしされます(純粋テキストの V4-Pro ブレインも画像を見ることができます)。代替として、任意の OpenAI 互換 VLM またはローカル Ollama も使用可能。
dsh-pdf-mineru
yurzi/dsh-pdf-mineru
MinerU を活用したプロバイダ非依存の DSH 文書解析。ネイティブなバックグラウンドジョブ、不変の結果、安全な request coalescing を備える。
dsh-docs
sqhao-o/dsh-docs
DeepSeek Harness 向けのローカル PDF・Office・画像・OCR ドキュメントインテリジェンス。
DSH-FormatForge (dsh-formatforge)
tianbuyu-wwx/dsh-formatforge
FormatForge:ドラッグ&ドロップの受信箱、ff_translate/ff_formats/ff_result ツール、CLI を使って、30 以上のファイル形式(PDF, DOCX, PPTX, XLSX, EML, EPUB, TOML, アーカイブ)を AI が読めるテキストへ鍛造。スキャン PDF はローカル OCR またはセッションモデルへの向上ヒントにフォールバックします。
dsh-vision
linenxi-ctrl/dsh-vision
DeepSeek Harness 向け外部ビジョンプラグイン: クジラボタンの設定パネル、自動返信付き画像認識、エージェント用スクリーンショット/認識ツール。
dsh-free-vision
fuzzysoul/dsh-free-vision
テキスト専用モデル用フリービジョンブリッジ:無料ティアプロバイダー(Qwen3-VL-Flash、Doubao、DeepSeek-OCR)による画像理解、OCR、UIおよびデバッグ分析、設定GUI付き。
dsh-iris
mokuyoaxis/dsh-iris
DeepSeek Harness 向けのメディア&ビジョンワークスペースです。画像・動画・音声の生成、画像への質問応答と要素の位置特定、長尺画像の OCR、ピクセル差分、HTML スクリーンショットの検証、動画の要約を提供し、DashScope と OpenAI 互換のプロバイダー、モデルプール、ワークベンチクライアントを備えています。
dsh-vision
54xkeee/dsh-vision
テキストのみのDeepSeekにビジョン機能を追加、デフォルトはDoubao Web経由(無料・APIキー不要——WindowsのCDPブリッジ経由でログイン済みのChromeを操作)、Antigravity IDEのクォータ(flash/pro)またはGeminiへのフォールバックにも対応。詳細レベルの自動エスカレーション、圧縮後の再水和に対応したビジョン証跡メモリ、コンテンツハッシュキャッシュ、バイリンガルのクライアントパネルを備える。
dsh-learning-mode (plugin)
chplus0/dsh-learning-mode
Learning Mode エージェントプリセット: コーディングしながら教えるコーディングエージェント — 具体的なシナリオに基づく説明、ソクラテス式ガイダンス、TODO(你) 練習空白を提供。Claude Code の Learning 出力スタイルをモデル化。dsh plugin add(dsh-learning-mode on npm) でインストール可能。
macos-computer-use-kit
sur-cai/macos-computer-use-kit
DeepSeek Harness のための AX 優先の macOS コンピュータ操作:安定した参照を持つアクセシビリティスナップショット、バックグラウンド入力、Unicode 入力、メニュー、アプリ、set-of-mark スクリーンショット、オンデバイス OCR、検証済みアクション、そしてオプションの Jev(TypeSafe System One)セマンティックガード——1
macos-computer-use-kit (dsh)
sur-cai/macos-computer-use-kit
DeepSeek Harness 向けの AX 優先の macOS computer use:安定した参照を持つアクセシビリティスナップショット、バックグラウンド入力、Unicode 入力、メニューとアプリ、set-of-mark スクリーンショット、オンデバイス OCR、検証済みアクション——macos-cu CLI にブリッジされた 11 のツール。
dsh-ocr-local
grelvan/dsh-ocr-local
テキスト専用ルート用のローカルOCRフォールバック:セッションモデルが画像を受け付けないと宣言した場合、添付画像をローカルにキャッシュし、そのパスを注入してモデルがocr_imageを呼び出せるようにする—PP-OCRv5 + ONNX RuntimeをCPUで使用、APIキー不要、画像はマシンを離れない。モデルが画像を見える場合には無音。