プラグイン
DeepSeek-Harness プラグインを閲覧・絞り込み・インストールできます。
15 件のプラグインが見つかりました
dsh-ros2
stvli/dsh-ros2
DeepSeek Harness 向け ROS2 デバッグツールセットとロボット状態視覚分析: ノード/トピック/サービス/アクション/インターフェース/TF 列挙、グラフ全体トポロジ JSON、rosdep チェック、承認ゲート付きビルドとカスタムメッセージスキャフォールド、GUI スクリーンショットとマルチモーダル視覚観測に加え、ヘッドレス RViz2 オフスクリーンレンダリング(ローポリのメッシュ、直接ピクセル読み取り、GPU パススルー — モーションは 30Hz レンダリング)と並列 VLM リアルタイム解析。
dsh-vision-proxy
flyvhidbwo/dsh-vision-proxy
DeepSeek ブレイン + 自動画像文字起こし:GUI で画像を添付すると、デフォルトで公式の deepseek-v4-flash-vision-exp により文字起こしされます(純粋テキストの V4-Pro ブレインも画像を見ることができます)。代替として、任意の OpenAI 互換 VLM またはローカル Ollama も使用可能。
dsh-video-lens
dundunhan/dsh-video-lens
テキストのみの DeepSeek Harness エージェントに動画理解能力を付与:シーン認識フレームサンプリング + VLM + オプションの ASR 文字起こしをタイムラインエビデンスに融合。/ 純テキストモデル用の動画理解プラグイン(シーン感知抽フレーム + VLM + オプション音声転写)
dsh-video-understand
ilps2/dsh-video-understand
低コストな動画理解ツール。video_understand ツールが Bilibili リンク / BV / ローカル動画を AVIS 情報層(ASR + シーン構造 + オブジェクト追跡 + YOLO ラベル)に変換し、要約 + Q&A を返す。質問主導のレイヤー間ダイナミックルーティング(L0 ASR / L1 オブジェクト追跡 / L2 キーフレーム VLM)、繰り返し質問向けの意味レイヤー再利用、質問ごとの予算上限を備える。Python エンジン: コア層には faster-whisper / opencv / yt-dlp が必要(約200-300MB)。任意の意味層を追加すると torch / transformers / ultralytics が約2GB 増える。付属の doctor --fix が venv をセットアップし、両方をインストールする。
dsh-vision
54xkeee/dsh-vision
テキストのみのDeepSeekにビジョン機能を追加、デフォルトはDoubao Web経由(無料・APIキー不要——WindowsのCDPブリッジ経由でログイン済みのChromeを操作)、Antigravity IDEのクォータ(flash/pro)またはGeminiへのフォールバックにも対応。詳細レベルの自動エスカレーション、圧縮後の再水和に対応したビジョン証跡メモリ、コンテンツハッシュキャッシュ、バイリンガルのクライアントパネルを備える。
dsh-vision-bridge
sfyyy/dsh-vision-bridge
テキスト専用のDSHセッション向けオンデマンドビジョン:画像はマーカーに変換され、vision_describeツールが画像と質問のみをOpenAI互換のビジョンモデルに送信します
dsh-her-eyes
huashenglian/dsh-her-eyes
AI が VLM(マルチモーダルモデル)を自動呼び出しして視覚分析を行えるようにする dsh プラグイン。
dsh-omni-workstation
huashenglian/dsh-omni-workstation
DSH 向けのオムニモーダル・ワークステーション:順序付けられたマルチカード VLM フェイルオーバーチェーン上の analyze_image、同じ画像リゾルバーを共有する 6 ツールのビジョンツールキット(ズーム、色サンプリング、ピクセル差分、OCR、要素検出、インライン表示)、OpenAI/DashScope/ComfyUI プロトコル上の generate_image、/build-video-tool ビルダーを備えたマルチカード非同期 generate_video、7 つのプロバイダー上の speak/clone_voice TTS。すべてが 1 つの自動保存設定ページから操作されます。
dsh-youreyes
54xkeee/dsh-youreyes
テキスト専用 DeepSeek 向けのビジョンツールキット。モデルから呼び出せる `vision` ツール、deepseek/opencode-go 用ラッパーアダプタ(v4 flash/pro)、Antigravity IDE クォータ(default, flash/pro)/任意の OpenAI 互換 VLM / Gemini / ローカル Ollama チャネル、圧縮再復元付きの証拠メモリ、コンテンツハッシュキャッシュ、そしてバイリンガルのクライアントパネルを備える。
dsh-file-attachment
wszhoho/dsh-file-attachment
Drag-and-drop / paste / upload files and images; on non-multimodal models images are auto-described by a configured VLM.
dsh-image-vision
xsoc1/dsh-image-vision
任意の OpenAI 互換 VLM(ローカル Ollama またはクラウド)向けの view_image ツールを備えたチャット画像添付ブリッジ:貼り付け/ドロップされた画像はテキスト専用の DeepSeek モデルに届く前に view_image のパスマーカーになる。
dsh-tool-vision
gloryxpnv/dsh-tool-vision
テキスト専用エージェント向けのローカル優先の構造化ビジョン:画像はローカルの OpenAI 互換 VLM に送られ、JSON の証拠(要約、逐語 OCR、レイアウト領域、エンティティ/関係、色、明示的な不確実性)として返ります。ハルシネーション対策のフォールバックと任意の貼り付け/アップロードブリッジ付き。クラウド費用はゼロで、画像はマシン外に出ません。
dsh-sight
fu3rte/dsh-sight
テキスト専用の DeepSeek Harness(dsh)モデルにビジョン機能をプラグインとして追加します。低価格/無料の VLM プリセットを内蔵した `vision` ツール、複数画像の一括解析、貼り付けによる画像入力、ホットリロード対応の Web 設定ページを提供します。
dsh-llm-mlx
robbywang25/dsh-llm-mlx
Use local MLX-LM or MLX-VLM models in DeepSeek Harness through a loopback OpenAI-compatible provider, with optional DSH-owned server startup.
dsh-mingmu
lab-sku/dsh-mingmu
明眸 VisionBridge - 自研の視覚ブリッジ:盲目モデルが画像を受信時、自動的に視覚モデルを呼び出して認識し、認識したテキストをメインモデルへフィードバック、違和感なし、設定可能、アップグレード時も失われない