メインコンテンツへスキップ

プラグイン

DeepSeek-Harness プラグインを閲覧・絞り込み・インストールできます。

15 件のプラグインが見つかりました

S

dsh-ros2

stvli/dsh-ros2

DeepSeek Harness 向け ROS2 デバッグツールセットとロボット状態視覚分析: ノード/トピック/サービス/アクション/インターフェース/TF 列挙、グラフ全体トポロジ JSON、rosdep チェック、承認ゲート付きビルドとカスタムメッセージスキャフォールド、GUI スクリーンショットとマルチモーダル視覚観測に加え、ヘッドレス RViz2 オフスクリーンレンダリング(ローポリのメッシュ、直接ピクセル読み取り、GPU パススルー — モーションは 30Hz レンダリング)と並列 VLM リアルタイム解析。

22一昨日ツールと機能MIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

DeepSeek ブレイン + 自動画像文字起こし:GUI で画像を添付すると、デフォルトで公式の deepseek-v4-flash-vision-exp により文字起こしされます(純粋テキストの V4-Pro ブレインも画像を見ることができます)。代替として、任意の OpenAI 互換 VLM またはローカル Ollama も使用可能。

15先月ビジョン、音声とマルチモーダルMIT
D

dsh-video-lens

dundunhan/dsh-video-lens

テキストのみの DeepSeek Harness エージェントに動画理解能力を付与:シーン認識フレームサンプリング + VLM + オプションの ASR 文字起こしをタイムラインエビデンスに融合。/ 純テキストモデル用の動画理解プラグイン(シーン感知抽フレーム + VLM + オプション音声転写)

13先月ビジョン、音声とマルチモーダルMIT
I

dsh-video-understand

ilps2/dsh-video-understand

低コストな動画理解ツール。video_understand ツールが Bilibili リンク / BV / ローカル動画を AVIS 情報層(ASR + シーン構造 + オブジェクト追跡 + YOLO ラベル)に変換し、要約 + Q&A を返す。質問主導のレイヤー間ダイナミックルーティング(L0 ASR / L1 オブジェクト追跡 / L2 キーフレーム VLM)、繰り返し質問向けの意味レイヤー再利用、質問ごとの予算上限を備える。Python エンジン: コア層には faster-whisper / opencv / yt-dlp が必要(約200-300MB)。任意の意味層を追加すると torch / transformers / ultralytics が約2GB 増える。付属の doctor --fix が venv をセットアップし、両方をインストールする。

8先月ツールと機能
5

dsh-vision

54xkeee/dsh-vision

テキストのみのDeepSeekにビジョン機能を追加、デフォルトはDoubao Web経由(無料・APIキー不要——WindowsのCDPブリッジ経由でログイン済みのChromeを操作)、Antigravity IDEのクォータ(flash/pro)またはGeminiへのフォールバックにも対応。詳細レベルの自動エスカレーション、圧縮後の再水和に対応したビジョン証跡メモリ、コンテンツハッシュキャッシュ、バイリンガルのクライアントパネルを備える。

72 か月前ビジョン、音声とマルチモーダルMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

テキスト専用のDSHセッション向けオンデマンドビジョン:画像はマーカーに変換され、vision_describeツールが画像と質問のみをOpenAI互換のビジョンモデルに送信します

52 か月前ビジョン、音声とマルチモーダルMIT
H

dsh-her-eyes

huashenglian/dsh-her-eyes

AI が VLM(マルチモーダルモデル)を自動呼び出しして視覚分析を行えるようにする dsh プラグイン。

42 か月前ビジョン、音声とマルチモーダルMIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

DSH 向けのオムニモーダル・ワークステーション:順序付けられたマルチカード VLM フェイルオーバーチェーン上の analyze_image、同じ画像リゾルバーを共有する 6 ツールのビジョンツールキット(ズーム、色サンプリング、ピクセル差分、OCR、要素検出、インライン表示)、OpenAI/DashScope/ComfyUI プロトコル上の generate_image、/build-video-tool ビルダーを備えたマルチカード非同期 generate_video、7 つのプロバイダー上の speak/clone_voice TTS。すべてが 1 つの自動保存設定ページから操作されます。

314 日前ビジョン、音声とマルチモーダルMIT
5

dsh-youreyes

54xkeee/dsh-youreyes

テキスト専用 DeepSeek 向けのビジョンツールキット。モデルから呼び出せる `vision` ツール、deepseek/opencode-go 用ラッパーアダプタ(v4 flash/pro)、Antigravity IDE クォータ(default, flash/pro)/任意の OpenAI 互換 VLM / Gemini / ローカル Ollama チャネル、圧縮再復元付きの証拠メモリ、コンテンツハッシュキャッシュ、そしてバイリンガルのクライアントパネルを備える。

22 か月前ビジョン、音声とマルチモーダルMIT
W

dsh-file-attachment

wszhoho/dsh-file-attachment

Drag-and-drop / paste / upload files and images; on non-multimodal models images are auto-described by a configured VLM.

13 日前UI拡張MIT
X

dsh-image-vision

xsoc1/dsh-image-vision

任意の OpenAI 互換 VLM(ローカル Ollama またはクラウド)向けの view_image ツールを備えたチャット画像添付ブリッジ:貼り付け/ドロップされた画像はテキスト専用の DeepSeek モデルに届く前に view_image のパスマーカーになる。

12 か月前ビジョン、音声とマルチモーダル
G

dsh-tool-vision

gloryxpnv/dsh-tool-vision

テキスト専用エージェント向けのローカル優先の構造化ビジョン:画像はローカルの OpenAI 互換 VLM に送られ、JSON の証拠(要約、逐語 OCR、レイアウト領域、エンティティ/関係、色、明示的な不確実性)として返ります。ハルシネーション対策のフォールバックと任意の貼り付け/アップロードブリッジ付き。クラウド費用はゼロで、画像はマシン外に出ません。

12 か月前ビジョン、音声とマルチモーダルMIT
F

dsh-sight

fu3rte/dsh-sight

テキスト専用の DeepSeek Harness(dsh)モデルにビジョン機能をプラグインとして追加します。低価格/無料の VLM プリセットを内蔵した `vision` ツール、複数画像の一括解析、貼り付けによる画像入力、ホットリロード対応の Web 設定ページを提供します。

12 か月前ビジョン、音声とマルチモーダルMIT
R

dsh-llm-mlx

robbywang25/dsh-llm-mlx

Use local MLX-LM or MLX-VLM models in DeepSeek Harness through a loopback OpenAI-compatible provider, with optional DSH-owned server startup.

027 日前モデルとプロバイダーMIT
L

dsh-mingmu

lab-sku/dsh-mingmu

明眸 VisionBridge - 自研の視覚ブリッジ:盲目モデルが画像を受信時、自動的に視覚モデルを呼び出して認識し、認識したテキストをメインモデルへフィードバック、違和感なし、設定可能、アップグレード時も失われない

02 か月前ビジョン、音声とマルチモーダルMIT