メインコンテンツへスキップ

プラグイン

DeepSeek-Harness プラグインを閲覧・絞り込み・インストールできます。

45 件のプラグインが見つかりました

F

dsh-memory

furongjun-1999/dsh-memory

ホワイトボックス AGI アーキテクチャの探求:メタ認知(自己認知ループ)、継続学習(知識フライホイール)、世界モデル(条件空間、時空間記憶グラフ)、自己改善(ブートストラップ規律)、ゼロ LLM ホワイトボックスパイプライン、監査可能な信頼ガードレール。

30815 時間前メモリMIT
B

DSH-Plugins-Marketplace

bradegithub/dsh-plugins-marketplace

GitHubトピック駆動のプラグイン&スキルマーケットプレイス:自動収集されたレジストリ(dsh-pluginトピック全体とスキルインデックス、2時間ごとにCIで更新)を閲覧できる設定ページで、ワンクリックインストール、タイプ検出、インストールスクリプトとホストのシャドウ依存関係の安全確認、環境変数キー管理、STANDARD.md認識仕様を備える。

1694 時間前開発とプラグインツールMIT
F

dsh-prompt-enhancer

fishsb/dsh-prompt-enhancer

コンポーザー向けワンクリックプロンプト拡張(5モード、メモリチェーン、マルチモデルフォールバック)と音声認識(クラウドQwen3-ASR / オフラインSenseVoice、無音時自動停止)、ワンクリックDSHサービス再起動付き。

825 日前ツールと機能
P

dsh-voice-scribe

pensivefei/dsh-voice-scribe

Web UI向け音声入力:Alt(またはAlt+Space)を押してディクテーションを開始/停止、ブラウザWeb Speech(ゼロ設定)またはOpenAI互換クラウドASR、DSH設定LLMによるオプションのポリッシュ、設定UI。

343 日前ビジョン、音声とマルチモーダルMIT
W

dsh-ears

wiziscool/dsh-ears

DeepSeek Harness(dsh)向け音声入力プラグイン:コンポーザーのマイクボタンで音声を下書き転写に変換し、複数の音声認識バックエンドから選択可能で、dsh 独自の LLM ルートによる任意の推敲とネイティブ設定ページを備えています。

2123 時間前ビジョン、音声とマルチモーダルMIT
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

DeepSeek Harness Web UI 用のフルデュプレックス音声モード:トグル(2 秒ポーズで自動送信)またはプッシュトゥトークによるディクテーションを、編集可能なドラフトに zipformer2 ストリーミング ASR で入力、オプションでウェイクワード対応。Edge TTS によるセンテンス単位の読み上げとライブキャプション、話すと再生と実行中ターンを割り込みます(真のバージイン)。オンデバイス ASR で API キー不要。

158 時間前ビジョン、音声とマルチモーダルMIT
L

dsh-vision

linenxi-ctrl/dsh-vision

DeepSeek Harness 向け外部ビジョンプラグイン: クジラボタンの設定パネル、自動返信付き画像認識、エージェント用スクリーンショット/認識ツール。

92 か月前ビジョン、音声とマルチモーダルMIT
A

dsh-highres-vision

azwosile/dsh-highres-vision

DeepSeek Harness ネイティブのビジョンモデル deepseek-v4-flash-vision-exp 向けに、画像の受付上限を 32 MiB / 8192 px / 600 枚に引き上げ、大きな画像をタイル分割し、ホストの read_image ツールを通じて画像全体と 800x800 のタイルを返す highres_read ツールを追加します。

822 日前ビジョン、音声とマルチモーダルMIT
3

dsh-voice

3274375092/dsh-voice

DeepSeek Harness用音声入力:マイクに向かって話すと、認識されたテキストが通常のチャットメッセージとして送信されます。ローカルまたはブラウザ音声認識を利用。

8一昨日ビジョン、音声とマルチモーダルMIT
5

dsh-vision

54xkeee/dsh-vision

テキストのみのDeepSeekにビジョン機能を追加、デフォルトはDoubao Web経由(無料・APIキー不要——WindowsのCDPブリッジ経由でログイン済みのChromeを操作)、Antigravity IDEのクォータ(flash/pro)またはGeminiへのフォールバックにも対応。詳細レベルの自動エスカレーション、圧縮後の再水和に対応したビジョン証跡メモリ、コンテンツハッシュキャッシュ、バイリンガルのクライアントパネルを備える。

72 か月前ビジョン、音声とマルチモーダルMIT
G

dsh-tool-see-image

gugu123a/dsh-tool-see-image

DSH 用の see_image ツールを提供します。画像ファイルを設定可能な OpenAI 互換ビジョンモデルに送信し、その説明をテキスト専用モデルへ中継します。

5先月ツールと機能MIT
N

vision-exp-tile

nicholas023/vision-exp-tile

vision-expモデル用大画像認識:ロスレス800×800タイル認識(smart/pipeline/full)、前処理と手書きルーティング付きローカルOCR、DirectML/CUDA/OpenVINO対応のオプション複数ベンダーGPU(CPU自動フォールバック)。

5先月ビジョン、音声とマルチモーダルMIT
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

Web UI向けの無料音声クローズドループ:ブラウザのSpeechRecognitionによるマイク入力で暫定結果をライブ表示し、さらに読み上げ用スピーカーボタンとアシスタント応答の自動読み上げを提供。設定不要でAPIキーも不要です。

42 か月前ビジョン、音声とマルチモーダルMIT
S

dsh-linghun

syyr1987/dsh-linghun

DeepSeek Harness の判断コア:あらゆる決定に由来と根拠を与え計画を完遂へ導く認知ループ、実行経験を使える知識に凝縮する海馬メモリ、カスタマイズ可能なペルソナカード(名前・性格・話し方)。DSH ^0.1.0-rc.7 が必要です。

314 時間前メモリ
A

dsh-j-space

anonyjcy/dsh-j-space

J-Space Cognition Suite SV1 のネイティブエージェントプリセットと単体で使える Cordis プラグイン:13 のモジュール、永続コントローラ、疎結合ワークスペース。

33 日前メモリMIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

DSH 向けのオムニモーダル・ワークステーション:順序付けられたマルチカード VLM フェイルオーバーチェーン上の analyze_image、同じ画像リゾルバーを共有する 6 ツールのビジョンツールキット(ズーム、色サンプリング、ピクセル差分、OCR、要素検出、インライン表示)、OpenAI/DashScope/ComfyUI プロトコル上の generate_image、/build-video-tool ビルダーを備えたマルチカード非同期 generate_video、7 つのプロバイダー上の speak/clone_voice TTS。すべてが 1 つの自動保存設定ページから操作されます。

314 日前ビジョン、音声とマルチモーダルMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

コンポーザー向けの片手・キーボード不要の入力:入力ボックス上でマウスを押し続けて話し、離すとテキストが下書きに入り、上へスライドすると中途半端な文を残さずキャンセルできます。狙って押すマイクボタンも覚えるショートカットも不要で、もう一方の手がふさがっているときに手が入力エリアから離れずに済むのが要点です。認識は完全にオフラインで動作します(sherpa-onnx 経由の SenseVoice、API キー不要、音声はマシン外に出ません)。

322 時間前ビジョン、音声とマルチモーダルMIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

dsh web 向けの音声アシスタント:ウェイクフレーズ(例:「小鲸」)を言うとハンズフリーの音声入力が有効になり、話した内容が文字起こしされて自動的にチャットボックスへ入力されます。音声による編集コマンド(送信、クリア、改行、読み上げ停止)に対応し、アシスタントの返答を中国語で読み上げます。音声認識は sherpa-onnx WASM によりブラウザ内でローカルに実行されるため、API キーなしでオフラインでも動作します。

3先月ビジョン、音声とマルチモーダルMIT
L

dsh-voco

lgquan/dsh-voco

DSHのためのハンズフリー Listening、プッシュ・トゥ・トーク、音声認識、TTS 応答、バックグラウンド Agent 委任を備えた継続的な音声会話。

3先月ビジョン、音声とマルチモーダルMIT
X

dsh-image-vision

xiaoyuink/dsh-image-vision

あらゆる DSH モデル向けの画像理解:vision、OCR、grounding、クロップツールと、病理組織学、細胞生物学、解剖学、臨床画像、科学図表向けのドメインプリセット。

329 日前ビジョン、音声とマルチモーダル
N

voco-input-sh

nothree-code/voco-input-sh

Web UI 用の音声入力: ローカルの VocoType オフライン音声認識を駆動するマイクボタンで、認識したテキストを自動的に composer に挿入する(自動デプロイ、重複排除、連続ディクテーション)。

319 日前ビジョン、音声とマルチモーダルMIT
W

visual-review

wang-bool/visual-review

貼り付け/アップロードした画像を DSH Web チャット内でインライン表示し、テキストのみのモデルに視覚を与えます。モデルから呼べる visual_review ツールは、まず OpenAI 互換のマルチモーダル API を呼び出し、失敗した場合はローカルの Qwen3-VL ワーカーにフォールバックします。

32 か月前ビジョン、音声とマルチモーダルMIT
M

dsh-vision-tools

moon09300731/dsh-vision-tools

DeepSeek Harness向けの完全な視覚機能バンドルです。vision_understandツール(OpenAI互換の視覚API、デフォルトで無料のZhipu GLM-4V-Flash)に加え、画像認識用の貼り付け/ドラッグ&ドロップ/ボタンのエントリーポイントを提供します。

32 か月前ビジョン、音声とマルチモーダルMIT
B

dsh-voice-call

biliye/dsh-voice-call

DSH Web GUI の音声通話アシスタント:ドラッグ可能なフローティング通話ボール、発話ごとにポーズ後に送信するブラウザ側 VAD、FunASR HTTP またはストリーミング音声認識、MiniMax または OpenAI 互換 TTS の返答、自動スリープ付きの任意のウェイクワードモード、進捗・停止・読み上げ完了報告を伴う別サブエージェントセッションへのタスク派遣。

25 日前ビジョン、音声とマルチモーダルMIT