プラグイン
DeepSeek-Harness プラグインを閲覧・絞り込み・インストールできます。
5 件のプラグインが見つかりました
dsh-ears
wiziscool/dsh-ears
DeepSeek Harness(dsh)向け音声入力プラグイン:コンポーザーのマイクボタンで音声を下書き転写に変換し、複数の音声認識バックエンドから選択可能で、dsh 独自の LLM ルートによる任意の推敲とネイティブ設定ページを備えています。
dsh-voice-mode (dsh-voice-mode)
qishuilalala/dsh-voice-mode
DeepSeek Harness Web UI 用のフルデュプレックス音声モード:トグル(2 秒ポーズで自動送信)またはプッシュトゥトークによるディクテーションを、編集可能なドラフトに zipformer2 ストリーミング ASR で入力、オプションでウェイクワード対応。Edge TTS によるセンテンス単位の読み上げとライブキャプション、話すと再生と実行中ターンを割り込みます(真のバージイン)。オンデバイス ASR で API キー不要。
dsh-omni-workstation
huashenglian/dsh-omni-workstation
DSH 向けのオムニモーダル・ワークステーション:順序付けられたマルチカード VLM フェイルオーバーチェーン上の analyze_image、同じ画像リゾルバーを共有する 6 ツールのビジョンツールキット(ズーム、色サンプリング、ピクセル差分、OCR、要素検出、インライン表示)、OpenAI/DashScope/ComfyUI プロトコル上の generate_image、/build-video-tool ビルダーを備えたマルチカード非同期 generate_video、7 つのプロバイダー上の speak/clone_voice TTS。すべてが 1 つの自動保存設定ページから操作されます。
dsh-voice-call
biliye/dsh-voice-call
Voice call assistant for the DSH Web GUI: a draggable floating call ball, browser-side VAD that sends each utterance after a pause, FunASR HTTP or streaming speech recognition, MiniMax or OpenAI-compatible TTS replies, an optional wake-word mode with auto-sleep, and task dispatch to separate subagent sessions with progress, stop, and spoken completion reports.
dsh-voco
lgquan/dsh-voco
DSHのためのハンズフリー Listening、プッシュ・トゥ・トーク、音声認識、TTS 応答、バックグラウンド Agent 委任を備えた継続的な音声会話。