catalog / media-vision
デザイン・メディア・ビジョン
キュレーション済み awesome リストの デザイン・メディア・ビジョン プラグインをすべて掲載。GitHub から同期しています。
ハーネスのマルチモーダル能力:ビジョンツールキット、OCR、画像生成、デザインキャンバス、メディア処理。エージェントに目とスケッチパッドを与え、モデルがタスクの途中で呼び出せるツールプロバイダーとして登録されます。
GitHub リストから同期 · カタログ更新:2026-08-30
455 件のプラグイン
modlens
by liustack
DeepSeek Harness 用のビジョンプラグイン。DeepSeek や GLM などのテキスト専用モデルに画像認識を外付けし、画像を貼るだけで OCR・レイアウト・意味情報を構造化 JSON として取得
agent-vision-toolkit
by anionex
テキスト専用モデルに「見る目」を与えるビジョンツールボックスとスキル。複数画像の理解、画像 QA、長いスクリーンショットの OCR、フロントエンド UI 復元、GUI 自動化に対応
dsh-vision-router
by ysr666
テキスト専用 DeepSeek Harness エージェントに目を与えるプラグイン。キー不要の無料ビジョンチェーン内蔵に加え、QA、グラウンディング、切り抜き、OCR などのツールをワンコマンドで導入可能
dsh-vision-toolkit
by anionex
テキスト専用 DSH エージェントに 10 個の構造化ビジョンツールを提供。意図を意識した画像 QA、長いスクリーンショットの OCR、ピクセルレベルのグラウンディング、UI 復元、ピクセル差分など
dsh-image-gen
by shanliuling
DeepSeek Harness チャット内で直接画像生成
dsh-openpencil
by zseven-w
DeepSeek Harness と OpenPencil を接続し、会話内で .op ドキュメントをプレビュー・編集・検証
dsh-vision
by oil-oil
DeepSeek Harness 向けネイティブに近い画像理解
dsh-video-lens
by dundunhan
テキスト専用DSHエージェントにローカル動画理解をさせる2ツール。フレーム抽出+視覚キャプションとASR書起こし、プロバイダー設定可。
patentradar
by yuc16
特許侵害分析システム。特許公開番号を入力すると競合の侵害分析レポートを生成します。skill としてパッケージ化されており、Codex や Claude Code など任意のエージェントから呼び出し可能です。
dsh-vision-complete
by yts1919
Windows スキルパック:画像/OCR/物体検出/動画/音声/PDF(Qwen クラウド)、qwen-mm-plugins MCP 登録
dsh-imagegen
by dickpy
OpenAI 互換エンドポイント(gpt-image-2)による text-to-image / image-to-image
dsh-vision
by william-jin-cmu
view_image ツールでテキスト専用 DeepSeek を OpenAI 互換 VLM に橋渡し(OCR、チャート、UI レイアウト)
picturereader
by jing-hy
ピクセル→テキスト識図。image_scan/ocr/sample + 34 画像訓練スキル
dsh-comfyui
by fandc520
DeepSeek Harness 上で使える ComfyUI プラグイン。ComfyUI ワークフローを AI から操作できます。
dsh-media-skills
by mjorgin
無料ビジョンブリッジ+画像生成。GLM-4V-Flash/Gemini フェイルオーバー
deepseek-visionary
by xlight
DeepSeek 公式のマルチモーダル視覚モデルを DSH や Zed、Claude Code などのエージェントから利用できるようにするプラグイン
dsh-plugin-aigc-canvas
by huanlinoto
プロバイダー非依存の AIGC HTTP ブリッジ + 無限キャンバス + ffmpeg 後処理。キャンバス連結・reroll・メディア編集など 13 ツール
dsh-vision-proxy
by flyvhidbwo
添付画像を OpenAI 互換 VLM(既定は DashScope qwen)でテキスト化して DeepSeek へ渡す自動画像転写プラグイン。key なし時はローカル Ollama を自動検出
dsh-ocr-plugin
by crazy222123
ローカル OCR プロバイダー(RapidOCR + DeepSeek-OCR-2)。画像を API 送信前にテキスト化
dsh-vision-opencode
by poiuyjie
画像を任意 vision モデルでテキスト化し、テキスト専用 LLM のまま画像理解
dsh-visual-plugin
by jyh20030112
ユーザー画像を任意の OpenAI 互換視覚モデルへ転送し、結果を Web UI 右パネルに表示するテキスト専用モデル向け視覚プラグイン
dsh-vision
by linenxi-ctrl
DeepSeek Harness に外部画像認識モデルを追加:送信画像の自動認識と会話への回送、screenshot/recognize_image ツール注入、複数プロトコル自動適応
dsh-mermaid
by aks1st
DSH Web の会話内で Mermaid コードブロックを SVG 図としてレンダリング
dsh-chat-imagine
by corrinehu
DSH チャット内で API チャネルまたはローカル CLI(mmx / codex / agy 対応)を呼び出して画像を自動生成・表示
dsh-image2-draw
by junelearn
DeepSeek Harness Image2 画像生成プラグイン:サードパーティ OpenAI Images 互換 API 経由で gpt-image-2 を呼び出し。baseURL と API Key の設定のみ
dsh-mmx-bridge
by welsione
DeepSeek Harness 用 MiniMax マルチモーダルハブ。画像理解・動画生成・音声・音楽・Web 検索などを mmx-cli 経由の単一ツールに集約
image-vision
by wangyang10
vision_query ツール + /image-vision:OpenAI 互換 API で純テキストモデルに視覚
dsh-deepseek-vision
by siegfly
DeepSeek Harness 向けビジョン言語ゲートウェイ:画像を貼ると DeepSeek がテキストとして認識
dsh-free-vision
by fuzzysoul
luma-mcp 経由でテキスト専用モデルに画像理解を提供する vision ブリッジ。デフォルトで無料の Qwen3-VL-Flash を使用
dsh-modlens-installer
by jr-jr07
dsh + ModLens 視覚機能の一括インストールパッケージ。Windows EXE インストーラーと智谱 GLM-4V-Flash の無料視覚エンジンで画像認識を追加
