返回目錄

dsh-vision-opencode

編輯精選維護狀態: 活躍

poiuyjie/dsh-vision-opencode

通過任意視覺模型把圖片自動轉成文本,純文本模型無需切換即可看圖

前往 GitHub
$ dsh plugin add dsh-vision-opencode

安裝

dsh 沒有統一的安裝指令 —— 把該外掛 README(見下方)中的設定行加入你的 profile / patch 設定,然後重啟即可。

查看安裝教學

13

星數

1

Fork

JavaScript

語言

MIT

授權條款

2026-08-13

建立於

2026-08-22

最近推送

README

dsh-vision-opencode

中文English

DeepSeek 不认图?OpenCode 多模态平替方案:给纯文本主模型加一个可配置的识图模型

dsh-vision-opencode 演示

它能做什么

  • 聊天里发图 → 先交给视觉模型(如 MiMo-V2.5)转成文字,主模型照常回复,不用换模型
  • 输入框右侧「识图模型」下拉,自动列出所有供应商中支持图片的模型
  • 设置 → Vision 独立管理模型;vision_read_image 工具 / vision-image-analysis skill 支持 OCR、图表、截图理解
  • 异常兜底:单次 60s 超时、失败重试 1 次、重试耗尽降级为占位文本,不拖垮回合

安装

方式一(DSH 原生,推荐):

dsh plugin --profile web add -w github:poiuyjie/dsh-vision-opencode

方式二:一键脚本(Ubuntu install.sh / Windows install.ps1):

curl -fsSL https://raw.githubusercontent.com/poiuyjie/dsh-vision-opencode/main/scripts/install.sh | bash

装完重启 dsh,在输入框右侧选择识图模型。

卸载:dsh plugin --profile web remove -w dsh-vision-opencode(或 uninstall.sh)。

卸载前先备份包含图片的会话——卸载后这些旧会话可能无法再发给纯文本主模型。

配置

编辑 ~/.dsh/settings.yaml(也可用设置 → Vision 图形化管理):

vision-opencode:
  provider: ''       # 识图模型供应商;空 = 未选择
  model: ''          # 识图模型 id;空 = 未选择
  autoConvert: true  # 发图自动转换开关;出问题可改 false 关掉

插件自动识别纯文本主模型并接管图片;原生多模态模型保留 DSH 原生链路,无需改模型目录。

渠道状态圆点

设置 → Vision 的渠道(提供方分组)名称旁有状态圆点,与官方「模型」页同款:

  • 🟢 已配置 API 密钥(宿主路由的 apiKeyEnv 或插件写入的 <PROVIDER>_API_KEY 任一可用即绿)
  • 🔴 明确未配置密钥
  • 不显示 = 状态未知(凭据服务不可用等)

识图模型的推理关闭

设置 → Vision 里每个模型有一行「推理」策略:

选项 含义
默认 跟随供应商默认档位,正常思考
关闭 不思考,更快更省;仅当供应商真实声明 off 时提供(如 hy3 off:"none"
强制关闭 尽力关掉思考(如 reasoning_effort:"none"),不保证成功;MiMo 这类未声明 off 的只能选这个

有「关闭」档的模型很少,没有时界面显示「默认 / 强制关闭」并标注「不保证成功」。关掉思考一般能明显降低首 token 延迟和花费(MiMo 实测 reasoning_effort:"none" 可真正关掉)。

推理关闭设置

⚠️ 各供应商对「关闭思考」的声明很混乱(off:"none" / off:null / 无字段各不相同),插件只能尽力按厂商目录区分「关闭」与「强制关闭」并试参数,不保证每个供应商都能真正关掉

常见问题

  • 只想关掉自动转换(保留工具和选择器):vision-opencode.autoConvert: false 后重启
  • 图片转换异常/选择器不出现:多半是识图模型未选或版本差异,看浏览器控制台报错发 issue
  • 纯文本与多模态主模型自动区分,切换供应商无需再改配置

开发规范

  • 每次推送必须打 taggit push 前先创建对应版本的 tag 并推送(如 git tag v0.4.0 && git push origin v0.4.0),保证远端每次更新都有可追溯的版本标记。

License

MIT

更多「設計、媒體與視覺」外掛

modlens

作者 liustack

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-only coding agent. Paste an image, get structured JSON evidence (OCR, layout, semantics). | 全網最強 DeepSeek Harness 外掛視覺外掛,為 DeepSeek、GLM 等純文本模型外掛視覺能力,貼上圖片即得結構化 JSON 證據(OCR、版面、語義)。

精選設計、媒體與視覺TypeScript
3,755110

agent-vision-toolkit

作者 anionex

為純文本模型"看圖“設計更好的視覺工具箱和技能,支援多圖理解,圖片問答,前端UI還原、GUI 自動化等,並可選無縫接入多個主流agent,直接識別貼上圖片| A vision toolkit and skill designed for text-only llms — image Q&A, long-screenshot OCR, frontend UI restoration, and GUI automation, with optional seamless integration for Codex, Claude Code, Pi, Oh My Pi, and OpenCode

設計、媒體與視覺Python
1,11838

dsh-vision-router

作者 ysr666

為純文本 DeepSeek Harness 智慧體提供「視覺」能力,內建免金鑰視覺鏈路與畫素級視覺工具,一條命令安裝,無需 Python。

精選設計、媒體與視覺JavaScript
1,02144

dsh-vision-toolkit

作者 anionex

[dsh]為純文本模型設計更強大的視覺工具箱:一行安裝使用、貼上圖片直接識別、多張圖片問答、截圖到前端UI 還原等|DeepSeek Harness-native integration for agent-vision-toolkit: image Q&A, long-screenshot OCR, UI restoration, grounding, pixel diff, Artifacts, and Web UI.

精選設計、媒體與視覺TypeScript
83937

DSH Plugins 是獨立的 DeepSeek Harness 外掛市集,與 DeepSeek 官方無關,也不代表官方背書。第三方外掛未經安全稽核,安裝前請審查原始碼。

每週取得最新的 DeepSeek Harness 外掛,絕不濫發。