dsh-agnes-studio
编辑精选维护状态: 活跃zmm863-commits/dsh-agnes-studio
🎬 泡泡猫的影视工具 — AI 影视创作工作站:文生图、图生图、文生视频、图生视频、短剧剧本拆解与提示词专家。支持 Agnes / DeepSeek / Qwen / 豆包 / MiniMax / Ollama 六大厂商,全局浮层不堵对话框。
$ dsh plugin add dsh-agnes-studio2
星标
2
Fork
TypeScript
语言
2026-09-15
创建于
2026-09-21
最近推送
README
🎬 dsh-agnes-studio — 泡泡猫的影视工具
充分利用 Agnes AI 免费生图/视频大模型的 DSH 插件(内部名:Agnes 创意工作站)。
核心特性
- 🎨 文生图 — Image 2.5 Flash,支持 1K-4K 尺寸,免费
- 🖼 图生图 — 风格迁移、场景变换、多图合成
- 🎬 文生视频 — Video 2.5 Flash,4-12 秒,免费
- 📹 图生视频 — 首帧控制、多模态参考
- 📖 短剧流水线 — 剧本导入 → 分镜 → 逐镜头真实生成 → 自动合成成片(可烧中文字幕)
- 🎙 数字人口播 — 文稿自动分段 → TTS 配音 → 画面 → 字幕 → 成片
- 三种画面模式:静态形象图 / 视频素材 / AI 生成画面
- AI 模式支持逐段生成画面(每段台词配一段画面,更贴合内容)
- 🕸 无限画布 — 节点化编排(文本/图片/视频),缩放拖拽、连线传参考图、逐节点真实生成,自动保存
- 📕 小说封面 — 上传 TXT/DOCX 自动提取书名/作者/简介,一键生成 3:4 标准封面
- ✨ 提示词专家 — 中文想法一键扩写成专业中英文提示词
环境依赖
短剧合成与口播需要本机具备:
| 依赖 | 用途 | 缺失时 |
|---|---|---|
| ffmpeg + ffprobe | 视频拼接、字幕烧录、音画合成 | 面板顶部提示安装方法;可设 AGNES_FFMPEG 指定路径 |
| 中文字体 | 烧录中文字幕 | 明确报错(不会静默输出豆腐块);可设 AGNES_SUBTITLE_FONT |
| MIMO_API_KEY | 口播 TTS 配音 | 口播页提示配置(mimo-api-key 凭据或环境变量) |
安装 ffmpeg:
# Linux
apt-get install -y ffmpeg fonts-wqy-zenhei
# macOS
brew install ffmpeg && brew install --cask font-noto-sans-cjk-sc
# Windows: 安装 ffmpeg 加入 PATH(或设 AGNES_FFMPEG),系统自带微软雅黑即可
技术亮点
- 不堵对话框 — 使用
shell.overlay浮层,对话框完全可用 - API Key 安全 — 走 Host 端代理,浏览器不暴露 Key
- 真实可用性验证 — 生图/生视频/拼接/TTS/字幕全部有端到端实测脚本
- 字幕按真实像素排版 — 用 ASS +
PlayResY声明分辨率,字号/边距不受 libass 默认 288 行缩放影响 - 拼接自动归一化 — 镜头分辨率或帧率不一致时逐个归一化再拼,避免时间轴错乱
安装
cd /dsh/profiles/web
npm install /root/软件/dsh-agnes-studio
# 编辑 package.json 的 dsh.profile.bundles 添加 "dsh-agnes-studio"
# 编辑 package.json 的 dependencies 添加 "dsh-agnes-studio": "file:/root/软件/dsh-agnes-studio"
# 重启 DSH 容器
首次使用:获取 Agnes API Key
- 打开 https://platform.agnes-ai.cn 注册 / 登录(免费)
- 在控制台「API Keys」创建密钥,复制
sk-开头的那串 - 填到本机(任选一种):
- 在 DSH 设置 → 模型 → 凭据 中新增
agnes-api-key - 或在本机
/dsh/.env写入AGNES_API_KEY=sk-...
- 在 DSH 设置 → 模型 → 凭据 中新增
面板首屏会显示同样的指引;Key 只由宿主进程读取,浏览器不会接触。
使用
- 侧边栏点击「🎬 泡泡猫的影视工具」
- 生图 / 生视频:输入提示词,点击生成
- 短剧:剧本导入 → 生成分镜 → 「一键生成全部镜头」→「合成成片」(可选烧字幕)→ 下载
- 口播:切到「🎙 口播」→ 输入文稿 → 选形象图 → 开始生成 → 预览/下载
- 画布:切到「🕸 画布」→ 拖空白平移、滚轮缩放、节点右圆点拖到左圆点连线(图片节点连到视频节点即作为参考图)→ 节点上直接生成
- 封面:切到「📕 封面」→ 上传 TXT/DOCX 或手填书名 → 选风格 → 生成封面
- 关闭:标题栏 ✕、Esc,或再次点击侧边栏入口
⚠️ 改动了插件宿主半(
lib/index.js)后需重启 DSH 才生效;只改客户端刷新页面即可。 画布状态保存在浏览器 localStorage,无需后端。
更多「设计、媒体与视觉」插件
modlens
作者 liustack
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-only coding agent. Paste an image, get structured JSON evidence (OCR, layout, semantics). | 全网最强 DeepSeek Harness 外挂视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。
agent-vision-toolkit
作者 anionex
为纯文本模型"看图“设计更好的视觉工具箱和技能,支持多图理解,图片问答,前端UI还原、GUI 自动化等,并可选无缝接入多个主流agent,直接识别粘贴图片| A vision toolkit and skill designed for text-only llms — image Q&A, long-screenshot OCR, frontend UI restoration, and GUI automation, with optional seamless integration for Codex, Claude Code, Pi, Oh My Pi, and OpenCode
dsh-vision-router
作者 ysr666
为纯文本 DeepSeek Harness 智能体提供「视觉」能力,内置免密钥视觉链路与像素级视觉工具,一条命令安装,无需 Python。
dsh-vision-toolkit
作者 anionex
[dsh]为纯文本模型设计更强大的视觉工具箱:一行安装使用、粘贴图片直接识别、多张图片问答、截图到前端UI 还原等|DeepSeek Harness-native integration for agent-vision-toolkit: image Q&A, long-screenshot OCR, UI restoration, grounding, pixel diff, Artifacts, and Web UI.
