返回目录

browser4

维护状态: 活跃

platonai/browser4

面向自主智能体与大规模网页自动化的 AI 原生浏览器引擎,支持智能内容抽取。

前往 GitHub项目主页
$ npm install -g browser4-cli

1,112

星标

150

Fork

Kotlin

语言

Apache-2.0

许可证

2018-03-12

创建于

2026-08-27

最近推送

Apache-2.0、基于 Kotlin/Rust 的面向 AI agent 的浏览器自动化引擎——原生 CLI + MCP 后端、X-SQL 抽取、swarm 爬取,以及含 50+ 个工具的编程 agent 内核,并提供了明确的 DeepSeek Harness 接入方式。

DSH 适配

兼容

作者声明

安全审计

未审计

最后核验

2026-08-29

许可证

Apache-2.0

01它能帮你完成什么?

  • 在 DeepSeek Harness 中驱动真实浏览器,完成导航、点击、填写、快照与数据抓取

    实时页面快照、基于 X-SQL 的结构化数据、截图 / PDF,以及自主 agent 任务结果

    在 DeepSeek Harness 上构建浏览器自动化、网页抽取或大规模爬取流程的 AI agent 与开发者

  • 把下载好的 HTML 文件转成结构化电子表格与报告,且不消耗 LLM token

    由 WebMiner 机器学习聚类产出的交互式 HTML 报告与 Excel 电子表格

    需要低成本、大规模网页数据结构化能力的数据 / 分析团队

02如何接入 DeepSeek Harness?

前置条件

  • Node.js——npm 安装路径所需(`npm install -g browser4-cli`)

安装步骤

  1. 01

    $ npm install -g browser4-cli

  2. 02

    browser4-cli install

  3. 03

    $ curl -fsSL https://browser4.oss-cn-beijing.aliyuncs.com/scripts/install-browser4-cli.sh | bash(Linux / macOS)

  4. 04

    $ dsh plugin --profile web add dsh-browser4(在 DeepSeek Harness 内添加 Browser4 配套插件)

验证接入成功

作者未说明

03DSH 适配与能力边界

DSH 适配兼容

通过配套的 `dsh-browser4` 插件与 DeepSeek Harness 兼容整合——用 `dsh plugin --profile web add dsh-browser4` 添加

  • Agent 浏览器驱动

    通过 browser4-cli 传入的实时页面(snapshot 引用或 CSS 选择器)页面快照、点击 / 填写、截图、PDF 以及结构化 DOM 抽取

    会驱动真实的 Chrome / Chromium 浏览器会话会把截图 / PDF 与会话状态写入磁盘
  • 零 Token 的 HTML→表格抽取

    已下载的 HTML 文件 / 爬取得到的 HTML 目录由 WebMiner 机器学习聚类产出的结构化 Excel 表格与交互式 HTML 报告

    WebMiner 需要 JDK 17+(自动探测)聚类在本地运行,不消耗 LLM token
  • Swarm 爬取与批量自动化

    种子 URL 列表或种子文件并行爬取 / swarm 任务及 X-SQL 抽取结果

    会启动并行浏览器上下文 / 进程对爬取目标站点产生出网流量
  • 编程 Agent 内核(browser4-coding)

    构建 Browser4 制品或 Browser4 本身的 agent 任务50+ 个 `coding.*` 工具:沙箱 shell/fs、脚手架、校验、自我开发

    在沙箱中执行 shell 命令(命令白名单)会在磁盘上写入 / 校验文件

04适合谁?何时不该用?

适合

  • 在 DeepSeek Harness 上构建浏览器自动化、网页抽取或大规模爬取流程的 AI agent 与开发者
  • 需要低成本、大规模网页数据结构化能力的数据 / 分析团队

05兼容性、维护与安全提示

  • AI 驱动类命令(`extract`、`summarize`、`chat`、`agent run` 以及 X-SQL 的 `llm_*` 函数)需要配置 LLM 提供方密钥,例如 `DEEPSEEK_API_KEY`。
  • Browser4 的运行时下载 / 安装操作以及 crawl / swarm 任务需要联网;可通过 `PROXY_ROTATION_URL` 配置代理。
  • 零 Token 表格抽取的 WebMiner 需要 JDK 17+(自动探测)。
  • 从源码构建需要 JDK 25+(Eclipse Temurin)、Chrome/Chromium,以及 PowerShell 7(仅 Linux / macOS)。
2018-03-122026-08-27v4.13.11

Apache-2.0 · 活跃维护中(最新发布 v4.13.11,2026-08-25)

06常见问题

怎么把 Browser4 接到 DeepSeek Harness?

Browser4 提供了配套插件。按 README:运行 `dsh plugin --profile web add dsh-browser4`(npm registry)或 `dsh plugin --profile web add github:platonai/dsh-browser4`(GitHub)。你也可以直接安装 `browser4-cli` 再连到 DeepSeek Harness。

AI 类命令需要 API key 吗?

需要。`extract`、`summarize`、`chat`、`agent run` 以及 X-SQL 的 `llm_*` 函数都需要 LLM 提供方密钥——例如 `DEEPSEEK_API_KEY`。纯浏览器交互与基于存储 HTML 的 X-SQL 抽取则不需要密钥。

能否不花 LLM token 就抽取数据?

可以。用 `htmlsnapshot query --sql @query.sql` 做确定性 DOM 抽取,或用 `htmlsnapshot readability` 取正文——都无需 token。要把大量 HTML 转成表格时,`browser4-cli webminer` 会在本地用 WebMiner 机器学习聚类完成,零 LLM 成本(需 JDK 17+)。

怎么跑大规模爬取?

用 `crawl` 从 URL 或种子文件爬取,或用 `swarm create` + `swarm query --seed-file ...` 做并行执行。该引擎原生基于 CDP,可支撑单机每天 10 万–20 万次复杂页面访问(swarm/crawl 横向扩展)。

什么是编程 Agent 内核?

`browser4-coding` 内核提供 50+ 个 `coding.*` 工具(沙箱 shell/fs、脚手架、校验、自我开发),让 agent 既能构建 Browser4 制品,也能开发 Browser4 本身,且不依赖 agent 后端。

08数据与来源

  • 作者声明github.comfaeecd825364…

    https://github.com/platonai/dsh-browser4

  • 作者声明github.comfaeecd825364…

    dsh plugin --profile web add dsh-browser4

页面基于项目公开文档、仓库元数据和 DSH Plugins 的结构化解析生成;最后核验于 2026-08-29。发现错误?提交更正。

🏆

最佳 DeepSeek Harness 插件

从全目录挑出的 12 个值得优先安装的插件,覆盖各个分类。

DSH Plugins 是独立的 DeepSeek Harness 插件市场,与 DeepSeek 官方无关,也不代表官方背书。第三方插件未经安全审计,安装前请审查源码。

每周获取最新的 DeepSeek Harness 插件,绝不滥发。