Apache-2.0 の Kotlin/Rust 製ブラウザ自動化エンジン(AI agent 向け)。ネイティブ CLI + MCP バックエンド、X-SQL 抽出、swarm クロール、50+ のツールを持つプログラミング agent カーネルを備え、DeepSeek Harness への明確な統合経路を提供します。
DSH 統合
互換
作者による申告
安全性監査
未監査
最終検証日
2026-08-29
ライセンス
Apache-2.0
01どんなタスクに使えるのか?
DeepSeek Harness 内で実ブラウザを駆動し、ナビゲーション・クリック・入力・スナップショット・データ取得を行う
ライブページのスナップショット、X-SQL による構造化データ、スクリーンショット / PDF、および自律 agent タスクの結果
DeepSeek Harness 上でブラウザ自動化・Web 抽出・大規模クロールのフローを作る AI agent や開発者
ダウンロード済みの HTML ファイルを構造化スプレッドシートとレポートに変換し、LLM トークンを消費しない
WebMiner の ML クラスタリングが生成する対話型 HTML レポートと Excel スプレッドシート
低コストで大規模な Web データの構造化を必要とするデータ / 分析チーム
02DeepSeek Harness への導入方法
前提条件
- Node.js——npm インストール経路に必要(`npm install -g browser4-cli`)
インストール手順
- 01
$ npm install -g browser4-cli
- 02
browser4-cli install
- 03
$ curl -fsSL https://browser4.oss-cn-beijing.aliyuncs.com/scripts/install-browser4-cli.sh | bash(Linux / macOS)
- 04
$ dsh plugin --profile web add dsh-browser4(DeepSeek Harness 内に Browser4 付属プラグインを追加)
導入成功の確認
作者は未記載
03DSH 統合と能力の範囲
付属の `dsh-browser4` プラグイン経由で DeepSeek Harness と互換統合——`dsh plugin --profile web add dsh-browser4` で追加
Agent ブラウザ駆動
browser4-cli 経由で渡されるライブページ(snapshot リファレンスまたは CSS セレクタ)→ページスナップショット、クリック / 入力、スクリーンショット、PDF、および構造化 DOM 抽出
実際の Chrome / Chromium ブラウザセッションを駆動するスクリーンショット / PDF とセッション状態をディスクに書き出すゼロトークン HTML→スプレッドシート抽出
ダウンロード済み HTML ファイル / クロール取得した HTML ディレクトリ→WebMiner の ML クラスタリングが生成する構造化 Excel スプレッドシートと対話型 HTML レポート
WebMiner は JDK 17+ が必要(自動検出)クラスタリングはローカルで実行され LLM トークンを消費しないSwarm クロールとバッチ自動化
シード URL リストまたはシードファイル→並列クロール / swarm タスクと X-SQL 抽出結果
並列ブラウザコンテキスト / プロセスを起動するクロール対象サイトへのネットワーク送信を伴うプログラミング Agent カーネル(browser4-coding)
Browser4 アーティファクトや Browser4 自体を作る agent タスク→50+ の `coding.*` ツール:サンドボックス shell/fs、スキャフォールド、検証、自己開発
サンドボックス内で shell コマンドを実行する(コマンド許可リスト)ディスク上にファイルを書き込み / 検証する
04誰に向いているのか?使うべきでない場面は?
向いている用途
- DeepSeek Harness 上でブラウザ自動化・Web 抽出・大規模クロールのフローを作る AI agent や開発者
- 低コストで大規模な Web データの構造化を必要とするデータ / 分析チーム
05互換性・メンテナンス・セキュリティ上の注意
- AI 駆動のコマンド(`extract`、`summarize`、`chat`、`agent run`、および X-SQL の `llm_*` 関数)には LLM プロバイダーキー(例:`DEEPSEEK_API_KEY`)が必要です。
- Browser4 の実行環境のダウンロード / インストール操作や crawl / swarm タスクにはネットワーク接続が必要です。プロキシは `PROXY_ROTATION_URL` で設定できます。
- ゼロトークンでのスプレッドシート抽出を行う WebMiner には JDK 17+ が必要です(自動検出)。
- ソースからのビルドには JDK 25+(Eclipse Temurin)、Chrome/Chromium、および PowerShell 7(Linux / macOS のみ)が必要です。
Apache-2.0 · 活発にメンテナンス中(最新リリース v4.13.11、2026-08-25)
06よくある質問
Browser4 を DeepSeek Harness に接続するには?
Browser4 は付属プラグインを提供しています。README に従い、`dsh plugin --profile web add dsh-browser4`(npm registry)または `dsh plugin --profile web add github:platonai/dsh-browser4`(GitHub)を実行します。`browser4-cli` を直接インストールして DeepSeek Harness に向けることもできます。
AI 系コマンドに API キーは必要ですか?
必要です。`extract`、`summarize`、`chat`、`agent run`、および X-SQL の `llm_*` 関数には LLM プロバイダーキー(例:`DEEPSEEK_API_KEY`)が必要です。純ブラウザ操作や保存済み HTML に対する X-SQL 抽出にはキーは不要です。
LLM トークンを使わずにデータを抽出できますか?
できます。決定的な DOM 抽出には `htmlsnapshot query --sql @query.sql` を、記事本文には `htmlsnapshot readability` を使います(いずれもトークン不要)。大量の HTML をスプレッドシートにする場合、`browser4-cli webminer` は WebMiner の ML クラスタリングをローカルで実行し LLM コストはゼロです(JDK 17+ が必要)。
大規模なクロールはどう実行しますか?
URL またはシードファイルから `crawl` するか、`swarm create` + `swarm query --seed-file ...` で並列実行します。エンジンは CDP ネイティブで、swarm/crawl の横スケールによりマシンあたり一日 10 万〜20 万回の複雑なページ訪問を想定して設計されています。
プログラミング Agent カーネルとは?
`browser4-coding` カーネルは 50+ の `coding.*` ツール(サンドボックス shell/fs、スキャフォールド、検証、自己開発)を公開し、agent が Browser4 アーティファクトを作るだけでなく Browser4 自体を開発できるようにします。agent バックエンドに依存しません。
07関連する DSH ワークフロー
last30days-skill-cn
by jesseovo
中国インターネット 8 大プラットフォームの直近 30 日コンテンツを自動検索・統合分析し、根拠付きレポートを生成する AI Agent スキル
dsh-browser
by lum1104
DSH が現在の Chrome タブを読み取り・クリック・入力・スクロール・ナビゲート(テキスト優先、ログイン状態を保持)
anysearch-dsh
by anysearch-team
DeepSeek Harness 向け AnySearch Web 検索プロバイダーと高度検索ツール
modsearch
by liustack
Web/X 検索・取得ブリッジ:テキスト専用 coding agent 向けに構造化 JSON 証拠(search/fetch/citations)を提供
08データと出典
https://github.com/platonai/dsh-browser4
dsh plugin --profile web add dsh-browser4
このページは、プロジェクトの公開ドキュメント、リポジトリのメタデータ、および DSH Plugins の構造化解析に基づいて生成されています。最終検証日:2026-08-29。誤りを見つけた場合は、修正を送信してください。
dsh プラグイン おすすめ
最初に入れたい 12 のプラグイン。全カタログ・全カテゴリから厳選しました。
