返回目录

tokenbank

维护状态: 活跃

wink-run/tokenbank

本地 LLM 网关,位于智能体与各提供方之间,智能路由到 Ollama、Groq 等降低成本,支持 P2P 共享闲置额度。

前往 GitHub项目主页
$ git clone https://github.com/wink-run/tokenbank.git

103

星标

17

Fork

JavaScript

语言

Apache-2.0

许可证

2026-05-09

创建于

2026-09-26

最近推送

Apache-2.0 开源的本地 LLM 网关:一键接入多个 AI agent、全链路 token 追踪、本地优先的智能路由与社区 P2P 分享,并提供 OpenAI 兼容端点(localhost:11430)。README 未提及 DeepSeek Harness,dsh 需通过 OpenAI 兼容端点接入。

DSH 适配

生态相关

作者声明

安全审计

未审计

最后核验

2026-08-27

许可证

Apache-2.0

01它能帮你完成什么?

  • 让 AI 用量每一笔 token 都有账可查、知道钱花在哪里

    全链路追踪(实时代理 + 会话导入自动去重)、按 app / provider / model / device / time 切片的多设备用量分析、订阅与 PAYG 并排对比

    同时使用多个 AI agent(Claude Code、Cursor、Codex、WorkBuddy 等)、希望在一个本地视图里掌握 token 消耗与成本的开发者

  • 让 agent 无感切换到更便宜或本地的模型,客户端不用改任何东西

    模型原名不变、协议自动转换(Anthropic Messages / OpenAI Chat / Codex Responses)、每个 app 独立绑定路由、一键 Revert 恢复官方配置

    想用本地优先路由与免费配额(Groq、GitHub Models)降低成本、同时保留熟悉客户端的 AI agent 用户

  • 把闲置算力与 API 配额变成社区 P2P 网络上的 credits

    按公式 credits = (output_tokens / 1000) × contribute_rate × quality_multiplier (0.5–1.5) 赚取 credits,可用来消费共享模型或租用远程 agent

    拥有闲置本地算力或未用上游配额、希望将其变现的用户(README 提醒需遵守上游服务条款)

02如何接入 DeepSeek Harness?

前置条件

  • 一个运行 Token Bank 的方式——macOS / Windows 桌面应用、Node.js CLI(Linux / 服务器)或 Docker
  • 本地网关监听 11430 端口接收 LLM 请求、11431 端口提供 Web 管理界面

安装步骤

  1. 01

    桌面应用(推荐):从 Releases 下载安装器——macOS `.dmg` 或 Windows `.exe`——打开应用后在 **Config** 里输入 backend URL 与 relay API key

  2. 02

    CLI 模式(Linux / 服务器):`git clone https://github.com/wink-run/tokenbank.git`、`cd tokenbank/client`、`npm install`,然后 `node cli/gateway.js start`

    $ git clone https://github.com/wink-run/tokenbank.git

  3. 03

    Docker:`git clone https://github.com/wink-run/tokenbank.git`、`cd tokenbank`,然后 `docker compose up gateway -d`

    $ git clone https://github.com/wink-run/tokenbank.git

  4. 04

    在 **Gateway** 页创建一个本地 API key(或用现有上游 key),然后把任意 OpenAI 兼容 client 指向 `OPENAI_BASE_URL=http://localhost:11430/v1`

验证接入成功

  • 运行 README 中的 quick curl test 验证本地网关:`curl http://localhost:11430/v1/chat/completions -H "Authorization: Bearer your-local-key" -H "Content-Type: application/json" -d '{"model":"gpt-4o","messages":[{"role":"user","content":"Hello"}],"stream":true}'`

回滚

  • 在 Gateway 页对已追踪的 app 点击 **Revert**——README 说明这会恢复官方配置并停止追踪

03DSH 适配与能力边界

DSH 适配生态相关

作为 OpenAI 兼容的本地网关——任何 OpenAI 兼容 client 都可以通过 `OPENAI_BASE_URL=http://localhost:11430/v1` 接入;README 未描述 DeepSeek Harness 专属集成

  • 一键 agent 接入

    已安装的 agent——Claude Code / Codex CLI / OpenCode / Hermes / Kimi Code,Claude Desktop / Codex Desktop / OpenClaw / WorkBuddy,Cursor / Copilot / Qwen / Grok→CLI shim 或 config-file patch 把每个 app 指向本地网关,支持 Track / Revert 两种状态

    CLI shim 注入 BASE_URL(及相关)环境变量;config-file patch 会改写配置(Revert 可恢复)
  • 智能本地优先路由

    每个 app 可绑定独立路由,或走全局 supply chain;本地源 + 社区共享源→链路:本地 Ollama → 免费 API(Groq / GitHub Models)→ 订阅 / PAYG → 社区共享 → 策略组(fallback / round-robin / weighted / latency / direct)

    Egress guards 会把出站 max_tokens 钳制到上游上限
  • 会话追踪与可观测性

    经 localhost:11430 的实时代理流量 + 本地会话日志(~/.claude、~/.codex、WorkBuddy Trace 等)→按 app · provider · model · supply type · device · time 切片的 Dashboard;每次请求的调用日志含路由结果与延迟

    自动去重:网关与会话文件同时记录的同一次调用只计一次
  • 网关无损压缩

    包含 pretty-printed JSON 的消息(工具结果、内嵌数据)→压缩后的 JSON——上游输入 token 更少、语义不变;Dashboard 显示压缩次数、节省 token 与比例

    非 JSON 内容逐字节保持不变
  • 社区共享与远程 agent

    闲置算力:本地 Ollama、未用上游配额、私有 LAN 模型(出站 WebSocket——无需入站端口)→赚取 credits 并消费社区共享模型;租用社区 agent,任务在其设备上运行

    上游 API key 永不离机远程 agent 无需下载源码——任务在其设备上运行
  • OpenAI 兼容端点

    任意 OpenAI 兼容 client 或工具→统一的本地地址 OPENAI_BASE_URL=http://localhost:11430/v1;CLI shim 可为已接入的 agent 自动注入 ANTHROPIC_BASE_URL / OPENAI_BASE_URL

04适合谁?何时不该用?

适合

  • 同时使用多个 AI agent(Claude Code、Cursor、Codex、WorkBuddy 等)、希望在一个本地视图里掌握 token 消耗与成本的开发者
  • 想用本地优先路由与免费配额(Groq、GitHub Models)降低成本、同时保留熟悉客户端的 AI agent 用户
  • 拥有闲置本地算力或未用上游配额、希望将其变现的用户(README 提醒需遵守上游服务条款)

不适合

  • README 完全没有提到 DeepSeek Harness 或官方 dsh CLI。唯一通用的接入路径是 OpenAI 兼容端点(`OPENAI_BASE_URL=http://localhost:11430/v1`);你的 dsh 能否使用取决于它是否支持 OpenAI 协议。

05兼容性、维护与安全提示

  • README 完全没有提到 DeepSeek Harness 或官方 dsh CLI。唯一通用的接入路径是 OpenAI 兼容端点(`OPENAI_BASE_URL=http://localhost:11430/v1`);你的 dsh 能否使用取决于它是否支持 OpenAI 协议。
  • 桌面应用安装器仅提供 macOS(`.dmg`)与 Windows(`.exe`);Linux / 服务器需要 CLI 模式(`git clone` + `npm install` + `node cli/gateway.js start`)或 Docker。
  • 项目仅用于教育研究目的;使用者需自行遵守适用法律法规与上游服务条款(包括分享配额或算力)。
2026-05-092026-08-26v0.5.17

Apache-2.0 · 活跃维护中(最新发布 v0.5.17,2026-08-26)

06常见问题

DeepSeek Harness 怎么接入 Token Bank?

README 未提及 DeepSeek Harness(dsh)专属集成。Token Bank 提供 OpenAI 兼容端点 `OPENAI_BASE_URL=http://localhost:11430/v1`,README 称它可接入任何 OpenAI 兼容 client,如果你的 harness 支持 OpenAI 协议即可通过该端点接入。

支持哪些 AI 工具的一键接入?

Claude Code / Codex CLI / OpenCode / Hermes / Kimi Code 通过 CLI shim(环境变量注入);Claude Desktop / Codex Desktop / OpenClaw / WorkBuddy 通过配置文件补丁;Trae Work 通过会话导入;Cursor / Copilot / Qwen / Grok 通过会话统计或设置 `OPENAI_BASE_URL`。

Token Bank 有哪几种安装方式?

桌面应用(macOS `.dmg`、Windows `.exe`)从 Releases 下载,打开后在 Config 填入 backend URL 与 relay key;Linux / 服务器可用 CLI 模式(`git clone` → `npm install` → `node cli/gateway.js start`);也可用 Docker(`docker compose up gateway -d`)。

它怎么帮我省 token 费用?

智能路由优先本地 Ollama,其次是免费 API(Groq / GitHub Models),再到订阅 / PAYG,社区共享作为兜底;可选无损压缩(`TOKENBANK_COMPRESS=1`)减少上游输入 token。每个 app 还能绑定独立路由。

它会改动我的 agent 配置吗?可以还原吗?

会。CLI shim 会注入 `BASE_URL` 环境变量、config-file patch 会改写配置;但 Gateway 页提供 **Track** / **Revert**,点击 Revert 即可恢复官方配置并停止追踪。

08数据与来源

  • 作者声明github.comae678ec7b643…

    Connecting any OpenAI-compatible client

  • 作者声明github.comae678ec7b643…

    OPENAI_BASE_URL=http://localhost:11430/v1

页面基于项目公开文档、仓库元数据和 DSH Plugins 的结构化解析生成;最后核验于 2026-08-27。发现错误?提交更正。

🏆

最佳 DeepSeek Harness 插件

从全目录挑出的 12 个值得优先安装的插件,覆盖各个分类。

DSH Plugins 是独立的 DeepSeek Harness 插件市场,与 DeepSeek 官方无关,也不代表官方背书。第三方插件未经安全审计,安装前请审查源码。

每周获取最新的 DeepSeek Harness 插件,绝不滥发。