ThinkWatch Lite#
ThinkWatch Lite 是运行本地 AI API 网关的桌面应用,常驻 macOS 菜单栏、Windows 通知区域或 Linux 系统托盘。它托管 ThinkWatch Core,并展示其配置、流量与费用。
Claude Code、Codex CLI 等使用 Anthropic、OpenAI、Gemini API 的客户端把请求发给这个网关,Lite 展示每个请求的费用、由哪个上游处理及其原因,以及随请求发出的内容。
支持 macOS 12 及以上版本的 Apple Silicon 机型、Windows 10 21H2 及以上版本的 x64 与 ARM64 机型,以及 x86_64 与 aarch64 机型的 Linux,可通过 Homebrew、磁盘映像、Windows 安装程序或 AppImage 安装,并由应用自动更新。
用量与费用#
按任意时间范围统计 token、费用与请求数,按模型分层,并给出缓存命中率、缓存带来的净节省与各模型的延迟分位。
实测费用、估算费用与无法计价的请求分别列出,从不相加;订阅制上游的用量单独统计,不计入费用。每个请求都注明计价所用的价目表及其数据日期——基于不同日期价目表算出的数字不可直接比较。
路由与故障转移#
路由规则按模型、密钥、token 数、工具、图片等条件,把请求交给某个上游或策略组。每个请求都记录命中的规则、经过的策略组,以及每一次尝试的状态与耗时。
试算按给定的请求条件逐条匹配规则,说明请求会交给哪个上游、哪些规则未命中及其原因。它不发出请求,也不产生费用。
上游#
支持 API 密钥、在应用内登录的 ChatGPT 账号(显示订阅额度与重置时间)、OpenRouter 等中转服务,以及本机模型。
客户端与上游的 API 格式不同时,请求在 Anthropic Messages、OpenAI Chat Completions、OpenAI Responses 与 Gemini 之间自动转换,无法转换的字段会逐一列出。上游可以经出站代理访问,也可以按自定义价目表计价。
安全#
- 出站脱敏:请求发往不受信任的上游之前,替换其中的密钥、私钥与连接串,并在响应中还原。
- 工具调用审查:上游返回的工具调用中出现可直接获得执行权限的命令时,在流中切断。
- 配置面扫描:检查客户端配置文件(skill、hook、MCP server)中的隐藏字符、注入内容与危险命令。
三项防护各有「关闭 / 观察 / 拦截」三档,出厂均为「观察」。「发现」页汇总扫描结果,并对比各上游最近 24 小时与此前 30 天的行为。
请求体与响应体在上屏之前即已遮蔽,界面上不会出现密钥原文。
客户端接管#
Claude Code、Codex CLI、opencode、Zed 与 Aider 可以在应用内一键指向网关。写入前先显示改动差异并完整备份原文件,只修改端点与密钥两个字段,随时可以还原。Cursor、Continue 与 Gemini CLI 提供逐步的手动配置说明。
菜单栏与系统通知#
菜单栏常驻显示今日费用与输出速率;使用订阅账号时改为显示额度用量与重置倒计时。由于菜单栏放不下两行文字,这一块以位图形式渲染。
Windows 上图标位于通知区域:悬停显示网关状态与今日 token、费用;左键打开主界面,右键打开同一份菜单,其中的额度条改为文字。系统通知为 Windows 原生通知。
Linux 上图标位于系统托盘:点击打开同一份菜单,第一项为「打开主界面」,额度条同样改为文字。系统通知通过桌面环境的通知服务发送。
网关停止转发、上游无法连接、订阅额度用完、凭据失效等情况会发送提醒。提醒方式由一项设置统一决定:系统通知、仅在应用内显示或关闭。
界面语言#
界面提供简体中文与英文,默认跟随系统语言,也可以在设置中另选。
与 ThinkWatch Core 的关系#
网关本体在 ThinkWatch Core 中实现。Lite 不包含路由、转发或计费逻辑,在 macOS 与 Linux 上通过 unix socket、在 Windows 上通过回环端口与 Core 通信,两者都带一个每次启动生成的凭据。参见架构。
许可证#
ThinkWatch Lite 采用 MIT 许可证。