ccglass

ccglassAI 编码代理的本地流量监控器

ccglass 是一款专为 AI 编码代理设计的本地流量监控工具,可实时查看 Claude Code、Codex、OpenCode 等工具的提示、工具架构、消息历史、token 用量、缓存命中、成本及流式响应,帮助开发者优化效率与成本。

free
AI 编码代理本地流量监控Claude CodeCodexOpenCodeDeepSeek-TUIKimitoken 监控开源工具开发效率
收录日期
更新日期
4.1 (0 评价数量)

登录后可为项目评分

如果你经常使用 AI 编码助手,比如 Claude CodeCodex 或者 OpenCode,大概率会遇到一个痛点:你根本不知道 AI 在后台到底干了什么。它发了多少请求?用了多少 token?哪些是缓存命中的?流式响应里到底说了什么?ccglass 就是来解决这个问题的。

它能看到什么?

ccglass 本质上是一个本地流量拦截器,运行在你的开发机上,抓取 AI 编码代理与后端 API 之间的所有通信。具体来说,它会展示:

  • 精确的 prompt:AI 收到的指令原文
  • 工具架构(tool schemas):AI 使用的函数/工具定义
  • 消息历史:完整的对话上下文
  • Token 用量缓存命中每次调用的成本,以及流式响应的逐字输出

这些信息以结构化视图呈现,方便你对照排查。比如你发现 AI 突然开始胡言乱语,一查消息历史就能定位到是哪一步的上下文污染。

支持哪些代理?

目前 ccglass 已经兼容 Claude CodeCodex CLIOpenCodeDeepSeek-TUIKimi 等主流工具。只要这些工具通过标准 HTTP/HTTPS 协议与 API 通信,ccglass 就能劫持流量。

安装也很简单——一条 npm 命令即可。启动后它会自动生成防篡改的测试摘要,方便分享或存档。对于团队协作场景,还能减少重复“嗯?”的困惑时间。

典型使用场景

假设你正在用 Claude Code 重构一个模块,结果它花了 2 分钟才给出答案,而且结果还不理想。打开 ccglass 一看,发现 token 消耗异常高,原来是因为缓存未命中,每次都在重复发送相同的上下文。这时你可以调整策略,让 AI 复用之前的结果。

另一个常见场景是调试工具调用。AI 有时候会调用错误的工具、或者传参异常,在 ccglass 里你可以逐条查看工具调用的输入输出,比翻终端日志快得多。

实际影响与价值

独立开发者小团队而言,ccglass 提供了一个低成本的方式来理解 AI 编码代理的“黑盒”行为。过去你可能只能通过估算或第三方的费用统计来推断成本,现在可以精确到每次调用。这直接影响了两个决策:

  • 选型:对比不同代理的真实 token 消耗和响应速度
  • 优化:调整 prompt 策略来减少冗余请求

当然,ccglass 目前还不支持 HTTPS 解密(需要手动信任证书),对某些非标准端口的代理支持也有限。但鉴于它完全开源且免费,这点门槛完全可以接受。

实用建议

如果你是重度 AI 编码用户,建议装上 ccglass 跑一两天,积累一些基线数据。你会发现:

  • 很多表面上的“慢”其实是网络延迟,而非模型推理
  • 很多 token 花在了重复的系统提示上
  • 缓存策略的差异可以极大影响成本

一句话总结:ccglass 把 AI 编码的黑箱变成了玻璃箱,值得一试。

优缺点

优点

  • 免费开源,轻量级
  • 支持主流 AI 编码代理
  • 精确展示 prompt、token 成本、缓存命中
  • 流式响应逐字回放
  • 便于调试工具调用

缺点

  • HTTPS 解密需要手动配置证书
  • 界面功能较基础,无高级过滤
  • 不支持非标准端口代理
  • 文档示例较少,新手可能需要摸索

常见问题

ccglass 需要安装什么?

需要 Node.js 环境,通过 npm 全局安装即可。安装后会自动拦截本地 HTTP/HTTPS 流量。

ccglass 会影响 AI 编码代理的性能吗?

几乎不影响。它只做被动监听和记录,不会修改请求或增加延迟。

ccglass 支持哪些代理?

支持 Claude Code、Codex CLI、OpenCode、DeepSeek-TUI、Kimi 等主流工具,只要它们使用标准 HTTP 协议与 API 通信。

ccglass 能抓取 HTTPS 流量吗?

需要手动安装并信任 ccglass 生成的根证书,之后即可解密 HTTPS 流量。

ccglass 的数据会发送到云端吗?

不。所有数据仅在本地存储和处理,没有云同步功能,保证隐私安全。

探索更多

相似工具

Airouter

Airouter

Airouter 是印度首个统一 AI 路由器,专为本地开发者设计。通过单一 API 访问 GPT-4、Claude、Gemini 等顶级模型,采用按实际使用量付费的模式,支持 UPI 支付,彻底告别国际信用卡拒付和强制订阅。

Nextbit

Nextbit

Nextbit 提供基于欧洲裸金属 GPU 集群的 AI 推理 API,通过 KV-cache 管理、prefill/decode 分离等优化,实现低成本、低延迟、完全合规的模型部署。适合对数据主权有严格要求的应用场景。

Aladeen

Aladeen 是一款本地运行、只读的 AI 编码代理日志分析工具,能自动识别会话中的重复失败模式,帮助开发者快速定位卡点。支持 Claude Code、Codex、Gemini、opencode 等工具,100% 本地处理,无遥测。

Palace Memory

Palace Memory

Palace Memory 为 AI 编码代理提供持久、可搜索的记忆,通过 MCP 协议集成 Cursor、Claude Code、Codex 等工具,让代理记住架构、约定和修复,避免每次会话重新解释。免费、本地运行、开源(MIT 核心),支持团队共享。

Tychi AI

Tychi 是专为 AI Agent 设计的自主托管钱包,提供人类可交互的 REPL 界面。私钥本地存储,签名不离开机器,策略限制在每次链上操作前执行。支持多钱包、gassless 路由,并与 Cursor、Claude 等集成。

Stride

Stride

Stride 是一个覆盖规划、设计、验证、发布全流程的 AI 原生工作空间。它直接接入真实项目数据,并通过 MCP 协议与 Claude Code、Codex 协同,真正执行任务而非空谈。团队无需切换工具即可从想法直达发布,大幅提升构建效率。

开源项目

guidellm: 评估和优化 LLM 部署性能

guidellm 是一个开源工具,专为评估和优化大语言模型(LLM)在生产环境中的推理性能而设计。它支持压力测试、延迟分析、吞吐量评估等,帮助开发者识别瓶颈并调整部署配置。基于 vLLM 团队开发,适合需要精细化调优 LLM 服务的团队。

Kun: 将 AI Agent 工作区嵌入你的应用

Kun 是一个开源的 AI Agent 工作空间,内置代码与写作模式,可无缝集成到你的应用程序中。基于 TypeScript 开发,为开发者提供可定制的智能交互环境,支持多轮对话、工具调用和上下文管理。

terax-ai: 7MB终端优先AI开发工作台

terax-ai 是一个轻量级(仅7MB)的终端优先AI原生开发工作台,专为命令行爱好者设计。它集成了AI辅助能力,提供极快的启动速度和极小的资源占用,让开发者在熟悉的终端环境中高效编码、调试和实验。开源且易于安装,适合追求简洁与效率的开发者。

ai-gateway: 统一管理生成式 AI 服务的访问网关

ai-gateway 是基于 Envoy Gateway 构建的开源项目,提供统一的 API 网关来管理对多种生成式 AI 服务的访问,支持负载均衡、缓存、限流等功能,简化 AI 应用的集成和运维。

go-micro: 为 AI 智能体打造的 Go 微服务框架

go-micro 是一个用 Go 语言编写的微服务框架,专门为构建 AI 智能体而设计。它提供服务发现、负载均衡、消息编码、事件驱动等核心能力,让开发者能快速搭建可扩展的分布式 AI 系统。GitHub 星标超 2.2 万,社区活跃,适合 Go 语言开发者入门微服务和 AI agent 架构。

Kiln: 一站式 AI 系统评估与优化平台

Kiln 是一个开源 Python 工具,帮助开发者系统化地构建、评估和优化 AI 系统。它集成了 evals、RAG、智能体、微调、合成数据生成、数据集管理和 MCP 协议支持,让 AI 开发工作流更高效、更可控。适合需要深度调优 AI 性能的团队和个人。