Edgee Turbo Models

Edgee Turbo ModelsClaude Code 加速路由

Edgee Turbo Models 為 Claude Code 使用者提供加速路由,把開源程式模型的推理速度提升到官網所稱約 200 tokens/秒,請求前先對 token 做壓縮,以每月定額計費,並內建工作階段與團隊層級的用量儀表。

paid
Claude Code開源程式模型加速推理Token 壓縮開發者工具MCP訂閱制
收錄日期
更新日期
3.6 (0 評價數量)

登錄后可為項目評分

產品定位

Edgee Turbo Models 是一層付費路由,位於 Claude Code 與一組開源程式碼模型之間。使用者不再直連標準端點,而是把 Claude Code 指向 Turbo,由 Turbo 依加速推理路徑轉發請求,同一批模型的輸出可顯著加快。官方明確表示:Turbo 只改變傳送速度,不改變模型本身的輸出內容。

速度與壓縮

  • 吞吐:官網稱最高約 200 tokens/秒,約為標準端點的 4 倍。
  • Token 壓縮:提示詞在送達模型前先經過壓縮,以降低整體用量。
  • 模型範圍:面向前沿的開源程式碼模型,實際清單以官網為準。

導入、觀測與價格

導入方式是一條指令,毋須更換 SDK。觀測介面同時呈現工作階段與團隊層級的 token 用量,方便多人共用同一份額度而不失去可視性。價格採每月定額,官網標示 29 美元/月,不因用量而變動。產品可與 Claude Code 內的 MCP 工具並用。價格與模型清單以官網為準。

優缺點

優點

  • 提升 Claude Code 回應速度
  • 每月定額計價,與用量無關
  • 內建工作階段與團隊用量觀測
  • 可與既有 MCP 工具並用
  • 毋須改動程式碼或 SDK

缺點

  • 效益取決於 Claude Code 使用強度
  • 在編輯器與模型之間新增一層依賴
  • 模型清單可能隨時間調整

常見問題

Edgee Turbo 主要解決什麼?

透過加速路由,讓 Claude Code 呼叫開源程式碼模型時更快回應。

速度有多快?

官網宣稱最高約 200 tokens/秒,約為標準端點的 4 倍。

如何收費?

官網說明為每月固定 29 美元。

是否需要修改程式碼或 SDK?

不需要,導入方式是一條指令,毋須更換 SDK。

查看 Edgee Turbo Models 的替代品
對比同類工具,找到更合適的選擇

探索更多

相似工具

Nadir

Nadir

Nadir 是一款驗證器門控的 LLM 路由器:先用便宜模型回答,再由校準驗證器打分,質量不足才升級。官方稱可省 60% 成本、保持 98% 質量,OpenAI 相容、兩行接入,適合請求量大但複雜度不均的團隊。

StackBuilder

StackBuilder

StackBuilder 是一款免費的 AI 雲架構圖生成工具,用自然語言描述系統即可自動生成 AWS、Azure、GCP、Kubernetes 等架構圖,支援匯出 PNG、SVG、PDF,無需註冊,適合系統設計面試、架構文件和演示場景。

Nest by RAVEN

Nest by RAVEN

Nest by RAVEN(官網品牌名 NestMux)是一款面向開發者的多 AI 終端工作臺,可在同一視窗並行執行 Claude、Gemini、Codex、Copilot 和 Aider,支援 Git worktrees、團隊終端共享、MCP 面板與廣播提示。本地優先、無遙測,免費開放下載,支援 macOS、Windows、Linux。

h5i

h5i

h5i是一款面向Claude Code、Codex等AI編碼代理的開源沙箱工具,將代理、Shell、依賴與瀏覽器放進同一個隔離邊界,輕量沙箱啟動不到200毫秒,支援匯出可審閱補丁與執行日誌,本地優先、無SaaS、單Rust二進位制。

Deep Work Plan

Deep Work Plan

Deep Work Plan 是一套開源方法論, 通過 init.md 將任何倉庫改造成 AI 代理可執行的結構化環境: 原子任務、驗收標準、校驗門和可恢復狀態, 讓長週期編碼任務不跑偏。支援任意代理, 無鎖定, MIT 開源。

Spanly

Spanly

Spanly 是一款面向 MCP 伺服器的可觀測性與監控工具,幫助 SaaS 團隊在生產環境中追蹤錯誤率、會話軌跡、延遲與客戶端行為。支援 CLI/SDK 快速接入,可與現有監控棧共存,並提供美歐資料駐留選項。官方提供免費掃描,可快速定位協議層隱患。

開源專案

guidellm: 評估與優化LLM推理性能的開源工具

guidellm 是由 vLLM 團隊開發的開源工具,用於評估和優化大型語言模型(LLM)在生產環境中的推理性能。它提供壓力測試、延遲分析和吞吐量評估,幫助開發者識別瓶頸並調整部署配置。項目主要使用 Python 編寫,採用 Apache-2.0 許可證,在採集時擁有 1214 個星標。

ai-gateway: 基於 Envoy Gateway 的統一 AI 網關

ai-gateway 是一個基於 Envoy Gateway 的開源項目,提供統一的 API 網關來管理對多種生成式 AI 服務的訪問。它簡化了 AI 應用的集成與運維,支持負載均衡、緩存和速率限制等功能。項目使用 Go 語言開發,採用 Apache-2.0 許可證。

go-micro:融合AI與微服務的Go框架

go-micro是一個開源的Go程式語言框架,它融合了AI代理工具集與微服務架構,並支持MCP、A2A協議以及多LLM集成。該項目採用Apache-2.0許可證,主要使用Go語言開發。截至採集時,該項目在GitHub上獲得22755顆星。

Kun: 本地優先的 AI 代理工作區

Kun 是一個本地優先的 AI 代理工作區,通過共享 GUI 和 TUI 運行時統一編碼、寫作、設計、研究和自動化。項目主要使用 TypeScript 開發,許可證為 Other。截至採集時擁有 4813 個 GitHub 星標。

terax-ai: 輕量級Tauri桌面開發環境

terax-ai 是一個基於 Tauri 的桌面開發環境,體積僅 7-8 MB。它集成了 GPU 終端、CodeMirror 編輯器、Git 工具和多提供商 AI 代理,為開發者提供一體化的開發體驗。項目主要使用 TypeScript 編寫,採用 Apache-2.0 許可證。

jar-analyzer: Java JAR包分析GUI工具,集成AI助手

jar-analyzer 是一款開源的 Java JAR 包分析 GUI 工具,集成了 AI 助手。它提供 JAR DIFF、方法調用圖探索、DFS 調用鏈分析、汙點分析以及控制流圖程序分析等強大功能,適用於 Java 開發者和安全研究員,簡化代碼審計與逆向工程任務。項目主要語言為 Java,採用 GPL-3.0 許可證,在採集時擁有 2111 個星標。