I am speed

I am speed像測網速一樣測 LLM API 吞吐量

I am speed 是一款面向開發者的 LLM API 測速工具,以 fast.com 式極簡體驗實時測出模型吞吐量。選擇供應商與模型即可檢視流式輸出,對比不同大模型的速度與穩定性,幫你快速完成選型。

free
LLM API測速大模型效能測試吞吐量測試AI基準測試開發者工具流式輸出模型對比AI工具
收錄日期
更新日期
3.2 (0 評價數量)

登錄后可為項目評分

做過大模型應用的人,大概率都有過這種經歷:選供應商和模型型號,靠的是看官方文件、翻評測帖,或者乾脆自己寫指令碼壓測。寫指令碼本身不算難,但要處理流式響應、統計首字延遲和每秒 tokens,還挺麻煩。I am speed 就是衝著這個痛點來的。

這個工具把 LLM API 測速做成了像 fast.com 測網速一樣的事:開啟網頁,選一個供應商和模型,畫面裡立刻開始流式輸出文字,旁邊實時跳動吞吐量數字。不需要配 API key,不需要寫程式碼,整個過程和測頻寬幾乎沒有區別。

一個頁面完成模型對比

工具的核心介面極簡:左邊選 provider,右邊選 model,點一下 Start 就開始生成。真正有用的是那些實時指標,除了最直觀的 tokens/s,它還顯示首字延遲、總耗時等資料。首字延遲對聊天機器人這類互動式應用尤其關鍵,使用者等多久看到第一個字,往往比最終速度更影響體驗。

  • 實時流式輸出,邊生成邊測,避免「假死」誤判
  • 實時吞吐量指標,包含速度、延遲、耗時等維度
  • 快速切換供應商和模型,方便做橫向對比

這種設計天然適合拿來橫向對比。想比較兩個主流模型在某個任務的輸出速度,以前要分別調 API、寫兩遍統計程式碼,現在開啟兩個標籤頁各跑一次就行。對比結果雖然粗糙,但足夠篩掉明顯慢的選項。

對誰最有用

獨立開發者小團隊來說,這個工具最大的價值是省掉前期調研時間。不用在每個平臺註冊賬號、開通 API、再安裝 SDK,就能快速感知哪家快、哪家慢,對選型決策有直接幫助。以前要花一晚上的事情,現在五分鐘就能得到初步結論。

當然,也要強調一句:

測速結果會受到網路環境、服務端負載和模型本身複雜度的影響,單次測速只能當參考,不能當絕對結論。
想做嚴肅評測,還是得用正式 API 配合多輪測試,才能排除偶然因素。

一點實話

I am speed 目前還比較輕量,功能上不像專業壓測工具那麼全面。它不做併發測試,也不記錄歷史趨勢,無法回答「高峰期會不會變慢」這類問題。但這些缺失不影響它作為日常「摸高」工具的價值。快速驗一下,心裡有個數,很多場景下就夠了。

大模型 API 的生態還在快速變化,這類輕量測速工具大概率會越來越多。I am speed 先做出來,而且把體驗做得足夠簡單,已經贏在了起跑線上。對於還在猶豫用哪家模型的開發者,它值得花一分鐘試試。

優缺點

優點

  • 無需註冊,開啟網頁即可測速
  • 實時流式輸出與吞吐量指標
  • 多模型橫向對比非常方便
  • 介面極簡,上手零成本

缺點

  • 不支援併發測試與歷史趨勢
  • 無法自定義 API 或私有模型
  • 測速結果易受網路波動影響

常見問題

I am speed 需要註冊或 API key 嗎?

不需要。它是一個純網頁工具,開啟頁面直接選擇供應商和模型就能開始測速,省掉了註冊和配置環節,非常適合快速體驗。

I am speed 的測速結果準確嗎?

測速結果受網路環境、伺服器負載影響較大,更適合作為相對參考。如果要嚴謹地評估模型效能,建議多次測試並配合正式 API 跑一輪完整壓測。

支援哪些模型供應商?

官方暫未公佈完整列表,通常會覆蓋當前主流的幾個大模型 API,具體以頁面上的下拉選項為準。隨著生態環境變化,列表應該會持續更新。

可以自定義 API 地址或私有模型嗎?

目前不支援。工具採用固定選擇模式,只能從頁面上列出的供應商和模型裡選,需要測私有部署模型的使用者可能不太適用。

探索更多

相似工具

Fikra API

Fikra API

Fikra API 為非洲開發者提供 OpenAI 相容的 AI 模型介面, 支援 M-Pesa 支付, 最低 $1 起, 每美元約 200 萬 tokens, 無需國際信用卡或 VPN, 一行程式碼即可切換。

VoiceDraw

VoiceDraw 是一款面向系統設計與架構評審的 AI 工具,能把自然語言對話實時轉化為視覺化架構圖,自動捕捉元件、關係、決策、假設與風險。適合系統設計面試演練、架構評審和技術團隊快速對齊思路,省去手動畫圖的繁瑣。

Edgee Turbo Models

Edgee Turbo Models

Edgee Turbo Models 將 GLM 5.1、Kimi K2.7 Code、MiniMax M2.7 等開源模型接入 Claude Code,實現最高 200 tok/s 的生成速度,統一訂閱價為 $29/月。無需改動程式碼,幾分鐘即可完成配置,為追求速度和開源的開發者提供新選擇。

SignalOps API

SignalOps API

SignalOps API 是面向開發者的信任與安全介面,整合文字/影象稽覈、欺詐檢測、IP 洞察、郵箱驗證與風險評分,適用於社交應用、電商平臺和 AI 產品的自動化安全流程。

VibeLayer

VibeLayer 是一個開源的本地優先狀態層,專為 TypeScript 應用設計,尤其適合 AI 編碼代理生成的程式碼。它提供即時本地資料來源、命名變更、持久化變更佇列和後端介面卡邊界,讓 UI 不再每個元件都發起 fetch(),實現離線路支援和更流暢的互動體驗。

OpenAnimus

OpenAnimus

OpenAnimus 是一個本地優先的 AI 駕駛艙,幫助開發者將目標和倉庫上下文轉化為代理工作、證據和 QA,專注於軟體維護。專案公開構建,每日直播,適合追求透明和可控的開發團隊。

開源專案

guidellm: 評估和優化 LLM 部署效能

guidellm 是一個開源工具,專為評估和優化大語言模型(LLM)在生產環境中的推理效能而設計。它支援壓力測試、延遲分析、吞吐量評估等,幫助開發者識別瓶頸並調整部署配置。基於 vLLM 團隊開發,適合需要精細化調優 LLM 服務的團隊。

Kun: 將 AI Agent 工作區嵌入你的應用

Kun 是一個開源的 AI Agent 工作空間,內建程式碼與寫作模式,可無縫整合到你的應用程序中。基於 TypeScript 開發,為開發者提供可定製的智慧互動環境,支援多輪對話、工具呼叫和上下文管理。

ai-gateway: 統一管理生成式 AI 服務的訪問閘道器

ai-gateway 是基於 Envoy Gateway 構建的開源專案,提供統一的 API 閘道器來管理對多種生成式 AI 服務的訪問,支援負載均衡、快取、限流等功能,簡化 AI 應用的整合和運維。

go-micro: 為 AI 智慧體打造的 Go 微服務框架

go-micro 是一個用 Go 語言編寫的微服務框架,專門為構建 AI 智慧體而設計。它提供服務發現、負載均衡、訊息編碼、事件驅動等核心能力,讓開發者能快速搭建可擴充套件的分散式 AI 系統。GitHub 星標超 2.2 萬,社羣活躍,適合 Go 語言開發者入門微服務和 AI agent 架構。

terax-ai: 7MB終端優先AI開發工作臺

terax-ai 是一個輕量級(僅7MB)的終端優先AI原生開發工作臺,專為命令列愛好者設計。它整合了AI輔助能力,提供極快的啟動速度和極小的資源佔用,讓開發者在熟悉的終端環境中高效編碼、除錯和實驗。開源且易於安裝,適合追求簡潔與效率的開發者。

jar-analyzer: JAR包GUI分析工具內建AI助手

Jar Analyzer 是一個開源的 JAR 包 GUI 分析工具,內建 AI 助手輔助分析,支援 JAR DIFF、方法呼叫關係搜尋、DFS 呼叫鏈分析、汙點分析、CFG 程序分析、JVM 棧幀分析等功能,適合 Java 開發者、安全研究人員進行程式碼審計和逆向分析。