I am speed

I am speed像测网速一样测 LLM API 吞吐量

I am speed 是一款面向开发者的 LLM API 测速工具,以 fast.com 式极简体验实时测出模型吞吐量。选择供应商与模型即可查看流式输出,对比不同大模型的速度与稳定性,帮你快速完成选型。

free
LLM API测速大模型性能测试吞吐量测试AI基准测试开发者工具流式输出模型对比AI工具
收录日期
更新日期
3.2 (0 评价数量)

登录后可为项目评分

做过大模型应用的人,大概率都有过这种经历:选供应商和模型型号,靠的是看官方文档、翻评测帖,或者干脆自己写脚本压测。写脚本本身不算难,但要处理流式响应、统计首字延迟和每秒 tokens,还挺麻烦。I am speed 就是冲着这个痛点来的。

这个工具把 LLM API 测速做成了像 fast.com 测网速一样的事:打开网页,选一个供应商和模型,画面里立刻开始流式输出文本,旁边实时跳动吞吐量数字。不需要配 API key,不需要写代码,整个过程和测带宽几乎没有区别。

一个页面完成模型对比

工具的核心界面极简:左边选 provider,右边选 model,点一下 Start 就开始生成。真正有用的是那些实时指标,除了最直观的 tokens/s,它还显示首字延迟、总耗时等数据。首字延迟对聊天机器人这类交互式应用尤其关键,用户等多久看到第一个字,往往比最终速度更影响体验。

  • 实时流式输出,边生成边测,避免「假死」误判
  • 实时吞吐量指标,包含速度、延迟、耗时等维度
  • 快速切换供应商和模型,方便做横向对比

这种设计天然适合拿来横向对比。想比较两个主流模型在某个任务的输出速度,以前要分别调 API、写两遍统计代码,现在打开两个标签页各跑一次就行。对比结果虽然粗糙,但足够筛掉明显慢的选项。

对谁最有用

独立开发者小团队来说,这个工具最大的价值是省掉前期调研时间。不用在每个平台注册账号、开通 API、再安装 SDK,就能快速感知哪家快、哪家慢,对选型决策有直接帮助。以前要花一晚上的事情,现在五分钟就能得到初步结论。

当然,也要强调一句:

测速结果会受到网络环境、服务端负载和模型本身复杂度的影响,单次测速只能当参考,不能当绝对结论。
想做严肃评测,还是得用正式 API 配合多轮测试,才能排除偶然因素。

一点实话

I am speed 目前还比较轻量,功能上不像专业压测工具那么全面。它不做并发测试,也不记录历史趋势,无法回答「高峰期会不会变慢」这类问题。但这些缺失不影响它作为日常「摸高」工具的价值。快速验一下,心里有个数,很多场景下就够了。

大模型 API 的生态还在快速变化,这类轻量测速工具大概率会越来越多。I am speed 先做出来,而且把体验做得足够简单,已经赢在了起跑线上。对于还在犹豫用哪家模型的开发者,它值得花一分钟试试。

优缺点

优点

  • 无需注册,打开网页即可测速
  • 实时流式输出与吞吐量指标
  • 多模型横向对比非常方便
  • 界面极简,上手零成本

缺点

  • 不支持并发测试与历史趋势
  • 无法自定义 API 或私有模型
  • 测速结果易受网络波动影响

常见问题

I am speed 需要注册或 API key 吗?

不需要。它是一个纯网页工具,打开页面直接选择供应商和模型就能开始测速,省掉了注册和配置环节,非常适合快速体验。

I am speed 的测速结果准确吗?

测速结果受网络环境、服务器负载影响较大,更适合作为相对参考。如果要严谨地评估模型性能,建议多次测试并配合正式 API 跑一轮完整压测。

支持哪些模型供应商?

官方暂未公布完整列表,通常会覆盖当前主流的几个大模型 API,具体以页面上的下拉选项为准。随着生态环境变化,列表应该会持续更新。

可以自定义 API 地址或私有模型吗?

目前不支持。工具采用固定选择模式,只能从页面上列出的供应商和模型里选,需要测私有部署模型的用户可能不太适用。

探索更多

相似工具

Fikra API

Fikra API

Fikra API 为非洲开发者提供 OpenAI 兼容的 AI 模型接口, 支持 M-Pesa 支付, 最低 $1 起, 每美元约 200 万 tokens, 无需国际信用卡或 VPN, 一行代码即可切换。

VoiceDraw

VoiceDraw 是一款面向系统设计与架构评审的 AI 工具,能把自然语言对话实时转化为可视化架构图,自动捕捉组件、关系、决策、假设与风险。适合系统设计面试演练、架构评审和技术团队快速对齐思路,省去手动画图的繁琐。

Edgee Turbo Models

Edgee Turbo Models

Edgee Turbo Models 将 GLM 5.1、Kimi K2.7 Code、MiniMax M2.7 等开源模型接入 Claude Code,实现最高 200 tok/s 的生成速度,统一订阅价为 $29/月。无需改动代码,几分钟即可完成配置,为追求速度和开源的开发者提供新选择。

SignalOps API

SignalOps API

SignalOps API 是面向开发者的信任与安全接口,整合文本/图像审核、欺诈检测、IP 洞察、邮箱验证与风险评分,适用于社交应用、电商平台和 AI 产品的自动化安全流程。

VibeLayer

VibeLayer 是一个开源的本地优先状态层,专为 TypeScript 应用设计,尤其适合 AI 编码代理生成的代码。它提供即时本地数据源、命名变更、持久化变更队列和后端适配器边界,让 UI 不再每个组件都发起 fetch(),实现离线路支持和更流畅的交互体验。

OpenAnimus

OpenAnimus

OpenAnimus 是一个本地优先的 AI 驾驶舱,帮助开发者将目标和仓库上下文转化为代理工作、证据和 QA,专注于软件维护。项目公开构建,每日直播,适合追求透明和可控的开发团队。

开源项目

guidellm: 评估和优化 LLM 部署性能

guidellm 是一个开源工具,专为评估和优化大语言模型(LLM)在生产环境中的推理性能而设计。它支持压力测试、延迟分析、吞吐量评估等,帮助开发者识别瓶颈并调整部署配置。基于 vLLM 团队开发,适合需要精细化调优 LLM 服务的团队。

Kun: 将 AI Agent 工作区嵌入你的应用

Kun 是一个开源的 AI Agent 工作空间,内置代码与写作模式,可无缝集成到你的应用程序中。基于 TypeScript 开发,为开发者提供可定制的智能交互环境,支持多轮对话、工具调用和上下文管理。

ai-gateway: 统一管理生成式 AI 服务的访问网关

ai-gateway 是基于 Envoy Gateway 构建的开源项目,提供统一的 API 网关来管理对多种生成式 AI 服务的访问,支持负载均衡、缓存、限流等功能,简化 AI 应用的集成和运维。

go-micro: 为 AI 智能体打造的 Go 微服务框架

go-micro 是一个用 Go 语言编写的微服务框架,专门为构建 AI 智能体而设计。它提供服务发现、负载均衡、消息编码、事件驱动等核心能力,让开发者能快速搭建可扩展的分布式 AI 系统。GitHub 星标超 2.2 万,社区活跃,适合 Go 语言开发者入门微服务和 AI agent 架构。

terax-ai: 7MB终端优先AI开发工作台

terax-ai 是一个轻量级(仅7MB)的终端优先AI原生开发工作台,专为命令行爱好者设计。它集成了AI辅助能力,提供极快的启动速度和极小的资源占用,让开发者在熟悉的终端环境中高效编码、调试和实验。开源且易于安装,适合追求简洁与效率的开发者。

jar-analyzer: JAR包GUI分析工具内置AI助手

Jar Analyzer 是一个开源的 JAR 包 GUI 分析工具,内置 AI 助手辅助分析,支持 JAR DIFF、方法调用关系搜索、DFS 调用链分析、污点分析、CFG 程序分析、JVM 栈帧分析等功能,适合 Java 开发者、安全研究人员进行代码审计和逆向分析。