查看 Agent、Coding 和 Reasoning 模型跑分, 对比服务商单价、免费额度与模型覆盖, 测量 API 延迟、吞吐和耗时,并 检测模型真实性、Prompt 与错误泄漏风险。
从模型跑分查询开始,再对比按 token 价格、五轮测速、健康检查和安全探针,判断一个 API 能不能进项目。
在首页直接搜索模型名,进入模型目录和详情页,查看 AA 综合、编程、数学跑分和模型元信息。
对比 100+ 家服务商的按 token 计费价格,找到每个模型更便宜的 API,并追踪免费额度与免费套餐。
用标准提示词做五轮连续测速,测量首字延迟、输出吞吐量和每轮响应耗时。
检测任意 OpenAI 兼容 API 的模型真实性、隐藏 Prompt、指令篡改、流式完整性和错误泄漏,并生成可分享的人话报告。
输入 Base URL、API Key 与模型 ID,即可测试官方、代理、中转或自部署端点。
查看首字延迟、输出吞吐量、总耗时、健康度与近期探测信号,判断性能是否稳定。
了解模型跑分、价格对比、测速和 API 安全检测如何使用。
可以直接使用首页的模型搜索框,也可以打开「模型跑分榜」。输入模型名称后进入模型目录或详情页,查看 AA 综合、编程、数学等跑分,并结合模型元信息继续筛选。
LMSpeed 汇集了 100+ 家 API 服务商的按 token 计费价格。访问任意模型页面即可查看各服务商的输入输出价格对比表,快速找到每个模型最便宜的服务商。
许多服务商为 DeepSeek、Gemini、Llama 等热门模型提供免费 API 额度或免费套餐。查看我们的免费大模型 API 汇总页面,获取完整的免费模型列表及各服务商的速度基准数据。
LMSpeed 采用五轮连续压力测试机制和标准化提示词。通过 tiktoken 进行精确的 token 计算,测量输出吞吐量(tok/s)和首字延迟。
它会对 OpenAI 兼容端点发送多轮安全探针,检查模型身份是否匹配、是否注入隐藏 system prompt、是否改写用户指令、流式响应是否完整、错误信息是否泄漏敏感实现;完成后生成风险分和可分享报告。API Key 只用于本次检测,不会写入公开报告。
使用我们的性能排行榜和模型详情页,直观对比各服务商的 API 速度基准。系统按吞吐量、延迟和健康度排名,帮您找到最快最稳定的 API。
Provider 详情页和健康排行榜已经展示近期健康检查、探测延迟、成功/失败状态和稳定性排行。更完整的持续监控与告警能力会继续扩展。
聚合 LMSpeed 最新收录模型与高分模型,聚焦 Artificial Analysis 的综合、编程和数学跑分。
| 模型 | 上下文 | 输入价 | 输出价 | 服务商 | Agents | 编程 | 推理 | 知识 | 数学 | 多语言 | 多模态 | 指令遵循 | 吞吐 | 延迟 | 发布日期 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5Anthropic最新 | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +79 | 65.9±8.2 | 68.4±6.6 | 60.5±8.7 | 67.4±14.0P | — | 64.3±17.1P | 57.6±17.3P | — | 吞吐 320 t/s | 延迟 4.96s | 发布日期2026-07-24 |
| Claude Fable 5Anthropic | 上下文1M | 输入价$10.00/M | 输出价$50.00/M | 服务商 +117 | 64.6±8.2 | 67.3±6.9 | 60.8±10.8E | 59.6±14.0P | — | — | 46.4±17.3P | 50.4±16.0P | 吞吐 56 t/s | 延迟 3.67s | 发布日期2026-06-09 |
| Grok 4.6SpaceXAI最新 | 上下文500K | 输入价$2.00/M | 输出价$6.00/M | 服务商 +4 | 62.3±8.6 | 60.5±12.0E | 59.9±10.8E | 59.8±16.0P | — | — | — | — | 吞吐 97 t/s | 延迟 10.46s | 发布日期2026-08-12 |
| Kimi K3MoonshotAI最新 | 上下文1.0M | 输入价$3.00/M | 输出价$15.00/M | 服务商 +74 | 68±7.3 | 57.7±12.0E | 59.6±10.8E | 61.6±14.0P | — | — | 66.6±11.3E | — | 吞吐 169 t/s | 延迟 68.29s | 发布日期2026-07-16 |
| Qwen3.8 MaxQwen最新 | 上下文1M | 输入价$2.00/M | 输出价$6.00/M | 服务商 +14 | 66.5±10.9E | 66.1±11.2E | 64.7±10.1E | 52.7±14.0P | — | — | 65.5±6.3 | 57.8±16.0P | 吞吐 93 t/s | 延迟 3.28s | 发布日期2026-08-03 |
| Qwen3.8 2.4T A95BQwen最新 | 上下文1.0M | 输入价$2.00/M | 输出价$6.00/M | 服务商— | — | 60.4±16.0P | 62.7±13.9P | — | — | — | — | — | 吞吐 — | 延迟 — | 发布日期2026-08-12 |
| GPT-5.6 SolOpenAI | 上下文1.1M | 输入价$5.00/M | 输出价$30.00/M | 服务商 +131 | 67.2±7.3 | 62.4±9.3E | 61.3±8.7 | 57.2±16.7P | 67±16.1P | — | 59.6±16.1P | 53.5±16.0P | 吞吐 57 t/s | 延迟 3.65s | 发布日期2026-07-09 |
| Claude Opus 4.8Anthropic | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +151 | 62.9±5.5 | 65.6±6.6 | 56.6±8.7 | 64.1±14.0P | 58±16.1P | 55±17.1P | 61±12.0E | 50±16.0P | 吞吐 232 t/s | 延迟 2.21s | 发布日期2026-05-27 |
| Muse Spark 1.2Meta最新 | 上下文1.0M | 输入价$1.25/M | 输出价$4.25/M | 服务商 | 56.9±9.4E | 57.2±12.0E | 61.5±10.8E | 55.8±14.0P | — | — | — | — | 吞吐 — | 延迟 — | 发布日期2026-08-05 |
| GPT-5.5OpenAI | 上下文1.1M | 输入价$5.00/M | 输出价$30.00/M | 服务商 +146 | 62±5.1 | 59.8±8.7 | 59.3±8.7 | 59.9±14.0P | 56.9±16.1P | — | 55.8±16.1P | 54.7±16.0P | 吞吐 46 t/s | 延迟 4.95s | 发布日期2026-04-24 |
| Gemini 3.7 FlashGoogle最新 | 上下文1.0M | 输入价$0.750/M | 输出价$3.75/M | 服务商 | 63.6±14.1P | 61.7±16.0P | 59.5±13.9P | — | — | — | 59.5±16.1P | — | 吞吐 — | 延迟 — | 发布日期2026-08-13 |
| Grok 4.5SpaceXAI | 上下文500K | 输入价$2.00/M | 输出价$6.00/M | 服务商 +102 | 61.8±11.3E | 59.8±6.9 | 54.5±8.7 | 58.1±14.0P | — | — | — | — | 吞吐 60 t/s | 延迟 9.70s | 发布日期2026-07-08 |
| Claude Sonnet 5Anthropic | 上下文1M | 输入价$2.00/M | 输出价$10.00/M | 服务商 +107 | 64.8±12.2P | 59.8±6.6 | 56.5±10.8E | 61.4±14.0P | — | — | 58.8±16.1P | — | 吞吐 — | 延迟 — | 发布日期2026-06-30 |
| Claude Opus 4.7Anthropic | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +195 | 54.6±6.9 | 60.1±11.2E | 56.1±10.8E | 54.6±14.0P | 56.8±16.1P | — | — | 44.5±16.0P | 吞吐 47 t/s | 延迟 4.89s | 发布日期2026-05-12 |
| Muse Spark 1.1Meta最新 | 上下文1.0M | 输入价$1.25/M | 输出价$4.25/M | 服务商 | 63.1±7.4 | 59.3±9.3E | 59.6±10.2E | 65.9±14.0P | — | — | 58.9±16.1P | — | 吞吐 — | 延迟 — | 发布日期2026-07-16 |
| GLM-5.2Z.ai | 上下文1.0M | 输入价$1.40/M | 输出价$4.40/M | 服务商 +140 | 59.9±7.2 | 54.1±8.9 | 54.7±10.8E | 58.3±14.0P | 70.1±11.5E | — | — | 53.7±16.0P | 吞吐 91 t/s | 延迟 8.31s | 发布日期2026-06-16 |
对比各 API 服务商的价格、速度基准与性能数据。
统一的API网关,提供对多种大语言模型的访问,支持国内直连。
健康状态
100%
测试次数
145
最近检查
Aug 14
API 价格
暂无健康检测
智谱 AI 提供 GLM 系列大语言模型,包括 GLM-4、ChatGLM 和 CodeGeeX,支持文本、代码和多模态任务。
健康状态
100%
测试次数
405
最近检查
Aug 14
API 价格
暂无健康检测
NVIDIA NIM 通过 NVIDIA 云基础设施提供优化的 AI 模型推理 API,支持大语言模型、视觉和向量模型。
健康状态
100%
测试次数
1,247
最近检查
Aug 14
API 价格
暂无健康检测
OpenCode 是一个开源的 AI 编码助手,支持在终端、IDE 和桌面应用中集成,兼容多种模型和提供商。
健康状态
100%
测试次数
345
最近检查
Aug 14
API 价格
暂无健康检测
速创 API 通过统一接口提供文本生成、图像创作、视频生成等多种 AI 模型访问。
健康状态
100%
测试次数
45
最近检查
Aug 14
API 价格
暂无健康检测
Ollama 提供了一个平台,用于在本地或云端运行和集成开源 AI 模型。
健康状态
100%
测试次数
135
最近检查
Aug 14
API 价格
暂无健康检测
DeepSeek 提供其最新大语言模型的 API 访问,用于文本生成和编程任务。
健康状态
100%
测试次数
755
最近检查
Aug 14
API 价格
暂无健康检测
专为组织打造的 AI 网关。
健康状态
100%
测试次数
54
最近检查
Aug 14
API 价格
暂无健康检测
VSLLM 是基于 New API 搭建的 AI 网关,在 vsllm.com 通过单一端点聚合多种模型访问。
健康状态
100%
测试次数
155
最近检查
Aug 14
API 价格
暂无健康检测
iTokens 是兼容 OpenAI 接口的 AI API 网关,按量提供 DeepSeek、GLM、Kimi、Qwen、MiniMax、KwaiKAT 等模型访问,公开各模型的 token 价格,并为新用户提供促销积分。
火山引擎方舟平台是字节跳动旗下的企业级 AI 平台,提供豆包系列模型及第三方大语言模型的 API 服务,兼容 OpenAI API 格式。
健康状态
100%
测试次数
379
最近检查
Aug 14
API 价格
暂无健康检测
只展示最近 7 天内端点画像、模型真实性、Prompt 安全与响应完整性全部拿到 100 分的中转站检测报告。