Изучайте оценки моделей по Agent, Coding и Reasoning, сравнивайте тарифы, бесплатные лимиты и покрытие моделей, измеряйте задержку, throughput и время API и выявляйте риски подмены модели, prompt и утечек ошибок.
Начните с поиска оценок модели, затем сравните цены за токен, пятираундовые тесты скорости, health checks и safety probes до запуска API в production.
Ищите модель с главной страницы и переходите к бенчмаркам с AA score, кодингом, математикой и метаданными модели.
Сравнивайте цены за токен у 100+ провайдеров, находите более дешевые API для каждой модели и отслеживайте бесплатные лимиты.
Запускайте пятираундовый тест со стандартизированными prompt, чтобы измерить задержку первого токена, throughput и время ответа.
Проверяйте OpenAI-совместимые API на подлинность модели, скрытые prompt, подмену инструкций, целостность stream и утечки ошибок.
Введите base URL, API key и model ID, чтобы тестировать официальные, proxy, relay или self-hosted endpoint.
Оценивайте задержку первого токена, скорость вывода, общую длительность, health и свежие сигналы проверок.
Как LMSpeed работает с бенчмарками моделей, ценами провайдеров, тестами скорости и аудитом API.
Используйте поиск моделей на главной странице или откройте рейтинг Model Performance. Поиск по названию модели ведет в каталог и на страницу модели, где LMSpeed связывает AA score, кодинг и математику с метаданными модели.
LMSpeed агрегирует цены за token от 100+ API-провайдеров. Откройте страницу любой модели, чтобы увидеть таблицу сравнения цен input и output за миллион token и найти самого дешевого провайдера для каждой модели.
Многие провайдеры предлагают бесплатные тарифы или кредиты для популярных моделей, таких как DeepSeek, Gemini и Llama. Смотрите наш каталог бесплатных LLM API со списком моделей с бесплатным доступом и бенчмарками скорости для каждого провайдера.
LMSpeed использует пятираундовый стресс-тест со стандартизированными prompt. Подсчет token выполняется через tiktoken с измерением пропускной способности (token в секунду) и задержки первого token.
Он отправляет несколько safety probe на OpenAI-совместимый endpoint, чтобы проверить соответствие модели, скрытые system prompt, переписывание пользовательских инструкций, целостность streaming-ответов и утечки чувствительных деталей в ошибках. Результат включает оценку риска и отчет, которым можно поделиться. API key используется только для аудита и не попадает в публичные отчеты.
Используйте наши рейтинги производительности и страницы моделей, чтобы визуально сравнить бенчмарки скорости API у провайдеров. Система ранжирует провайдеров по throughput, задержке и health, помогая выбрать самый быстрый и надежный API.
Страницы провайдеров и рейтинг health уже показывают недавние health check, задержку probe, статус успеха или ошибки и рейтинг стабильности. Более широкий непрерывный мониторинг и алерты будут расширяться дальше.
Живой срез новых моделей и лидеров бенчмарков с фокусом на оценки Artificial Analysis по общему интеллекту, кодингу и математике.
| Модель | Контекст | Ввод | Вывод | Провайдеры | Агенты | Кодинг | Рассуждения | Знания | Математика | Мультиязычность | Мультимодальность | Следование инструкциям | Пропускная способность | Задержка | Дата выпуска |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5AnthropicNEW | Контекст1M | Ввод$5.00/M | Вывод$25.00/M | Провайдеры +79 | 65.9±8.2 | 68.4±6.6 | 60.5±8.7 | 67.4±14.0P | — | 64.3±17.1P | 57.6±17.3P | — | Пропускная способность 320 t/s | Задержка 4.96с | Дата выпуска2026-07-24 |
| Claude Fable 5Anthropic | Контекст1M | Ввод$10.00/M | Вывод$50.00/M | Провайдеры +117 | 64.6±8.2 | 67.3±6.9 | 60.8±10.8E | 59.6±14.0P | — | — | 46.4±17.3P | 50.4±16.0P | Пропускная способность 56 t/s | Задержка 3.67с | Дата выпуска2026-06-09 |
| Grok 4.6SpaceXAINEW | Контекст500K | Ввод$2.00/M | Вывод$6.00/M | Провайдеры +4 | 62.3±8.6 | 60.5±12.0E | 59.9±10.8E | 59.8±16.0P | — | — | — | — | Пропускная способность 97 t/s | Задержка 10.46с | Дата выпуска2026-08-12 |
| Kimi K3MoonshotAINEW | Контекст1.0M | Ввод$3.00/M | Вывод$15.00/M | Провайдеры +74 | 68±7.3 | 57.7±12.0E | 59.6±10.8E | 61.6±14.0P | — | — | 66.6±11.3E | — | Пропускная способность 169 t/s | Задержка 68.29с | Дата выпуска2026-07-16 |
| Qwen3.8 MaxQwenNEW | Контекст1M | Ввод$2.00/M | Вывод$6.00/M | Провайдеры +14 | 66.5±10.9E | 66.1±11.2E | 64.7±10.1E | 52.7±14.0P | — | — | 65.5±6.3 | 57.8±16.0P | Пропускная способность 93 t/s | Задержка 3.28с | Дата выпуска2026-08-03 |
| Qwen3.8 2.4T A95BQwenNEW | Контекст1.0M | Ввод$2.00/M | Вывод$6.00/M | Провайдеры— | — | 60.4±16.0P | 62.7±13.9P | — | — | — | — | — | Пропускная способность — | Задержка — | Дата выпуска2026-08-12 |
| GPT-5.6 SolOpenAI | Контекст1.1M | Ввод$5.00/M | Вывод$30.00/M | Провайдеры +131 | 67.2±7.3 | 62.4±9.3E | 61.3±8.7 | 57.2±16.7P | 67±16.1P | — | 59.6±16.1P | 53.5±16.0P | Пропускная способность 57 t/s | Задержка 3.65с | Дата выпуска2026-07-09 |
| Claude Opus 4.8Anthropic | Контекст1M | Ввод$5.00/M | Вывод$25.00/M | Провайдеры +151 | 62.9±5.5 | 65.6±6.6 | 56.6±8.7 | 64.1±14.0P | 58±16.1P | 55±17.1P | 61±12.0E | 50±16.0P | Пропускная способность 232 t/s | Задержка 2.21с | Дата выпуска2026-05-27 |
| Muse Spark 1.2MetaNEW | Контекст1.0M | Ввод$1.25/M | Вывод$4.25/M | Провайдеры | 56.9±9.4E | 57.2±12.0E | 61.5±10.8E | 55.8±14.0P | — | — | — | — | Пропускная способность — | Задержка — | Дата выпуска2026-08-05 |
| GPT-5.5OpenAI | Контекст1.1M | Ввод$5.00/M | Вывод$30.00/M | Провайдеры +146 | 62±5.1 | 59.8±8.7 | 59.3±8.7 | 59.9±14.0P | 56.9±16.1P | — | 55.8±16.1P | 54.7±16.0P | Пропускная способность 46 t/s | Задержка 4.95с | Дата выпуска2026-04-24 |
| Gemini 3.7 FlashGoogleNEW | Контекст1.0M | Ввод$0.750/M | Вывод$3.75/M | Провайдеры | 63.6±14.1P | 61.7±16.0P | 59.5±13.9P | — | — | — | 59.5±16.1P | — | Пропускная способность — | Задержка — | Дата выпуска2026-08-13 |
| Grok 4.5SpaceXAI | Контекст500K | Ввод$2.00/M | Вывод$6.00/M | Провайдеры +102 | 61.8±11.3E | 59.8±6.9 | 54.5±8.7 | 58.1±14.0P | — | — | — | — | Пропускная способность 60 t/s | Задержка 9.70с | Дата выпуска2026-07-08 |
| Claude Sonnet 5Anthropic | Контекст1M | Ввод$2.00/M | Вывод$10.00/M | Провайдеры +107 | 64.8±12.2P | 59.8±6.6 | 56.5±10.8E | 61.4±14.0P | — | — | 58.8±16.1P | — | Пропускная способность — | Задержка — | Дата выпуска2026-06-30 |
| Claude Opus 4.7Anthropic | Контекст1M | Ввод$5.00/M | Вывод$25.00/M | Провайдеры +195 | 54.6±6.9 | 60.1±11.2E | 56.1±10.8E | 54.6±14.0P | 56.8±16.1P | — | — | 44.5±16.0P | Пропускная способность 47 t/s | Задержка 4.89с | Дата выпуска2026-05-12 |
| Muse Spark 1.1MetaNEW | Контекст1.0M | Ввод$1.25/M | Вывод$4.25/M | Провайдеры | 63.1±7.4 | 59.3±9.3E | 59.6±10.2E | 65.9±14.0P | — | — | 58.9±16.1P | — | Пропускная способность — | Задержка — | Дата выпуска2026-07-16 |
| GLM-5.2Z.ai | Контекст1.0M | Ввод$1.40/M | Вывод$4.40/M | Провайдеры +140 | 59.9±7.2 | 54.1±8.9 | 54.7±10.8E | 58.3±14.0P | 70.1±11.5E | — | — | 53.7±16.0P | Пропускная способность 91 t/s | Задержка 8.31с | Дата выпуска2026-06-16 |
Сравнивайте цены API, тесты скорости и данные производительности разных провайдеров.
Единый API-шлюз, предоставляющий доступ к нескольким большим языковым моделям с прямым подключением в Китае.
Доступность
100%
Тесты
145
Последняя проверка
Aug 14
Цена API
Проверок работоспособности ещё нет
Zhipu AI предоставляет серию больших языковых моделей GLM, включая GLM-4, ChatGLM и CodeGeeX, для работы с текстом, кодом и мультимодальными задачами.
Доступность
100%
Тесты
405
Последняя проверка
Aug 14
Цена API
Проверок работоспособности ещё нет
NVIDIA NIM предоставляет оптимизированные API для вывода моделей ИИ, включая LLM, модели зрения и эмбеддинги, через облачную инфраструктуру NVIDIA.
Доступность
100%
Тесты
1,247
Последняя проверка
Aug 14
Цена API
Проверок работоспособности ещё нет
OpenCode — это агент написания кода с открытым исходным кодом, интегрирующийся с терминалами, IDE и настольными приложениями, поддерживающий несколько моделей и провайдеров.
Доступность
100%
Тесты
345
Последняя проверка
Aug 14
Цена API
Проверок работоспособности ещё нет
Suchuang API — единый API для доступа к моделям генерации текста, изображений и видео.
Доступность
100%
Тесты
45
Последняя проверка
Aug 14
Цена API
Проверок работоспособности ещё нет
Ollama предоставляет платформу для запуска и интеграции моделей ИИ с открытым исходным кодом локально или в облаке.
Доступность
100%
Тесты
135
Последняя проверка
Aug 14
Цена API
Проверок работоспособности ещё нет
DeepSeek предоставляет API-доступ к своим крупным языковым моделям для генерации текста и задач программирования.
Доступность
100%
Тесты
755
Последняя проверка
Aug 14
Цена API
Проверок работоспособности ещё нет
ИИ-шлюз, созданный для организаций.
Доступность
100%
Тесты
54
Последняя проверка
Aug 14
Цена API
Проверок работоспособности ещё нет
VSLLM — AI-шлюз на базе New API на vsllm.com для доступа к моделям через единую точку.
Доступность
100%
Тесты
155
Последняя проверка
Aug 14
Цена API
Проверок работоспособности ещё нет
iTokens — совместимый с OpenAI API-шлюз с оплатой по мере использования для моделей DeepSeek, GLM, Kimi, Qwen, MiniMax, KwaiKAT и других разработчиков. Сервис публикует цены по моделям и предлагает новым пользователям бонусные кредиты.
Volcengine Ark — корпоративная AI-платформа ByteDance с моделями серии Doubao и сторонними LLM через OpenAI-совместимый API.
Доступность
100%
Тесты
379
Последняя проверка
Aug 14
Цена API
Проверок работоспособности ещё нет
Новейшие отчеты аудита relay, где профиль endpoint, идентичность модели, безопасность prompt и целостность ответа получили 100 баллов.