Бенчмарк LLM API

Проверьте реальную скорость ответа AI API

Запустите одинаковые пять запросов на любом совместимом endpoint и сравните ожидание до начала вывода, скорость генерации и полное время ответа.

Что измеряет Speedtest

Измерьте ожидание и скорость вывода

LMSpeed отправляет модели пять стандартизированных запросов и записывает каждый ответ от первого token до завершения. Это позволяет отделить задержку соединения и очереди от стабильной скорости генерации модели.

Почему это полезно

Сравнивайте результаты, находите медленные relay-маршруты, оценивайте провайдеров до интеграции и выбирайте отзывчивый endpoint для реальных пользователей.

01Задержка первого token
Сколько пользователь ждёт до появления первого видимого token. Чем меньше, тем лучше для чатов и интерактивных продуктов.
02Скорость вывода
Сколько token API генерирует в секунду после начала ответа. Чем выше значение, тем быстрее завершаются длинные ответы.
03Полная длительность
Общее время каждого стандартизированного ответа, включая начальную задержку и время генерации.

Последние результаты тестов

Свежая выборка тестов сообщества для сравнения задержки провайдеров и скорости вывода.

ВремяПровайдерМодельСкоростьЗадержка
7 сент., 07:00api.zicc.cc
claude-fable-5
61.79t/s
1.99s
7 сент., 06:50www.micuapi.ai
gpt-5.6-sol
41.16t/s
7.90s
7 сент., 00:17origin.modelflare.dev
gpt-5.6-terra
35.55t/s
5.90s
6 сент., 21:56api.amanai.dev
amanai/glm-5.3
288.79t/s
15.99s
6 сент., 19:36integrate.api.nvidia.com
moonshotai/kimi-k3
12.16t/s
6.75s

Ищите оценки моделей и проверяйте API за ними

Начните с поиска оценок модели, затем сравните цены за токен, пятираундовые тесты скорости, health checks и safety probes до запуска API в production.

Поиск бенчмарков моделей

Ищите модель с главной страницы и переходите к бенчмаркам с AA score, кодингом, математикой и метаданными модели.

Сравнение цен API

Сравнивайте цены за токен у 100+ провайдеров, находите более дешевые API для каждой модели и отслеживайте бесплатные лимиты.

Тесты скорости в реальном времени

Запускайте пятираундовый тест со стандартизированными prompt, чтобы измерить задержку первого токена, throughput и время ответа.

Аудит безопасности API

Проверяйте OpenAI-совместимые API на подлинность модели, скрытые prompt, подмену инструкций, целостность stream и утечки ошибок.

Тесты кастомных endpoint

Введите base URL, API key и model ID, чтобы тестировать официальные, proxy, relay или self-hosted endpoint.

Аналитика тестов скорости

Оценивайте задержку первого токена, скорость вывода, общую длительность, health и свежие сигналы проверок.

Часто задаваемые вопросы

Как LMSpeed работает с бенчмарками моделей, ценами провайдеров, тестами скорости и аудитом API.

Как искать бенчмарки моделей?

Используйте поиск моделей на главной странице или откройте рейтинг Model Performance. Поиск по названию модели ведет в каталог и на страницу модели, где LMSpeed связывает AA score, кодинг и математику с метаданными модели.

Как сравнить цены LLM API у разных провайдеров?

LMSpeed агрегирует цены за token от 100+ API-провайдеров. Откройте страницу любой модели, чтобы увидеть таблицу сравнения цен input и output за миллион token и найти самого дешевого провайдера для каждой модели.

Какие LLM API бесплатны?

Многие провайдеры предлагают бесплатные тарифы или кредиты для популярных моделей, таких как DeepSeek, Gemini и Llama. Смотрите наш каталог бесплатных LLM API со списком моделей с бесплатным доступом и бенчмарками скорости для каждого провайдера.

Как LMSpeed проводит тесты скорости?

LMSpeed использует пятираундовый стресс-тест со стандартизированными prompt. Подсчет token выполняется через tiktoken с измерением пропускной способности (token в секунду) и задержки первого token.

Что проверяет аудит доверия API?

Он отправляет несколько safety probe на OpenAI-совместимый endpoint, чтобы проверить соответствие модели, скрытые system prompt, переписывание пользовательских инструкций, целостность streaming-ответов и утечки чувствительных деталей в ошибках. Результат включает оценку риска и отчет, которым можно поделиться. API key используется только для аудита и не попадает в публичные отчеты.

Как сравнить скорость разных API-провайдеров?

Используйте наши рейтинги производительности и страницы моделей, чтобы визуально сравнить бенчмарки скорости API у провайдеров. Система ранжирует провайдеров по throughput, задержке и health, помогая выбрать самый быстрый и надежный API.

Поддерживается ли долгосрочный мониторинг производительности?

Страницы провайдеров и рейтинг health уже показывают недавние health check, задержку probe, статус успеха или ошибки и рейтинг стабильности. Более широкий непрерывный мониторинг и алерты будут расширяться дальше.