Бенчмарк LLM API
Проверьте реальную скорость ответа AI API
Запустите одинаковые пять запросов на любом совместимом endpoint и сравните ожидание до начала вывода, скорость генерации и полное время ответа.
Что измеряет Speedtest
Измерьте ожидание и скорость вывода
LMSpeed отправляет модели пять стандартизированных запросов и записывает каждый ответ от первого token до завершения. Это позволяет отделить задержку соединения и очереди от стабильной скорости генерации модели.
Почему это полезно
Сравнивайте результаты, находите медленные relay-маршруты, оценивайте провайдеров до интеграции и выбирайте отзывчивый endpoint для реальных пользователей.
- 01Задержка первого token
- Сколько пользователь ждёт до появления первого видимого token. Чем меньше, тем лучше для чатов и интерактивных продуктов.
- 02Скорость вывода
- Сколько token API генерирует в секунду после начала ответа. Чем выше значение, тем быстрее завершаются длинные ответы.
- 03Полная длительность
- Общее время каждого стандартизированного ответа, включая начальную задержку и время генерации.
Последние результаты тестов
Свежая выборка тестов сообщества для сравнения задержки провайдеров и скорости вывода.
| Время | Провайдер | Модель | Скорость | Задержка |
|---|---|---|---|---|
| 7 сент., 07:00 | api.zicc.cc | claude-fable-5 | 61.79t/s | 1.99s |
| 7 сент., 06:50 | www.micuapi.ai | gpt-5.6-sol | 41.16t/s | 7.90s |
| 7 сент., 00:17 | origin.modelflare.dev | gpt-5.6-terra | 35.55t/s | 5.90s |
| 6 сент., 21:56 | api.amanai.dev | amanai/glm-5.3 | 288.79t/s | 15.99s |
| 6 сент., 19:36 | integrate.api.nvidia.com | moonshotai/kimi-k3 | 12.16t/s | 6.75s |
Ищите оценки моделей и проверяйте API за ними
Начните с поиска оценок модели, затем сравните цены за токен, пятираундовые тесты скорости, health checks и safety probes до запуска API в production.
- Поиск бенчмарков моделей
Ищите модель с главной страницы и переходите к бенчмаркам с AA score, кодингом, математикой и метаданными модели.
- Сравнение цен API
Сравнивайте цены за токен у 100+ провайдеров, находите более дешевые API для каждой модели и отслеживайте бесплатные лимиты.
- Тесты скорости в реальном времени
Запускайте пятираундовый тест со стандартизированными prompt, чтобы измерить задержку первого токена, throughput и время ответа.
- Аудит безопасности API
Проверяйте OpenAI-совместимые API на подлинность модели, скрытые prompt, подмену инструкций, целостность stream и утечки ошибок.
- Тесты кастомных endpoint
Введите base URL, API key и model ID, чтобы тестировать официальные, proxy, relay или self-hosted endpoint.
- Аналитика тестов скорости
Оценивайте задержку первого токена, скорость вывода, общую длительность, health и свежие сигналы проверок.
Часто задаваемые вопросы
Как LMSpeed работает с бенчмарками моделей, ценами провайдеров, тестами скорости и аудитом API.
Как искать бенчмарки моделей?
Используйте поиск моделей на главной странице или откройте рейтинг Model Performance. Поиск по названию модели ведет в каталог и на страницу модели, где LMSpeed связывает AA score, кодинг и математику с метаданными модели.
Как сравнить цены LLM API у разных провайдеров?
LMSpeed агрегирует цены за token от 100+ API-провайдеров. Откройте страницу любой модели, чтобы увидеть таблицу сравнения цен input и output за миллион token и найти самого дешевого провайдера для каждой модели.
Какие LLM API бесплатны?
Многие провайдеры предлагают бесплатные тарифы или кредиты для популярных моделей, таких как DeepSeek, Gemini и Llama. Смотрите наш каталог бесплатных LLM API со списком моделей с бесплатным доступом и бенчмарками скорости для каждого провайдера.
Как LMSpeed проводит тесты скорости?
LMSpeed использует пятираундовый стресс-тест со стандартизированными prompt. Подсчет token выполняется через tiktoken с измерением пропускной способности (token в секунду) и задержки первого token.
Что проверяет аудит доверия API?
Он отправляет несколько safety probe на OpenAI-совместимый endpoint, чтобы проверить соответствие модели, скрытые system prompt, переписывание пользовательских инструкций, целостность streaming-ответов и утечки чувствительных деталей в ошибках. Результат включает оценку риска и отчет, которым можно поделиться. API key используется только для аудита и не попадает в публичные отчеты.
Как сравнить скорость разных API-провайдеров?
Используйте наши рейтинги производительности и страницы моделей, чтобы визуально сравнить бенчмарки скорости API у провайдеров. Система ранжирует провайдеров по throughput, задержке и health, помогая выбрать самый быстрый и надежный API.
Поддерживается ли долгосрочный мониторинг производительности?
Страницы провайдеров и рейтинг health уже показывают недавние health check, задержку probe, статус успеха или ошибки и рейтинг стабильности. Более широкий непрерывный мониторинг и алерты будут расширяться дальше.
