Ищите оценки моделей и тестируйте AI API перед выбором
Изучайте оценки моделей по Agent, Coding и Reasoning, сравнивайте тарифы, бесплатные лимиты и покрытие моделей, измеряйте задержку, throughput и время API и выявляйте риски подмены модели, prompt и утечек ошибок.
Наши спонсоры
Партнёры, поддерживающие независимые тесты моделей и API-провайдеров.
Последние аудиты безопасности API на 100/100
Новейшие отчеты аудита relay, где профиль endpoint, идентичность модели, безопасность prompt и целостность ответа получили 100 баллов.
- sub.callai.onegpt-5.6-solВремя отчета18 авг.Время отчета18 авг.848486100
- sub.callai.onegpt-5.6-solВремя отчета18 авг.Время отчета18 авг.707280100
- ai.databyte.co.iddatabyte-m1Время отчета18 авг.Время отчета18 авг.7284100100
- ai.databyte.co.iddeepseek-v4-flashВремя отчета18 авг.Время отчета18 авг.10084100100
- ai.databyte.co.idMiniMax-M3Время отчета18 авг.Время отчета18 авг.768478100
- tokengate-cqt9ivzs.manus.spaceclaude-opus-5Время отчета17 авг.Время отчета17 авг.648465100
- router.bynara.idqwen-3.8-max-freeВремя отчета17 авг.Время отчета17 авг.846686100
- 87.120.187.161claude-fable-5Время отчета17 авг.Время отчета17 авг.72727273
- muyuan.doGLM-5.2Время отчета17 авг.Время отчета17 авг.768468100
- code28.ccwu.ccGPT-5.6 TerraВремя отчета17 авг.Время отчета17 авг.848486100
Новейшие и сильнейшие LLM-модели
Живой срез новых моделей и лидеров бенчмарков с фокусом на оценки Artificial Analysis по общему интеллекту, кодингу и математике.
| Модель | Контекст | Ввод | Вывод | Провайдеры | Агенты | Кодинг | Рассуждения | Знания | Математика | Мультиязычность | Мультимодальность | Следование инструкциям | Пропускная способность | Задержка | Дата выпуска |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5Anthropic | Контекст1M | Ввод$5.00/M | Вывод$25.00/M | Провайдеры +85 | 65.8±7.7 | 67.2±6.6 | 59.4±8.7 | 66.7±14.0P | — | 64.3±17.1P | 56.6±16.4P | — | Пропускная способность 284 t/s | Задержка 5.44с | Дата выпуска2026-07-24 |
| Claude Fable 5Anthropic | Контекст1M | Ввод$10.00/M | Вывод$50.00/M | Провайдеры +122 | 62.9±8.2 | 66.1±6.9 | 60.2±10.8E | 64.8±14.0P | — | — | 45±16.4P | 50.3±16.0P | Пропускная способность 61 t/s | Задержка 3.92с | Дата выпуска2026-06-09 |
| Muse Spark 1.3MetaNEW | Контекст1.0M | Ввод$1.25/M | Вывод$4.25/M | Провайдеры | 63.5±8.4 | 58.7±11.9E | 60.8±10.8E | 57.1±14.0P | — | — | — | — | Пропускная способность — | Задержка — | Дата выпуска2026-09-02 |
| Claude Fable 5.1AnthropicNEW | Контекст1M | Ввод$10.00/M | Вывод$50.00/M | Провайдеры +2 | 61.8±8.6 | 68±6.9 | 60.8±8.7 | 67.8±14.0P | — | — | — | — | Пропускная способность — | Задержка — | Дата выпуска2026-09-01 |
| Grok 4.6SpaceXAINEW | Контекст500K | Ввод$2.00/M | Вывод$6.00/M | Провайдеры +20 | 60.9±8.4 | 58±11.9E | 58.9±10.8E | 60.2±14.0P | — | — | — | — | Пропускная способность 150 t/s | Задержка 22.76с | Дата выпуска2026-08-12 |
| Kimi K3MoonshotAI | Контекст1.0M | Ввод$3.00/M | Вывод$15.00/M | Провайдеры +88 | 65.8±7.3 | 55.8±11.9E | 59±10.8E | 59.3±14.0P | — | — | 64.9±11.3E | — | Пропускная способность 144 t/s | Задержка 29.69с | Дата выпуска2026-07-16 |
| GLM 5.3Z.aiNEW | Контекст1.3M | Ввод$1.40/M | Вывод$4.40/M | Провайдеры +16 | 51.3±20.2P | 61.6±16.0P | 60.9±13.9P | — | — | — | — | — | Пропускная способность 379 t/s | Задержка 30.00с | Дата выпуска2026-08-18 |
| GPT-5.6 SolOpenAI | Контекст1.1M | Ввод$4.00/M | Вывод$20.00/M | Провайдеры +137 | 64.9±7.3 | 60.4±9.3E | 60.3±8.7 | 55.9±16.6P | 66±16.1P | — | 59.5±16.1P | 53.4±16.0P | Пропускная способность 53 t/s | Задержка 4.44с | Дата выпуска2026-07-09 |
| GPT-6 AstraOpenAINEW | Контекст1.1M | Ввод$10.00/M | Вывод$50.00/M | Провайдеры +3 | 62.9±8.4 | 58.9±11.9E | 61.5±8.7 | 58±16.6P | 72.3±16.1P | — | 66.4±16.4P | — | Пропускная способность — | Задержка — | Дата выпуска2026-09-04 |
| Gemini 3.8 FlashGoogleNEW | Контекст1.0M | Ввод$0.750/M | Вывод$3.75/M | Провайдеры +1 | 59.5±11.3E | 58.1±11.9E | 60.7±10.8E | 61.2±14.0P | — | — | 54±16.4P | — | Пропускная способность — | Задержка — | Дата выпуска2026-09-02 |
| Qwen3.8 MaxQwen | Контекст1M | Ввод$2.00/M | Вывод$6.00/M | Провайдеры +28 | 61.2±10.9E | 61.2±11.2E | 64±10.1E | 52.2±14.0P | — | — | 64.3±6.3 | 57.7±16.0P | Пропускная способность 292 t/s | Задержка 4.31с | Дата выпуска2026-08-03 |
| Muse Spark 1.2Meta | Контекст1.0M | Ввод$1.25/M | Вывод$4.25/M | Провайдеры +2 | 56±8.9 | 55.1±11.9E | 61±10.8E | 58.8±14.0P | — | — | — | — | Пропускная способность 69 t/s | Задержка 22.53с | Дата выпуска2026-08-05 |
| Qwen3.8 2.4T A95BQwenNEW | Контекст1.0M | Ввод$2.00/M | Вывод$6.00/M | Провайдеры— | — | 58.3±16.0P | 62.1±13.9P | — | — | — | — | — | Пропускная способность — | Задержка — | Дата выпуска2026-08-12 |
| Claude Opus 4.8Anthropic | Контекст1M | Ввод$5.00/M | Вывод$25.00/M | Провайдеры +156 | 61.7±5.5 | 63.6±6.6 | 55.7±8.7 | 62.1±14.0P | 57.2±16.1P | 55±17.1P | 59±12.0E | 49.9±16.0P | Пропускная способность 193 t/s | Задержка 4.02с | Дата выпуска2026-05-27 |
| GLM 5.3 FlashZ.aiNEW | Контекст1.3M | Ввод$0.150/M | Вывод$0.500/M | Провайдеры +19 | 60.1±11.9E | 56.3±9.3E | 58.5±11.1E | 54.2±14.0P | — | — | 57.9±16.1P | — | Пропускная способность 338 t/s | Задержка 31.95с | Дата выпуска2026-08-26 |
| GPT-5.5OpenAI | Контекст1.1M | Ввод$5.00/M | Вывод$30.00/M | Провайдеры +152 | 60.9±5.1 | 58.9±8.7 | 58.4±8.7 | 58.5±14.0P | 56.2±16.1P | — | 55.7±16.1P | 54.7±16.0P | Пропускная способность 46 t/s | Задержка 4.95с | Дата выпуска2026-04-24 |
Ищите оценки моделей и проверяйте API за ними
Начните с поиска оценок модели, затем сравните цены за токен, пятираундовые тесты скорости, health checks и safety probes до запуска API в production.
- Поиск бенчмарков моделей
Ищите модель с главной страницы и переходите к бенчмаркам с AA score, кодингом, математикой и метаданными модели.
- Сравнение цен API
Сравнивайте цены за токен у 100+ провайдеров, находите более дешевые API для каждой модели и отслеживайте бесплатные лимиты.
- Тесты скорости в реальном времени
Запускайте пятираундовый тест со стандартизированными prompt, чтобы измерить задержку первого токена, throughput и время ответа.
- Аудит безопасности API
Проверяйте OpenAI-совместимые API на подлинность модели, скрытые prompt, подмену инструкций, целостность stream и утечки ошибок.
- Тесты кастомных endpoint
Введите base URL, API key и model ID, чтобы тестировать официальные, proxy, relay или self-hosted endpoint.
- Аналитика тестов скорости
Оценивайте задержку первого токена, скорость вывода, общую длительность, health и свежие сигналы проверок.
Часто задаваемые вопросы
Как LMSpeed работает с бенчмарками моделей, ценами провайдеров, тестами скорости и аудитом API.
Как искать бенчмарки моделей?
Используйте поиск моделей на главной странице или откройте рейтинг Model Performance. Поиск по названию модели ведет в каталог и на страницу модели, где LMSpeed связывает AA score, кодинг и математику с метаданными модели.
Как сравнить цены LLM API у разных провайдеров?
LMSpeed агрегирует цены за token от 100+ API-провайдеров. Откройте страницу любой модели, чтобы увидеть таблицу сравнения цен input и output за миллион token и найти самого дешевого провайдера для каждой модели.
Какие LLM API бесплатны?
Многие провайдеры предлагают бесплатные тарифы или кредиты для популярных моделей, таких как DeepSeek, Gemini и Llama. Смотрите наш каталог бесплатных LLM API со списком моделей с бесплатным доступом и бенчмарками скорости для каждого провайдера.
Как LMSpeed проводит тесты скорости?
LMSpeed использует пятираундовый стресс-тест со стандартизированными prompt. Подсчет token выполняется через tiktoken с измерением пропускной способности (token в секунду) и задержки первого token.
Что проверяет аудит доверия API?
Он отправляет несколько safety probe на OpenAI-совместимый endpoint, чтобы проверить соответствие модели, скрытые system prompt, переписывание пользовательских инструкций, целостность streaming-ответов и утечки чувствительных деталей в ошибках. Результат включает оценку риска и отчет, которым можно поделиться. API key используется только для аудита и не попадает в публичные отчеты.
Как сравнить скорость разных API-провайдеров?
Используйте наши рейтинги производительности и страницы моделей, чтобы визуально сравнить бенчмарки скорости API у провайдеров. Система ранжирует провайдеров по throughput, задержке и health, помогая выбрать самый быстрый и надежный API.
Поддерживается ли долгосрочный мониторинг производительности?
Страницы провайдеров и рейтинг health уже показывают недавние health check, задержку probe, статус успеха или ошибки и рейтинг стабильности. Более широкий непрерывный мониторинг и алерты будут расширяться дальше.


