Ищите оценки моделей и тестируйте AI API перед выбором

Изучайте оценки моделей по Agent, Coding и Reasoning, сравнивайте тарифы, бесплатные лимиты и покрытие моделей, измеряйте задержку, throughput и время API и выявляйте риски подмены модели, prompt и утечек ошибок.

Наши спонсоры

Партнёры, поддерживающие независимые тесты моделей и API-провайдеров.

Новейшие и сильнейшие LLM-модели

Живой срез новых моделей и лидеров бенчмарков с фокусом на оценки Artificial Analysis по общему интеллекту, кодингу и математике.

МодельКонтекстВводВыводПровайдерыАгентыКодингРассужденияЗнанияМатематикаМультиязычностьМультимодальностьСледование инструкциямПропускная способностьЗадержкаДата выпуска
Claude Opus 5AnthropicКонтекст1MВвод$5.00/MВывод$25.00/MПровайдеры
+85
65.8±7.7
67.2±6.6
59.4±8.7
66.7±14.0P
64.3±17.1P
56.6±16.4P
Пропускная способность
284 t/s
Задержка
5.44с
Дата выпуска2026-07-24
Claude Fable 5AnthropicКонтекст1MВвод$10.00/MВывод$50.00/MПровайдеры
+122
62.9±8.2
66.1±6.9
60.2±10.8E
64.8±14.0P
45±16.4P
50.3±16.0P
Пропускная способность
61 t/s
Задержка
3.92с
Дата выпуска2026-06-09
Muse Spark 1.3MetaNEWКонтекст1.0MВвод$1.25/MВывод$4.25/MПровайдеры
63.5±8.4
58.7±11.9E
60.8±10.8E
57.1±14.0P
Пропускная способность
Задержка
Дата выпуска2026-09-02
Claude Fable 5.1AnthropicNEWКонтекст1MВвод$10.00/MВывод$50.00/MПровайдеры
+2
61.8±8.6
68±6.9
60.8±8.7
67.8±14.0P
Пропускная способность
Задержка
Дата выпуска2026-09-01
Grok 4.6SpaceXAINEWКонтекст500KВвод$2.00/MВывод$6.00/MПровайдеры
+20
60.9±8.4
58±11.9E
58.9±10.8E
60.2±14.0P
Пропускная способность
150 t/s
Задержка
22.76с
Дата выпуска2026-08-12
Kimi K3MoonshotAIКонтекст1.0MВвод$3.00/MВывод$15.00/MПровайдеры
+88
65.8±7.3
55.8±11.9E
59±10.8E
59.3±14.0P
64.9±11.3E
Пропускная способность
144 t/s
Задержка
29.69с
Дата выпуска2026-07-16
GLM 5.3Z.aiNEWКонтекст1.3MВвод$1.40/MВывод$4.40/MПровайдеры
+16
51.3±20.2P
61.6±16.0P
60.9±13.9P
Пропускная способность
379 t/s
Задержка
30.00с
Дата выпуска2026-08-18
GPT-5.6 SolOpenAIКонтекст1.1MВвод$4.00/MВывод$20.00/MПровайдеры
+137
64.9±7.3
60.4±9.3E
60.3±8.7
55.9±16.6P
66±16.1P
59.5±16.1P
53.4±16.0P
Пропускная способность
53 t/s
Задержка
4.44с
Дата выпуска2026-07-09
GPT-6 AstraOpenAINEWКонтекст1.1MВвод$10.00/MВывод$50.00/MПровайдеры
+3
62.9±8.4
58.9±11.9E
61.5±8.7
58±16.6P
72.3±16.1P
66.4±16.4P
Пропускная способность
Задержка
Дата выпуска2026-09-04
Gemini 3.8 FlashGoogleNEWКонтекст1.0MВвод$0.750/MВывод$3.75/MПровайдеры
+1
59.5±11.3E
58.1±11.9E
60.7±10.8E
61.2±14.0P
54±16.4P
Пропускная способность
Задержка
Дата выпуска2026-09-02
Qwen3.8 MaxQwenКонтекст1MВвод$2.00/MВывод$6.00/MПровайдеры
+28
61.2±10.9E
61.2±11.2E
64±10.1E
52.2±14.0P
64.3±6.3
57.7±16.0P
Пропускная способность
292 t/s
Задержка
4.31с
Дата выпуска2026-08-03
Muse Spark 1.2MetaКонтекст1.0MВвод$1.25/MВывод$4.25/MПровайдеры
+2
56±8.9
55.1±11.9E
61±10.8E
58.8±14.0P
Пропускная способность
69 t/s
Задержка
22.53с
Дата выпуска2026-08-05
Qwen3.8 2.4T A95BQwenNEWКонтекст1.0MВвод$2.00/MВывод$6.00/MПровайдеры
58.3±16.0P
62.1±13.9P
Пропускная способность
Задержка
Дата выпуска2026-08-12
Claude Opus 4.8AnthropicКонтекст1MВвод$5.00/MВывод$25.00/MПровайдеры
+156
61.7±5.5
63.6±6.6
55.7±8.7
62.1±14.0P
57.2±16.1P
55±17.1P
59±12.0E
49.9±16.0P
Пропускная способность
193 t/s
Задержка
4.02с
Дата выпуска2026-05-27
GLM 5.3 FlashZ.aiNEWКонтекст1.3MВвод$0.150/MВывод$0.500/MПровайдеры
+19
60.1±11.9E
56.3±9.3E
58.5±11.1E
54.2±14.0P
57.9±16.1P
Пропускная способность
338 t/s
Задержка
31.95с
Дата выпуска2026-08-26
GPT-5.5OpenAIКонтекст1.1MВвод$5.00/MВывод$30.00/MПровайдеры
+152
60.9±5.1
58.9±8.7
58.4±8.7
58.5±14.0P
56.2±16.1P
55.7±16.1P
54.7±16.0P
Пропускная способность
46 t/s
Задержка
4.95с
Дата выпуска2026-04-24

Ищите оценки моделей и проверяйте API за ними

Начните с поиска оценок модели, затем сравните цены за токен, пятираундовые тесты скорости, health checks и safety probes до запуска API в production.

Поиск бенчмарков моделей

Ищите модель с главной страницы и переходите к бенчмаркам с AA score, кодингом, математикой и метаданными модели.

Сравнение цен API

Сравнивайте цены за токен у 100+ провайдеров, находите более дешевые API для каждой модели и отслеживайте бесплатные лимиты.

Тесты скорости в реальном времени

Запускайте пятираундовый тест со стандартизированными prompt, чтобы измерить задержку первого токена, throughput и время ответа.

Аудит безопасности API

Проверяйте OpenAI-совместимые API на подлинность модели, скрытые prompt, подмену инструкций, целостность stream и утечки ошибок.

Тесты кастомных endpoint

Введите base URL, API key и model ID, чтобы тестировать официальные, proxy, relay или self-hosted endpoint.

Аналитика тестов скорости

Оценивайте задержку первого токена, скорость вывода, общую длительность, health и свежие сигналы проверок.

Часто задаваемые вопросы

Как LMSpeed работает с бенчмарками моделей, ценами провайдеров, тестами скорости и аудитом API.

Как искать бенчмарки моделей?

Используйте поиск моделей на главной странице или откройте рейтинг Model Performance. Поиск по названию модели ведет в каталог и на страницу модели, где LMSpeed связывает AA score, кодинг и математику с метаданными модели.

Как сравнить цены LLM API у разных провайдеров?

LMSpeed агрегирует цены за token от 100+ API-провайдеров. Откройте страницу любой модели, чтобы увидеть таблицу сравнения цен input и output за миллион token и найти самого дешевого провайдера для каждой модели.

Какие LLM API бесплатны?

Многие провайдеры предлагают бесплатные тарифы или кредиты для популярных моделей, таких как DeepSeek, Gemini и Llama. Смотрите наш каталог бесплатных LLM API со списком моделей с бесплатным доступом и бенчмарками скорости для каждого провайдера.

Как LMSpeed проводит тесты скорости?

LMSpeed использует пятираундовый стресс-тест со стандартизированными prompt. Подсчет token выполняется через tiktoken с измерением пропускной способности (token в секунду) и задержки первого token.

Что проверяет аудит доверия API?

Он отправляет несколько safety probe на OpenAI-совместимый endpoint, чтобы проверить соответствие модели, скрытые system prompt, переписывание пользовательских инструкций, целостность streaming-ответов и утечки чувствительных деталей в ошибках. Результат включает оценку риска и отчет, которым можно поделиться. API key используется только для аудита и не попадает в публичные отчеты.

Как сравнить скорость разных API-провайдеров?

Используйте наши рейтинги производительности и страницы моделей, чтобы визуально сравнить бенчмарки скорости API у провайдеров. Система ранжирует провайдеров по throughput, задержке и health, помогая выбрать самый быстрый и надежный API.

Поддерживается ли долгосрочный мониторинг производительности?

Страницы провайдеров и рейтинг health уже показывают недавние health check, задержку probe, статус успеха или ошибки и рейтинг стабильности. Более широкий непрерывный мониторинг и алерты будут расширяться дальше.