При поддержкеFusecodeКорпоративный API для Claude Code, Codex и модельных рабочих процессов.
LogoLMSpeed
  • Бесплатные
  • Модели
  • Провайдеры
  • Рейтинги
  • Документация
LogoLMSpeed
  1. Главная
  2. Модели
LogoLMSpeed

Лучший инструмент для проверки скорости API

GitHubGitHubTwitterX (Twitter)Email
Продукт
  • Возможности
  • Цены
  • FAQ
Рейтинги
  • Обзор
  • Рейтинг скорости
  • Рейтинг задержки
  • Рейтинг стабильности
  • Цены моделей
  • Скорость моделей
  • Reasoning
  • Coding
Модели
  • Все модели
  • GPT
  • Claude
  • Gemini
  • DeepSeek
  • Llama
  • Qwen
Бесплатные модели
  • Все бесплатные модели
  • Бесплатный GPT
  • Бесплатный Claude
  • Бесплатный Gemini
  • Бесплатный DeepSeek
  • Бесплатный Llama
  • Бесплатный Qwen
Tools
  • Speed Test
  • Provider Audit
Компания
  • О нас
Ресурсы
  • Каталог провайдеров
  • Документация
  • Публичный API
  • Botab
  • VidBee
Правовая информация
  • Политика cookie
  • Политика конфиденциальности
  • Условия использования
© 2026 LMSpeed All Rights Reserved.Made by Nexmoe with ❤️
Все28Текст28

Библиотека моделей

LMSpeed — это каталог AI-моделей для сравнения цен API, скорости вывода, задержки первого токена, охвата провайдеров и данных бенчмарков. Сначала сузьте выбор модели и провайдера, затем проверьте endpoint для своей задачи.

Цена, скорость, задержка и доступность могут меняться. Считайте эту таблицу текущим сигналом и проверьте свой endpoint перед запуском.

Лучшее для агентов
  1. 1MoonshotAIKimi K369.8±7.3
  2. 2OpenAIGPT-5.6 Sol69.8±7.4
  3. 3ClaudeClaude Fable 567.4±8.2
  4. 4OpenAIGPT-5.6 Terra64.7±7.4
  5. 5ClaudeClaude Opus 4.863.9±5.3
Лучшее в рассуждениях
Лучшее в кодинге
Наибольшая пропускная способность
Рейтинги по категориям
Дата выпуска
Контекст1.0MВвод$0.435/M

Как читать оценки категорий

Агенты, кодирование, рассуждение и другие столбцы — это оценки наблюдаемой способности 0–100 относительно допустимых моделей запуска Category Score V3.

Это не вероятность успеха, не IQ и не среднее восьми категорий. Читайте их вместе с 80% интервалом, измеренными аспектами, семействами бенчмарков и доказательствами на странице модели.

Что показывает этот каталог

В каждой строке собрана информация для сравнения LLM API. Поля остаются пустыми, если у LMSpeed нет текущих данных по модели или провайдеру.

Цена API
Сравнивайте цену входных и выходных токенов за миллион, когда данные доступны.
Скорость и задержка
Используйте пропускную способность и задержку первого токена для сравнения ответа.
Охват провайдеров
Откройте модель, чтобы увидеть перечисленных провайдеров и текущие данные.
Данные о возможностях
Используйте столбцы возможностей, когда текущие оценки модели доступны.

Как использовать каталог моделей

Сначала выберите главный критерий для вашей задачи, затем сравните текущие строки и проверьте endpoint.

  1. Найдите модель.Ищите по названию модели, slug или описанию.
  2. Отсортируйте нужную метрику.Сортируйте по цене, пропускной способности, задержке, числу провайдеров или данным о возможностях.
  3. Сравните провайдеров.Откройте страницу модели, чтобы просмотреть варианты провайдеров и текущие данные.
  4. Проверьте свой endpoint.Запустите тест скорости перед использованием endpoint в production.

Frequently Asked Questions

How does LMSpeed benchmark AI models?

LMSpeed runs standardized five-round API speed tests on each model, measuring output throughput (tokens per second), first-token latency, and total response time across multiple providers.

Which AI model has the lowest API latency?

Latency varies by provider and model. Use the LMSpeed model directory to sort by latency and find the model with the fastest first-token response time. Check the latency leaderboard for monthly rankings.

How to compare LLM API pricing across providers?

LMSpeed lists input and output token prices per million for each model across available providers. Sort by price to find a lower-cost option, or filter by provider to compare rates side by side.

Вывод
$0.870/M
Провайдеры
+186
52.1±5.1
48.7±6.3
53.8±8.4
43.9±14.0P
35.9±12.4E
—
—
53.3±16.0P
Пропускная способность
38 t/s
Задержка
8.27с
Дата выпуска2026-04-24
  • 52.1
  • 48.7
  • 53.8
  • 43.9
  • 35.9
  • —
  • —
  • 53.3
DeepSeekDeepSeek V4 FlashDeepSeekКонтекст1.0MВвод$0.140/MВывод$0.280/MПровайдеры
+194
47.8±5.3
44.4±6.6
51.6±8.4
39±14.0P
36.6±12.4E
—
—
54.2±16.0P
Пропускная способность
66 t/s
Задержка
7.55с
Дата выпуска2026-04-24
  • 47.8
  • 44.4
  • 51.6
  • 39
  • 36.6
  • —
  • —
  • 54.2
Aion 2.0AionLabsКонтекст131.1KВвод—Вывод—Провайдеры
+1
—
—
—
—
—
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска2026-02-23
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek V3.2DeepSeekКонтекст163.8KВвод$0.280/MВывод$0.420/MПровайдеры
+172
39.4±6.9
51.5±8.6
51.3±8.7
40.5±16.0P
49±16.1P
—
—
46.2±16.0P
Пропускная способность
46 t/s
Задержка
5.36с
Дата выпуска2025-12-01
  • 39.4
  • 51.5
  • 51.3
  • 40.5
  • 49
  • —
  • —
  • 46.2
DeepSeekDeepSeek V3.2 ExpDeepSeekКонтекст163.8KВвод$0.280/MВывод$0.420/MПровайдеры
—
53.9±13.9P
54.3±11.1E
—
52.7±16.1P
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска2025-09-29
  • —
  • 53.9
  • 54.3
  • —
  • 52.7
  • —
  • —
  • —
DeepSeekDeepSeek V3.1 TerminusDeepSeekКонтекст163.8KВвод$0.270/MВывод$1.00/MПровайдеры
+85
—
55.5±13.9P
54.4±11.1E
—
53±16.1P
—
—
—
Пропускная способность
58 t/s
Задержка
1.50с
Дата выпуска2025-09-22
  • —
  • 55.5
  • 54.4
  • —
  • 53
  • —
  • —
  • —
DeepSeekDeepSeek Chat V3.1DeepSeekКонтекст163.8KВвод—Вывод—Провайдеры
+7
—
—
—
—
—
—
—
—
Пропускная способность
23 t/s
Задержка
2.02с
Дата выпуска2025-08-21
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek R1DeepSeekКонтекст163.8KВвод$1.35/MВывод$4.20/MПровайдеры
+145
41.4±16.0P
50.2±13.9P
50.9±8.7
45.6±16.0P
57.1±11.8E
—
—
43.3±16.0P
Пропускная способность
52 t/s
Задержка
10.36с
Дата выпуска2025-05-28
  • 41.4
  • 50.2
  • 50.9
  • 45.6
  • 57.1
  • —
  • —
  • 43.3
Sonar Reasoning ProPerplexityКонтекст128KВвод—Вывод—Провайдеры
+4
—
—
—
—
57.4±11.8E
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска2025-03-07
  • —
  • —
  • —
  • —
  • 57.4
  • —
  • —
  • —
QwenDeepSeek R1 Distill QwenDeepSeekКонтекст128KВвод—Вывод—Провайдеры
+50
—
40.4±13.9P
39.6±8.9
55.5±16.0P
55.7±11.8E
—
—
37.3±16.0P
Пропускная способность
50 t/s
Задержка
19.88с
Дата выпуска2025-01-29
  • —
  • 40.4
  • 39.6
  • 55.5
  • 55.7
  • —
  • —
  • 37.3
MetaAIR1 Distill Llama 70BDeepSeekКонтекст8.2KВвод$0.700/MВывод$1.05/MПровайдеры
—
43±13.9P
46±11.1E
—
55±11.8E
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска2025-01-23
  • —
  • 43
  • 46
  • —
  • 55
  • —
  • —
  • —
DeepSeekDeepSeek V4DeepSeekКонтекст—Ввод—Вывод—Провайдеры
+9
—
—
—
—
—
—
—
—
Пропускная способность
47 t/s
Задержка
2.49с
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
QwenDeepSeek R1 Distill Qwen 1.5BDeepSeekКонтекст—Ввод—Вывод—Провайдеры
+21
—
26.1±13.9P
29.9±11.1E
—
45.4±11.8E
—
—
—
Пропускная способность
126 t/s
Задержка
4.28с
Дата выпуска—
  • —
  • 26.1
  • 29.9
  • —
  • 45.4
  • —
  • —
  • —
DeepSeekDeepSeek V2.5DeepSeekКонтекст—Ввод—Вывод—Провайдеры
+4
—
—
—
—
45.4±16.0P
—
—
—
Пропускная способность
16 t/s
Задержка
0.96с
Дата выпуска—
  • —
  • —
  • —
  • —
  • 45.4
  • —
  • —
  • —
DeepSeekDeepSeek V3.1DeepSeekКонтекст—Ввод$0.560/MВывод$1.68/MПровайдеры
+116
41.1±16.0P
54.5±13.9P
49.9±8.7
42±16.0P
53±16.1P
—
—
42.7±16.0P
Пропускная способность
103 t/s
Задержка
1.78с
Дата выпуска—
  • 41.1
  • 54.5
  • 49.9
  • 42
  • 53
  • —
  • —
  • 42.7
DeepSeekDeepSeek V3 TurboDeepSeekКонтекст—Ввод—Вывод—Провайдеры
+1
—
—
—
—
—
—
—
—
Пропускная способность
28 t/s
Задержка
1.31с
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek R1 TurboDeepSeekКонтекст—Ввод—Вывод—Провайдеры
+2
—
—
—
—
—
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek Vision ReasonerDeepSeekКонтекст—Ввод—Вывод—Провайдеры
—
—
—
—
—
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek V3.2 ReasonerDeepSeekКонтекст—Ввод—Вывод—Провайдеры
+1
—
—
—
—
—
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek Coder v2 InstructDeepSeekКонтекст—Ввод—Вывод—Провайдеры
+2
—
—
—
—
—
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek Prover v2DeepSeekКонтекст—Ввод—Вывод—Провайдеры
+7
—
—
—
—
—
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek Coder InstructDeepSeekКонтекст—Ввод—Вывод—Провайдеры
+4
—
—
—
—
—
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek R1 MetaSearchDeepSeekКонтекст—Ввод—Вывод—Провайдеры
—
—
—
—
—
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek OCRDeepSeekКонтекст—Ввод—Вывод—Провайдеры
+37
—
—
—
—
—
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek ReasonerDeepSeekКонтекст—Ввод—Вывод—Провайдеры
+85
—
—
—
—
—
—
—
—
Пропускная способность
28 t/s
Задержка
6.40с
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek VL2Контекст—Ввод—Вывод—Провайдеры
+8
—
—
—
—
—
—
—
—
Пропускная способность
126 t/s
Задержка
0.75с
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek CoderКонтекст—Ввод—Вывод—Провайдеры
+8
—
—
—
—
—
—
—
—
Пропускная способность
—
Задержка
—
Дата выпуска—
  • —
  • —
  • —
  • —
  • —
  • —
  • —
  • —
DeepSeekDeepSeek V3Контекст—Ввод$0.360/MВывод$0.890/MПровайдеры
+148
35.5±11.8E
37.8±11.2E
44.7±8.7
41.9±16.0P
49.5±9.3E
—
—
39.7±11.9E
Пропускная способность
49 t/s
Задержка
3.39с
Дата выпуска—
  • 35.5
  • 37.8
  • 44.7
  • 41.9
  • 49.5
  • —
  • —
  • 39.7
What is an AI model directory?

An AI model directory is a searchable list of models and their comparison data. On LMSpeed, it brings together API price, throughput, first-token latency, provider coverage, and capability data when available.

How do I choose a model and provider?

Start with the metric that matters most for your workload. Then open a model page to compare provider data. Run your own speed test before you use an endpoint in production.

Can model price and speed change?

Yes. Price, availability, throughput, and latency can change by model, provider, and time. Use current page values as a comparison signal and confirm with your own endpoint test.

1ClaudeClaude Opus 4.562.7±8.1
2OpenAIGPT-5.4 Pro62±11.4
3OpenAIGPT-5.6 Sol61.9±10.8
4MoonshotAIKimi K361.8±10.8
5OpenAIGPT-5.561.3±8.8
1ClaudeClaude Fable 568.3±6.9
2ClaudeClaude Opus 4.866.7±6.6
3OpenAIGPT-5.6 Sol63.7±9.3
4OpenAIGPT-5.463.1±10.3
5ClaudeClaude Opus 4.7 Max62.2±6.9
1MetaAILlama 3.3985 t/s
2Mercury 2490 t/s
3GeminiGemini 3.5 Flash425 t/s
4OpenAIGPT-OSS390 t/s
5GeminiGemini 2.5 Flash Lite277 t/s
Новейшие
Наиболее тестируемые
Недавно тестированные
А–Я
Агенты
Кодинг
Рассуждения
Знания
Математика
Мультиязычность
Мультимодальность
Следование инструкциям
Модель
Контекст
Ввод
Вывод
Провайдеры
Агенты
Кодинг
Рассуждения
Знания
Математика
Мультиязычность
Мультимодальность
Следование инструкциям
Пропускная способность
Задержка
DeepSeekDeepSeek V4 ProDeepSeek
Открыть полную методологию оценки
Рейтинг цен моделей
Рейтинг скорости моделей
Рейтинг задержки
Каталог провайдеров
Тест скорости LLM API