Библиотека моделей

LMSpeed — это каталог AI-моделей для сравнения цен API, скорости вывода, задержки первого токена, охвата провайдеров и данных бенчмарков. Сначала сузьте выбор модели и провайдера, затем проверьте endpoint для своей задачи.

Цена, скорость, задержка и доступность могут меняться. Считайте эту таблицу текущим сигналом и проверьте свой endpoint перед запуском.

МодельКонтекстВводВыводПровайдерыАгентыКодингРассужденияЗнанияМатематикаМультиязычностьМультимодальностьСледование инструкциямПропускная способностьЗадержкаДата выпуска
Qwen3Контекст262.1KВвод$0.200/MВывод$0.800/MПровайдеры
+126
48.6±16.0P
47.5±11.1E
36.8±16.3P
58.3±11.8E
36.7±16.4P
Пропускная способность
100 t/s
Задержка
12.55с
Дата выпуска2025-07-21
  • 48.6
  • 47.5
  • 36.8
  • 58.3
  • 36.7
Qwen3 VLКонтекстВводВыводПровайдеры
+17
Пропускная способность
206 t/s
Задержка
6.63с
Дата выпуска
Qwen3 CoderQwenКонтекст262.1KВводВыводПровайдеры
+61
Пропускная способность
243 t/s
Задержка
5.28с
Дата выпуска2025-07-23
Qwen3 EmbeddingКонтекстВводВыводПровайдеры
+43
Пропускная способность
Задержка
Дата выпуска
Qwen3 NextКонтекстВводВыводПровайдеры
+7
Пропускная способность
Задержка
Дата выпуска
Qwen ImageКонтекстВводВыводПровайдеры
+34
Пропускная способность
Задержка
Дата выпуска
Qwen3 Omni FlashКонтекстВводВыводПровайдеры
+39
Пропускная способность
62 t/s
Задержка
5.13с
Дата выпуска
Qwen3 S2S Flash RealtimeКонтекстВводВыводПровайдеры
+13
Пропускная способность
Задержка
Дата выпуска
Qwen3.5 Plus ImageКонтекстВводВыводПровайдеры
+1
Пропускная способность
Задержка
Дата выпуска
Qwen3 TTS Flash RealtimeКонтекстВводВыводПровайдеры
+14
Пропускная способность
Задержка
Дата выпуска
Qwen PlusQwenКонтекст1MВводВыводПровайдеры
+35
Пропускная способность
39 t/s
Задержка
0.83с
Дата выпуска2025-09-08
Qwen3 Coder PlusQwenКонтекст1MВводВыводПровайдеры
+73
Пропускная способность
45 t/s
Задержка
1.35с
Дата выпуска2025-09-23
Qwen3 MaxQwenКонтекст262.1KВвод$1.20/MВывод$6.00/MПровайдеры
+93
47.5±11.8E
43.9±11.2E
48.6±8.7
40.5±16.0P
51.4±16.1P
44.6±16.0P
Пропускная способность
38 t/s
Задержка
7.37с
Дата выпуска2025-09-23
  • 47.5
  • 43.9
  • 48.6
  • 40.5
  • 51.4
  • 44.6
Qwen3.5 PlusAlibabaКонтекст1MВводВыводПровайдеры
+115
44.4±16.1P
46.4±16.1P
48.5±16.1P
Пропускная способность
51 t/s
Задержка
13.81с
Дата выпуска2026-04-27
  • 44.4
  • 46.4
  • 48.5
Qwen3 TTS FlashКонтекстВводВыводПровайдеры
+29
Пропускная способность
Задержка
Дата выпуска
Qwen3.1AlibabaКонтекстВводВыводПровайдеры
+11
Пропускная способность
151 t/s
Задержка
4.42с
Дата выпуска
Qwen3 Coder FlashQwenКонтекст1MВводВыводПровайдеры
+29
Пропускная способность
Задержка
Дата выпуска2025-09-17
Qwen3.6 PlusQwenКонтекст1MВвод$0.500/MВывод$3.00/MПровайдеры
+127
48.7±5.5
50±8.2
56.4±8.1
52±11.6E
52±9.1E
52.2±12.2E
50.2±6.4
55.7±11.9E
Пропускная способность
49 t/s
Задержка
24.59с
Дата выпуска2026-04-02
  • 48.7
  • 50
  • 56.4
  • 52
  • 52
  • 52.2
  • 50.2
  • 55.7
Qwen3.0AlibabaКонтекстВводВыводПровайдеры
+12
Пропускная способность
165 t/s
Задержка
1.77с
Дата выпуска
Qwen3 Max ThinkingQwenКонтекст262.1KВвод$1.20/MВывод$6.00/MПровайдеры
+6
48.9±16.0P
54.9±11.1E
51.7±16.1P
Пропускная способность
Задержка
Дата выпуска2026-02-09
  • 48.9
  • 54.9
  • 51.7
Qwen3.5 FlashКонтекст1MВводВыводПровайдеры
+73
42.6±16.1P
Пропускная способность
115 t/s
Задержка
7.92с
Дата выпуска2026-02-25
  • 42.6
Qwen3.5 Plus ThinkingКонтекстВводВыводПровайдеры
+7
Пропускная способность
Задержка
Дата выпуска
Qwen3.5 MaxКонтекстВводВыводПровайдеры
+6
Пропускная способность
31 t/s
Задержка
29.33с
Дата выпуска
Qwen3 Coder NextQwenКонтекст262.1KВвод$0.350/MВывод$1.20/MПровайдеры
+20
50.1±16.3P
48.4±13.9P
Пропускная способность
147 t/s
Задержка
0.97с
Дата выпуска2026-02-04
  • 50.1
  • 48.4
Qwen3.6 Plus ThinkingКонтекстВводВыводПровайдеры
+9
Пропускная способность
Задержка
Дата выпуска
Qwen3.5 Omni PlusКонтекстВвод$0.400/MВывод$4.80/MПровайдеры
+20
52.3±13.9P
Пропускная способность
36 t/s
Задержка
2.15с
Дата выпуска
  • 52.3
Qwen3.5 Omni FlashКонтекстВвод$0.100/MВывод$0.800/MПровайдеры
+20
47.5±13.9P
Пропускная способность
Задержка
Дата выпуска
  • 47.5
Qwen3.5 Plus Image EditКонтекстВводВыводПровайдеры
+1
Пропускная способность
Задержка
Дата выпуска
DeepSeek V3.2DeepSeekКонтекст163.8KВвод$0.280/MВывод$0.420/MПровайдеры
+181
38.9±6.9
49.5±8.6
50.6±8.7
39.6±16.0P
48.7±16.1P
46±16.0P
Пропускная способность
46 t/s
Задержка
5.33с
Дата выпуска2025-12-01
  • 38.9
  • 49.5
  • 50.6
  • 39.6
  • 48.7
  • 46
Qwen3.5Контекст262.1KВвод$0.030/MВывод$0.150/MПровайдеры
+105
44.1±5.2
45.2±8.9
52.2±8.1
53.1±11.6E
41.4±11.5E
54.6±12.2E
49.7±6.4
53.7±11.9E
Пропускная способность
51 t/s
Задержка
10.34с
Дата выпуска2026-03-10
  • 44.1
  • 45.2
  • 52.2
  • 53.1
  • 41.4
  • 54.6
  • 49.7
  • 53.7
FreeOpenrouterКонтекст200KВводВыводПровайдеры
+16
Пропускная способность
24 t/s
Задержка
25.61с
Дата выпуска2026-02-01
DeepSeek R1 Distill Qwen 1.5BDeepSeekКонтекстВводВыводПровайдеры
+21
35.6±16.0P
29.7±11.1E
45.5±11.8E
Пропускная способность
126 t/s
Задержка
4.28с
Дата выпуска
  • 35.6
  • 29.7
  • 45.5
DeepSeek R1 Distill QwenDeepSeekКонтекст128KВводВыводПровайдеры
+51
45.1±13.9P
39.3±8.8
54.3±16.0P
55.7±11.8E
37.5±16.0P
Пропускная способность
50 t/s
Задержка
19.88с
Дата выпуска2025-01-29
  • 45.1
  • 39.3
  • 54.3
  • 55.7
  • 37.5
Qwen1.8BAlibabaКонтекстВводВыводПровайдеры
+14
Пропускная способность
Задержка
Дата выпуска
Qwen1.8B Long ContextAlibabaКонтекстВводВыводПровайдеры
+14
Пропускная способность
Задержка
Дата выпуска
Qwen3.6 FlashQwenКонтекст1MВводВыводПровайдеры
+21
Пропускная способность
106 t/s
Задержка
8.21с
Дата выпуска2026-04-27
Qwen3 InstantAlibabaКонтекстВводВыводПровайдеры
Пропускная способность
Задержка
Дата выпуска
Qwen3.7 MaxQwenКонтекст1MВвод$2.50/MВывод$7.50/MПровайдеры
+60
56.3±5.7
55.5±6.0
59.3±8.7
55.8±12.2E
62.2±12.2E
58.1±11.7E
56.8±11.9E
Пропускная способность
111 t/s
Задержка
22.62с
Дата выпуска2026-05-21
  • 56.3
  • 55.5
  • 59.3
  • 55.8
  • 62.2
  • 58.1
  • 56.8
Qwen3.7 PlusQwenКонтекст1MВвод$0.400/MВывод$1.60/MПровайдеры
+55
53.1±5.7
52±6.0
57.1±8.7
48.5±12.2E
55.2±12.2E
51.1±11.7E
54.7±6.3
56.8±11.9E
Пропускная способность
80 t/s
Задержка
28.78с
Дата выпуска2026-06-03
  • 53.1
  • 52
  • 57.1
  • 48.5
  • 55.2
  • 51.1
  • 54.7
  • 56.8
Nex n2 ProNex AGIКонтекст262.1KВвод$0.500/MВывод$2.50/MПровайдеры
+9
56.1±16.3P
58.3±13.9P
Пропускная способность
83 t/s
Задержка
1.16с
Дата выпуска2026-06-08
  • 56.1
  • 58.3
Qwen3.6 35B A3BQwenКонтекст262.1KВвод$0.375/MВывод$2.25/MПровайдеры
+5
46.1±5.9
41.7±6.0
52.2±8.7
39.1±12.2E
34.6±11.5E
43.9±7.0
50.6±16.0P
Пропускная способность
Задержка
Дата выпуска2026-04-27
  • 46.1
  • 41.7
  • 52.2
  • 39.1
  • 34.6
  • 43.9
  • 50.6
Qwen3.6 Max PreviewQwenКонтекст262.1KВвод$1.30/MВывод$7.80/MПровайдеры
+15
53.3±11.8E
50.2±8.9
55.1±10.8E
55.1±16.3P
50.2±16.1P
54.9±16.0P
Пропускная способность
Задержка
Дата выпуска2026-04-27
  • 53.3
  • 50.2
  • 55.1
  • 55.1
  • 50.2
  • 54.9
Qwen3.6 27BQwenКонтекст262.1KВвод$0.600/MВывод$3.60/MПровайдеры
+3
55.2±6.6
46.9±6.0
54.2±8.7
37.3±11.6E
41.3±11.5E
46.1±6.5
51.7±16.0P
Пропускная способность
Задержка
Дата выпуска2026-04-27
  • 55.2
  • 46.9
  • 54.2
  • 37.3
  • 41.3
  • 46.1
  • 51.7
Qwen3.5-9BQwenКонтекст262.1KВвод$0.170/MВывод$0.250/MПровайдеры
48.1±16.3P
51.7±13.9P
Пропускная способность
Задержка
Дата выпуска2026-03-10
  • 48.1
  • 51.7
Qwen3.5-35B-A3BQwenКонтекст262.1KВвод$0.250/MВывод$2.00/MПровайдеры
42.3±8.7
39.9±11.2E
51±8.3
38±16.3P
41.6±16.4P
45.8±12.1E
51.5±11.9E
Пропускная способность
Задержка
Дата выпуска2026-02-25
  • 42.3
  • 39.9
  • 51
  • 38
  • 41.6
  • 45.8
  • 51.5
Qwen3.5-27BQwenКонтекст262.1KВвод$0.300/MВывод$2.40/MПровайдеры
45.4±8.7
46.9±11.2E
53.4±8.3
41.4±16.3P
45.4±16.4P
49±12.1E
57.1±11.9E
Пропускная способность
Задержка
Дата выпуска2026-02-25
  • 45.4
  • 46.9
  • 53.4
  • 41.4
  • 45.4
  • 49
  • 57.1
Qwen3.5-122B-A10BQwenКонтекст262.1KВвод$0.400/MВывод$3.20/MПровайдеры
47.3±10.6E
46.7±11.8E
52.9±8.3
43.7±16.3P
45.4±16.4P
47.6±9.4E
54.2±11.9E
Пропускная способность
Задержка
Дата выпуска2026-02-25
  • 47.3
  • 46.7
  • 52.9
  • 43.7
  • 45.4
  • 47.6
  • 54.2
Qwen3.5 397B A17BQwenКонтекст262.1KВвод$0.600/MВывод$3.60/MПровайдеры
53.3±16.3P
57.7±13.9P
Пропускная способность
366 t/s
Задержка
9.72с
Дата выпуска2026-02-16
  • 53.3
  • 57.7
Qwen3 VL 32B InstructQwenКонтекст131.1KВвод$0.160/MВывод$0.640/MПровайдеры
+2
48.5±16.0P
48.2±11.1E
49.1±16.1P
Пропускная способность
Задержка
Дата выпуска2025-10-23
  • 48.5
  • 48.2
  • 49.1
Qwen3 VL 8B ThinkingQwenКонтекст131.1KВводВыводПровайдеры
Пропускная способность
Задержка
Дата выпуска2025-10-14
Qwen3 VL 8B InstructQwenКонтекст262.1KВвод$0.180/MВывод$0.700/MПровайдеры
+2
44.8±16.0P
40.6±11.1E
41.5±16.1P
Пропускная способность
Задержка
Дата выпуска2025-10-14
  • 44.8
  • 40.6
  • 41.5
Qwen3 VL 30B A3B ThinkingQwenКонтекст262.1KВводВыводПровайдеры
+2
Пропускная способность
Задержка
Дата выпуска2025-10-06
Qwen3 VL 30B A3B InstructQwenКонтекст262.1KВвод$0.200/MВывод$0.800/MПровайдеры
+1
47.8±16.0P
47.2±11.1E
49.8±16.1P
Пропускная способность
Задержка
Дата выпуска2025-10-06
  • 47.8
  • 47.2
  • 49.8
Qwen3 VL 235B A22B ThinkingQwenКонтекст131.1KВводВыводПровайдеры
+5
Пропускная способность
Задержка
Дата выпуска2025-09-23
Qwen3 VL 235B A22B InstructQwenКонтекст262.1KВвод$0.400/MВывод$1.60/MПровайдеры
+5
50.1±16.0P
49.9±11.1E
49.5±16.1P
Пропускная способность
Задержка
Дата выпуска2025-09-23
  • 50.1
  • 49.9
  • 49.5
Qwen3 Next 80B A3B ThinkingQwenКонтекст262.1KВводВыводПровайдеры
+5
Пропускная способность
Задержка
Дата выпуска2025-09-11
Qwen3 Next 80B A3B InstructQwenКонтекст262.1KВвод$0.150/MВывод$1.20/MПровайдеры
+17
52±16.0P
50.3±11.1E
48.7±16.1P
Пропускная способность
Задержка
Дата выпуска2025-09-11
  • 52
  • 50.3
  • 48.7
Qwen3 30B A3B Thinking 2507QwenКонтекст81.9KВводВыводПровайдеры
+4
Пропускная способность
Задержка
Дата выпуска2025-08-28
Qwen3 Coder 30B A3B InstructQwenКонтекст262.1KВвод$0.450/MВывод$2.25/MПровайдеры
46.3±16.0P
42.6±11.1E
50.5±11.8E
Пропускная способность
Задержка
Дата выпуска2025-07-31
  • 46.3
  • 42.6
  • 50.5
Qwen3 30B A3B Instruct 2507QwenКонтекст262.1KВводВыводПровайдеры
+3
Пропускная способность
Задержка
Дата выпуска2025-07-29

Как читать оценки категорий

Агенты, кодирование, рассуждение и другие столбцы — это оценки наблюдаемой способности 0–100 относительно допустимых моделей запуска Category Score V3.

Это не вероятность успеха, не IQ и не среднее восьми категорий. Читайте их вместе с 80% интервалом, измеренными аспектами, семействами бенчмарков и доказательствами на странице модели.

Открыть полную методологию оценки

Что показывает этот каталог

В каждой строке собрана информация для сравнения LLM API. Поля остаются пустыми, если у LMSpeed нет текущих данных по модели или провайдеру.

Цена API
Сравнивайте цену входных и выходных токенов за миллион, когда данные доступны.
Скорость и задержка
Используйте пропускную способность и задержку первого токена для сравнения ответа.
Охват провайдеров
Откройте модель, чтобы увидеть перечисленных провайдеров и текущие данные.
Данные о возможностях
Используйте столбцы возможностей, когда текущие оценки модели доступны.

Как использовать каталог моделей

Сначала выберите главный критерий для вашей задачи, затем сравните текущие строки и проверьте endpoint.

  1. Найдите модель.Ищите по названию модели, slug или описанию.
  2. Отсортируйте нужную метрику.Сортируйте по цене, пропускной способности, задержке, числу провайдеров или данным о возможностях.
  3. Сравните провайдеров.Откройте страницу модели, чтобы просмотреть варианты провайдеров и текущие данные.
  4. Проверьте свой endpoint.Запустите тест скорости перед использованием endpoint в production.

Frequently Asked Questions

How does LMSpeed benchmark AI models?

LMSpeed runs standardized five-round API speed tests on each model, measuring output throughput (tokens per second), first-token latency, and total response time across multiple providers.

Which AI model has the lowest API latency?

Latency varies by provider and model. Use the LMSpeed model directory to sort by latency and find the model with the fastest first-token response time. Check the latency leaderboard for monthly rankings.

How to compare LLM API pricing across providers?

LMSpeed lists input and output token prices per million for each model across available providers. Sort by price to find a lower-cost option, or filter by provider to compare rates side by side.

What is an AI model directory?

An AI model directory is a searchable list of models and their comparison data. On LMSpeed, it brings together API price, throughput, first-token latency, provider coverage, and capability data when available.

How do I choose a model and provider?

Start with the metric that matters most for your workload. Then open a model page to compare provider data. Run your own speed test before you use an endpoint in production.

Can model price and speed change?

Yes. Price, availability, throughput, and latency can change by model, provider, and time. Use current page values as a comparison signal and confirm with your own endpoint test.