Библиотека моделей

LMSpeed — это каталог AI-моделей для сравнения цен API, скорости вывода, задержки первого токена, охвата провайдеров и данных бенчмарков. Сначала сузьте выбор модели и провайдера, затем проверьте endpoint для своей задачи.

Цена, скорость, задержка и доступность могут меняться. Считайте эту таблицу текущим сигналом и проверьте свой endpoint перед запуском.

МодельКонтекстВводВыводПровайдерыАгентыКодингРассужденияЗнанияМатематикаМультиязычностьМультимодальностьСледование инструкциямПропускная способностьЗадержкаДата выпуска
GPT-6 AstraOpenAIКонтекст1.1MВвод$10.00/MВывод$50.00/MПровайдеры
+3
62.9±8.4
58.9±11.9E
61.5±8.7
58±16.6P
72.3±16.1P
66.4±16.4P
Пропускная способность
Задержка
Дата выпуска2026-09-04
  • 62.9
  • 58.9
  • 61.5
  • 58
  • 72.3
  • 66.4
GPT-5.6 Sol ProOpenAIКонтекст1.1MВводВыводПровайдеры
+2
Пропускная способность
Задержка
Дата выпуска2026-07-09
GPT-5.6 Terra ProOpenAIКонтекст1.1MВводВыводПровайдеры
+2
Пропускная способность
Задержка
Дата выпуска2026-07-09
GPT-5.6 Luna ProOpenAIКонтекст1.1MВводВыводПровайдеры
+3
Пропускная способность
Задержка
Дата выпуска2026-07-09
GPT-3.5 Turbo 16kOpenAIКонтекст16.4KВводВыводПровайдеры
+1
Пропускная способность
Задержка
Дата выпуска2023-08-28
GPT-4 Turbo PreviewOpenAIКонтекст128KВводВыводПровайдеры
Пропускная способность
Задержка
Дата выпуска2024-01-25
GPT-3.5 Turbo (older v0613)OpenAIКонтекст4.1KВводВыводПровайдеры
+1
Пропускная способность
Задержка
Дата выпуска2024-01-25
GPT-4o (2024-05-13)OpenAIКонтекст128KВвод$5.00/MВывод$15.00/MПровайдеры
44.9±16.0P
42.6±11.1E
46±11.8E
Пропускная способность
Задержка
Дата выпуска2024-05-13
  • 44.9
  • 42.6
  • 46
GPT-4o-mini (2024-07-18)OpenAIКонтекст128KВводВыводПровайдеры
Пропускная способность
Задержка
Дата выпуска2024-07-18
GPT-4o (2024-08-06)OpenAIКонтекст128KВвод$2.50/MВывод$10.00/MПровайдеры
44.5±16.0P
38.9±13.9P
46.2±11.8E
Пропускная способность
Задержка
Дата выпуска2024-08-06
  • 44.5
  • 38.9
  • 46.2
GPT-4o (2024-11-20)OpenAIКонтекст128KВводВыводПровайдеры
Пропускная способность
Задержка
Дата выпуска2024-11-20
GPT-4o Search PreviewOpenAIКонтекст128KВводВыводПровайдеры
+2
Пропускная способность
Задержка
Дата выпуска2025-03-12
GPT-4o-mini Search PreviewOpenAIКонтекст128KВводВыводПровайдеры
+2
Пропускная способность
Задержка
Дата выпуска2025-03-12
gpt-oss-20bOpenAIКонтекст131.1KВвод$0.070/MВывод$0.200/MПровайдеры
37.9±9.3E
46.8±11.2E
43.7±8.7
35.6±16.0P
53±16.1P
50.9±16.0P
Пропускная способность
Задержка
Дата выпуска2025-08-05
  • 37.9
  • 46.8
  • 43.7
  • 35.6
  • 53
  • 50.9
gpt-oss-120bOpenAIКонтекст131.1KВвод$0.150/MВывод$0.545/MПровайдеры
+3
34.4±6.0
45.8±9.1
48.9±8.7
38.4±14.0P
53.7±16.1P
31.5±17.3P
52.1±16.0P
Пропускная способность
Задержка
Дата выпуска2025-08-05
  • 34.4
  • 45.8
  • 48.9
  • 38.4
  • 53.7
  • 31.5
  • 52.1
GPT-5 ChatOpenAIКонтекст128KВводВыводПровайдеры
Пропускная способность
Задержка
Дата выпуска2025-08-07
GPT-5.1 ChatOpenAIКонтекст128KВводВыводПровайдеры
Пропускная способность
Задержка
Дата выпуска2025-11-13
GPT-5.2 ChatOpenAIКонтекст128KВводВыводПровайдеры
Пропускная способность
Задержка
Дата выпуска2025-12-10
GPT-5.3 ChatOpenAIКонтекст128KВводВыводПровайдеры
Пропускная способность
Задержка
Дата выпуска2026-03-03
GPT Chat LatestOpenAIКонтекст400KВводВыводПровайдеры
+6
Пропускная способность
Задержка
Дата выпуска2026-05-05
GPT-5.6 TerraOpenAIКонтекст1.1MВвод$2.00/MВывод$12.00/MПровайдеры
+137
59.9±7.2
57.8±9.3E
58±8.7
55.6±16.6P
63.6±16.1P
54.7±16.1P
52.9±16.0P
Пропускная способность
148 t/s
Задержка
3.70с
Дата выпуска2026-07-09
  • 59.9
  • 57.8
  • 58
  • 55.6
  • 63.6
  • 54.7
  • 52.9
GPT-5.6 SolOpenAIКонтекст1.1MВвод$4.00/MВывод$20.00/MПровайдеры
+137
64.9±7.3
60.4±9.3E
60.3±8.7
55.9±16.6P
66±16.1P
59.5±16.1P
53.4±16.0P
Пропускная способность
53 t/s
Задержка
4.44с
Дата выпуска2026-07-09
  • 64.9
  • 60.4
  • 60.3
  • 55.9
  • 66
  • 59.5
  • 53.4
GPT-5.6 LunaOpenAIКонтекст1.1MВвод$0.200/MВывод$1.20/MПровайдеры
+132
56.3±7.2
55.8±9.3E
53.8±8.7
55.2±16.6P
61.6±16.1P
50.3±16.1P
Пропускная способность
527 t/s
Задержка
6.96с
Дата выпуска2026-07-09
  • 56.3
  • 55.8
  • 53.8
  • 55.2
  • 61.6
  • 50.3
GPT-5.5 ProOpenAIКонтекст1.1MВводВыводПровайдеры
+31
60.6±16.1P
61.6±14.0P
56.5±16.0P
56.4±16.1P
Пропускная способность
Задержка
Дата выпуска2026-04-24
  • 60.6
  • 61.6
  • 56.5
  • 56.4
GPT-5.5OpenAIКонтекст1.1MВвод$5.00/MВывод$30.00/MПровайдеры
+152
60.9±5.1
58.9±8.7
58.4±8.7
58.5±14.0P
56.2±16.1P
55.7±16.1P
54.7±16.0P
Пропускная способность
46 t/s
Задержка
4.95с
Дата выпуска2026-04-24
  • 60.9
  • 58.9
  • 58.4
  • 58.5
  • 56.2
  • 55.7
  • 54.7
GPT Image 2OpenAIКонтекст400KВводВыводПровайдеры
+118
Пропускная способность
51 t/s
Задержка
3.62с
Дата выпуска2026-06-24
GPT-4o StudyOpenAIКонтекстВводВыводПровайдеры
+4
Пропускная способность
Задержка
Дата выпуска
GPT-5 ImageOpenAIКонтекст400KВводВыводПровайдеры
+7
Пропускная способность
Задержка
Дата выпуска2025-10-14
GPT-4o DALL-EOpenAIКонтекстВводВыводПровайдеры
Пропускная способность
Задержка
Дата выпуска
GPT-4o TranscribeOpenAIКонтекст128KВводВыводПровайдеры
+40
Пропускная способность
Задержка
Дата выпуска2026-04-27
GPT-3.5 NetOpenAIКонтекстВводВыводПровайдеры
+1
Пропускная способность
Задержка
Дата выпуска
GPT Image 1 MiniOpenAIКонтекст400KВводВыводПровайдеры
+20
Пропускная способность
Задержка
Дата выпуска2026-06-24
GPT-5.4 ProOpenAIКонтекст1.1MВвод$30.00/MВывод$180.00/MПровайдеры
+71
59.7±16.1P
57.9±11.2E
57.3±16.0P
56.1±16.1P
73±16.1P
Пропускная способность
Задержка
Дата выпуска2026-03-05
  • 59.7
  • 57.9
  • 57.3
  • 56.1
  • 73
GPT-4o Mini SearchOpenAIКонтекст128KВводВыводПровайдеры
+36
Пропускная способность
Задержка
Дата выпуска2025-03-12
GPT-4OpenAIКонтекст8.2KВвод$30.00/MВывод$60.00/MПровайдеры
+77
44±16.3P
36.9±11.8E
40.7±16.0P
Пропускная способность
35 t/s
Задержка
0.74с
Дата выпуска2023-05-28
  • 44
  • 36.9
  • 40.7
GPT-5.3OpenAIКонтекст128KВводВыводПровайдеры
+75
Пропускная способность
59 t/s
Задержка
2.57с
Дата выпуска2026-03-03
GPT Image 1OpenAIКонтекст400KВводВыводПровайдеры
+44
Пропускная способность
Задержка
Дата выпуска2026-06-24
GPT-5 ProOpenAIКонтекст400KВводВыводПровайдеры
+72
Пропускная способность
Задержка
Дата выпуска2025-10-06
GPT-4 DALL-EOpenAIКонтекстВводВыводПровайдеры
+12
Пропускная способность
Задержка
Дата выпуска
GPT-4o AudioOpenAIКонтекстВводВыводПровайдеры
+80
Пропускная способность
Задержка
Дата выпуска
GPT AudioOpenAIКонтекст128KВводВыводПровайдеры
+22
Пропускная способность
Задержка
Дата выпуска2026-01-19
GPT-4o Mini AudioOpenAIКонтекстВводВыводПровайдеры
+34
Пропускная способность
Задержка
Дата выпуска
GPT-5 CodexOpenAIКонтекст400KВвод$1.25/MВывод$10.00/MПровайдеры
+124
56.4±16.0P
56.5±11.1E
54.7±16.1P
Пропускная способность
154 t/s
Задержка
2.76с
Дата выпуска2025-09-23
  • 56.4
  • 56.5
  • 54.7
GPT-4o Mini RealtimeOpenAIКонтекстВводВыводПровайдеры
+36
Пропускная способность
Задержка
Дата выпуска
GPT-5 NanoOpenAIКонтекст400KВвод$0.050/MВывод$0.400/MПровайдеры
+111
54±16.0P
47.8±11.1E
50.9±16.1P
Пропускная способность
123 t/s
Задержка
10.60с
Дата выпуска2025-08-07
  • 54
  • 47.8
  • 50.9
GPT-4o RealtimeOpenAIКонтекстВводВыводПровайдеры
+73
Пропускная способность
Задержка
Дата выпуска
GPT-5.2OpenAIКонтекст400KВвод$1.75/MВывод$14.00/MПровайдеры
+241
47±6.6
56.1±8.5
53.1±6.4
54.5±14.0P
55.3±16.1P
42.2±9.0E
54.5±16.0P
Пропускная способность
56 t/s
Задержка
3.43с
Дата выпуска2025-12-10
  • 47
  • 56.1
  • 53.1
  • 54.5
  • 55.3
  • 42.2
  • 54.5
GPT-5.3 CodexOpenAIКонтекст400KВвод$1.75/MВывод$14.00/MПровайдеры
+253
52.1±6.6
56.8±8.5
59.3±10.8E
57.1±14.0P
50.8±16.4P
54.5±16.0P
Пропускная способность
78 t/s
Задержка
3.91с
Дата выпуска2026-02-24
  • 52.1
  • 56.8
  • 59.3
  • 57.1
  • 50.8
  • 54.5
GPT-5.4 NanoOpenAIКонтекст400KВвод$0.200/MВывод$1.25/MПровайдеры
+97
44.1±8.1
51.8±11.8E
49.5±10.8E
40.8±14.0P
51.3±16.1P
31.2±16.1P
54.7±16.0P
Пропускная способность
137 t/s
Задержка
3.38с
Дата выпуска2026-03-17
  • 44.1
  • 51.8
  • 49.5
  • 40.8
  • 51.3
  • 31.2
  • 54.7
GPT-4o Transcribe DiarizeOpenAIКонтекстВводВыводПровайдеры
+18
Пропускная способность
Задержка
Дата выпуска
ChatGPT ImageКонтекстВводВыводПровайдеры
+17
Пропускная способность
Задержка
Дата выпуска
GPT-5 Codex MiniOpenAIКонтекстВводВыводПровайдеры
+64
Пропускная способность
38 t/s
Задержка
3.35с
Дата выпуска
GPT-4o ImageOpenAIКонтекстВводВыводПровайдеры
+29
Пропускная способность
Задержка
Дата выпуска
GPT-5.1 CodexOpenAIКонтекст400KВвод$1.25/MВывод$10.00/MПровайдеры
+133
49.4±9.3E
49.4±11.2E
55±8.7
49.8±16.0P
54.1±16.1P
52.5±16.0P
Пропускная способность
Задержка
Дата выпуска2025-11-13
  • 49.4
  • 49.4
  • 55
  • 49.8
  • 54.1
  • 52.5
GPT-5.2 ProOpenAIКонтекст400KВводВыводПровайдеры
+90
Пропускная способность
Задержка
Дата выпуска2025-12-10
GPT-4 NetOpenAIКонтекстВводВыводПровайдеры
+2
Пропускная способность
Задержка
Дата выпуска
GPT Image 1.5OpenAIКонтекстВводВыводПровайдеры
+115
Пропускная способность
Задержка
Дата выпуска
GPT-4 GizmoOpenAIКонтекстВводВыводПровайдеры
+24
Пропускная способность
Задержка
Дата выпуска
Net GPT-4oКонтекстВводВыводПровайдеры
Пропускная способность
Задержка
Дата выпуска
GPT-4o Mini TranscribeOpenAIКонтекст128KВводВыводПровайдеры
+38
Пропускная способность
Задержка
Дата выпуска2026-05-01

Как читать оценки категорий

Агенты, кодирование, рассуждение и другие столбцы — это оценки наблюдаемой способности 0–100 относительно допустимых моделей запуска Category Score V3.

Это не вероятность успеха, не IQ и не среднее восьми категорий. Читайте их вместе с 80% интервалом, измеренными аспектами, семействами бенчмарков и доказательствами на странице модели.

Открыть полную методологию оценки

Что показывает этот каталог

В каждой строке собрана информация для сравнения LLM API. Поля остаются пустыми, если у LMSpeed нет текущих данных по модели или провайдеру.

Цена API
Сравнивайте цену входных и выходных токенов за миллион, когда данные доступны.
Скорость и задержка
Используйте пропускную способность и задержку первого токена для сравнения ответа.
Охват провайдеров
Откройте модель, чтобы увидеть перечисленных провайдеров и текущие данные.
Данные о возможностях
Используйте столбцы возможностей, когда текущие оценки модели доступны.

Как использовать каталог моделей

Сначала выберите главный критерий для вашей задачи, затем сравните текущие строки и проверьте endpoint.

  1. Найдите модель.Ищите по названию модели, slug или описанию.
  2. Отсортируйте нужную метрику.Сортируйте по цене, пропускной способности, задержке, числу провайдеров или данным о возможностях.
  3. Сравните провайдеров.Откройте страницу модели, чтобы просмотреть варианты провайдеров и текущие данные.
  4. Проверьте свой endpoint.Запустите тест скорости перед использованием endpoint в production.

Frequently Asked Questions

How does LMSpeed benchmark AI models?

LMSpeed runs standardized five-round API speed tests on each model, measuring output throughput (tokens per second), first-token latency, and total response time across multiple providers.

Which AI model has the lowest API latency?

Latency varies by provider and model. Use the LMSpeed model directory to sort by latency and find the model with the fastest first-token response time. Check the latency leaderboard for monthly rankings.

How to compare LLM API pricing across providers?

LMSpeed lists input and output token prices per million for each model across available providers. Sort by price to find a lower-cost option, or filter by provider to compare rates side by side.

What is an AI model directory?

An AI model directory is a searchable list of models and their comparison data. On LMSpeed, it brings together API price, throughput, first-token latency, provider coverage, and capability data when available.

How do I choose a model and provider?

Start with the metric that matters most for your workload. Then open a model page to compare provider data. Run your own speed test before you use an endpoint in production.

Can model price and speed change?

Yes. Price, availability, throughput, and latency can change by model, provider, and time. Use current page values as a comparison signal and confirm with your own endpoint test.