Llama 4 Scout API Benchmarks, Pricing & Provider Data
Compare Llama 4 Scout with another model
Choose a model to open its comparison page.
Тесты, цены API и данные поставщиков Llama 4 Scout: поставщиков — 16, цены от $0.010/request. На странице также приведены измеренная скорость API и задержка первого токена.
Meta Llama 4 Scout is a compact open-weight model in the Llama 4 family, designed for efficient inference, on-device deployment, and low-latency agent workloads.
Производительность по категориям
Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.
- Покрытие
- 6 / 8
- Методология
- V3.0
#1Математика44.3Оценка3/4 Измеренные измерения
#2Следование инструкциям43.3Предварительная1/4 Измеренные измерения
#3Рассуждение41.7РейтинговаяОбщий рейтинг #623/4 Измеренные измерения
#4Знания38.8Предварительная1/4 Измеренные измерения
#5Программирование34.1Предварительная1/4 Измеренные измерения
#6Агенты33.6Оценка2/4 Измеренные измерения
Specifications
Input and output token limits for this model, plus how it ranks on long-context understanding.
Возможности
Technical Details
- Вход
- Выход
- Всего параметров
- 17B
- Выпущена
- Apr 2025
- Срез знаний
- 2024-08-31
- Токенизатор
- Llama4
- Архитектура
- text+image->text
- Модерация
- Нет
- Поддерживаемые параметры
- frequency_penaltylogit_biasmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Rankings
Excels at
It's decent at
Falls behind in
Подробные оценки
Обновлено: 15 сент. 2026 г.Общее
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Overall score43.0#104 / 112
Общее
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Скорость и задержка
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Скорость вывода128.6 tok/s#32 / 80Время до первого токена0.64 s#16 / 80
Скорость и задержка
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Цены
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Цена входных данных$0.190/M#33 / 186Цена выходных данных$0.680/M#32 / 186
Цены
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Агенты
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Оценка33.680% интервал21.8–45.42/4 Измеренные измеренияAA Agentic Index1.1#69 / 70Τ²-bench results15.5#81 / 82
Агенты
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Программирование
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка34.180% интервал20.1–48.01/4 Измеренные измеренияLiveCodeBench29.9%#89 / 115SciCode21.3%#89 / 89
Программирование
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Рассуждение
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая
Оценка41.7#6280% интервал33.1–50.43/4 Измеренные измеренияMMLU-Pro75.2%#85 / 129GPQA58.7%#175 / 218
Рассуждение
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая
Знания
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка38.880% интервал22.8–54.81/4 Измеренные измеренияArtificial Analysis Intelligence Index10.3#109 / 117AA-GPQA Diamond58.7#103 / 113
Знания
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Математика
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Оценка44.380% интервал35.0–53.63/4 Измеренные измеренияAIME28.3%#42 / 68MATH-50084.4%#44 / 73
Математика
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Многоязычность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Многоязычность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Мультимодальность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
80% интервал30.8–69.20/4 Измеренные измеренияAA-MMMU-Pro52.9#63 / 68Design Arena Website761.0#78 / 78
Мультимодальность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Следование инструкциям
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка43.380% интервал27.3–59.31/4 Измеренные измеренияAA-IFBench39.5#70 / 84
Следование инструкциям
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Эндпоинты OpenRouter
3 эндпоинтовСторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.
| Provider endpoint | Вход | Вывод | Доступность 1 день | Задержка 30м | Пропускная способность 30м | Контекст / вывод |
|---|---|---|---|---|---|---|
DeepInfra deepinfra/fp8 | $0.100/M | $0.300/M | 99.9% | — | — | undefined токенов / undefined токенов |
Novita novita/bf16 | $0.180/M | $0.590/M | 99.9% | — | — | undefined токенов / undefined токенов |
Google google-vertex/us-east5 | $0.250/M | $0.700/M | — | — | — | undefined токенов / undefined токенов |
Сравнение цен
Compare Llama 4 Scout API pricing across 16 providers. Prices range from $0.010/request to $75.00/M. 素墨API offers the lowest rate at $0.010/request.
| Провайдер | Работоспособность | Вариант модели | Группа | Входные данные ($/M) | Выходные данные ($/M) | Скорость (т/с) | Первый токен | Аудит |
|---|---|---|---|---|---|---|---|---|
L1 100% | llama-4-scout-17b-16e-instruct | default | -80%$0.038/M | -82%$0.121/M | — | — | — | |
L1 100% | llama-4-scout-17b-16e-instruct | default | -57%$0.082/M | -62%$0.259/M | — | — | — | |
L1 100% | llama-4-scout | default | -57%$0.082/M | -62%$0.259/M | — | — | — | |
L1 99% | llama-4-scout | default | $0.300/M | $0.945/M | — | — | — | |
L1 100% | meta-llama/llama-4-scout | default | $3.75/M | $15.00/M | — | — | — | |
L1 99% | llama-4-scout | default | -78%$0.041/M | -81%$0.129/M | — | — | — | |
L1 100% | meta-llama/llama-4-scout | default | $0.500/M | $1.50/M | — | — | — | |
L1 46% | llama-4-scout | default | $0.010/request | - | — | — | — | |
L1 0% | llama-4-scout | default | -78%$0.041/M | -81%$0.129/M | — | — | — | |
L1 0% | llama-4-scout | default | -68%$0.062/M | -71%$0.194/M | — | — | — | |
L1 0% | meta-llama/llama-4-scout | default | -39%$0.116/M | -36%$0.434/M | — | — | — | |
L1 0% | llama-4-scout-17b | default | $75.00/M | $75.00/M | — | — | — | |
L1 0% | meta-llama/llama-4-scout | default | $75.00/M | $75.00/M | — | — | — |
Альтернативы и похожие модели
Gemini 2.5 Pro
gemini-2-5-pro
Google Gemini 2.5 Pro is Google advanced multimodal model with a 1M-token context window, strong STEM reasoning, and native support for images, audio, and video understanding.
GPT-OSS
gpt-oss
GPT-OSS is an open-weight language model family designed for self-hosted inference, research, and cost-efficient alternatives to proprietary GPT-class models.
Kimi K2
kimi-k2
Moonshot Kimi K2 is a trillion-parameter MoE model from Moonshot AI, built for long-context chat, agentic tool use, and high-quality Chinese-English bilingual generation.
GPT-5.4
gpt-5-4
OpenAI GPT-5.4 extends the GPT-5 family with stronger instruction following, deeper tool use, and improved performance on coding, math, and long-document analysis.
Claude Sonnet 4.6
claude-sonnet-4-6
Anthropic Claude Sonnet 4.6 extends the Sonnet line with improved tool use, coding reliability, and long-context performance for everyday production workloads.
Kimi K2.5
kimi-k2-5
Moonshot Kimi K2.5 is an open-weight multimodal agent model with native vision and text input, strong coding performance, and a 256K context window.
Frequently Asked Questions
- What benchmark data does Llama 4 Scout include?
- LMSpeed shows Llama 4 Scout benchmark context, API price, output speed, first-token latency, and provider data across 16 providers when those signals are available.
- Сколько стоит API Llama 4 Scout?
- Цены Llama 4 Scout у поставщиков (16): от $0.010/request до $75.00/M. Самая низкая указанная цена — у 素墨API.
- What does the Llama 4 Scout API pricing table include?
- The Llama 4 Scout API pricing table compares 16 providers by input price, output price, free tier status, speed, first-token latency, and recent health data when available.
- У какого провайдера самая низкая цена API Llama 4 Scout?
- Сейчас самая низкая указанная цена Llama 4 Scout — $0.010/request у 素墨API. Сравниваются поставщики: 16.
- Can I compare Llama 4 Scout API price and speed together?
- Yes. LMSpeed shows Llama 4 Scout API price, output speed, first-token latency, and provider health on the same page so you can compare cost and performance together.
- Является ли API Llama 4 Scout бесплатным?
- У Llama 4 Scout в настоящее время нет бесплатного тарифа API на LMSpeed. Все 16 провайдеров взимают плату за token.
