Data points: 111
Model compare
The readout for GPT-5.4 and Llama 4 Scout, before the detailed comparison sheet.
Weighted outcome: GPT-5.4. Benchmark capability categories carry 80%, while price, API performance, and availability carry 20%.
Decision read
GPT-5.4
GPT-5.4 has the higher weighted result; Model A / B score 92 to 8.
Evidence depth
111 data points
Includes 22 benchmark rows, 0 audit samples, and 7 provider examples.
Selection signal
Start with GPT-5.4
The charts below split 29 high-signal samples across speed, scores, and audit health.
Switch either side of this report to compare another model with the same LMSpeed data pipeline.
Select a different model to open a new comparison URL.
This report only uses LMSpeed data for GPT-5.4 and Llama 4 Scout: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.
| Model compare | GPT-5.4 | Llama 4 Scout |
|---|---|---|
| Overall leader | Leading | Contender |
| Weighted overall score | 92.0 pts | 8.0 pts |
| Benchmark category leads | 6 categories | 0 categories |
| Operational advantages | Cheapest input price, Free providers, Provider coverage | Average speed, First-token latency |
| Context window | 1.1M tokens | 1.3M tokens |
| Max output | 128K tokens | 16.4K tokens |
| Modalities | Input TextImageFile Output Text |
The overall result weights benchmark capability categories at 80% and price, API speed/latency, and availability at 20%. Recent test volume does not affect the winner, and missing benchmark categories are excluded.
| Model compare | GPT-5.4 | Llama 4 Scout |
|---|---|---|
| Developer | OpenAI | Meta |
| Released | Mar 2026 | Apr 2025 |
| Parameters | No data | 17B |
| Tokenizer | GPT | Llama4 |
| Knowledge cutoff | No data | 2024-08-31 |
| OpenRouter ID | openai/gpt-5.4 | meta-llama/llama-4-scout |
| References | No data | No data |
This report only uses LMSpeed data for GPT-5.4 and Llama 4 Scout: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.
GPT-5.4
GPT-5.4 is stronger in benchmark categories (Agents, Coding, Reasoning, Knowledge, Math) and operational dimensions (Cheapest input price, Free providers, Provider coverage).
Llama 4 Scout
Llama 4 Scout has these operational advantages: Average speed, First-token latency.
Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.
Compare benchmark category scores on a 0-100 scale. Select a category to inspect the gap.
Avg. score
GPT-5.4
57.6
Avg. score
Llama 4 Scout
39.3
GPT-5.4 leads by 24.8
GPT-5.4 leads by 29.1
GPT-5.4 leads by 14.9
GPT-5.4 leads by 20.8
GPT-5.4 leads by 13.3
No data
GPT-5.4
GPT-5.4 leads by 10.7
Metric-level scores with benchmark source, rank depth, confidence, error, and evaluation date where available.
GPT-5.4
winner67.0
Rank #22/91 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
43.0
Rank #83/91 · confidence 1 · eval date 2026-02-28
GPT-5.4
$5.63/M
Rank #143/170 · confidence 4
Llama 4 Scout
winner$0.300/M
Rank #25/170 · confidence 4
GPT-5.4
$2.50/M
Rank #139/170 · confidence 4
Llama 4 Scout
winner$0.180/M
Rank #25/170 · confidence 4
GPT-5.4
$15.00/M
Rank #144/170 · confidence 4
Llama 4 Scout
winner$0.660/M
Rank #26/170 · confidence 4
GPT-5.4
winner74.0
Rank #6/94 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
25.8
Rank #89/94 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner10.6%
Rank #98/194 · confidence 4
Llama 4 Scout
4.3%
Rank #157/194 · confidence 4
GPT-5.4
winner74.8%
Rank #104/195 · confidence 4
Llama 4 Scout
58.7%
Rank #154/195 · confidence 4
GPT-5.4
winner56.6
Rank #5/101 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
17.0
Rank #101/101 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner71.0
Rank #13/64 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
8.2
Rank #64/64 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner47.1%
Rank #28/192 · confidence 4
Llama 4 Scout
17.0%
Rank #187/192 · confidence 4
GPT-5.4
winner66.0
Rank #19/58 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
25.5
Rank #56/58 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner41.6
Rank #10/101 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
4.3
Rank #89/101 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner50.0
Rank #11/95 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
14.6
Rank #92/95 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner51.4
Rank #11/104 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
10.0
Rank #97/104 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner92.0
Rank #13/101 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
58.7
Rank #92/101 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner88.6
Rank #18/95 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
78.3
Rank #42/95 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner78.4
Rank #19/61 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
52.9
Rank #58/61 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner1245.0
Rank #35/69 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
775.0
Rank #69/69 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner73.9
Rank #24/86 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
39.5
Rank #72/86 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner98.9
Rank #2/84 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
15.5
Rank #83/84 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner41.1
Rank #13/60 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
1.1
Rank #59/60 · confidence 1 · eval date 2026-02-28
GPT-5.4
winner1392.0
Rank #14/60 · confidence 3 · eval date 2026-03-05
Llama 4 Scout
111.0
Rank #58/60 · confidence 1 · eval date 2026-02-28
Latest completed audits from shared providers, with four safety and integrity score groups plus report links.
| Provider | GPT-5.4 | Llama 4 Scout |
|---|---|---|
| No completed audits are available from shared providers yet. | ||
Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.
| Provider | GPT-5.4 | Llama 4 Scout |
|---|---|---|
5 tests | GPT-5.4 speed / latency 44 tok/s / 1119ms input / output No data | Llama 4 Scout speed / latency N/A / N/A input / output No data |
5 tests | GPT-5.4 speed / latency 46 tok/s / 3291ms input / output No data | Llama 4 Scout speed / latency N/A / N/A input / output No data |
5 tests | GPT-5.4 speed / latency 51 tok/s / 6045ms input / output No data | Llama 4 Scout speed / latency N/A / N/A input / output No data |
0 tests | GPT-5.4 speed / latency N/A / N/A input / output No data | Llama 4 Scout speed / latency N/A / N/A input / output No data |
0 tests | GPT-5.4 speed / latency N/A / N/A input / output No data | Llama 4 Scout speed / latency N/A / N/A input / output No data |
GPT-5.4 gpt-5.4 speed / latency No data input / output $0.240/M/$1.44/M | Llama 4 Scout llama-4-scout-17b-16e-instruct speed / latency No data input / output $0/M | |
GPT-5.4 gpt-5.4-2026-03-05 speed / latency No data input / output $0.171/M/$1.03/M | Llama 4 Scout llama-4-scout-17b-16e-instruct speed / latency No data input / output $0.019/M |
Weighted outcome: GPT-5.4. Benchmark capability categories carry 80%, while price, API performance, and availability carry 20%.
Input
Output
| Features | Text inputImage inputFile inputText outputTool callingStructured outputsJSON modeReasoning | Text inputImage inputText outputTool callingStructured outputsJSON mode |
|---|