Data points: 60
Model compare
The readout for GPT-5.4 and Grok 3 Mini, before the detailed comparison sheet.
Weighted outcome: GPT-5.4. Benchmark capability categories carry 80%, while price, API performance, and availability carry 20%.
Decision read
GPT-5.4
GPT-5.4 has the higher weighted result; Model A / B score 80 to 20.
Evidence depth
60 data points
Includes 0 benchmark rows, 1 audit samples, and 6 provider examples.
Selection signal
Start with GPT-5.4
The charts below split 7 high-signal samples across speed, scores, and audit health.
Switch either side of this report to compare another model with the same LMSpeed data pipeline.
Select a different model to open a new comparison URL.
This report only uses LMSpeed data for GPT-5.4 and Grok 3 Mini: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.
| Model compare | GPT-5.4 | Grok 3 Mini |
|---|---|---|
| Overall leader | Leading | Contender |
| Weighted overall score | 80.0 pts | 20.0 pts |
| Benchmark category leads | 0 categories | 0 categories |
| Operational advantages | Cheapest input price, First-token latency, Free providers, Provider coverage | Average speed |
| Context window | 1.1M tokens | No data |
| Max output | 128K tokens | No data |
| Modalities | Input TextImageFile Output Text |
The overall result weights benchmark capability categories at 80% and price, API speed/latency, and availability at 20%. Recent test volume does not affect the winner, and missing benchmark categories are excluded.
| Model compare | GPT-5.4 | Grok 3 Mini |
|---|---|---|
| Developer | OpenAI | No data |
| Released | Mar 2026 | No data |
| Parameters | No data | No data |
| Tokenizer | GPT | No data |
| Knowledge cutoff | No data | No data |
| OpenRouter ID | openai/gpt-5.4 | No data |
| References | No data | No data |
This report only uses LMSpeed data for GPT-5.4 and Grok 3 Mini: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.
GPT-5.4
GPT-5.4 has these operational advantages: Cheapest input price, First-token latency, Free providers, Provider coverage.
Grok 3 Mini
Grok 3 Mini has these operational advantages: Average speed.
Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.
Compare benchmark category scores on a 0-100 scale. Select a category to inspect the gap.
Avg. score
GPT-5.4
57.4
Avg. score
Grok 3 Mini
-
GPT-5.4
GPT-5.4
GPT-5.4
GPT-5.4
GPT-5.4
No data
GPT-5.4
GPT-5.4
Metric-level scores with benchmark source, rank depth, confidence, error, and evaluation date where available.
No shared professional benchmark scores are available yet.
Latest completed audits from shared providers, with four safety and integrity score groups plus report links.
| Provider | GPT-5.4 | Grok 3 Mini |
|---|---|---|
Winner: GPT-5.4 | GPT-5.4 gpt-5.4 Audit score 93 1008486100 | Grok 3 Mini grok-3-mini No audit yet |
Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.
| Provider | GPT-5.4 | Grok 3 Mini |
|---|---|---|
50 tests | GPT-5.4 speed / latency 50 tok/s / 7305ms input / output No data | Grok 3 Mini speed / latency N/A / N/A input / output No data |
15 tests | GPT-5.4 speed / latency 41 tok/s / 6581ms input / output No data | Grok 3 Mini speed / latency N/A / N/A input / output No data |
10 tests | GPT-5.4 speed / latency 51 tok/s / 2526ms input / output No data | Grok 3 Mini speed / latency N/A / N/A input / output No data |
5 tests | GPT-5.4 speed / latency 51 tok/s / 5463ms input / output No data | Grok 3 Mini speed / latency N/A / N/A input / output No data |
5 tests | GPT-5.4 speed / latency 70 tok/s / 2961ms input / output No data | Grok 3 Mini speed / latency N/A / N/A input / output No data |
GPT-5.4 gpt-5.4 speed / latency No data input / output $0/request | Grok 3 Mini grok-3-mini speed / latency No data input / output $0/request |
Weighted outcome: GPT-5.4. Benchmark capability categories carry 80%, while price, API performance, and availability carry 20%.
| Features | Text inputImage inputFile inputText outputTool callingStructured outputsJSON modeReasoning | None listed |
|---|