Data points: 63
Model compare
The readout for Claude Sonnet 4.6 and Grok-2, before the detailed comparison sheet.
Weighted outcome: Claude Sonnet 4.6. Benchmark capability categories carry 80%, while price, API performance, and availability carry 20%.
Decision read
Claude Sonnet 4.6
Claude Sonnet 4.6 has the higher weighted result; Model A / B score 92 to 8.
Evidence depth
63 data points
Includes 4 benchmark rows, 0 audit samples, and 7 provider examples.
Selection signal
Start with Claude Sonnet 4.6
The charts below split 11 high-signal samples across speed, scores, and audit health.
Switch either side of this report to compare another model with the same LMSpeed data pipeline.
Select a different model to open a new comparison URL.
This report only uses LMSpeed data for Claude Sonnet 4.6 and Grok-2: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.
| Model compare | Claude Sonnet 4.6 | Grok-2 |
|---|---|---|
| Overall leader | Leading | Contender |
| Weighted overall score | 92.0 pts | 8.0 pts |
| Benchmark category leads | 3 categories | 0 categories |
| Operational advantages | Cheapest input price, Free providers, Provider coverage | Average speed, First-token latency |
| Context window | 1M tokens | No data |
| Max output | 128K tokens | No data |
| Modalities | Input TextImageFile Output Text |
The overall result weights benchmark capability categories at 80% and price, API speed/latency, and availability at 20%. Recent test volume does not affect the winner, and missing benchmark categories are excluded.
| Model compare | Claude Sonnet 4.6 | Grok-2 |
|---|---|---|
| Developer | Anthropic | No data |
| Released | Feb 2026 | No data |
| Parameters | No data | No data |
| Tokenizer | Claude | No data |
| Knowledge cutoff | No data | No data |
| OpenRouter ID | anthropic/claude-sonnet-4.6 | No data |
| References | No data | No data |
This report only uses LMSpeed data for Claude Sonnet 4.6 and Grok-2: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.
Claude Sonnet 4.6
Claude Sonnet 4.6 is stronger in benchmark categories (Coding, Reasoning, Math) and operational dimensions (Cheapest input price, Free providers, Provider coverage).
Grok-2
Grok-2 has these operational advantages: Average speed, First-token latency.
Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.
Compare benchmark category scores on a 0-100 scale. Select a category to inspect the gap.
Avg. score
Claude Sonnet 4.6
53.2
Avg. score
Grok-2
43.5
Claude Sonnet 4.6
Claude Sonnet 4.6 leads by 14.8
Claude Sonnet 4.6 leads by 7.2
Claude Sonnet 4.6
Claude Sonnet 4.6 leads by 7.0
No data
Claude Sonnet 4.6
Claude Sonnet 4.6
Metric-level scores with benchmark source, rank depth, confidence, error, and evaluation date where available.
Claude Sonnet 4.6
winner87.5%
Rank #31/188 · confidence 4
Grok-2
51.0%
Rank #165/188 · confidence 4
Claude Sonnet 4.6
winner30.0%
Rank #31/187 · confidence 4
Grok-2
3.8%
Rank #168/187 · confidence 4
Claude Sonnet 4.6
winner79.2%
Rank #68/125 · confidence 3 · eval date 2026-02-01
Grok-2
70.9%
Rank #100/125 · confidence 4
Claude Sonnet 4.6
winner46.8%
Rank #29/185 · confidence 4
Grok-2
28.5%
Rank #142/185 · confidence 4
Latest completed audits from shared providers, with four safety and integrity score groups plus report links.
| Provider | Claude Sonnet 4.6 | Grok-2 |
|---|---|---|
| No completed audits are available from shared providers yet. | ||
Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.
| Provider | Claude Sonnet 4.6 | Grok-2 |
|---|---|---|
5 tests | Claude Sonnet 4.6 speed / latency 20 tok/s / 8427ms input / output No data | Grok-2 speed / latency N/A / N/A input / output No data |
0 tests | Claude Sonnet 4.6 speed / latency N/A / N/A input / output No data | Grok-2 speed / latency N/A / N/A input / output No data |
0 tests | Claude Sonnet 4.6 speed / latency N/A / N/A input / output No data | Grok-2 speed / latency N/A / N/A input / output No data |
0 tests | Claude Sonnet 4.6 speed / latency N/A / N/A input / output No data | Grok-2 speed / latency N/A / N/A input / output No data |
0 tests | Claude Sonnet 4.6 speed / latency N/A / N/A input / output No data | Grok-2 speed / latency N/A / N/A input / output No data |
Claude Sonnet 4.6 claude-sonnet-4-6 speed / latency No data input / output $0/request | Grok-2 grok-2-1212 speed / latency No data input / output $0/request | |
Claude Sonnet 4.6 claude-sonnet-4-6 speed / latency No data input / output $0.010/request | Grok-2 grok-2-1212 speed / latency No data input / output $10.27/M |
Weighted outcome: Claude Sonnet 4.6. Benchmark capability categories carry 80%, while price, API performance, and availability carry 20%.
| Features | Text inputImage inputFile inputText outputTool callingStructured outputsJSON modeReasoning | None listed |
|---|