Back to models

Model compare

Claude Opus 4.6 vs O1

Краткий вывод по Claude Opus 4.6 и O1 перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: Claude Opus 4.6. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

Claude Opus 4.6

Claude Opus 4.6 имеет более высокий взвешенный результат; баллы модели A / B — 73.3 к 26.7.

Глубина данных

103 точек данных

Включает 20 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с Claude Opus 4.6

Графики ниже разделяют 30 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

This report only uses LMSpeed data for Claude Opus 4.6 and O1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Model compare
Claude Opus 4.6
O1
Overall leaderLeadingContender
Итоговый взвешенный балл73.3 балла26.7 балла
Лидерство в категориях benchmark4 категорий2 категорий
Операционные преимуществаCheapest input price, Free providers, Provider coverageNo data
Контекстное окно1M токенов200K токенов
Макс. вывод128K токенов100K токенов
Модальности

Вход

ТекстИзображениеФайл

Выход

Текст

Вход

ТекстИзображениеФайл

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Model compare
Claude Opus 4.6
O1
РазработчикAnthropicOpenAI
Выпущенафевр. 2026 г.дек. 2024 г.
ПараметрыNo dataNo data
ТокенизаторClaudeGPT
Срез знанийNo data2023-10-31
OpenRouter IDanthropic/claude-opus-4.6openai/o1
СсылкиNo dataNo data

When to choose each model

This report only uses LMSpeed data for Claude Opus 4.6 and O1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Claude Opus 4.6

Claude Opus 4.6 сильнее в категориях benchmark (Агенты, Кодинг, Reasoning, Математика) и операционных измерениях (Cheapest input price, Free providers, Provider coverage).

O1

O1 лидирует в категориях benchmark: Знания, Следование инструкциям.

Benchmark score comparison

Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
8 / 8
Покрытие модели B
6 / 8
Общие
6 общих категорий

Средний балл

Claude Opus 4.6

53.1

Средний балл

O1

52.3

Агенты

Claude Opus 4.6 впереди на 9.3

Claude Opus 4.654.9
O145.6

Кодинг

Claude Opus 4.6 впереди на 8.3

Claude Opus 4.658.9
O150.6

Reasoning

Claude Opus 4.6 впереди на 2.7

Claude Opus 4.653.4
O150.7

Знания

O1 впереди на 8.8

Claude Opus 4.653.7
O162.5

Математика

Claude Opus 4.6 впереди на 3.9

Claude Opus 4.656.5
O152.6

Многоязычность

Claude Opus 4.6

Claude Opus 4.654
O1-

Мультимодальность

Claude Opus 4.6

Claude Opus 4.648.4
O1-

Следование инструкциям

O1 впереди на 6.8

Claude Opus 4.644.7
O151.5

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Ценыverified

Input price

Claude Opus 4.6

лидер

$5.00/M

Ранг #164/180 · confidence 4

+$10.00/M

O1

$15.00/M

Ранг #173/180 · confidence 4

Ценыverified

Blended price

Claude Opus 4.6

лидер

$10.00/M

Ранг #165/180 · confidence 4

+$16.25/M

O1

$26.25/M

Ранг #173/180 · confidence 4

Ценыverified

Output price

Claude Opus 4.6

лидер

$25.00/M

Ранг #165/180 · confidence 4

+$35.00/M

O1

$60.00/M

Ранг #173/180 · confidence 4

Reasoningreported

MMLU-Pro

ИсточникClaude Opus 4.6

Claude Opus 4.6

82.0%

Ранг #50/129 · confidence 3 · дата оценки 2026-02-01

+2.1%

O1

лидер

84.1%

Ранг #34/129 · confidence 4

Reasoningreported

CritPt

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

2.8

Ранг #52/83 · confidence 3 · дата оценки 2026-02-01

+2.5

O1

0.3

Ранг #78/83 · confidence 1 · дата оценки 2024-12-01

Reasoningverified

GPQA

Claude Opus 4.6

лидер

84.0%

Ранг #70/212 · confidence 4

+9.3%

O1

74.7%

Ранг #120/212 · confidence 4

Reasoningreported

AA-LCR

ИсточникClaude Opus 4.6

Claude Opus 4.6

62.3

Ранг #73/100 · confidence 3 · дата оценки 2026-02-01

+1.0

O1

лидер

63.3

Ранг #72/100 · confidence 1 · дата оценки 2024-12-01

Reasoningverified

HLE

Claude Opus 4.6

лидер

19.1%

Ранг #83/209 · confidence 4

+12.1%

O1

7.0%

Ранг #135/209 · confidence 4

Кодингverified

SciCode

Claude Opus 4.6

лидер

45.7%

Ранг #45/205 · confidence 4

+9.9%

O1

35.8%

Ранг #124/205 · confidence 4

Кодингreported

AA-SciCode

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

45.7

Ранг #47/108 · confidence 3 · дата оценки 2026-02-01

+9.9

O1

35.8

Ранг #86/108 · confidence 1 · дата оценки 2024-12-01

Математикаreported

FrontierMath v2 (Tiers 1-3)

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

40.7

Ранг #10/47 · confidence 3 · дата оценки 2026-02-01

+31.4

O1

9.3

Ранг #34/47 · confidence 1 · дата оценки 2024-12-01

Математикаreported

BenchLM Math score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

59.6

Ранг #28/62 · confidence 3 · дата оценки 2026-02-01

+27.0

O1

32.6

Ранг #48/62 · confidence 1 · дата оценки 2024-12-01

Знанияreported

BenchLM Knowledge score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

82.4

Ранг #12/69 · confidence 3 · дата оценки 2026-02-01

+18.4

O1

64.0

Ранг #43/69 · confidence 1 · дата оценки 2024-12-01

Знанияreported

AA-Omniscience Accuracy

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

45.8

Ранг #20/101 · confidence 3 · дата оценки 2026-02-01

+11.3

O1

34.5

Ранг #43/101 · confidence 1 · дата оценки 2024-12-01

Знанияreported

AA-Omniscience Hallucination Rate

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

80.1

Ранг #43/101 · confidence 3 · дата оценки 2026-02-01

+10.5

O1

69.6

Ранг #54/101 · confidence 1 · дата оценки 2024-12-01

Знанияreported

Artificial Analysis Intelligence Index

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

38.8

Ранг #48/111 · confidence 3 · дата оценки 2026-02-01

+21.6

O1

17.2

Ранг #90/111 · confidence 1 · дата оценки 2024-09-12

Знанияreported

AA-GPQA Diamond

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

84.0

Ранг #62/108 · confidence 3 · дата оценки 2026-02-01

+9.3

O1

74.7

Ранг #84/108 · confidence 1 · дата оценки 2024-12-01

Знанияreported

AA-HLE

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

19.1

Ранг #68/108 · confidence 3 · дата оценки 2026-02-01

+12.1

O1

7.0

Ранг #85/108 · confidence 1 · дата оценки 2024-12-01

Следование инструкциямreported

AA-IFBench

ИсточникClaude Opus 4.6

Claude Opus 4.6

44.6

Ранг #59/84 · confidence 3 · дата оценки 2026-02-01

+25.7

O1

лидер

70.3

Ранг #35/84 · confidence 1 · дата оценки 2024-12-01

Агентыreported

τ²-bench results

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

84.8

Ранг #46/82 · confidence 3 · дата оценки 2026-02-01

+22.2

O1

62.6

Ранг #61/82 · confidence 1 · дата оценки 2024-12-01

API audit comparison

Latest completed audits from shared providers, with four safety and integrity score groups plus report links.

Provider
Claude Opus 4.6
O1
No completed audits are available from shared providers yet.

Provider examples

Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.

Provider
Claude Opus 4.6
O1
Cuz AI5 tests

Claude Opus 4.6

speed / latency

43 tok/s / 2285ms

input / output

No data

O1

speed / latency

N/A / N/A

input / output

No data

EasyMore5 tests

Claude Opus 4.6

speed / latency

27 tok/s / 15402ms

input / output

No data

O1

speed / latency

N/A / N/A

input / output

No data

N1N5 tests

Claude Opus 4.6

speed / latency

46 tok/s / 2559ms

input / output

No data

O1

speed / latency

N/A / N/A

input / output

No data

Claude Opus 4.6

speed / latency

N/A / N/A

input / output

No data

O1

speed / latency

N/A / N/A

input / output

No data

AAAI0 tests

Claude Opus 4.6

speed / latency

N/A / N/A

input / output

No data

O1

speed / latency

N/A / N/A

input / output

No data

Claude Opus 4.6

claude-opus-4-6

speed / latency

No data

input / output

$0/request

O1

o1-2024-12-17

speed / latency

No data

input / output

$0/request

Claude Opus 4.6

claude-opus-4-6-c

speed / latency

No data

input / output

$0.0082/request

O1

o1-all

speed / latency

No data

input / output

$0.082/request

Claude Opus 4.6

claude-opus-4-6

speed / latency

No data

input / output

$0.017/request

O1

o1

speed / latency

No data

input / output

$1.03/M/$4.11/M

Claude Opus 4.6

claude-opus-4-6-thinking

speed / latency

No data

input / output

$0.548/M/$2.74/M

O1

o1-preview-all

speed / latency

No data

input / output

$0.033/request

Claude Opus 4.6

claude-opus-4-6-thinking

speed / latency

No data

input / output

$0.548/M/$2.74/M

O1

o1-preview-all

speed / latency

No data

input / output

$0.033/request

FAQ

Взвешенный результат: Claude Opus 4.6. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Why is this comparison indexable?
It has 4 verifiable comparison points, and both models have pricing or benchmark data.
Are missing metrics invented?
No. Metrics without LMSpeed data are omitted from this report.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.