Qwen
·Released on 21 июл. 2025 г.

Qwen3 235B A22B Instruct 2507 API Benchmarks, Pricing & Provider Data

Compare Qwen3 235B A22B Instruct 2507 with another model

Choose a model to open its comparison page.

Share on X
LLM

Qwen3-235B-A22B-Instruct-2507 is a multilingual, instruction-tuned mixture-of-experts language model based on the Qwen3-235B architecture, with 22B active parameters per forward pass. It is optimized ...

Производительность по категориям

Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.

Покрытие
3 / 8
Методология
V3.0
Производительность по категориямОценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.Агенты-Программирование55.5Рассуждение53.6Знания-Математика62.9Многоязычность-Мультимодальность-Следование инструкциям-
#1Математика62.9Оценка2/4 Измеренные измерения
80% интервал: 51.174.7
foundational math62.1
math_500 · math_500
competition math63.7
aime · aime
proof frontierТолько априорное
applied tool mathТолько априорное
#2Программирование55.5Предварительная1/4 Измеренные измерения
80% интервал: 41.569.4
code generation55.5
livecodebench · livecodebench / scicode · scicode
repository engineeringТолько априорное
debugging testingТолько априорное
tooling qualityТолько априорное
#3Рассуждение53.6Оценка2/4 Измеренные измерения
80% интервал: 42.564.7
abstract logicТолько априорное
scientific causal51.8
gpqa · gpqa / hle · hle
multistep constraints55.5
mmlu_pro · mmlu_pro
evidence verificationТолько априорное
Нет данных:АгентыЗнанияМногоязычностьМультимодальностьСледование инструкциям

Specifications

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
262.1Ktokens
314.6 pages of text
OUTPUT
16.4Ktokens
8K128K1M4M
262.1K

Возможности

Technical Details

Вход
Выход
Всего параметров
235B
Активные параметры
22B
Выпущена
Jul 2025
Срез знаний
2025-06-30
Документация
Токенизатор
Qwen3
Архитектура
text->text
Модерация
Нет
Поддерживаемые параметры
frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Rankings

Excels at

Подробные оценки

Обновлено: 23 авг. 2026 г.

Цены

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Цена входных данных$0.230/M#42 / 180Цена выходных данных$2.30/M#82 / 180
Цена входных данных
Input price
Рейтинг LMSpeed#42
Оценка$0.230/M
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4
Цена выходных данных
Output price
Рейтинг LMSpeed#82
Оценка$2.30/M
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4

Агенты

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Планирование и декомпозицияТолько априорное
Использование инструментовТолько априорное
Среда и длительное выполнениеТолько априорное
Восстановление и надёжность завершенияТолько априорное

Программирование

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка55.580% интервал41.5–69.41/4 Измеренные измеренияLiveCodeBench78.8%#21 / 115SciCode42.4%#62 / 204
Измерения и доказательства
Генерация кода55.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
livecodebench · livecodebench · z 0.90 · q 1.00
scicode · scicode · z 0.39 · q 1.00
Работа с репозиториямиТолько априорное
Отладка и тестированиеТолько априорное
Инструментальная разработка и качествоТолько априорное
LiveCodeBenchДоказательство V3
Рейтинг LMSpeed#21
Оценка78.8%
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4
SciCodeДоказательство V3
Рейтинг LMSpeed#62
Оценка42.4%
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4

Рассуждение

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка

Оценка53.680% интервал42.5–64.72/4 Измеренные измеренияMMLU-Pro84.3%#33 / 129GPQA79.0%#94 / 211
Измерения и доказательства
Абстрактная логикаТолько априорное
Научное и причинное рассуждение51.8
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
gpqa · gpqa · z 0.11 · q 1.00
hle · hle · z 0.11 · q 1.00
Многошаговые ограничения55.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
mmlu_pro · mmlu_pro · z 0.53 · q 1.00
Интеграция и проверка свидетельствТолько априорное
MMLU-ProДоказательство V3
Рейтинг LMSpeed#33
Оценка84.3%
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4
GPQAДоказательство V3
Рейтинг LMSpeed#94
Оценка79.0%
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4
HLEДоказательство V3
Рейтинг LMSpeed#91
Оценка15.9%
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4

Знания

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Широкие знанияТолько априорное
Профессиональные знанияТолько априорное
ФактологичностьТолько априорное
Поиск и открытые источникиТолько априорное

Математика

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка

Оценка62.980% интервал51.1–74.72/4 Измеренные измеренияAIME94.0%#1 / 68MATH-50098.4%#5 / 73
Измерения и доказательства
Базовая математика62.1
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
math_500 · math_500 · z 1.65 · q 1.00
Олимпиадная математика63.7
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
aime · aime · z 1.80 · q 1.00
Продвинутые доказательстваТолько априорное
Прикладная математика и инструментыТолько априорное
AIMEДоказательство V3
Рейтинг LMSpeed#1
Оценка94.0%
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4
MATH-500Доказательство V3
Рейтинг LMSpeed#5
Оценка98.4%
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4

Многоязычность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Межъязыковое пониманиеТолько априорное
Многоязычная генерацияТолько априорное
Перенос рассужденийТолько априорное
Устойчивость для малоресурсных языковТолько априорное

Мультимодальность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Восприятие и OCRТолько априорное
Документы и пространственное пониманиеТолько априорное
Визуальное рассуждениеТолько априорное
Видео и действия в средеТолько априорное

Следование инструкциям

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Соблюдение ограниченийТолько априорное
Структурированный выводТолько априорное
Обобщение новых инструкцийТолько априорное
Многоходовые и длинные инструкцииТолько априорное

Эндпоинты OpenRouter

10 эндпоинтов

Сторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.

Provider endpointВходВыводДоступность 1 деньЗадержка 30мПропускная способность 30мКонтекст / вывод
Google
google-vertex/us-south1
$0.220/M$0.880/M100.0%undefined токенов / undefined токенов
Alibaba
alibaba
$0.150/M$0.598/M99.9%undefined токенов / undefined токенов
Parasail
parasail/fp8
$0.140/M$0.800/M99.9%undefined токенов / undefined токенов
StreamLake
streamlake
$0.210/M$0.840/M99.7%undefined токенов / undefined токенов
Novita
novita/fp8
$0.090/M$0.580/M99.6%undefined токенов / undefined токенов
GMICloud
gmicloud/fp8
$0.087/M$0.350/M99.5%undefined токенов / —
AtlasCloud
atlas-cloud/fp8
$0.200/M$0.880/M99.5%undefined токенов / undefined токенов
DeepInfra
deepinfra/fp8
$0.090/M$0.550/M99.1%undefined токенов / undefined токенов
Venice
venice/fp8
$0.150/M$0.750/M98.2%undefined токенов / undefined токенов
Nebius
nebius/fp8
$0.200/M$0.600/M98.1%undefined токенов / —

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.Artificial AnalysisСтандартные бенчмарки могут включать BenchLM и другие открытые источники.

Работайте с данными LMSpeed

Бесплатно

Бесплатный публичный API для цен LLM, бенчмарков и данных провайдеров

  • Актуальные цены и доступность
  • Бенчмарки скорости и задержки
  • 300+ моделей, 600+ провайдеров
  • 1 000 запросов в день
Документация API