Arcee AI
·Released on 1 апр. 2026 г.

Trinity Large Thinking API Benchmarks, Pricing & Provider Data

Compare Trinity Large Thinking with another model

Choose a model to open its comparison page.

Share on X
LLM

The page also shows measured API speed and first-token latency.

Trinity Large Thinking is a powerful open source reasoning model from the team at Arcee AI. It shows strong performance in PinchBench, agentic workloads, and reasoning tasks. Launch video: https://you...

Качество
0.0
Оценка LMSpeed
Скорость
#9of 74
108char/s
1.94 s

Производительность по категориям

Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.

Покрытие
5 / 8
Методология
V3.0
Производительность по категориямОценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.Агенты43.9Программирование49.7Рассуждение44.4Знания56.4Математика-Многоязычность-Мультимодальность-Следование инструкциям48.2
#1Знания56.4Предварительная1/4 Измеренные измерения
80% интервал: 40.472.4
broad knowledge56.4
aa_omniscience · artificial_analysis
professional knowledgeТолько априорное
factualityТолько априорное
retrieval open bookТолько априорное
#2Программирование49.7Предварительная1/4 Измеренные измерения
80% интервал: 33.765.7
code generation49.7
scicode · scicode
repository engineeringТолько априорное
debugging testingТолько априорное
tooling qualityТолько априорное
#3Следование инструкциям48.2Предварительная1/4 Измеренные измерения
80% интервал: 32.264.2
constraint followingТолько априорное
structured outputТолько априорное
novel instruction generalization48.2
ifbench · aa_if_bench
long multiturn instructionТолько априорное
#4Рассуждение44.4Оценка2/4 Измеренные измерения
80% интервал: 33.655.2
abstract logicТолько априорное
scientific causal49.6
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraintsТолько априорное
evidence verification39.2
lcr · lcr
#5Агенты43.9Оценка3/4 Измеренные измерения
80% интервал: 34.653.1
planning41.3
deep_planning · gert_labs
tool use52.5
tau · tau2_bench
environment execution38
gdpval_aa · benchlm_agentic_gdpval_aa
recovery reliabilityТолько априорное
Нет данных:МатематикаМногоязычностьМультимодальность

Specifications

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
262.1Ktokens
314.6 pages of text
OUTPUT
262.1Ktokens
8K128K1M4M
262.1K

Возможности

Technical Details

Вход
Выход
Выпущена
Apr 2026
Документация
Токенизатор
Other
Архитектура
text->text
Модерация
Нет
Поддерживаемые параметры
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokenspresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Rankings

Excels at

It's decent at

Falls behind in

Подробные оценки

Обновлено: 24 авг. 2026 г.

Скорость и задержка

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Скорость вывода207.3 tok/s#9 / 74Время до первого токена0.71 s#17 / 74
Скорость вывода
Output speed
Рейтинг LMSpeed#9
Оценка207.3 tok/s
Источникartificialanalysis.ai
Обновлено24 авг. 2026 г.
Достоверность4
Время до первого токена
Time to first token
Рейтинг LMSpeed#17
Оценка0.71 s
Источникartificialanalysis.ai
Обновлено24 авг. 2026 г.
Достоверность4

Цены

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Цена входных данных$0.235/M#43 / 180Цена выходных данных$0.875/M#41 / 180
Цена входных данных
Input price
Рейтинг LMSpeed#43
Оценка$0.235/M
Источникartificialanalysis.ai
Обновлено24 авг. 2026 г.
Достоверность4
Цена выходных данных
Output price
Рейтинг LMSpeed#41
Оценка$0.875/M
Источникartificialanalysis.ai
Обновлено24 авг. 2026 г.
Достоверность4

Агенты

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка

Оценка43.980% интервал34.6–53.13/4 Измеренные измеренияΤ²-bench results90.1#34 / 82Gert Labs32.5#44 / 49
Измерения и доказательства
Планирование и декомпозиция41.3
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
deep_planning · gert_labs · z -1.15 · q 1.00
Использование инструментов52.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
tau · tau2_bench · z 0.21 · q 1.00
Среда и длительное выполнение38
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
gdpval_aa · benchlm_agentic_gdpval_aa · z -1.78 · q 1.00
Восстановление и надёжность завершенияТолько априорное
Τ²-bench resultsДоказательство V3
Рейтинг LMSpeed#34
Оценка90.1
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
Gert LabsДоказательство V3
Рейтинг LMSpeed#44
Оценка32.5
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
GDPval-AA
Рейтинг LMSpeed#59
Оценка3.1
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
GDPval-AAДоказательство V3
Рейтинг LMSpeed#59
Оценка563.0
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
AA Agentic Index
Рейтинг LMSpeed#57
Оценка3.7
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Программирование

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка49.780% интервал33.7–65.71/4 Измеренные измеренияSciCode36.1%#118 / 204SWE-bench Verified*63.2#5 / 5
Измерения и доказательства
Генерация кода49.7
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
scicode · scicode · z -0.19 · q 1.00
Работа с репозиториямиТолько априорное
Отладка и тестированиеТолько априорное
Инструментальная разработка и качествоТолько априорное
SciCodeДоказательство V3
Рейтинг LMSpeed#118
Оценка36.1%
Источникartificialanalysis.ai
Обновлено24 авг. 2026 г.
Достоверность4
SWE-bench Verified*
Рейтинг LMSpeed#5
Оценка63.2
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
AA-SciCodeДоказательство V3
Рейтинг LMSpeed#85
Оценка36.1
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
AA Coding Index
Рейтинг LMSpeed#58
Оценка25.8
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Рассуждение

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка

Оценка44.480% интервал33.6–55.22/4 Измеренные измеренияGPQA75.2%#113 / 211HLE15.8%#93 / 208
Измерения и доказательства
Абстрактная логикаТолько априорное
Научное и причинное рассуждение49.6
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
critpt · critpt · z -0.47 · q 1.00
gpqa · gpqa · z -0.09 · q 1.00
hle · hle · z 0.10 · q 1.00
Многошаговые ограниченияТолько априорное
Интеграция и проверка свидетельств39.2
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
lcr · lcr · z -1.80 · q 1.00
GPQAДоказательство V3
Рейтинг LMSpeed#113
Оценка75.2%
Источникartificialanalysis.ai
Обновлено24 авг. 2026 г.
Достоверность4
HLEДоказательство V3
Рейтинг LMSpeed#93
Оценка15.8%
Источникartificialanalysis.ai
Обновлено24 авг. 2026 г.
Достоверность4
AA-LCRДоказательство V3
Рейтинг LMSpeed#88
Оценка38.3
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
CritPtДоказательство V3
Рейтинг LMSpeed#70
Оценка0.9
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Знания

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка56.480% интервал40.4–72.41/4 Измеренные измеренияGPQA-D76.3#31 / 31MMLU-Pro (Arcee)83.4#4 / 5
Измерения и доказательства
Широкие знания56.4
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
aa_omniscience · artificial_analysis · z 0.77 · q 1.00
Профессиональные знанияТолько априорное
ФактологичностьТолько априорное
Поиск и открытые источникиТолько априорное
GPQA-D
Рейтинг LMSpeed#31
Оценка76.3
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
MMLU-Pro (Arcee)
Рейтинг LMSpeed#4
Оценка83.4
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
Artificial Analysis Intelligence IndexДоказательство V3
Рейтинг LMSpeed#89
Оценка18.7
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
AA-GPQA Diamond
Рейтинг LMSpeed#80
Оценка75.2
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
AA-HLE
Рейтинг LMSpeed#71
Оценка15.8
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
AA-Omniscience Accuracy
Рейтинг LMSpeed#78
Оценка22.5
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
AA-Omniscience Hallucination Rate
Рейтинг LMSpeed#29
Оценка85.9
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1

Математика

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

80% интервал30.8–69.20/4 Измеренные измеренияAIME25 (Arcee)96.3#2 / 5
Измерения и доказательства
Базовая математикаТолько априорное
Олимпиадная математикаТолько априорное
Продвинутые доказательстваТолько априорное
Прикладная математика и инструментыТолько априорное
AIME25 (Arcee)
Рейтинг LMSpeed#2
Оценка96.3
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1

Многоязычность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Межъязыковое пониманиеТолько априорное
Многоязычная генерацияТолько априорное
Перенос рассужденийТолько априорное
Устойчивость для малоресурсных языковТолько априорное

Мультимодальность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

80% интервал30.8–69.20/4 Измеренные измеренияDesign Arena Website1148.0#59 / 75
Измерения и доказательства
Восприятие и OCRТолько априорное
Документы и пространственное пониманиеТолько априорное
Визуальное рассуждениеТолько априорное
Видео и действия в средеТолько априорное
Design Arena Website
Рейтинг LMSpeed#59
Оценка1148.0
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Следование инструкциям

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка48.280% интервал32.2–64.21/4 Измеренные измеренияAA-IFBench56.3#53 / 84
Измерения и доказательства
Соблюдение ограниченийТолько априорное
Структурированный выводТолько априорное
Обобщение новых инструкций48.2
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
ifbench · aa_if_bench · z -0.52 · q 1.00
Многоходовые и длинные инструкцииТолько априорное
AA-IFBenchДоказательство V3
Рейтинг LMSpeed#53
Оценка56.3
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1

Эндпоинты OpenRouter

2 эндпоинтов

Сторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.

Provider endpointВходВыводДоступность 1 деньЗадержка 30мПропускная способность 30мКонтекст / вывод
Parasail
parasail/fp4
$0.220/M$0.850/M100.0%undefined токенов / undefined токенов
Arcee AI
arcee-ai
$0.250/M$0.800/M100.0%undefined токенов / undefined токенов

Альтернативы и похожие модели

Также известна как

arcee-ai/trinity-large-thinkingarcee-ai/trinity-large-thinking:freekilo/trinity-large-thinkingtrinity-large-thinking

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.Стандартные бенчмарки могут включать BenchLM и другие открытые источники.

Работайте с данными LMSpeed

Бесплатно

Бесплатный публичный API для цен LLM, бенчмарков и данных провайдеров

  • Актуальные цены и доступность
  • Бенчмарки скорости и задержки
  • 300+ моделей, 600+ провайдеров
  • 1 000 запросов в день
Документация API