IBM
·Released on 30 апр. 2026 г.

Granite 4.1 8B API Benchmarks, Pricing & Provider Data

Compare Granite 4.1 8B with another model

Choose a model to open its comparison page.

Share on X
LLM

Granite 4.1 8B is a dense, decoder-only 8-billion-parameter language model from IBM, part of the Granite 4.1 family. It supports a 131K-token context window and is designed for enterprise tasks...

Производительность по категориям

Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.

Покрытие
2 / 8
Методология
V3.0
Производительность по категориямОценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.Агенты-Программирование38.2Рассуждение39.2Знания-Математика-Многоязычность-Мультимодальность-Следование инструкциям-
#1Рассуждение39.2Предварительная1/4 Измеренные измерения
80% интервал: 25.353.1
abstract logicТолько априорное
scientific causal39.2
gpqa · gpqa / hle · hle
multistep constraintsТолько априорное
evidence verificationТолько априорное
#2Программирование38.2Предварительная1/4 Измеренные измерения
80% интервал: 22.254.1
code generation38.2
scicode · scicode
repository engineeringТолько априорное
debugging testingТолько априорное
tooling qualityТолько априорное
Нет данных:АгентыЗнанияМатематикаМногоязычностьМультимодальностьСледование инструкциям

Specifications

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
131.1Ktokens
157.3 pages of text
OUTPUT
131.1Ktokens
8K128K1M4M
131.1K

Возможности

Technical Details

Вход
Выход
Всего параметров
8B
Выпущена
Apr 2026
Документация
Токенизатор
Other
Архитектура
text->text
Модерация
Нет
Поддерживаемые параметры
frequency_penaltylogprobsmax_tokenspresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Rankings

Excels at

Подробные оценки

Обновлено: 23 авг. 2026 г.

Скорость и задержка

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Скорость вывода124.8 tok/s#25 / 74Время до первого токена0.45 s#6 / 74
Скорость вывода
Output speed
Рейтинг LMSpeed#25
Оценка124.8 tok/s
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4
Время до первого токена
Time to first token
Рейтинг LMSpeed#6
Оценка0.45 s
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4

Цены

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Цена входных данных$0.050/M#2 / 180Цена выходных данных$0.100/M#1 / 180
Цена входных данных
Input price
Рейтинг LMSpeed#2
Оценка$0.050/M
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4
Цена выходных данных
Output price
Рейтинг LMSpeed#1
Оценка$0.100/M
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4

Агенты

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Планирование и декомпозицияТолько априорное
Использование инструментовТолько априорное
Среда и длительное выполнениеТолько априорное
Восстановление и надёжность завершенияТолько априорное

Программирование

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка38.280% интервал22.2–54.11/4 Измеренные измеренияSciCode21.8%#190 / 204
Измерения и доказательства
Генерация кода38.2
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
scicode · scicode · z -1.72 · q 1.00
Работа с репозиториямиТолько априорное
Отладка и тестированиеТолько априорное
Инструментальная разработка и качествоТолько априорное
SciCodeДоказательство V3
Рейтинг LMSpeed#190
Оценка21.8%
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4

Рассуждение

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка39.280% интервал25.3–53.11/4 Измеренные измеренияGPQA43.3%#192 / 211HLE3.8%#183 / 208
Измерения и доказательства
Абстрактная логикаТолько априорное
Научное и причинное рассуждение39.2
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
gpqa · gpqa · z -1.39 · q 1.00
hle · hle · z -0.91 · q 1.00
Многошаговые ограниченияТолько априорное
Интеграция и проверка свидетельствТолько априорное
GPQAДоказательство V3
Рейтинг LMSpeed#192
Оценка43.3%
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4
HLEДоказательство V3
Рейтинг LMSpeed#183
Оценка3.8%
Источникartificialanalysis.ai
Обновлено23 авг. 2026 г.
Достоверность4

Знания

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Широкие знанияТолько априорное
Профессиональные знанияТолько априорное
ФактологичностьТолько априорное
Поиск и открытые источникиТолько априорное

Математика

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Базовая математикаТолько априорное
Олимпиадная математикаТолько априорное
Продвинутые доказательстваТолько априорное
Прикладная математика и инструментыТолько априорное

Многоязычность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Межъязыковое пониманиеТолько априорное
Многоязычная генерацияТолько априорное
Перенос рассужденийТолько априорное
Устойчивость для малоресурсных языковТолько априорное

Мультимодальность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Восприятие и OCRТолько априорное
Документы и пространственное пониманиеТолько априорное
Визуальное рассуждениеТолько априорное
Видео и действия в средеТолько априорное

Следование инструкциям

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Соблюдение ограниченийТолько априорное
Структурированный выводТолько априорное
Обобщение новых инструкцийТолько априорное
Многоходовые и длинные инструкцииТолько априорное

Эндпоинты OpenRouter

1 эндпоинтов

Сторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.

Provider endpointВходВыводДоступность 1 деньЗадержка 30мПропускная способность 30мКонтекст / вывод
CoreWeave
coreweave/bf16
$0.050/M$0.100/M100%undefined токенов / undefined токенов

Альтернативы и похожие модели

Также известна как

ibm-granite/granite-4.1-8b

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.Artificial AnalysisСтандартные бенчмарки могут включать BenchLM и другие открытые источники.

Работайте с данными LMSpeed

Бесплатно

Бесплатный публичный API для цен LLM, бенчмарков и данных провайдеров

  • Актуальные цены и доступность
  • Бенчмарки скорости и задержки
  • 300+ моделей, 600+ провайдеров
  • 1 000 запросов в день
Документация API