Hugging Face Router обеспечивает интеллектуальную маршрутизацию моделей между Inference Providers, предоставляя доступ к моделям с открытым исходным кодом через API, совместимый с OpenAI.

Модели
10 моделей
От
--
Скорость
138 tok/s
Обновлено
7/8/2026
Задержка
0.00 s
Дата создания
8/13/2025

Конечные точки API

  • Конечная точка 1
    router.huggingface.co
  • Конечная точка 2
    huggingface.co
Подтвердить права на провайдера

Подтвердите право собственности, чтобы получить доступ к управлению провайдером:

  • Редактировать название, контент и ссылки провайдера
  • Получить продвижение с приоритетным трафиком и повышенной видимостью
  • Отображать значок верификации для повышения доверия пользователей

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.

О Hugging Face

Hugging Face — платформа для сотрудничества в области машинного обучения, размещающая более 1 миллиона моделей, 250 000 наборов данных и 400 000 приложений. Поддерживает различные модальности, включая текст, изображения, видео, аудио и 3D. Ключевые предложения включают Hugging Face Hub для публичного хостинга, Inference Providers API для доступа к более чем 45 000 моделей ведущих AI-провайдеров, а также вычислительные решения, такие как Inference Endpoints и Spaces с поддержкой GPU. Корпоративные тарифы начинаются от $20/пользователь/месяц, вычислительные ресурсы от $0.60/час для GPU. Сценарии использования включают обнаружение моделей, развёртывание приложений и командную работу в AI-разработке.

Мониторинг работоспособности

0%Доступность за последнее время
История (72 точек)
ПрошлоеСейчас

Бенчмарки API и цены

Сравните 8 строк моделей по свежести аудита, последним speedtest, скорости, задержке и цене за токен.

Модель
Скорость
Задержка
109.0 t/s7.99 s
meta-llama/Llama-3.3-70B-Instruct
416.2 t/s0.26 s
48.8 t/s1.21 s
Qwen/Qwen3-Coder-480B-A35B-Instruct:novita
63.6 t/s1.06 s
240.3 t/s1.26 s
155.7 t/s3.56 s
35.4 t/s1.39 s
34.1 t/s1.12 s

Показано 8 из 8 строк моделей

Последние записи тестов

ВремяМодельСкоростьЗадержка
Apr 1, 06:16 AM
Qwen/Qwen3.5-9B
108.96 tok/s
7.99s
Jan 14, 02:25 AM
meta-llama/Llama-3.3-70B-Instruct
416.19 tok/s
0.26s
Aug 13, 03:29 PM
moonshotai/Kimi-K2-Instruct:novita
48.81 tok/s
1.21s
Aug 13, 03:26 PM
Qwen/Qwen3-Coder-480B-A35B-Instruct:novita
63.59 tok/s
1.06s
Aug 13, 02:45 PM
openai/gpt-oss-20b:novita
155.67 tok/s
3.56s
Aug 13, 02:41 PM
openai/gpt-oss-120b:novita
240.32 tok/s
1.26s
Aug 13, 02:35 PM
zai-org/GLM-4.5:novita
35.36 tok/s
1.39s
Aug 13, 03:46 AM
Qwen/Qwen3-235B-A22B:novita
34.12 tok/s
1.12s

Похожие альтернативные API-провайдеры для сравнения

Сравните альтернативы Hugging Face среди 6 близких API-провайдеров по 106 сигналам LMSpeed: общим моделям, ценам, скорости бенчмарков, доступности и бесплатным моделям.

ПровайдерПочему сравниватьМоделиБесплатноСредняя ценаСкоростьДоступность 30д
Hugging Face

router-huggingface-co

Hugging Face Router provides intelligent model routing across Inference Providers, offering OpenAI-compatible API access to open-source models.

Текущий провайдер как база100N/A138 tok/s0%
S3AI API

s3ai-api

  • Выше доступность за 30 дней
  • Больше бесплатных моделей
  • Шире покрытие моделей
  • Та же категория провайдера
26162$0.000000103/M59 tok/s9580%
Fireworks AI

api-fireworks-ai

Fireworks AI provides a cloud platform for running and fine-tuning open-source AI models with optimized inference for production applications.

  • Выше измеренная скорость
  • Выше доступность за 30 дней
  • Шире покрытие моделей
  • Та же категория провайдера
360N/A139 tok/s5350%
共绩算力(算了么 API)

api-suanli-cn

Gongji Compute (共绩算力) provides pay-as-you-go, standard API access to mainstream LLMs and elastic GPU computing for AI applications.

  • Выше доступность за 30 дней
  • Больше бесплатных моделей
  • Шире покрытие моделей
  • Та же категория провайдера
155N/A36 tok/s7360%
iTokens

itokens

iTokens is an OpenAI-compatible AI API gateway with usage-based access to models from DeepSeek, GLM, Kimi, Qwen, MiniMax, KwaiKAT, and other developers. It publishes per-model token pricing and offers promotional credits to new users.

  • Выше измеренная скорость
  • Выше доступность за 30 дней
  • Шире покрытие моделей
  • Та же категория провайдера
120$0.168/M149 tok/s9940%
JembatanAI

jembatanai

  • Выше измеренная скорость
  • Выше доступность за 30 дней
  • Шире покрытие моделей
  • Та же категория провайдера
120N/A185 tok/s9720%
Kriora

api-kriora-com

Provides OpenAI-compatible APIs and managed GPU instances for deploying and scaling open-source AI models.

  • Выше измеренная скорость
  • Выше доступность за 30 дней
  • Шире покрытие моделей
  • Та же категория провайдера
110N/A565 tok/s9970%

Примечания

  • Проверки работоспособности: Область: график за 72 часа и недавняя доступность измеряют только подключение к API. Каждый столбец суммирует проверки за один час. Цели: LMSpeed сначала проверяет настроенный URL проверки и URL статуса провайдера, затем API-адреса, полученные из известных API-хостов и недавних базовых URL speed-test. Сайт используется только тогда, когда его адрес похож на API endpoint. Этапы: для каждого адреса выполняются DNS-разрешение, TCP-соединение, TLS-рукопожатие для HTTPS и HTTP HEAD с переходом по редиректам. После первого доступного адреса проверка прекращается. Критерий доступности: все обязательные сетевые этапы должны завершиться успешно. HTTP-ответ ниже 500, включая 401 от API с аутентификацией, считается доступным, кроме статусов, классифицированных как блокировка. Блокировки: HTTP 403, 429, 521, 525 и 530, а также обнаруженные проверки WAF или Cloudflare, помечаются как заблокированные и не учитываются при расчёте доступности, поскольку LMSpeed не может определить, отключён ли сам API. Доступность моделей: если настроен отдельный тестовый ключ, LMSpeed отправляет аутентифицированный GET-запрос к вычисленному endpoint /models и сравнивает полученные ID с моделями провайдера. Результаты по моделям показываются в разделе «Модели и цены» и не включаются в процент доступности API. Таймауты: TCP-соединение, TLS-рукопожатие, HTTP-проверка и запрос моделей используют отдельный 20-секундный таймаут. Полный запуск может занять больше времени при проверке нескольких адресов. Периодичность: фоновый worker по умолчанию проверяет всех провайдеров каждые 5 минут. На 72-часовом графике эти выборки объединяются в почасовые столбцы; оператор также может изменить расписание. Ограничение: автоматические выборочные проверки не являются SLA и не гарантируют квоту аккаунта, доступность каждой модели и региона или успешное выполнение запросов генерации. Перед операционными решениями проверьте официальную страницу статуса провайдера.
  • Данные Domain Rating поступают от Ahrefs. Это оценка силы домена от 0 до 100 на основе обратных ссылок; она не измеряет скорость или надежность API.
  • Объявления и FAQ берутся из снимка статуса NewAPI этого провайдера, если он доступен. LMSpeed сохраняет исходный контент и необязательные английские переводы из источника статуса провайдера, затем показывает на странице локализованные поля.