Hugging Face — платформа для сотрудничества в области машинного обучения, размещающая более 1 миллиона моделей, 250 000 наборов данных и 400 000 приложений. Поддерживает различные модальности, включая текст, изображения, видео, аудио и 3D. Ключевые предложения включают Hugging Face Hub для публичного хостинга, Inference Providers API для доступа к более чем 45 000 моделей ведущих AI-провайдеров, а также вычислительные решения, такие как Inference Endpoints и Spaces с поддержкой GPU. Корпоративные тарифы начинаются от $20/пользователь/месяц, вычислительные ресурсы от $0.60/час для GPU. Сценарии использования включают обнаружение моделей, развёртывание приложений и командную работу в AI-разработке.
Hugging Face Router обеспечивает интеллектуальную маршрутизацию моделей между Inference Providers, предоставляя доступ к моделям с открытым исходным кодом через API, совместимый с OpenAI.
- Модели
- 10 моделей
- От
- --
- Скорость
- 138 tok/s
- Обновлено
- 7/8/2026
- Задержка
- 0.00 s
- Дата создания
- 8/13/2025
Конечные точки API
- Конечная точка 1
router.huggingface.co - Конечная точка 2
huggingface.co
Подтвердите право собственности, чтобы получить доступ к управлению провайдером:
- Редактировать название, контент и ссылки провайдера
- Получить продвижение с приоритетным трафиком и повышенной видимостью
- Отображать значок верификации для повышения доверия пользователей
Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.
О Hugging Face
Мониторинг работоспособности
Бенчмарки API и цены
Сравните 8 строк моделей по свежести аудита, последним speedtest, скорости, задержке и цене за токен.
| 109.0 t/s | 7.99 s | |
meta-llama/Llama-3.3-70B-Instruct | 416.2 t/s | 0.26 s |
| 48.8 t/s | 1.21 s | |
Qwen/Qwen3-Coder-480B-A35B-Instruct:novita | 63.6 t/s | 1.06 s |
| 240.3 t/s | 1.26 s | |
| 155.7 t/s | 3.56 s | |
| 35.4 t/s | 1.39 s | |
| 34.1 t/s | 1.12 s |
Показано 8 из 8 строк моделей
Последние записи тестов
| Время | Модель | Скорость | Задержка |
|---|---|---|---|
| Apr 1, 06:16 AM | Qwen/Qwen3.5-9B | 108.96 tok/s | 7.99s |
| Jan 14, 02:25 AM | meta-llama/Llama-3.3-70B-Instruct | 416.19 tok/s | 0.26s |
| Aug 13, 03:29 PM | moonshotai/Kimi-K2-Instruct:novita | 48.81 tok/s | 1.21s |
| Aug 13, 03:26 PM | Qwen/Qwen3-Coder-480B-A35B-Instruct:novita | 63.59 tok/s | 1.06s |
| Aug 13, 02:45 PM | openai/gpt-oss-20b:novita | 155.67 tok/s | 3.56s |
| Aug 13, 02:41 PM | openai/gpt-oss-120b:novita | 240.32 tok/s | 1.26s |
| Aug 13, 02:35 PM | zai-org/GLM-4.5:novita | 35.36 tok/s | 1.39s |
| Aug 13, 03:46 AM | Qwen/Qwen3-235B-A22B:novita | 34.12 tok/s | 1.12s |
Похожие альтернативные API-провайдеры для сравнения
Сравните альтернативы Hugging Face среди 6 близких API-провайдеров по 106 сигналам LMSpeed: общим моделям, ценам, скорости бенчмарков, доступности и бесплатным моделям.
| Провайдер | Почему сравнивать | Модели | Бесплатно | Средняя цена | Скорость | Доступность 30д |
|---|---|---|---|---|---|---|
| Hugging Face router-huggingface-co Hugging Face Router provides intelligent model routing across Inference Providers, offering OpenAI-compatible API access to open-source models. | Текущий провайдер как база | 10 | 0 | N/A | 138 tok/s | 0% |
| S3AI API s3ai-api |
| 261 | 62 | $0.000000103/M | 59 tok/s | 9580% |
| Fireworks AI api-fireworks-ai Fireworks AI provides a cloud platform for running and fine-tuning open-source AI models with optimized inference for production applications. |
| 36 | 0 | N/A | 139 tok/s | 5350% |
| 共绩算力(算了么 API) api-suanli-cn Gongji Compute (共绩算力) provides pay-as-you-go, standard API access to mainstream LLMs and elastic GPU computing for AI applications. |
| 15 | 5 | N/A | 36 tok/s | 7360% |
| iTokens itokens iTokens is an OpenAI-compatible AI API gateway with usage-based access to models from DeepSeek, GLM, Kimi, Qwen, MiniMax, KwaiKAT, and other developers. It publishes per-model token pricing and offers promotional credits to new users. |
| 12 | 0 | $0.168/M | 149 tok/s | 9940% |
| JembatanAI jembatanai |
| 12 | 0 | N/A | 185 tok/s | 9720% |
| Kriora api-kriora-com Provides OpenAI-compatible APIs and managed GPU instances for deploying and scaling open-source AI models. |
| 11 | 0 | N/A | 565 tok/s | 9970% |
Примечания
- Проверки работоспособности: Область: график за 72 часа и недавняя доступность измеряют только подключение к API. Каждый столбец суммирует проверки за один час. Цели: LMSpeed сначала проверяет настроенный URL проверки и URL статуса провайдера, затем API-адреса, полученные из известных API-хостов и недавних базовых URL speed-test. Сайт используется только тогда, когда его адрес похож на API endpoint. Этапы: для каждого адреса выполняются DNS-разрешение, TCP-соединение, TLS-рукопожатие для HTTPS и HTTP HEAD с переходом по редиректам. После первого доступного адреса проверка прекращается. Критерий доступности: все обязательные сетевые этапы должны завершиться успешно. HTTP-ответ ниже 500, включая 401 от API с аутентификацией, считается доступным, кроме статусов, классифицированных как блокировка. Блокировки: HTTP 403, 429, 521, 525 и 530, а также обнаруженные проверки WAF или Cloudflare, помечаются как заблокированные и не учитываются при расчёте доступности, поскольку LMSpeed не может определить, отключён ли сам API. Доступность моделей: если настроен отдельный тестовый ключ, LMSpeed отправляет аутентифицированный GET-запрос к вычисленному endpoint /models и сравнивает полученные ID с моделями провайдера. Результаты по моделям показываются в разделе «Модели и цены» и не включаются в процент доступности API. Таймауты: TCP-соединение, TLS-рукопожатие, HTTP-проверка и запрос моделей используют отдельный 20-секундный таймаут. Полный запуск может занять больше времени при проверке нескольких адресов. Периодичность: фоновый worker по умолчанию проверяет всех провайдеров каждые 5 минут. На 72-часовом графике эти выборки объединяются в почасовые столбцы; оператор также может изменить расписание. Ограничение: автоматические выборочные проверки не являются SLA и не гарантируют квоту аккаунта, доступность каждой модели и региона или успешное выполнение запросов генерации. Перед операционными решениями проверьте официальную страницу статуса провайдера.
- Данные Domain Rating поступают от Ahrefs. Это оценка силы домена от 0 до 100 на основе обратных ссылок; она не измеряет скорость или надежность API.
- Объявления и FAQ берутся из снимка статуса NewAPI этого провайдера, если он доступен. LMSpeed сохраняет исходный контент и необязательные английские переводы из источника статуса провайдера, затем показывает на странице локализованные поля.

