Groq обеспечивает быстрый и недорогой AI-инференс через свою архитектуру LPU и платформу GroqCloud.

Модели
20 моделей
От
--
Скорость
20 tok/s
Обновлено
7/8/2026
Задержка
0.00 s
Дата создания
12/8/2025

Конечные точки API

  • Конечная точка 1
    api.groq.com
Подтвердить права на провайдера

Подтвердите право собственности, чтобы получить доступ к управлению провайдером:

  • Редактировать название, контент и ссылки провайдера
  • Получить продвижение с приоритетным трафиком и повышенной видимостью
  • Отображать значок верификации для повышения доверия пользователей

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.

О Groq

Groq предлагает услуги AI-инференса через свою платформу GroqCloud, построенную на архитектуре LPU (Language Processing Unit), разработанной для скорости и доступности в масштабе. Ключевые возможности включают высокопроизводительный инференс для AI-моделей с акцентом на низкую задержку и экономическую эффективность. Платформа поддерживает разработчиков и предприятия, предоставляя API-доступ для создания AI-приложений. Среди заметных преимуществ — высокая скорость инференса и конкурентоспособные цены, что подтверждается историями клиентов и демонстрациями. Типичные сценарии использования включают AI-приложения в различных отраслях, например, продемонстрированные такими партнерами, как McLaren F1 Team, Dropbox, Vercel и другими. Сервис включает бесплатные API-ключи, документацию и поддержку сообщества для разработчиков.

Мониторинг работоспособности

100%Доступность за последнее время
История (72 точек)
ПрошлоеСейчас

Бенчмарки API и цены

Сравните 20 строк моделей по свежести аудита, последним speedtest, скорости, задержке и цене за токен.

Модель
Скорость
Задержка
qwen/qwen3.8-27b
--
qwen/qwen3.6-27b
--
allam-2-7b
--
canopylabs/orpheus-arabic-saudi
--
canopylabs/orpheus-v1-english
--
groq/compound
--
groq/compound-mini
--
llama-3.1-8b-instant
--
llama-3.3-70b-versatile
--
meta-llama/llama-4-scout-17b-16e-instruct
447.8 t/s0.20 s
meta-llama/llama-prompt-guard-2-22m
--
meta-llama/llama-prompt-guard-2-86m
--
openai/gpt-oss-120b
--
openai/gpt-oss-20b
--
openai/gpt-oss-safeguard-20b
--
qwen/qwen3-32b
--
whisper-large-v3
--
whisper-large-v3-turbo
--
19.7 t/s25.30 s
53.0 t/s8.89 s

Показано 20 из 20 строк моделей

Free resources

Community-shared API keys and redeem codes associated with Groq.

Free API keys

10
View all
API ключ / СтатусAPI URLМоделиДобавлен

gsk_VN***h4Ym

Available
https://api.groq.com/openai/v1meta-llama/llama-prompt-guard-2-22m · qwen/qwen3.8-27b · +12free· 8 сент. 2026 г.

gsk_55***hB0K

Available
https://api.groq.com/openai/v1openai/gpt-oss-120b · meta-llama/llama-prompt-guard-2-86m · +12free· 8 сент. 2026 г.

gsk_Sr***8W45

Available
https://api.groq.com/openai/v1allam-2-7b · whisper-large-v3 · +12free· 7 сент. 2026 г.

gsk_p7***tPjW

Available
https://api.groq.com/openai/v1canopylabs/orpheus-arabic-saudi · meta-llama/llama-prompt-guard-2-86m · +12free· 7 сент. 2026 г.

Последние записи тестов

ВремяМодельСкоростьЗадержка
Apr 25, 11:32 PM
meta-llama/llama-4-scout-17b-16e-instruct
447.76 tok/s
0.20s
Dec 23, 03:21 PM
free:Qwen3-30B-A3B
23.23 tok/s
18.61s
Dec 20, 02:59 AM
free:Qwen3-30B-A3B
24.49 tok/s
13.14s
Dec 18, 08:29 AM
free:Qwen3-30B-A3B
30.07 tok/s
9.45s
Dec 18, 04:35 AM
free:Qwen3-30B-A3B
22.38 tok/s
27.29s
Dec 17, 09:28 AM
free:Qwen3-30B-A3B
24.97 tok/s
15.03s
Dec 16, 12:22 PM
free:Qwen3-30B-A3B
21.75 tok/s
4.61s
Dec 16, 07:52 AM
free:Qwen3-30B-A3B
19.47 tok/s
23.58s
Dec 14, 04:14 PM
free:Qwen3-30B-A3B
29.29 tok/s
5.65s
Dec 13, 03:57 PM
free:Qwen3-30B-A3B
21.04 tok/s
1.45s

Похожие альтернативные API-провайдеры для сравнения

Сравните альтернативы Groq среди 6 близких API-провайдеров по 98 сигналам LMSpeed: общим моделям, ценам, скорости бенчмарков, доступности и бесплатным моделям.

ПровайдерПочему сравниватьМоделиБесплатноСредняя ценаСкоростьДоступность 30д
Groq

groq

Groq provides fast and low-cost AI inference through its LPU architecture and GroqCloud platform.

Текущий провайдер как база200N/A20 tok/s9670%
OpenRouter

openrouter

A unified API interface providing access to over 300 models from 60+ providers, including OpenAI, Anthropic, and Google.

  • Выше измеренная скорость
  • Выше доступность за 30 дней
  • Шире покрытие моделей
  • Та же категория провайдера
6140N/A93 tok/s10000%
S3AI API

s3ai-api

  • Выше измеренная скорость
  • Больше бесплатных моделей
  • Шире покрытие моделей
  • Та же категория провайдера
26162$0.000000103/M59 tok/s9590%
NVIDIA NIM

nvidia-nim

NVIDIA NIM provides optimized AI model inference APIs for LLMs, vision, and embedding models through NVIDIA cloud infrastructure.

  • Выше измеренная скорость
  • Выше доступность за 30 дней
  • Шире покрытие моделей
  • Та же категория провайдера
1680N/A82 tok/s9960%
七牛云

qiniu-2

七牛云提供AI大模型推理服务,包括多种模型调用、智能问答助手、代码助手等企业级AI解决方案。

  • Выше измеренная скорость
  • Выше доступность за 30 дней
  • Шире покрытие моделей
  • Та же категория провайдера
920N/A90 tok/s9980%
SophNet

www-sophnet-com

An AI development platform offering API access to models like DeepSeek and Qwen for tasks such as text generation and code creation.

  • Выше измеренная скорость
  • Выше доступность за 30 дней
  • Шире покрытие моделей
  • Та же категория провайдера
720N/A122 tok/s9960%
SiliconFlow

siliconflow

Provides cost-effective generative AI cloud services based on open-source models for text, image, video, and audio generation.

  • Выше измеренная скорость
  • Шире покрытие моделей
  • Та же категория провайдера
1540N/A59 tok/s6150%

Примечания

  • Проверки работоспособности: Область: график за 72 часа и недавняя доступность измеряют только подключение к API. Каждый столбец суммирует проверки за один час. Цели: LMSpeed сначала проверяет настроенный URL проверки и URL статуса провайдера, затем API-адреса, полученные из известных API-хостов и недавних базовых URL speed-test. Сайт используется только тогда, когда его адрес похож на API endpoint. Этапы: для каждого адреса выполняются DNS-разрешение, TCP-соединение, TLS-рукопожатие для HTTPS и HTTP HEAD с переходом по редиректам. После первого доступного адреса проверка прекращается. Критерий доступности: все обязательные сетевые этапы должны завершиться успешно. HTTP-ответ ниже 500, включая 401 от API с аутентификацией, считается доступным, кроме статусов, классифицированных как блокировка. Блокировки: HTTP 403, 429, 521, 525 и 530, а также обнаруженные проверки WAF или Cloudflare, помечаются как заблокированные и не учитываются при расчёте доступности, поскольку LMSpeed не может определить, отключён ли сам API. Доступность моделей: если настроен отдельный тестовый ключ, LMSpeed отправляет аутентифицированный GET-запрос к вычисленному endpoint /models и сравнивает полученные ID с моделями провайдера. Результаты по моделям показываются в разделе «Модели и цены» и не включаются в процент доступности API. Таймауты: TCP-соединение, TLS-рукопожатие, HTTP-проверка и запрос моделей используют отдельный 20-секундный таймаут. Полный запуск может занять больше времени при проверке нескольких адресов. Периодичность: фоновый worker по умолчанию проверяет всех провайдеров каждые 5 минут. На 72-часовом графике эти выборки объединяются в почасовые столбцы; оператор также может изменить расписание. Ограничение: автоматические выборочные проверки не являются SLA и не гарантируют квоту аккаунта, доступность каждой модели и региона или успешное выполнение запросов генерации. Перед операционными решениями проверьте официальную страницу статуса провайдера.
  • Данные Domain Rating поступают от Ahrefs. Это оценка силы домена от 0 до 100 на основе обратных ссылок; она не измеряет скорость или надежность API.
  • Объявления и FAQ берутся из снимка статуса NewAPI этого провайдера, если он доступен. LMSpeed сохраняет исходный контент и необязательные английские переводы из источника статуса провайдера, затем показывает на странице локализованные поля.