Предоставляет API, совместимые с OpenAI, и управляемые экземпляры GPU для развертывания и масштабирования моделей ИИ с открытым исходным кодом.

Модели
11 моделей
От
--
Скорость
565 tok/s
Обновлено
7/8/2026
Задержка
0.00 s
Дата создания
3/9/2026

Конечные точки API

  • Конечная точка 1
    api.kriora.com
Подтвердить права на провайдера

Подтвердите право собственности, чтобы получить доступ к управлению провайдером:

  • Редактировать название, контент и ссылки провайдера
  • Получить продвижение с приоритетным трафиком и повышенной видимостью
  • Отображать значок верификации для повышения доверия пользователей

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.

О Kriora

Kriora предлагает готовые к работе ИИ API и GPU-инфраструктуру корпоративного уровня для создания интеллектуальных приложений. Ключевые возможности включают:

  • OpenAI-совместимый API: Полная замена с изменением только базового URL, поддержка передовых моделей.
  • Управляемые конечные точки моделей: Оптимизированный инференс для ведущих моделей с открытым исходным кодом — Llama 3.3 70B, Gemma 3 27B Instruct, Qwen3 Next 80B A3B Instruct, DeepSeek V3 0324, Ring 1T и DeepSeek V3.2 Speciale.
  • Развертывание в один клик: Запуск моделей с открытым исходным кодом на управляемых GPU (B200, H200, H100, A100) за считанные секунды.
  • Бессерверный инференс: Оплата за токен для ввода и вывода без дополнительных комиссий.
  • GPU по требованию: Почасовая оплата за выделенные GPU-развертывания.

Типичные сценарии включают разработку ИИ-приложений, развертывание моделей и масштабируемые рабочие нагрузки инференса. Платформа делает акцент на высокой доступности и стабильной производительности.

Мониторинг работоспособности

99%Доступность за последнее время
История (72 точек)
ПрошлоеСейчас

Бенчмарки API и цены

Сравните 11 строк моделей по свежести аудита, последним speedtest, скорости, задержке и цене за токен.

Модель
Скорость
Задержка
344.8 t/s0.82 s
70.7 t/s1.34 s
gemma-3-27b-it
78.0 t/s0.81 s
qwen3.5-397b-a17b
138.2 t/s1.26 s
intellect-3
67.9 t/s8.19 s
google/gemma-3-27b-it
54.0 t/s0.89 s
inclusionai/ring-1t
91.2 t/s5.95 s
103.5 t/s8.67 s
101.7 t/s8.79 s
1180.9 t/s2.02 s
112.9 t/s8.90 s

Показано 11 из 11 строк моделей

Последние записи тестов

ВремяМодельСкоростьЗадержка
Apr 2, 11:03 PM
kimi-k2.5
1231.67 tok/s
1.29s
Mar 26, 11:07 AM
kimi-k2.5
995.39 tok/s
1.17s
Mar 26, 11:06 AM
glm-5
101.67 tok/s
8.79s
Mar 22, 01:41 AM
kimi-k2.5
1275.28 tok/s
1.13s
Mar 22, 01:40 AM
glm-4.7
112.93 tok/s
8.90s
Mar 22, 01:39 AM
minimax-m2.5
103.52 tok/s
8.67s
Mar 14, 06:34 PM
kimi-k2.5
1280.08 tok/s
1.14s
Mar 14, 06:33 PM
deepseek-v3-0324
345.85 tok/s
0.81s
Mar 11, 11:04 AM
deepseek-v3-0324
345.15 tok/s
0.85s
Mar 11, 10:31 AM
kimi-k2.5
1485.27 tok/s
1.31s

Похожие альтернативные API-провайдеры для сравнения

Сравните альтернативы Kriora среди 6 близких API-провайдеров по 95 сигналам LMSpeed: общим моделям, ценам, скорости бенчмарков, доступности и бесплатным моделям.

ПровайдерПочему сравниватьМоделиБесплатноСредняя ценаСкоростьДоступность 30д
Kriora

api-kriora-com

Provides OpenAI-compatible APIs and managed GPU instances for deploying and scaling open-source AI models.

Текущий провайдер как база110N/A565 tok/s9970%
OpenRouter

openrouter

A unified API interface providing access to over 300 models from 60+ providers, including OpenAI, Anthropic, and Google.

  • Выше доступность за 30 дней
  • Шире покрытие моделей
  • Та же категория провайдера
6140N/A93 tok/s10000%
S3AI API

s3ai-api

  • Больше бесплатных моделей
  • Шире покрытие моделей
  • Та же категория провайдера
26162$0.000000103/M59 tok/s9590%
七牛云

qiniu-2

七牛云提供AI大模型推理服务,包括多种模型调用、智能问答助手、代码助手等企业级AI解决方案。

  • Выше доступность за 30 дней
  • Шире покрытие моделей
  • Та же категория провайдера
920N/A90 tok/s9980%
共绩算力(算了么 API)

api-suanli-cn

Gongji Compute (共绩算力) provides pay-as-you-go, standard API access to mainstream LLMs and elastic GPU computing for AI applications.

  • Больше бесплатных моделей
  • Шире покрытие моделей
  • Та же категория провайдера
155N/A36 tok/s7300%
NVIDIA NIM

nvidia-nim

NVIDIA NIM provides optimized AI model inference APIs for LLMs, vision, and embedding models through NVIDIA cloud infrastructure.

  • Шире покрытие моделей
  • Та же категория провайдера
1680N/A82 tok/s9960%
SiliconFlow

siliconflow

Provides cost-effective generative AI cloud services based on open-source models for text, image, video, and audio generation.

  • Шире покрытие моделей
  • Та же категория провайдера
1540N/A59 tok/s6160%

Примечания

  • Проверки работоспособности: Область: график за 72 часа и недавняя доступность измеряют только подключение к API. Каждый столбец суммирует проверки за один час. Цели: LMSpeed сначала проверяет настроенный URL проверки и URL статуса провайдера, затем API-адреса, полученные из известных API-хостов и недавних базовых URL speed-test. Сайт используется только тогда, когда его адрес похож на API endpoint. Этапы: для каждого адреса выполняются DNS-разрешение, TCP-соединение, TLS-рукопожатие для HTTPS и HTTP HEAD с переходом по редиректам. После первого доступного адреса проверка прекращается. Критерий доступности: все обязательные сетевые этапы должны завершиться успешно. HTTP-ответ ниже 500, включая 401 от API с аутентификацией, считается доступным, кроме статусов, классифицированных как блокировка. Блокировки: HTTP 403, 429, 521, 525 и 530, а также обнаруженные проверки WAF или Cloudflare, помечаются как заблокированные и не учитываются при расчёте доступности, поскольку LMSpeed не может определить, отключён ли сам API. Доступность моделей: если настроен отдельный тестовый ключ, LMSpeed отправляет аутентифицированный GET-запрос к вычисленному endpoint /models и сравнивает полученные ID с моделями провайдера. Результаты по моделям показываются в разделе «Модели и цены» и не включаются в процент доступности API. Таймауты: TCP-соединение, TLS-рукопожатие, HTTP-проверка и запрос моделей используют отдельный 20-секундный таймаут. Полный запуск может занять больше времени при проверке нескольких адресов. Периодичность: фоновый worker по умолчанию проверяет всех провайдеров каждые 5 минут. На 72-часовом графике эти выборки объединяются в почасовые столбцы; оператор также может изменить расписание. Ограничение: автоматические выборочные проверки не являются SLA и не гарантируют квоту аккаунта, доступность каждой модели и региона или успешное выполнение запросов генерации. Перед операционными решениями проверьте официальную страницу статуса провайдера.
  • Данные Domain Rating поступают от Ahrefs. Это оценка силы домена от 0 до 100 на основе обратных ссылок; она не измеряет скорость или надежность API.
  • Объявления и FAQ берутся из снимка статуса NewAPI этого провайдера, если он доступен. LMSpeed сохраняет исходный контент и необязательные английские переводы из источника статуса провайдера, затем показывает на странице локализованные поля.