提供与OpenAI兼容的API和托管GPU实例,用于部署和扩展开源AI模型。

模型
11 个
最低
--
速度
565 tok/s
更新
7/8/2026
延迟
0.00 s
创建时间
3/9/2026

API 地址

  • 接口 1
    api.kriora.com
认领该站点

完成站点认证,解锁以下权益:

  • 编辑服务商名称、正文和链接
  • 获得优先流量扶持和曝光推荐
  • 展示官方认证徽章,提升用户信任

排行榜排名

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。

关于 Kriora

Kriora提供生产就绪的AI API和企业级GPU基础设施,用于构建智能应用。主要功能包括:

  • OpenAI兼容API:只需更改基础URL即可直接替换,支持最先进的模型。
  • 托管模型端点:为领先的开源模型(如Llama 3.3 70B、Gemma 3 27B Instruct、Qwen3 Next 80B A3B Instruct、DeepSeek V3 0324、Ring 1T和DeepSeek V3.2 Speciale)提供优化推理。
  • 一键部署:在几秒钟内将开源模型部署到托管GPU(例如B200、H200、H100、A100)。
  • 无服务器推理:按输入和输出令牌付费,无额外费用。
  • 按需GPU实例:专用GPU部署的每小时定价。

典型用例包括AI应用开发、模型部署和可扩展推理工作负载。该平台强调高可用性和一致性能。

健康检查

99%近期可用性
历史记录 (72 条)
过去现在

API 基准测试与价格

按 11 个模型行对比最新 audit、最新测速、吞吐、延迟与按 token 计费价格。

模型
速度
延迟
344.8 t/s0.82 s
70.7 t/s1.34 s
gemma-3-27b-it
78.0 t/s0.81 s
qwen3.5-397b-a17b
138.2 t/s1.26 s
intellect-3
67.9 t/s8.19 s
google/gemma-3-27b-it
54.0 t/s0.89 s
inclusionai/ring-1t
91.2 t/s5.95 s
103.5 t/s8.67 s
101.7 t/s8.79 s
1180.9 t/s2.02 s
112.9 t/s8.90 s

当前显示 11 / 11 个模型行

最近测试记录

时间模型速度延迟
Apr 2, 11:03 PM
kimi-k2.5
1231.67 tok/s
1.29s
Mar 26, 11:07 AM
kimi-k2.5
995.39 tok/s
1.17s
Mar 26, 11:06 AM
glm-5
101.67 tok/s
8.79s
Mar 22, 01:41 AM
kimi-k2.5
1275.28 tok/s
1.13s
Mar 22, 01:40 AM
glm-4.7
112.93 tok/s
8.90s
Mar 22, 01:39 AM
minimax-m2.5
103.52 tok/s
8.67s
Mar 14, 06:34 PM
kimi-k2.5
1280.08 tok/s
1.14s
Mar 14, 06:33 PM
deepseek-v3-0324
345.85 tok/s
0.81s
Mar 11, 11:04 AM
deepseek-v3-0324
345.15 tok/s
0.85s
Mar 11, 10:31 AM
kimi-k2.5
1485.27 tok/s
1.31s

相似 API 替代服务商对比

用 94 个 LMSpeed 信号,把 Kriora 的 6 个相近 API 替代服务商放在一起比较:共享模型覆盖、价格、实测速度、可用性和免费模型。

服务商对比理由模型数免费项均价速度30 天可用性
Kriora

api-kriora-com

Provides OpenAI-compatible APIs and managed GPU instances for deploying and scaling open-source AI models.

当前服务商基线110N/A565 tok/s9970%
OpenRouter

openrouter

A unified API interface providing access to over 300 models from 60+ providers, including OpenAI, Anthropic, and Google.

  • 30 天可用性更高
  • 模型覆盖更广
  • 同分类服务商
6140N/A85 tok/s9990%
S3AI API

s3ai-api

  • 免费模型更多
  • 模型覆盖更广
  • 同分类服务商
24746$0.000000103/M59 tok/s9610%
共绩算力(算了么 API)

api-suanli-cn

Gongji Compute (共绩算力) provides pay-as-you-go, standard API access to mainstream LLMs and elastic GPU computing for AI applications.

  • 免费模型更多
  • 模型覆盖更广
  • 同分类服务商
155N/A36 tok/s7510%
NVIDIA NIM

nvidia-nim

NVIDIA NIM provides optimized AI model inference APIs for LLMs, vision, and embedding models through NVIDIA cloud infrastructure.

  • 模型覆盖更广
  • 同分类服务商
1680N/A82 tok/s9970%
SiliconFlow

siliconflow

Provides cost-effective generative AI cloud services based on open-source models for text, image, video, and audio generation.

  • 模型覆盖更广
  • 同分类服务商
1540N/A59 tok/s6150%
Novita AI

novita-ai

Provides a unified API for accessing 200+ AI models, custom model deployment, GPU cloud services, and secure agent sandboxes.

  • 模型覆盖更广
  • 同分类服务商
1420N/A56 tok/s5930%

注释

  • 健康检查: 统计范围:72 小时图表和近期可用率只衡量 API 连通性,每个柱形汇总一小时内的检查结果。 检查目标:LMSpeed 会优先尝试已配置的健康检查 URL 和 Provider 状态 URL,再尝试从已知 API Host 与近期测速 Base URL 推导出的 API 端点;只有官网地址本身明显是 API 地址时才会作为候选。 探测步骤:每个候选地址依次进行 DNS 解析、TCP 连接、HTTPS 的 TLS 握手,以及自动跟随重定向的 HTTP HEAD 请求;找到首个可达地址后停止尝试。 可达标准:所有必需的网络步骤都必须成功。除被归类为拦截的状态外,低于 500 的 HTTP 响应均视为可达;其中 401 表示需要鉴权,但也证明 API 端点已响应。 拦截结果:HTTP 403、429、521、525、530,以及识别出的 WAF 或 Cloudflare 挑战会标记为“被拦截”,不计入可用率,因为 LMSpeed 无法据此判断 API 本身是否宕机。 模型可用性:配置专用测试 Key 后,LMSpeed 会向推导出的 /models 端点发送带鉴权的 GET 请求,并将返回的模型 ID 与该 Provider 收录的模型进行比对。逐模型结果显示在“模型与价格”中,不计入 Provider 连通性百分比。 超时限制:TCP 连接、TLS 握手、HTTP 连通性请求和模型请求分别使用 20 秒超时;尝试多个候选地址时,整轮检查可能超过 20 秒。 检查频率:后台 Worker 默认每 5 分钟检查一次所有 Provider;72 小时图表会将这些采样汇总为小时柱形,运营方也可以调整调度。 限制说明:自动抽样结果不构成 SLA,也不能保证账户额度、所有模型、所有地区或实际补全请求始终成功;作出运维决策前请同时查看 Provider 官方状态页。
  • Domain Rating 数据来自 Ahrefs。它是基于外链估算的 0–100 域名强度信号,不代表 API 速度或可用性。
  • 页面上的公告和 FAQ 来自该服务商的 NewAPI 状态快照(如果可用)。LMSpeed 会保存服务商状态源中的原始内容和可选英文翻译,并在页面上展示对应语言字段。