A

ai.xae.ccwu.cc

基于 Cloudflare Workers AI 的多模型服务商,提供多种开源模型的高速推理服务。

模型
26 个
最低
--
速度
47 tok/s
更新
6/8/2026
延迟
0.00 s
创建时间
4/22/2026

API 地址

  • 接口 1
    ai.xae.ccwu.cc
    域名注册于 8/17/2025
认领该站点

完成站点认证,解锁以下权益:

  • 编辑服务商名称、正文和链接
  • 获得优先流量扶持和曝光推荐
  • 展示官方认证徽章,提升用户信任

排行榜排名

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。

关于 Nebula AI

Nebula AI 是一个基于 Cloudflare Workers AI 构建的多模型 API 服务,提供与多种开源模型的快速推理交互。

  • 主要模型: 提供来自多家供应商的模型,包括月之暗面(Kimi)、Google、Meta(Llama 系列)、DeepSeek、Qwen、NVIDIA、智谱、IBM、Mistral AI 和 OpenAI 等。
  • 服务能力: 支持对话、代码生成、多模态推理、工具调用和函数调用等任务。模型库包含针对速度、多语言任务(如适用于东南亚语言的 SEA-LION 模型)和特定用例优化的模型。
  • 界面特性: 平台本身是一个智能助手界面,支持文件上传、图片上传和语音输入。通过设置面板提供可调节的推理参数,如温度、top-p 和最大令牌数。
  • 基础设施: 基于 Cloudflare Workers AI 基础设施,以提供“快速响应”为特点。

备注:该平台使用基于 Cloudflare Workers 的边缘计算环境。

健康检查

0%近期可用性
历史记录 (72 条)
过去现在

API 基准测试与价格

按 26 个模型行对比最新 audit、最新测速、吞吐、延迟与按 token 计费价格。

模型
速度
延迟
@cf/aisingapore/gemma-sea-lion-v4-27b-it
--
@cf/deepseek-ai/deepseek-r1-distill-qwen-32b
--
@cf/google/gemma-3-12b-it
--
@cf/google/gemma-4-26b-a4b-it
--
@cf/ibm-granite/granite-4.0-h-micro
--
@cf/meta/llama-2-7b-chat-int8
--
@cf/meta/llama-3-8b-instruct
--
@cf/meta/llama-3-8b-instruct-awq
--
@cf/meta/llama-3.1-8b-instruct
--
@cf/meta/llama-3.1-8b-instruct-awq
--
@cf/meta/llama-3.1-8b-instruct-fp8
--
@cf/meta/llama-3.2-1b-instruct
--
@cf/meta/llama-3.2-3b-instruct
--
@cf/meta/llama-3.3-70b-instruct-fp8-fast
--
@cf/meta/llama-4-scout-17b-16e-instruct
--
@cf/microsoft/phi-2
--
@cf/mistralai/mistral-small-3.1-24b-instruct
--
@cf/nvidia/nemotron-3-120b-a12b
--
@cf/openai/gpt-oss-120b
--
@cf/openai/gpt-oss-20b
--
@cf/qwen/qwen2.5-coder-32b-instruct
--
@cf/qwen/qwen3-30b-a3b-fp8
--
@cf/qwen/qwq-32b
--
@cf/zai-org/glm-4.7-flash
--
47.4 t/s23.02 s

当前显示 25 / 26 个模型行

最近测试记录

时间模型速度延迟
Jun 13, 12:44 AM
@cf/moonshotai/kimi-k2.6
44.56 tok/s
20.89s
Jun 10, 05:38 AM
@cf/moonshotai/kimi-k2.6
51.00 tok/s
24.85s
Apr 22, 09:59 AM
@cf/moonshotai/kimi-k2.5
47.31 tok/s
10.75s
Apr 22, 09:34 AM
@cf/moonshotai/kimi-k2.6
52.65 tok/s
20.63s
Apr 22, 09:28 AM
@cf/moonshotai/kimi-k2.6
41.55 tok/s
25.71s

相似 API 替代服务商对比

用 104 个 LMSpeed 信号,把 Nebula AI 的 6 个相近 API 替代服务商放在一起比较:共享模型覆盖、价格、实测速度、可用性和免费模型。

服务商对比理由模型数免费项均价速度30 天可用性
Nebula AI

ai-xae-ccwu-cc

Cloudflare Workers AI-based multi-model provider offering rapid inference for a versatile selection of open-source models.

当前服务商基线260N/A47 tok/s0%
ChooseC API

ipv4-beta-lm-studio

ChooseC API is a unified AI model aggregation gateway supporting 260+ mainstream models including Claude, GPT, Qwen, DeepSeek, Kimi, and GLM with OpenAI, Claude, and Gemini compatibility.

  • 实测速度更快
  • 30 天可用性更高
  • 免费模型更多
  • 模型覆盖更广
3359$0.095/M138 tok/s9950%
F2API

api-f2api-com

F2API is an enterprise AI gateway providing a unified OpenAI-compatible interface for accessing multiple large language models.

  • 实测速度更快
  • 30 天可用性更高
  • 模型覆盖更广
1,2620N/A272 tok/s9990%
Koyeb AI Gateway

new-api-koyeb-app

An OpenAI-compatible API gateway deployed on Koyeb, providing access to multiple AI models.

  • 30 天可用性更高
  • 免费模型更多
  • 模型覆盖更广
578420N/A33 tok/s9960%
LLMService

llmservice

LLMService provides API access to large language models for self-use applications.

  • 实测速度更快
  • 30 天可用性更高
  • 模型覆盖更广
4490N/A139 tok/s4790%
DeadlySignal API

deadlysignal

  • 实测速度更快
  • 30 天可用性更高
  • 模型覆盖更广
2900N/A63 tok/s9970%
ChooseC API

ipv4-beta-kxcym-top-3001

ChooseC API is an OpenAI-compatible relay service hosted at ipv4-beta.kxcym.top, providing access to multiple AI models through standardized endpoints.

  • 实测速度更快
  • 免费模型更多
  • 模型覆盖更广
1229$0.095/M51 tok/s0%

注释

  • 健康检查: 统计范围:72 小时图表和近期可用率只衡量 API 连通性,每个柱形汇总一小时内的检查结果。 检查目标:LMSpeed 会优先尝试已配置的健康检查 URL 和 Provider 状态 URL,再尝试从已知 API Host 与近期测速 Base URL 推导出的 API 端点;只有官网地址本身明显是 API 地址时才会作为候选。 探测步骤:每个候选地址依次进行 DNS 解析、TCP 连接、HTTPS 的 TLS 握手,以及自动跟随重定向的 HTTP HEAD 请求;找到首个可达地址后停止尝试。 可达标准:所有必需的网络步骤都必须成功。除被归类为拦截的状态外,低于 500 的 HTTP 响应均视为可达;其中 401 表示需要鉴权,但也证明 API 端点已响应。 拦截结果:HTTP 403、429、521、525、530,以及识别出的 WAF 或 Cloudflare 挑战会标记为“被拦截”,不计入可用率,因为 LMSpeed 无法据此判断 API 本身是否宕机。 模型可用性:配置专用测试 Key 后,LMSpeed 会向推导出的 /models 端点发送带鉴权的 GET 请求,并将返回的模型 ID 与该 Provider 收录的模型进行比对。逐模型结果显示在“模型与价格”中,不计入 Provider 连通性百分比。 超时限制:TCP 连接、TLS 握手、HTTP 连通性请求和模型请求分别使用 20 秒超时;尝试多个候选地址时,整轮检查可能超过 20 秒。 检查频率:后台 Worker 默认每 5 分钟检查一次所有 Provider;72 小时图表会将这些采样汇总为小时柱形,运营方也可以调整调度。 限制说明:自动抽样结果不构成 SLA,也不能保证账户额度、所有模型、所有地区或实际补全请求始终成功;作出运维决策前请同时查看 Provider 官方状态页。
  • Domain Rating 数据来自 Ahrefs。它是基于外链估算的 0–100 域名强度信号,不代表 API 速度或可用性。
  • 页面上的公告和 FAQ 来自该服务商的 NewAPI 状态快照(如果可用)。LMSpeed 会保存服务商状态源中的原始内容和可选英文翻译,并在页面上展示对应语言字段。