小天公益站是一个统一的大模型接口网关,为开发者提供通过单一接口访问多种AI模型的能力。主要端点包括 /v1/chat/completions、/v1/embeddings、/v1/images/generations、/v1/audio/transcriptions 和 /v1beta/models。支持来自MoonshotAI、OpenAI、Grok、Zhipu、Volcengine、Cohere、Claude、Gemini、Suno、Minimax、Wenxin、Spark、Qingyan、DeepSeek、Qwen、Midjourney、AzureAI、Hunyuan和Xinference等供应商的模型。该服务强调更好的价格和稳定性,提供速率限制(例如,默认分组3分钟25次请求,翻译分组3分钟150次请求)和模型分组功能,以优化翻译等使用场景。新用户注册后可获得5元初始余额。
- 延迟
- 0.00 s
- 创建时间
- 3/8/2026
- 充值汇率
- ¥2.00 / 1 美元额度
功能
登录方式
API 地址
- 腾讯edgeone
https://new-api.xt-url.com主线路
- 阿里esa
https://esa-new-api.xt-url.com只支持api调用,不支持登录
- cloudflare
https://cf-new-api.xt-url.com只支持api调用,不支持登录
- 接口 4历史推断 / 未验证
https://gz-new-api.xt-url.com
完成站点认证,解锁以下权益:
- 编辑服务商名称、正文和链接
- 获得优先流量扶持和曝光推荐
- 展示官方认证徽章,提升用户信任
排行榜排名
排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。
关于 小天公益站
健康检查
API 基准测试与价格
按 25 个模型行对比最新 audit、最新测速、吞吐、延迟与按 token 计费价格。
bot-chatnvidia | $0.540/M | $0.820/M | - | - |
diffusiongemma-26b-a4bnvidia | $150.00/M | $150.00/M | - | - |
Qwen2.5-7B-InstructTranslation | $120.00/M | $120.00/M | - | - |
glm-5.2nvidia | $1.00/M | $4.40/M | - | - |
no-testdefault | $19998.00/request | - | - | - |
MiniMax-M3nvidia | $0.600/M | $2.40/M | - | - |
step-3.7-flashnvidia | $0.400/M | $2.30/M | - | - |
deepseek-v4-pronvidia | $0.696/M | $1.39/M | - | - |
deepseek-v4-flashnvidia | $0.224/M | $0.448/M | - | - |
glm-4.6v-flashdefault | 免费 | 免费 | - | - |
glm-4.5-flashdefault | 免费 | 免费 | - | - |
glm-4-flash-250414default | $0.0040/M | $0.0004/M | - | - |
glm-z1-flashdefault | $0.0040/M | $0.0004/M | - | - |
qwen3.5-397b-a17bnvidia | $0.700/M | $3.50/M | - | - |
gemma-4-31bnvidia | $1.98/M | $2.98/M | - | - |
z-image-turbodefault | $0.800/request | - | - | - |
TranslationTranslation | $0.224/M | $0.336/M | 242.5 t/s | 2.56 s |
step-3.5-flashnvidia | $0.200/M | $0.600/M | - | - |
glm-4.7-flashdefault | $0.080/M | $0.600/M | - | - |
| - | - | 23.5 t/s | 23.07 s | |
gemini-2.5-flash-litedefault | $0.180/M | $0.720/M | - | - |
gpt-oss-120bnvidia | $0.080/M | $0.320/M | - | - |
gpt-oss-20bnvidia | $0.080/M | $0.300/M | - | - |
| - | - | 78.3 t/s | 18.76 s | |
| $150.00/M | $150.00/M | - | - |
当前显示 25 / 25 个模型行
最近测试记录
| 时间 | 模型 | 速度 | 延迟 |
|---|---|---|---|
| Apr 3, 03:53 PM | glm-4.5-air | 78.35 tok/s | 18.76s |
| Apr 3, 03:52 PM | Translation | 203.11 tok/s | 2.56s |
| Apr 3, 03:52 PM | GLM-4.7 | 23.53 tok/s | 23.07s |
| Mar 8, 10:00 AM | Translation | 281.81 tok/s | 2.57s |
相似 API 替代服务商对比
用 502 个 LMSpeed 信号,把 小天公益站 的 6 个相近 API 替代服务商放在一起比较:共享模型覆盖、价格、实测速度、可用性和免费模型。
| 服务商 | 对比理由 | 模型数 | 免费项 | 均价 | 速度 | 30 天可用性 |
|---|---|---|---|---|---|---|
| 小天公益站 new-api-xt-url-com A unified gateway API for large language models, offering access to multiple providers with competitive pricing and stability. | 当前服务商基线 | 137 | 2 | $0.0022/M | 150 tok/s | 9960% |
| 初叶🍂Furry API ai-chuyel-top A free, community-supported API service providing access to various AI models for developers and users. |
| 1,021 | 152 | $18.00/M | 171 tok/s | 3670% |
| 6345ywz API api-6345ywz-cn 6345ywz API is an OpenAI-compatible API relay providing access to multiple AI models with competitive pricing. |
| 466 | 0 | $0.0000686/M | 272 tok/s | 9660% |
| Cuz AI ai-cuz-lab-space Cuz AI runs an OpenAI-compatible relay at ai.cuz-lab.space with broad model coverage, public pricing, and stable throughput for chat and coding workloads. |
| 393 | 0 | $0.020/M | 170 tok/s | 9980% |
| 猫羽霖API huashang-dpdns-org An OpenAI-compatible API relay providing access to multiple AI models with extensive model coverage and pricing data. |
| 1,378 | 21 | $0.0042/M | 57 tok/s | 9770% |
| 星见雅 API api-xinjianya-top Xinjianya API is an OpenAI-compatible API relay at api.xinjianya.top. Service availability may be limited. |
| 498 | 211 | N/A | 67 tok/s | 7010% |
| 小水管 API edge-pieixan-icu Pie-Xian (小水管) provides an OpenAI-compatible API relay with multiple endpoints including api.pie-xian.com and edge nodes. |
| 495 | 2 | $0.054/M | 260 tok/s | 9890% |
公告
本站因站长精力不足已长时间无主动维护,但无意外会一直开着,服务器剩余寿命还很长
迁移工作已完毕,如有问题请及时反馈
禁止批量测活,全自动封号
LDC临时关闭,因此暂无法充值
有需要可私信获取兑换码
官方号池的flashx模型进行了一些调整,详情如下:
glm-4-flashx-250414 -> glm-4-flash-250414
glm-4.7-flashx -> glm-4.7-flash
为了保证模型名称兼容,flashx会被自动路由到相同的flash模型
flashx实则为输出速率较高的flash模型,本次调整对模型输出质量无影响
z-image-turbo模型端上来了
基于2api,不支持nsfw,有这个需求的佬友可以找找别的
重要提醒:通过绘图接口/v1/images/generations调用,而不是对话接口
已实测Cherry Studio中是可以使用的
现已对接Linux Do Credit。原私聊获取兑换码将继续保留
关于余额
新用户注册统一获得5元
用完私聊联系获取兑换码
没有签到,没有AFF
关于速率限制
第一次开公益站,不知道如何配置较为合理的数值,当前限制数值为我自己使用场景下不容易触发限制的速率
如各位佬友有更好的配置建议欢迎提出
关于可用模型
目前仅Translation和default分组是可用的,其余模型均为自用
目前只提供智谱相关模型(通过号池轮询,非2api)
关于分组
default分组为通用分组,不限制使用场景,但NSFW场景可能会触发智谱本身的审查导致不可用
速率限制为3分钟25次
Translation分组为翻译专用分组,为确保翻译速度,支持设置思考的模型统一关闭思考
速率限制为3分钟150次
注释
- 健康检查: 统计范围:72 小时图表和近期可用率只衡量 API 连通性,每个柱形汇总一小时内的检查结果。 检查目标:LMSpeed 会优先尝试已配置的健康检查 URL 和 Provider 状态 URL,再尝试从已知 API Host 与近期测速 Base URL 推导出的 API 端点;只有官网地址本身明显是 API 地址时才会作为候选。 探测步骤:每个候选地址依次进行 DNS 解析、TCP 连接、HTTPS 的 TLS 握手,以及自动跟随重定向的 HTTP HEAD 请求;找到首个可达地址后停止尝试。 可达标准:所有必需的网络步骤都必须成功。除被归类为拦截的状态外,低于 500 的 HTTP 响应均视为可达;其中 401 表示需要鉴权,但也证明 API 端点已响应。 拦截结果:HTTP 403、429、521、525、530,以及识别出的 WAF 或 Cloudflare 挑战会标记为“被拦截”,不计入可用率,因为 LMSpeed 无法据此判断 API 本身是否宕机。 模型可用性:配置专用测试 Key 后,LMSpeed 会向推导出的 /models 端点发送带鉴权的 GET 请求,并将返回的模型 ID 与该 Provider 收录的模型进行比对。逐模型结果显示在“模型与价格”中,不计入 Provider 连通性百分比。 超时限制:TCP 连接、TLS 握手、HTTP 连通性请求和模型请求分别使用 20 秒超时;尝试多个候选地址时,整轮检查可能超过 20 秒。 检查频率:后台 Worker 默认每 5 分钟检查一次所有 Provider;72 小时图表会将这些采样汇总为小时柱形,运营方也可以调整调度。 限制说明:自动抽样结果不构成 SLA,也不能保证账户额度、所有模型、所有地区或实际补全请求始终成功;作出运维决策前请同时查看 Provider 官方状态页。
- Domain Rating 数据来自 Ahrefs。它是基于外链估算的 0–100 域名强度信号,不代表 API 速度或可用性。
- 页面上的公告和 FAQ 来自该服务商的 NewAPI 状态快照(如果可用)。LMSpeed 会保存服务商状态源中的原始内容和可选英文翻译,并在页面上展示对应语言字段。

