api.holdai.top

毫秒API提供稳定、高带宽的API转发服务,支持OpenAI兼容模型,包括GPT、Claude和Midjourney,具备全球服务器部署和透明定价。

模型
1184 个
最低
$0.0015/M
速度
82 tok/s
更新
8/13/2026
延迟
0.00 s
创建时间
8/13/2025

功能

绘图任务数据导出

API 地址

  • 接口 1历史推断 / 未验证
    https://api.gptbest.vip
  • 接口 2历史推断 / 未验证
    https://hk-api.gptbest.vip
  • 接口 3历史推断 / 未验证
    https://usage.gptbest.vip
  • 接口 4历史推断 / 未验证
    https://api.holdai.top
  • 接口 5历史推断 / 未验证
    https://api.bltcy.ai
认领该站点

完成站点认证,解锁以下权益:

  • 编辑服务商名称、正文和链接
  • 获得优先流量扶持和曝光推荐
  • 展示官方认证徽章,提升用户信任

排行榜排名

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。

关于 毫秒API

毫秒API是一项API转发服务,为企业级用户提供高带宽访问AI模型的能力。它支持OpenAI兼容接口,包括GPT-3.5、GPT-4、Claude、Midjourney等模型,并实时更新。主要特点包括:

  • 全球服务器部署覆盖8个地区(如美国、日本、新加坡),使用CN2线路和负载均衡技术,确保低延迟和高稳定性。
  • 透明、按量计费的定价模式,兑换比例约为1.2元人民币兑1美元,并提供VIP/SVIP折扣。
  • 支持多种模型分组(如逆向、Azure、纯OpenAI),满足不同需求,高并发处理能力达100万TPM。
  • 完全兼容OpenAI API协议,可无缝集成到现有应用中。
  • 额外服务包括Midjourney代理支持、7*24小时自助充值以及代理分发选项。
  • 典型用例包括AI聊天、文件分析、多模态任务、文本转语音和通过Midjourney进行图像生成。

健康检查

100%近期可用性
历史记录 (72 条)
过去现在

API 基准测试与价格

按 2578 个模型行对比最新 audit、最新测速、吞吐、延迟与按 token 计费价格。

模型
输入 ($/M)
输出 ($/M)
$5.00/M$10.00/M
$5.00/M$10.00/M
$7.50/M$15.00/M
$15.00/M$30.00/M
claude-fable-5-thinkingcc优质
$20.00/M$100.00/M
claude-fable-5-thinkingclaude官
$50.00/M$250.00/M
claude-fable-5-thinkingorigin
$73.00/M$365.00/M
claude-fable-5-thinkingclaude正价
$80.00/M$400.00/M
claude-opus-4-7-thinkingcc
$4.00/M$20.00/M
claude-opus-4-7-thinkingdefault
$5.00/M$25.00/M
claude-opus-4-7-thinkingcc优质
$10.00/M$50.00/M
claude-opus-4-7-thinkingorigin
$36.50/M$182.50/M
claude-opus-4-7-thinkingclaude正价
$40.00/M$200.00/M
claude-opus-4-8-thinkingcc
$4.00/M$20.00/M
claude-opus-4-8-thinkingdefault
$5.00/M$25.00/M
claude-opus-4-8-thinkingcc优质
$10.00/M$50.00/M
claude-opus-4-8-thinkingorigin
$36.50/M$182.50/M
claude-opus-4-8-thinkingclaude正价
$40.00/M$200.00/M
claude-opus-5-thinkingcc
$4.00/M$20.00/M
claude-opus-5-thinkingdefault
$5.00/M$25.00/M
claude-opus-5-thinkingcc优质
$10.00/M$50.00/M
claude-opus-5-thinkingclaude官
$25.00/M$125.00/M
claude-opus-5-thinkingorigin
$36.50/M$182.50/M
claude-opus-5-thinkingclaude正价
$40.00/M$200.00/M
claude-sonnet-5-thinkingcc
$1.60/M$8.00/M

当前显示 25 / 2578 个模型行

最近测试记录

时间模型速度延迟
Feb 20, 03:23 AM
gemini-2.0-pro-exp
70.15 tok/s
7.13s
Feb 20, 03:21 AM
chatgpt-4o-latest
100.72 tok/s
3.47s

相似 API 替代服务商对比

用 3197 个 LMSpeed 信号,把 毫秒API 的 6 个相近 API 替代服务商放在一起比较:共享模型覆盖、价格、实测速度、可用性和免费模型。

服务商对比理由模型数免费项均价速度30 天可用性
毫秒API

haomiao-api

毫秒API provides a stable, high-bandwidth API forwarding service for OpenAI-compatible models, including GPT, Claude, and Midjourney, with global server deployment and transparent pricing.

当前服务商基线1,1846$0.0015/M82 tok/s9940%
F2API

api-f2api-com

F2API is an enterprise AI gateway providing a unified OpenAI-compatible interface for accessing multiple large language models.

  • 实测速度更快
  • 30 天可用性更高
  • 模型覆盖更广
1,2620N/A272 tok/s9990%
钱多多 API

api2-aigcbest-top

Provides AI-generated content APIs for various applications, including text and image generation.

  • 实测速度更快
  • 模型覆盖更广
1,4182$0.0025/M101 tok/s9940%
Koyeb AI Gateway

new-api-koyeb-app

An OpenAI-compatible API gateway deployed on Koyeb, providing access to multiple AI models.

  • 30 天可用性更高
  • 免费模型更多
578420N/A33 tok/s9960%
哈基米API站

api-gemai-cc

哈基米API站 offers a unified API gateway for large language models with competitive pricing and stable service.

  • 实测速度更快
  • 30 天可用性更高
3230$0.930/M119 tok/s9990%
TommyLam API

new-api-tommylam-me

TommyLam API offers an OpenAI-compatible API gateway for accessing multiple AI models at competitive rates.

  • 30 天可用性更高
  • 免费模型更多
231100N/A61 tok/s9990%
OpenCode

opencode-ai

OpenCode is an open-source AI coding agent that integrates with terminals, IDEs, and desktop apps, supporting multiple models and providers.

  • 实测速度更快
  • 30 天可用性更高
920N/A139 tok/s9970%

FAQ

联系客服

🐧: 1340650660 微信:llmh217 有任何问题不要害羞都可以直接问,客服会尽力服务好每一位客户。

额度是什么?倍率是什么?系统怎么计算的?

额度 = 分组倍率 * 模型倍率* (提示 token + 补全 token *补全倍率) 其中补全倍率对于 GPT3.5 固定为 1.33,GPT4 为 2,与官方保持一致。 如果是非流模式,官方接口会返回消耗的总 token,但是你要注意提示和补全的消耗倍率不一样。倍率是本系统的计费方式,并不是官方价格的倍数,本系统显示的价格为最终价格,计费透明。

关于高并发

系统默认支持高并发。请放开火力,尽情调用。

为什么请求后没吐字没补全 token

有以下可能 1. 快吐字了,客户端断开连接 2. tools call 或 function call 3. openai 直接返回[Done],一般是政策安全相关拒绝回答,需要结合返回的 finish_reason或内容进行判断

我如何去判断他是否是GPT-4模型

可使用以下逻辑性问题进行测试 问题 : 鲁迅和周树人是什么关系 GPT-3.5:鲁迅和周树人是两个不同的人 GPT-4:鲁迅和周树人是同一个人

各个分组有什么区别

各个分组是根据不同渠道而定,有官方api,有逆向,官方也可能分为op官方,az官方,aws官方等等。逆向最优惠,官方最稳定,可以根据自己的需要进行选择。

官方NanoBananaPro、NanoBanana2在本站对应的模型名称

官方的NanoBananaPro对应本站的nano-banana-2、nano-banana-2、nano-banana-2-2k、nano-banana-2-4k和gemini-3-pro-image-preview;nNanoBanana2对应本站的gemini-3.1-flash-image-preview、gemini-3.1-flash-image-preview-2k、gemini-3.1-flash-image-preview-4k;n为什么会这样呢?因为之前官方有一个nano-banana模型,后来官方出了NanoBananaPro,我们创建了nano-banana-2,所以是现在这样。n本站的nano-banana-pro是即梦的,甲厚不好用,请勿使用。

注释

  • 健康检查: 统计范围:72 小时图表和近期可用率只衡量 API 连通性,每个柱形汇总一小时内的检查结果。 检查目标:LMSpeed 会优先尝试已配置的健康检查 URL 和 Provider 状态 URL,再尝试从已知 API Host 与近期测速 Base URL 推导出的 API 端点;只有官网地址本身明显是 API 地址时才会作为候选。 探测步骤:每个候选地址依次进行 DNS 解析、TCP 连接、HTTPS 的 TLS 握手,以及自动跟随重定向的 HTTP HEAD 请求;找到首个可达地址后停止尝试。 可达标准:所有必需的网络步骤都必须成功。除被归类为拦截的状态外,低于 500 的 HTTP 响应均视为可达;其中 401 表示需要鉴权,但也证明 API 端点已响应。 拦截结果:HTTP 403、429、521、525、530,以及识别出的 WAF 或 Cloudflare 挑战会标记为“被拦截”,不计入可用率,因为 LMSpeed 无法据此判断 API 本身是否宕机。 模型可用性:配置专用测试 Key 后,LMSpeed 会向推导出的 /models 端点发送带鉴权的 GET 请求,并将返回的模型 ID 与该 Provider 收录的模型进行比对。逐模型结果显示在“模型与价格”中,不计入 Provider 连通性百分比。 超时限制:TCP 连接、TLS 握手、HTTP 连通性请求和模型请求分别使用 20 秒超时;尝试多个候选地址时,整轮检查可能超过 20 秒。 检查频率:后台 Worker 默认每 5 分钟检查一次所有 Provider;72 小时图表会将这些采样汇总为小时柱形,运营方也可以调整调度。 限制说明:自动抽样结果不构成 SLA,也不能保证账户额度、所有模型、所有地区或实际补全请求始终成功;作出运维决策前请同时查看 Provider 官方状态页。
  • Domain Rating 数据来自 Ahrefs。它是基于外链估算的 0–100 域名强度信号,不代表 API 速度或可用性。
  • 页面上的公告和 FAQ 来自该服务商的 NewAPI 状态快照(如果可用)。LMSpeed 会保存服务商状态源中的原始内容和可选英文翻译,并在页面上展示对应语言字段。