统一的API网关,提供对多种大语言模型的访问,支持国内直连。

模型
752 个
最低
$0.0005/M
速度
111 tok/s
更新
6/8/2026
延迟
0.00 s
创建时间
8/13/2025
充值汇率
¥0.50 / 1 美元额度

功能

绘图任务数据导出签到

登录方式

GitHubLinuxDO

API 地址

  • 主站
    https://yunwu.ai

    美国高防负载均衡站群

  • CF站
    https://api.apiplus.org

    全球CDN,国内访问速度一般

  • 无登录页面API接口
    https://api.zhongzhuan.chat

    方便二次售卖KEY

  • 国内服务器
    https://api3.wlai.vip

    国内高防服务器线路

  • 接口 5历史推断 / 未验证
    https://yunwu.zeabur.app
认领该站点

完成站点认证,解锁以下权益:

  • 编辑服务商名称、正文和链接
  • 获得优先流量扶持和曝光推荐
  • 展示官方认证徽章,提升用户信任

排行榜排名

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。

关于 YUNWU API

YUNWU API 是一个统一的LLM API网关,提供稳定可靠的API中转服务。它支持多种AI模型,包括ChatGPT、Claude、Gemini、Grok、MoonshotAI、智谱、以及来自OpenAI、Cohere、深度求索等提供商的30多种模型。主要特点包括国内直连无需代理、低延迟、高并发和按量计费。该服务适用于需要通过单一接口访问多个LLM的应用程序,常见集成工具包括LobeChat和OpenCat。

健康检查

100%近期可用性
历史记录 (72 条)
过去现在

API 基准测试与价格

按 5391 个模型行对比最新 audit、最新测速、吞吐、延迟与按 token 计费价格。

模型
输入 ($/M)
输出 ($/M)
doubao-1-5-pro-256k-250115测试
$3.42/M$6.16/M
doubao-1-5-pro-32k-character-250228测试
$0.548/M$1.37/M
doubao-seed-1-6-flash-250615测试
$0.205/M$2.05/M
doubao-seed-1-6-flash-250715测试
$0.205/M$2.05/M
mj_uploads测试
$0.0021/request-
omni_flash-10s测试
$1.78/request-
text-embedding-v1测试
$0.068/M$0.068/M
gpt-5.6-luna-2026-07-09
--
gpt-5.6-sol-2026-07-09
--
gpt-5.6-terra-2026-07-09
--
gpt-5.5-openai-compact
--
$0.342/M$1.71/M
claude-opus-5特价 Claude Code
$0.411/M$2.05/M
claude-opus-5Claude独立特供
$0.822/M$4.11/M
claude-opus-5Claude Code专属
$0.822/M$4.11/M
$1.37/M$6.85/M
claude-opus-5huawei-cc
$1.89/M$9.45/M
claude-opus-5huawei-ccmax
$1.89/M$9.45/M
$2.05/M$10.27/M
claude-opus-5官转克劳德2
$2.05/M$10.27/M
claude-opus-5inferel special supply
$2.74/M$13.70/M
claude-opus-5特供-awsclaude
$2.74/M$13.70/M
$3.42/M$17.12/M
claude-opus-5官转克劳德3
$4.11/M$20.55/M
$0.103/M$0.514/M

当前显示 25 / 5391 个模型行

最近测试记录

时间模型速度延迟
Jul 29, 10:56 PM
gpt-5.6-sol
53.00 tok/s
2.27s
Jul 26, 08:49 PM
gpt-5.6-sol
53.42 tok/s
2.06s
Jul 4, 04:15 PM
claude-opus-4-7
162.36 tok/s
1.91s
May 15, 04:00 PM
gpt-5-mini
82.67 tok/s
6.57s
Apr 24, 11:02 AM
gpt-5.4-nano
19.82 tok/s
7.05s
Apr 24, 11:00 AM
deepseek-v4-flash
67.17 tok/s
2.68s
Apr 24, 05:00 AM
deepseek-v4-flash
80.40 tok/s
2.96s
Apr 1, 11:04 AM
gpt-5-nano-2025-08-07
111.99 tok/s
10.26s
Apr 1, 11:00 AM
gpt-5-nano
91.01 tok/s
14.07s
Mar 26, 05:04 AM
gpt-5.4-mini
200.70 tok/s
1.44s

相似 API 替代服务商对比

用 1099 个 LMSpeed 信号,把 YUNWU API 的 6 个相近 API 替代服务商放在一起比较:共享模型覆盖、价格、实测速度、可用性和免费模型。

服务商对比理由模型数免费项均价速度30 天可用性
YUNWU API

yunwu-ai

A unified API gateway providing access to multiple large language models with direct connectivity in China.

当前服务商基线7522$0.0005/M111 tok/s9980%
91VIP API

hcg-pippi-top

A unified API gateway providing access to multiple large language models and AI services with competitive pricing and stability.

  • 实测速度更快
  • 免费模型更多
18130$0.467/M148 tok/s9890%
钱多多 API

api2-aigcbest-top

Provides AI-generated content APIs for various applications, including text and image generation.

  • 模型覆盖更广
1,4182$0.0025/M101 tok/s9940%
Koyeb AI Gateway

new-api-koyeb-app

An OpenAI-compatible API gateway deployed on Koyeb, providing access to multiple AI models.

  • 免费模型更多
578420N/A33 tok/s9960%
艾可API

aicanapi-com

AicanAPI provides an enterprise-grade API management platform with high-performance architecture, security compliance, and cost optimization for business digital transformation.

  • 免费模型更多
545103N/A70 tok/s5790%
APIMart

apimart

APIMart is a pay-as-you-go, OpenAI-compatible AI API gateway operated by Hangzhou Huanzhi Network Technology Co., Ltd. It provides unified access to more than 500 third-party text, image, video, and audio models, with consolidated billing, multi-provider routing, and automatic failover.

  • 免费模型更多
25716$0.015/MN/A9980%
C85 API

c85-api

C85 API is an OpenAI-compatible API gateway built on the New API panel, providing unified access to multiple AI models through a hosted endpoint.

  • 免费模型更多
188130N/AN/A0%

公告

success2026/8/16

同步官方价格:deepseek-v4-pro deepseek-v4-flash

success2026/8/14

同步官方价格:gemini-3.6-flash

success2026/8/13

模型上架:deepseek-v4-pro-0813

success2026/8/12

模型下架:grok-imagine-image-pro

success2026/8/5

模型列表:doubao-seedream-5-0-pro-260628

success2026/8/5

模型上架:qwen3.8-max

success2026/8/2

模型上架:deepseek-v4-flash-0731

success2026/7/25

模型上架:claude-opus-5

success2026/7/24

通知:cc max分组倍率4上线

success2026/7/21

模型上架:gemini-3.6-flash、gemini-3.5-flash-lite

success2026/7/21

通知:直连aws claude分组上线,分组倍率为14.8,直连aws Claude官方

success2026/7/21

通知:特价codex分组倍率0.2上线

success2026/7/20

通知:gpt-绘图分组倍率1.25上线,支持生图1,2,4k

success2026/7/17

通知:az claude 分组倍率6,Vertex claude分组倍率6上线

success2026/7/17

通知: 新增stripe 支付方式

success2026/7/16

模型上架:kimi-k3

success2026/7/13

通知:模型上新deepseek-v4-pro-202606,deepseek-v4-flash-202605系列带日期为官方原厂模型

success2026/7/10

模型上架:gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna,包括其带后缀的使用方法

success2026/7/9

通知:1、由于官方新版 Claude 接口限制:claude-opus-4.7+模型(4.8、sonnet-5、fable-5) 官方 API 不再支持自定义参数“temperature、top_p、top_k”,传入会直接报参数错误、400 请求失败。 2、为提高用户使用体验,平台将在2026年7月10日00:00对claude-opus-4.7+模型(4.8、sonnet-5、fable-5)的“temperature、top_p、top_k”参数进行过滤。如有疑问请与客服联系,感谢您的理解与支持!!!

default2026/7/9

通知: doubao-seed-2-1-turbo-260628,维护中,暂时下线,恢复等通知

FAQ

中转站的计费模式是怎样的?

1.提供多种计费模式:按请求次数、按token数量等 2.实时显示用户的API使用情况和费用.

支持哪些编程语言的调用?

我们的API遵循RESTful标准,支持任何可以发送HTTP请求的编程语言,包括但不限于Python、JavaScript、Java、Go、PHP、C#等。

如何将现有代码迁移?

只需将原API请求地址替换为我们的中转地址,其余参数保持不变。例如: // 原地址 https://api.openai.com/v1/chat/completions // 替换为 https://我们的域名/v1/chat/completions 大部分客户端库只需修改baseURL和APIKEY即可无缝切换。

API请求失败怎么办?

常见的API请求失败原因及解决方案: 1.认证错误:检查API密钥是否正确 2.余额不足:请及时充值账户 3.参数错误:参考文档检查请求参数 4.模型不可用:尝试切换到其他可用模型 5.请求超时:可能是网络问题或服务压力大,请稍后重试 如果无法解决,可联系在线客服

如何查看API调用记录和用量?

登录后,可在"使用日志"页面查看详细的API调用记录,包括时间、模型、消耗的token数量和费用等信息。

数据安全如何保障?

1.我们不存储您的请求内容和响应数据 2.所有API请求采用TLS加密传输 3.严格的访问控制和权限管理 4.定期安全审计和漏洞扫描

服务可用性保障?

我们承诺99.9%的服务可用性,通过全球分布式部署和负载均衡确保服务稳定。对企业用户提供服务级别协议(SLA)保障。

遇到问题如何获取帮助?

1.查阅详细的开发文档 2.可联系在线客服支持

有开发示例代码吗?

我们提供多种编程语言的示例代码和SDK,包括Python、Node.js、Java等,详见顶部的"文档"部分。

注释

  • 健康检查: 统计范围:72 小时图表和近期可用率只衡量 API 连通性,每个柱形汇总一小时内的检查结果。 检查目标:LMSpeed 会优先尝试已配置的健康检查 URL 和 Provider 状态 URL,再尝试从已知 API Host 与近期测速 Base URL 推导出的 API 端点;只有官网地址本身明显是 API 地址时才会作为候选。 探测步骤:每个候选地址依次进行 DNS 解析、TCP 连接、HTTPS 的 TLS 握手,以及自动跟随重定向的 HTTP HEAD 请求;找到首个可达地址后停止尝试。 可达标准:所有必需的网络步骤都必须成功。除被归类为拦截的状态外,低于 500 的 HTTP 响应均视为可达;其中 401 表示需要鉴权,但也证明 API 端点已响应。 拦截结果:HTTP 403、429、521、525、530,以及识别出的 WAF 或 Cloudflare 挑战会标记为“被拦截”,不计入可用率,因为 LMSpeed 无法据此判断 API 本身是否宕机。 模型可用性:配置专用测试 Key 后,LMSpeed 会向推导出的 /models 端点发送带鉴权的 GET 请求,并将返回的模型 ID 与该 Provider 收录的模型进行比对。逐模型结果显示在“模型与价格”中,不计入 Provider 连通性百分比。 超时限制:TCP 连接、TLS 握手、HTTP 连通性请求和模型请求分别使用 20 秒超时;尝试多个候选地址时,整轮检查可能超过 20 秒。 检查频率:后台 Worker 默认每 5 分钟检查一次所有 Provider;72 小时图表会将这些采样汇总为小时柱形,运营方也可以调整调度。 限制说明:自动抽样结果不构成 SLA,也不能保证账户额度、所有模型、所有地区或实际补全请求始终成功;作出运维决策前请同时查看 Provider 官方状态页。
  • Domain Rating 数据来自 Ahrefs。它是基于外链估算的 0–100 域名强度信号,不代表 API 速度或可用性。
  • 页面上的公告和 FAQ 来自该服务商的 NewAPI 状态快照(如果可用)。LMSpeed 会保存服务商状态源中的原始内容和可选英文翻译,并在页面上展示对应语言字段。