YUNWU API 是一个统一的LLM API网关,提供稳定可靠的API中转服务。它支持多种AI模型,包括ChatGPT、Claude、Gemini、Grok、MoonshotAI、智谱、以及来自OpenAI、Cohere、深度求索等提供商的30多种模型。主要特点包括国内直连无需代理、低延迟、高并发和按量计费。该服务适用于需要通过单一接口访问多个LLM的应用程序,常见集成工具包括LobeChat和OpenCat。
统一的API网关,提供对多种大语言模型的访问,支持国内直连。
https://yunwu.ai美国高防负载均衡站群
https://api.apiplus.org全球CDN,国内访问速度一般
完成站点认证,解锁以下权益:
https://api.zhongzhuan.chat方便二次售卖KEY
https://api3.wlai.vip国内高防服务器线路
https://yunwu.zeabur.app按 28 个模型行对比最新 audit、最新测速、吞吐、延迟与按 token 计费价格。
| 模型 | 输入 ($/M) | 输出 ($/M) | 检测 | 速度 | 延迟 |
|---|---|---|---|---|---|
gpt-5.6-lunaCodex专属 | $0.055/M | $0.329/M | — | — | — |
gpt-5.6-lunadefault | $0.068/M | $0.411/M | — | — | — |
gpt-5.6-luna限时体验 | $0.096/M | $0.575/M | — | — | — |
gpt-5.6-luna纯AZ | $0.103/M | $0.616/M | — | — | — |
| $0.205/M | $1.23/M | — | — | — | |
gpt-5.6-luna官转OpenAI | $0.411/M | $2.47/M | — | — | — |
gpt-5.6-luna优质官转OpenAI | $0.548/M | $3.29/M | — | — | — |
| $0.103/M | $0.616/M | — | — | — | |
| $0.205/M | $1.23/M | — | — | — | |
gpt-5.6-terraCodex专属 | $0.137/M | $0.822/M | — | — | — |
| - | - | — | 162.4 t/s | 1.91 s | |
| - | - | 846886100 | 73.8 t/s | 2.82 s | |
grok-4-1-fast-non-reasoning | - | - | — | 111.2 t/s | 3.38 s |
mimo-v2-flash | - | - | — | 60.5 t/s | 2.09 s |
| - | - | — | 147.0 t/s | 4.37 s | |
| - | - | 1008486100 | 200.7 t/s | 1.44 s | |
gemini-2.5-pro-thinking | - | - | — | 105.7 t/s | 9.62 s |
grok-4-fast | - | - | — | 84.1 t/s | 4.01 s |
mistral-small-latest | - | - | — | 474.5 t/s | 1.51 s |
qwen-max-latest | - | - | — | 23.5 t/s | 1.55 s |
qwen3-coder-480b-a35b-instruct | - | - | — | 58.4 t/s | 1.43 s |
qwq-plus-latest | - | - | — | 43.9 t/s | 19.49 s |
| - | - | — | 41.4 t/s | 3.27 s | |
| - | - | — | 318.1 t/s | 0.99 s | |
| - | - | — | 82.7 t/s | 6.57 s | |
| - | - | — | 91.0 t/s | 14.07 s | |
| - | - | — | 112.0 t/s | 10.26 s | |
| - | - | — | 57.6 t/s | 2.58 s |
当前显示 28 / 28 个模型行
| 时间 | 模型 | 速度 | 延迟 |
|---|---|---|---|
| Jul 4, 04:15 PM | claude-opus-4-7 | 162.36 tok/s | 1.91s |
| May 15, 04:00 PM | gpt-5-mini | 82.67 tok/s | 6.57s |
| Apr 24, 11:02 AM | gpt-5.4-nano | 19.82 tok/s | 7.05s |
| Apr 24, 11:00 AM | deepseek-v4-flash | 67.17 tok/s | 2.68s |
| Apr 24, 05:00 AM | deepseek-v4-flash | 80.40 tok/s | 2.96s |
| Apr 1, 11:04 AM | gpt-5-nano-2025-08-07 | 111.99 tok/s | 10.26s |
| Apr 1, 11:00 AM | gpt-5-nano | 91.01 tok/s | 14.07s |
| Mar 26, 05:04 AM | gpt-5.4-mini | 200.70 tok/s | 1.44s |
| Mar 26, 05:02 AM | gpt-5.4-nano | 274.17 tok/s | 1.68s |
| Mar 26, 05:00 AM | mimo-v2-flash | 49.16 tok/s | 2.81s |
通知:az claude 分组倍率6,Vertex claude分组倍率6上线
通知: 新增stripe 支付方式
模型上架:kimi-k3
通知:模型上新deepseek-v4-pro-202606,deepseek-v4-flash-202605系列带日期为官方原厂模型
模型上架:gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna,包括其带后缀的使用方法
通知:1、由于官方新版 Claude 接口限制:claude-opus-4.7+模型(4.8、sonnet-5、fable-5) 官方 API 不再支持自定义参数“temperature、top_p、top_k”,传入会直接报参数错误、400 请求失败。 2、为提高用户使用体验,平台将在2026年7月10日00:00对claude-opus-4.7+模型(4.8、sonnet-5、fable-5)的“temperature、top_p、top_k”参数进行过滤。如有疑问请与客服联系,感谢您的理解与支持!!!
通知: doubao-seed-2-1-turbo-260628,维护中,暂时下线,恢复等通知
模型上架:grok-4.5
通知:快乐马系列模型已恢复
通知:快乐马系列模型做调整,暂时下架
分组变动:claude code专属分组倍率变动由3->2.4;gemini-cli分组倍率变动由1.5->1
模型上架:claude-fable-5
通知:直连Aistudio 分组 重命名 直连Gemini ,资源类型为VERTEX AI
模型上架:claude-sonnet-5
模型上架:gemini-3.1-flash-lite-image
模型上架:gpt-image-2-c
通知:直连Aistudio 分组上线
模型上架:kling-3.0-turbo
分组变动:由于成本提升,官转gemini分组将于6月29日12:00涨价至3.6倍率
模型上新: happyhorse-1.1-r2v, happyhorse-1.1-t2v, happyhorse-1.1-i2v
1.提供多种计费模式:按请求次数、按token数量等 2.实时显示用户的API使用情况和费用.
我们的API遵循RESTful标准,支持任何可以发送HTTP请求的编程语言,包括但不限于Python、JavaScript、Java、Go、PHP、C#等。
只需将原API请求地址替换为我们的中转地址,其余参数保持不变。例如: // 原地址 https://api.openai.com/v1/chat/completions // 替换为 https://我们的域名/v1/chat/completions 大部分客户端库只需修改baseURL和APIKEY即可无缝切换。
常见的API请求失败原因及解决方案: 1.认证错误:检查API密钥是否正确 2.余额不足:请及时充值账户 3.参数错误:参考文档检查请求参数 4.模型不可用:尝试切换到其他可用模型 5.请求超时:可能是网络问题或服务压力大,请稍后重试 如果无法解决,可联系在线客服
登录后,可在"使用日志"页面查看详细的API调用记录,包括时间、模型、消耗的token数量和费用等信息。
1.我们不存储您的请求内容和响应数据 2.所有API请求采用TLS加密传输 3.严格的访问控制和权限管理 4.定期安全审计和漏洞扫描
我们承诺99.9%的服务可用性,通过全球分布式部署和负载均衡确保服务稳定。对企业用户提供服务级别协议(SLA)保障。
1.查阅详细的开发文档 2.可联系在线客服支持
我们提供多种编程语言的示例代码和SDK,包括Python、Node.js、Java等,详见顶部的"文档"部分。
排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。
用 1020 个 LMSpeed 信号,把 YUNWU API 的 6 个相近 API 替代服务商放在一起比较:共享模型覆盖、价格、实测速度、可用性和免费模型。
| 服务商 | 对比理由 | 模型数 | 免费项 | 均价 | 速度 | 30 天可用性 |
|---|---|---|---|---|---|---|
| YUNWU API yunwu-ai A unified API gateway providing access to multiple large language models with direct connectivity in China. | 当前服务商基线 | 216 | 6 | $4.39/M | 115 tok/s | 99.4% |
| Higobs API newapi-higobs-com An OpenAI-compatible API gateway providing access to multiple large language models and AI services. |
| 137 | 0 | $2.21/M | 118 tok/s | 0.5% |
apitoken-online ApiToken Online offers an OpenAI-compatible API gateway at apitoken.online with transparent per-model pricing and multi-provider routing. |
| 33 | 16 | $0.736/M | 81 tok/s | 72.9% |
new-api-bxhm-onrender-com Kingo API Sharing Station is a LinuxDO API relay by user Kingo deployed on Render. Proxies Claude haiku / sonnet 4.5. Small daily sign-in credits; some 1.21-era models may return 502. |
| 3 | 0 | $1.71/M | N/A | 99.6% |
new-waadri-top WAADRI runs a unified AI model gateway that exposes aggregated model access through OpenAI-, Claude-, and Gemini-compatible interfaces. |
| 192 | 710 | N/A | N/A | 5.5% |
api-n1n-ai N1N provides API access to a wide range of AI models including GPT-4, Claude 3, Gemini, and others for text, image, and video generation. |
| 177 | 6 | $8.77/M | 90 tok/s | 99.7% |
180txt-cn 180txt API provides an OpenAI-compatible API relay for multiple AI models. |
| 37 | 8 | $31.07/M | 42 tok/s | 4.8% |