VSLLM currently presents a New API-based gateway on vsllm.com. A live review on 2026-04-27 showed the default New API title and the standard /logo.png icon path, so LMSpeed keeps the provider copy conservative: VSLLM appears to operate a unified AI gateway for routing requests to multiple model families through one endpoint and management panel rather than the broader marketplace positioning previously listed.
- 延迟
- 0.00 s
- 创建时间
- 3/8/2026
- 充值汇率
- ¥7.30 / 1 美元额度
功能
登录方式
API 地址
- 接口 1历史推断 / 未验证
https://vsllm.com - 接口 2历史推断 / 未验证
https://api.vsllm.com - 接口 3历史推断 / 未验证
https://for.shuo.bar
完成站点认证,解锁以下权益:
- 编辑服务商名称、正文和链接
- 获得优先流量扶持和曝光推荐
- 展示官方认证徽章,提升用户信任
排行榜排名
排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。
关于 VSLLM
健康检查
API 基准测试与价格
按 220 个模型行对比最新 audit、最新测速、吞吐、延迟与按 token 计费价格。
[opencode]deepseek-v4-flashdefault | $0.0004/request | - | - | - | ||||||||||
[opencode]deepseek-v4-prodefault | $0.036/request | - | - | - | ||||||||||
deepseek-flashdefault | $0.0073/request | - | - | - | ||||||||||
deepseek-v4.1-flash-apidefault | $0.0015/request | - | - | - | ||||||||||
dsdefault | $14.60/request | - | - | - | ||||||||||
gemini-3.7-flash-apidefault | $0.015/request | - | - | - | ||||||||||
gemini-3.8-flash-antigravitydefault | $0.015/request | - | - | - | ||||||||||
gemini-3.8-flash-apidefault | $0.015/request | - | - | - | ||||||||||
glmdefault | $1095.00/M | $1095.00/M | - | - | ||||||||||
glm-5.3-anthropicdefault | $0.146/request | - | - | - | ||||||||||
grok-composer-2.5-fastdefault | $0.219/request | - | - | - | ||||||||||
kimi-k3-apidefault | $0.219/request | - | - | - | ||||||||||
deepseek-v4.1-flashdefault | $0.0015/request | - | - | - | ||||||||||
gpt-6-astradefault | $0.365/request | - | - | - | ||||||||||
gemini-3.8-flashdefault | $0.015/request | - | - | - | ||||||||||
glm-5.3-flashdefault | $0.036/request | - | - | - | ||||||||||
glm-5.3default | $0.073/request | - | - | - | ||||||||||
gemini-3.7-flashdefault | $0.015/request | - | - | - | ||||||||||
grok-4.6default | $0.073/request | - | - | - | ||||||||||
qwen3.8-maxdefault | $0.219/request | - | - | - | ||||||||||
claude-opus-5default | $0.365/request | - | 38.6 t/s | 5.06 s | ||||||||||
gemini-3.6-flash-highdefault | $0.036/request | - | - | - | ||||||||||
gemini-3.5-flash-litedefault | $0.0073/request | - | - | - | ||||||||||
kimi-k3default | $0.073/request | - | - | - | ||||||||||
gpt-5.6-lunadefault | $0.015/request | - | 150.9 t/s | 3.07 s |
当前显示 25 / 220 个模型行
最近测试记录
| 时间 | 模型 | 速度 | 延迟 |
|---|---|---|---|
| Aug 12, 08:23 AM | gpt-5.6-luna | 150.93 tok/s | 3.07s |
| Jul 30, 01:08 PM | claude-opus-5 | 38.63 tok/s | 5.06s |
| Jul 30, 01:05 PM | gpt-5.6-sol | 43.72 tok/s | 7.13s |
| Jun 10, 01:26 AM | claude-opus-4-7 | 32.27 tok/s | 4.93s |
| May 30, 05:43 AM | claude-opus-4-8 | 28.20 tok/s | 26.33s |
| May 30, 05:42 AM | claude-opus-4-8-free | 44.93 tok/s | 4.15s |
| May 21, 01:44 AM | gpt-5.5-pro20x | 50.29 tok/s | 1.52s |
| May 21, 01:42 AM | claude-opus-4-7-request | 38.20 tok/s | 1.84s |
| May 21, 01:40 AM | gemini-3.5-flash-antigravity | 320.41 tok/s | 7.77s |
| May 19, 08:11 AM | gemini-3-flash-preview-request-antigravity | 193.61 tok/s | 12.37s |
相似 API 替代服务商对比
用 505 个 LMSpeed 信号,把 VSLLM 的 6 个相近 API 替代服务商放在一起比较:共享模型覆盖、价格、实测速度、可用性和免费模型。
| 服务商 | 对比理由 | 模型数 | 免费项 | 均价 | 速度 | 30 天可用性 |
|---|---|---|---|---|---|---|
| VSLLM vsllm-com VSLLM runs a New API-powered AI gateway on vsllm.com for aggregated model access through a single endpoint. | 当前服务商基线 | 221 | 2 | $0.056/M | 174 tok/s | 9970% |
| RenRen API llm-whitedream-top RenRen API runs a New API-powered gateway on llm.whitedream.top for aggregated access to multiple AI models. |
| 477 | 0 | $0.0075/M | 271 tok/s | 9930% |
| 6345ywz API api-6345ywz-cn 6345ywz API is an OpenAI-compatible API relay providing access to multiple AI models with competitive pricing. |
| 473 | 0 | $0.0001/M | 272 tok/s | 9900% |
| 91VIP 91vip-futureppo-top 91VIP is a non-profit API service providing access to various AI models including Codex, Claude Code, and Open Code, with specific unlimited-use groups. |
| 402 | 10 | $0.149/M | 301 tok/s | 0% |
| 钠 API naapi-cc Na API (naapi.cc) is an OpenAI-compatible LLM API gateway with competitive pricing and stable access to 100+ models from OpenAI, Anthropic, Google, and more. |
| 1,086 | 2 | $0.082/M | 649 tok/s | 9950% |
| 初叶🍂Furry API ai-chuyel-top A free, community-supported API service providing access to various AI models for developers and users. |
| 1,069 | 173 | $8.50/M | 171 tok/s | 3350% |
| 天絮 API tianxu-api Tianxu API provides an AI model relay service with multiple access points and stable connectivity. |
| 810 | 0 | $0.029/M | 93 tok/s | 9920% |
公告
稳定~
近期在部分网络环境下,原 .com 域名可能会出现无法连接或访问受限的情况。如遇此问题,请直接将 API 地址中的 .com 后缀替换为 .cc 即可恢复正常访问。
若 https://vsllm.com/v1 无法连接,请将其更换为 https://vsllm.cc/v1。
感谢大家的理解与支持!
📢 核心调度引擎重构与底层性能深度优化
今天对底层调度引擎进行了深度重构,重点解决了高并发场景下的内存溢出、路由探针调度及数据库 I/O 阻塞等核心问题,系统稳定性与吞吐量得到显著提升
重构渠道探测调度器,实现实时拉取最新渠道状态。引入探中数安全阈值控制,优化打断与放行机制。增加并发互斥锁拦截并发上传,避免线上数据踩踏
修复路由热路径中模型名传递不一致导致的误拦截问题,统一对齐至实际映射模型。重做死链追踪器逻辑,仅在网络层断开时标记死链,消除因单一凭证失效导致的节点连坐封禁。收紧动态模型映射算法,强制精准匹配,非精准匹配仅作为发现记录,从底层杜绝变体模型掺水。优化优先路由降级重试逻辑,避免无效超时
彻底排查并封杀线上环境内存溢出的核心源头。限制动态映射表的无界增长,过滤无效自映射,设置全局与单候选条目数量上限,管理接口默认仅返回已生效映射。精细化调整 Go Runtime 的 GOMEMLIMIT,降低垃圾回收压力,确保高负载下的内存安全
重构数据流程,将巨型单事务拆分为细粒度分批提交,消除长时间数据库写锁独占导致的 I/O 阻塞。优化查询逻辑,消除全表反序列化与海量单行查询,改用预编译语句与轻量级 ID 映射性能实现数量级提速。修复截断压缩文件导致的解析死循环
统一规范化读写形式,解决因斜杠差异导致的内存与数据库状态不一致问题。优化构建内存索引替代全量配置拉取,大幅降低数据库查询开销
目前新版本已平滑热更上线。感谢大家的耐心等待,我们将持续打磨系统,提供更稳定的 API 服务
全新调度系统现已上线运行三天。由于底层架构进行了全面重构,目前系统仍处于高强度的深度调试与磨合期。我们注意到,近期部分请求仍存在路由匹配异常(如“无法找到对应上游”)等Bug。
必须坦诚地向大家说明,将一个庞大且复杂的全新系统打磨至真正的最佳状态,是一项极其艰巨的工程,绝非一日之功。我们正在夜以继日地排查每一个边缘场景,全力攻克这些技术瓶颈。
只要最终能达到极致的稳定与高效,眼前的所有努力与阵痛都是值得的。在此,恳请大家给予我们更多的耐心与包容,陪伴新系统度过这段关键的成长期。感谢您的理解与坚定支持!
本次全渠道系统维护与底层升级已顺利完成,各项模型服务逐步恢复中。
关于此前遭受的大规模 DDoS 攻击,已彻底查明攻击源头与真实诱因。由于背后的原因实在过于离谱和惊悚(请原谅我们暂时无法公开披露细节),我们已紧急采取了最高级别的反制与隔离措施。
目前已成功拦截绝大部分恶意攻击流量,核心链路已恢复平稳。剩余部分模型将在接下来的时间内陆续上线。
感谢大家在至暗时刻的耐心等待与坚定支持!😉
鉴于近期本站持续遭受大规模 DDoS 网络攻击。为保障平台的长期稳定运行与数据安全,我们将对底层网络防护架构进行紧急升级,并开展全渠道系统维护。
维护时间:今日 23:00 至 次日凌晨 02:00
影响范围:维护期间,部分模型接口将出现短暂不可用或请求延迟现象。
请各位用户提前做好业务安排。维护结束后,所有服务将自动恢复正常。由此给您带来的不便,我们深表歉意,感谢您的理解与支持。
V4.1 Flash 模型名请使用 deepseek-flash。旧模型名 deepseek-v4-flash、deepseek-v4-flash-vision-exp 仍可调用,但对应模型已下线,请求将由 DeepSeek-V4.1-Flash 模型提供服务
📢 关于新调度系统上线及稳定性优化的说明
本站于昨日凌晨正式上线了全新的底层调度系统。由于新架构仍处于磨合与持续优化阶段,昨日部分时段出现了稳定性波动,导致部分请求触发4xx错误及其他异常问题。
目前已针对暴露的问题进行了紧急修复与参数调优。预计今日起,系统整体稳定性与请求成功率将显著回升,并逐步恢复至最佳状态。
感谢您在系统升级期间的理解与耐心等待!
📢 关于各模型 API 端点(Endpoint)配置说明
为保证调用成功率,请大家在配置时严格按照以下完整路径填写:
- Gemini 系列:请使用
v1beta端点,并务必带上模型名称与 Key 参数。完整示例:https://vsllm.cc/v1beta/models/gemini-3.8-flash:generateContent?key=YOUR_API_KEY - Claude 系列:请使用专属的 Claude 端点:
https://vsllm.cc/v1/messages - OpenAI (GPT) 系列:请使用
/v1/responses端点:https://vsllm.cc/v1/responses - 其他模型(如各类国产模型、Grok 等):使用常规的 Chat 端点即可:
https://vsllm.cc/v1/chat/completions
请根据实际调用的模型替换对应的 URL 与参数,避免因路径缺失导致请求失败。
📢 关于启用全新专属域名节点的通知
宝子们,由于近期部分地区网络环境出现波动,部分小伙伴反馈访问旧址有些迷路或者加载缓慢 🥺。
为了给大家提供始终如一的丝滑体验,我们紧急启用了全新的专属纯净节点:👉 https://vsllm.cc/v1 👈
新节点已接入深度优化的防干扰线路,无视各种网络波动与环境限制,直连超级稳!如果你现在访问旧址有点卡顿或打不开,赶紧把 Base URL 换成这个新地址,保证瞬间畅通无阻,继续丝滑起飞!🚀✨
📢 底层调度系统的最后阶段攻坚现已圆满结束。
本次全量升级彻底重构了核心路由策略与高并发处理机制,目前系统各项性能指标均已达到预期最优状态,全链路稳定性大幅提升。感谢您在升级期间的耐心等待与理解,欢迎体验更稳定、高效的服务❤️
📢 本站底层调度系统升级进度已达 2/3🎉,核心链路的负载均衡与稳定性优化已初步生效。剩余部分攻坚工作正在紧急推进中,我们将尽快完成全量升级,感谢大家的耐心等待与支持。
📢 关于“7·23 投毒事件”的再次声明
宝子们,关于一个月前的“投毒事件”再给大家做个详细复盘哈!事情发生在 北京时间7月23日晚22点,黑客 龚某华(极其狡诈,但我们已完全掌握其本人手机号、个人信息及其妻子的联系方式)爆破了本站号池后台密码并植入恶意上游。从 23日晚23点到24日早上8点 期间发生了投毒,24日凌晨我们发现 ccload 密码被改,虽然本站拼命拦截(对方上游返回极快我们拦了一部分,但他一直换打法),凌晨3点换了密码依然存在,随后我们开启大清理💪🫵并对 ccload 彻底加固修复,直到 24日早上9点 才彻底解决
这事都过去一个月了,新来的小伙伴不知道可以去翻当时的公告。当然,如果那次事件对您造成了任何损失,请立刻联系我们! 我们随时可以直接报警把这个犯罪分子逮捕送进去!😡 绝对死磕到底,绝不姑息,现在系统非常安全,大家放心用就完事了
📢 宝子们,高峰期调度排队的问题理论上已经被我们搞定啦!🎉 不过因为现在这会儿流量还没到最巅峰,还得等明天再进一步观察验证一下效果 🧐
📢 新模型上线通知
宝子们,鉴于 Gemini 3.7 Flash 最近的表现实在太惊人了 🤩,我们特意给大家新增了一个超平价的版本:gemini-3.7-flash-api!
性价比直接拉满,体验一样丝滑,大家快去试试吧 🚀✨
📢 宝子们,我们修复了一个严重的级联 bug 🛠️!之前由于 Gemini 的拒绝/安全响应("The prompt could not be submitted...")天生缺少标记,导致只要转发一次拒绝,账号就会被误判封禁并硬隔离。结果就是发一个会被拒绝的提示词,会把整个号池的账号挨个试穿并全部拉黑,最后请求一直转圈 😵💫。目前这个问题已彻底修复,号池不会再被误伤劣化啦,大家放心用!🚀
📢 宝子们,正在紧急修复高负载导致的间歇性断连 bug 🛠️,大家稍安勿躁哈~ 🙏
稳定~
📢 宝子们,给大家按头安利本站唯一指定合作的 GPT 神仙渠道!🌟 他家的 GPT 真的特别稳,日常调用丝滑得飞起,最关键的是价格香到离谱,只要 0.085 倍率!💰 想要便宜又稳定冲 GPT 的宝子直接闭眼入,传送门:sub.unsee.you ,赶紧去薅羊毛啦!🚀✨
📢 新模型上线通知
宝子们,鉴于 Gemini 3.7 Flash 最近的表现实在太惊人了 🤩,我们特意给大家新增了一个超平价的版本:gemini-3.7-flash-api!
性价比直接拉满,体验一样丝滑,大家快去试试吧 🚀✨
注释
- 健康检查: 统计范围:72 小时图表和近期可用率只衡量 API 连通性,每个柱形汇总一小时内的检查结果。 检查目标:LMSpeed 会优先尝试已配置的健康检查 URL 和 Provider 状态 URL,再尝试从已知 API Host 与近期测速 Base URL 推导出的 API 端点;只有官网地址本身明显是 API 地址时才会作为候选。 探测步骤:每个候选地址依次进行 DNS 解析、TCP 连接、HTTPS 的 TLS 握手,以及自动跟随重定向的 HTTP HEAD 请求;找到首个可达地址后停止尝试。 可达标准:所有必需的网络步骤都必须成功。除被归类为拦截的状态外,低于 500 的 HTTP 响应均视为可达;其中 401 表示需要鉴权,但也证明 API 端点已响应。 拦截结果:HTTP 403、429、521、525、530,以及识别出的 WAF 或 Cloudflare 挑战会标记为“被拦截”,不计入可用率,因为 LMSpeed 无法据此判断 API 本身是否宕机。 模型可用性:配置专用测试 Key 后,LMSpeed 会向推导出的 /models 端点发送带鉴权的 GET 请求,并将返回的模型 ID 与该 Provider 收录的模型进行比对。逐模型结果显示在“模型与价格”中,不计入 Provider 连通性百分比。 超时限制:TCP 连接、TLS 握手、HTTP 连通性请求和模型请求分别使用 20 秒超时;尝试多个候选地址时,整轮检查可能超过 20 秒。 检查频率:后台 Worker 默认每 5 分钟检查一次所有 Provider;72 小时图表会将这些采样汇总为小时柱形,运营方也可以调整调度。 限制说明:自动抽样结果不构成 SLA,也不能保证账户额度、所有模型、所有地区或实际补全请求始终成功;作出运维决策前请同时查看 Provider 官方状态页。
- Domain Rating 数据来自 Ahrefs。它是基于外链估算的 0–100 域名强度信号,不代表 API 速度或可用性。
- 页面上的公告和 FAQ 来自该服务商的 NewAPI 状态快照(如果可用)。LMSpeed 会保存服务商状态源中的原始内容和可选英文翻译,并在页面上展示对应语言字段。

