免费大模型 API
发现各大提供商提供的免费大模型 API,对比速度与延迟数据。免费模型 2794服务商 153免费服务 8378
最新大语言模型
查看 LMSpeed 最新收录并发布的大语言模型,进入模型页对比服务商、价格、性能与免费可用性。
- Ling 3.0 Flash VLinclusionAI
Ling 3.0 Flash VL builds on Ling 3.0 Flash (124B total / 5.5B active MoE from InclusionAI), further strengthening its language capabilities while adding native visual perception and advanced visual...
发布于 2026年9月10日1 家服务商 - DeepSeek V4.1 FlashDeepSeek
DeepSeek V4.1 Flash is a sparse mixture-of-experts model from DeepSeek, and the cost-efficient tier of the V4.1 family. DeepSeek reports that it exceeds V4 Pro on performance, speed, and task...
发布于 2026年9月10日39 家服务商1 家免费 - Nex-N2.5-MiniNex AGI
Nex-N2.5 is an agentic model built to turn goals into working, verified outcomes. Its core strength is agentic coding within a visual feedback loop: it can explore codebases, implement multi-file...
发布于 2026年9月8日4 家服务商 - Nex-N2.5-ProNex AGI
Nex-N2.5 is an agentic model built to turn goals into working, verified outcomes. Its core strength is agentic coding within a visual feedback loop: it can explore codebases, implement multi-file...
发布于 2026年9月8日4 家服务商 - GPT-6 AstraOpenAI
GPT-6 Astra is OpenAI's flagship model for demanding end-to-end work. It is suited for advanced analysis, software engineering, deep research, scientific work, and document creation, with particular strengths in long-horizon...
发布于 2026年9月4日104 家服务商3 家免费 - Ling 3.0 Flash SanteinclusionAI
Ling 3.0 Flash Sante is a health and medicine-focused mixture-of-experts model from InclusionAI, built on Ling 3.0 Flash with 5.1B active parameters out of 124B total. It is designed for...
发布于 2026年9月4日4 家服务商
免费模型目录
按服务商数量、速度和首字延迟对比免费模型,数据来自真实 API 测试。
| 模型 | 服务商 | 速度 | 延迟 | 测试 |
|---|---|---|---|---|
deepseek-v4-flash-vision-exp-freeDeepSeek免费 | N/A | N/A | 0 | |
buzz-free免费 | N/A | N/A | 0 | |
你妈-16x9免费 文生图 | N/A | N/A | 0 | |
你妈-9x16免费 文生图 | N/A | N/A | 0 | |
你妈-4x3免费 文生图 | N/A | N/A | 0 | |
你妈-1x1免费 文生图 | N/A | N/A | 0 | |
你妈-2x3免费 文生图 | N/A | N/A | 0 | |
你妈-3x2免费 文生图 | N/A | N/A | 0 | |
kilo-auto/free免费 | N/A | N/A | 0 | |
mj_inpaintMidjourney免费 绘画异步 | N/A | N/A | 0 | |
mj_custom_zoomMidjourney免费 生图绘画异步 | N/A | N/A | 0 | |
[free]GLM-5.3-flash智谱免费 | 42.58 t/s | 28.35 s | 5 | |
[free]GLM-5.3智谱免费 | N/A | N/A | 0 | |
[free]gpt-5.6-solOpenAI免费 | N/A | N/A | 0 | |
[free]claude-opus-5Anthropic免费 | N/A | N/A | 0 | |
[free]grok-4-6xAI免费 | N/A | N/A | 0 | |
[free]kimi-k3Moonshot免费 | N/A | N/A | 0 | |
[free]gemini-3.7-flashGoogle免费 | N/A | N/A | 0 | |
[free]deepseek-v4-pro-0813DeepSeek免费 | N/A | N/A | 0 | |
[free]qwen3.8-max阿里巴巴免费 | N/A | N/A | 0 | |
NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it... | 59.59 t/s | 0.89 s | 5 | |
NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer... | N/A | N/A | 0 | |
Muse Glimmer 30B is a dense, open-weight multimodal model from Meta Superintelligence Labs, distilled from Muse Spark and optimized for autonomous agents on consumer hardware. It is suited for long-horizon... | N/A | N/A | 0 | |
ReasoningToolsFilesOpen WeightsGemma 4 26B A4B IT is an instruction-tuned Mixture-of-Experts (MoE) model from Google DeepMind. Despite 25.2B total parameters, only 3.8B activate per token during inference — delivering near-31B quality at... | N/A | N/A | 0 | |
ReasoningToolsFilesVisionGemma 4 31B Instruct is Google DeepMind's 30.7B dense multimodal model supporting text and image input with text output. Features a 256K token context window, configurable thinking/reasoning mode, native function... | N/A | N/A | 0 | |
ox-alphaOpenRouter免费 | 88.65 t/s | 8.97 s | 5 | |
sensenova-6.8-flash-liteSenseNova免费 | 293.60 t/s | 6.69 s | 5 | |
dots-3-note-preview免费 | 101.36 t/s | 1.07 s | 5 | |
diffusiongemma-26b-a4b-itGemini免费 | 796.82 t/s | 1.98 s | 5 | |
brave-deep-research免费 | N/A | N/A | 0 | |
cc-glm-5智谱免费 文本 | N/A | N/A | 0 | |
brave免费 | N/A | N/A | 0 | |
babbage-002免费 文本 | N/A | N/A | 0 | |
cc-glm-5-turbo智谱免费 文本 | N/A | N/A | 0 | |
cc-glm-5.1智谱免费 文本 | N/A | N/A | 0 | |
agnes-image-2.1-flash免费 | N/A | N/A | 0 | |
agnes-video-2.5-flash免费 | N/A | N/A | 0 | |
cf41b0e0dd7d53e5免费 | N/A | N/A | 0 | |
abab6.5-chatMiniMax免费 文本 | N/A | N/A | 0 | |
abab5.5-chatMiniMax免费 文本 | N/A | N/A | 0 | |
abab6.5s-chatMiniMax免费 文本 | N/A | N/A | 0 | |
chatglm_lite智谱免费 文本通用 | N/A | N/A | 0 | |
chatglm_pro智谱免费 文本通用 | N/A | N/A | 0 | |
[free]DeepSeek-V3.2DeepSeek免费 | N/A | N/A | 0 | |
Cursor-co4-thinkingClaude免费 文本代码推理 | N/A | N/A | 0 | |
[free]DeepSeek-V4-FlashDeepSeek免费 | N/A | N/A | 0 | |
01-ai/yi-large零一万物免费 | N/A | N/A | 0 | |
aa/agnes-3.0-flash免费 | N/A | N/A | 0 | |
abab5.5s-chatMiniMax免费 文本 | N/A | N/A | 0 | |
abab6-chatMiniMax免费 文本 | N/A | N/A | 0 | |
adept/fuyu-8b免费 | N/A | N/A | 0 | |
agnes-image-2.5-flash免费 | N/A | N/A | 0 | |
agnes-2.5-flash免费 | N/A | N/A | 0 | |
agnes-3.0-flash免费 | N/A | N/A | 0 | |
agnes-video-v2.0免费 | N/A | N/A | 0 | |
aisingapore/sea-lion-7b-instruct免费 | N/A | N/A | 0 | |
bigcode/starcoder2-15b免费 | N/A | N/A | 0 | |
big-pickleopencode zen免费 ReasoningTools200K | N/A | N/A | 0 | |
Doubao-1.5-pro-256k字节跳动免费 文本长上下文 | N/A | N/A | 0 | |
SparkDesk-v1.1讯飞免费 文本通用 | N/A | N/A | 0 |
LMSpeed 追踪了来自 153 家 API 提供商的 2794 个免费大语言模型。各提供商的免费额度不同——有的限制每日请求数,有的为新用户提供免费额度。所有速度数据均来自真实 API 测试。
如何使用
先找到合适的免费模型,对比它背后的服务商,再进入模型或服务商详情页确认限制与表现。
- 1
按模型系列筛选
使用搜索、模型系列筛选和能力标签,把目录缩小到真正想测试的免费模型。
- 2
对比速度与延迟
查看服务商数量、测试量、吞吐速度和首字延迟,不只按价格选择。
- 3
进入服务商详情
在服务商详情页确认可用性、健康检测、价格备注和免费额度限制,再用于测试或集成。
免费大模型 API 常见问题
关于免费额度与如何使用这份目录的常见问题。
LMSpeed 上的「免费 API」是怎么界定的?
指的是某家提供商上输入和输出价格都为 $0 / token 的模型组合。部分提供商提供长期免费额度,部分仅向新账号一次性赠送。只有在公开价格为零时才会被标记为免费,价格页会定期复核。
这些免费 API 真的免费吗?有什么坑?
大多数有速率限制——每分钟请求数、每日总量、上下文长度上限——很多要求实名注册并绑定手机号或支付方式。部分是阶段性活动。在依赖某个免费端点之前,请仔细阅读提供商的条款和配额。
列表里有「公益站」/ 社区中转吗?还需要注意什么?
部分条目是社区运营的「公益站」或聚合中转——站长用自掏腰包的上游 key 打包再免费分发。它们通常额度更大、可用模型更全,但稳定性远低于官方 API:站长随时可能停服或「跑路」,额度和价格也可能毫无预警地变动;很多站点是邀请制,需要 GitHub 邀请码、社区推荐或特定圈子才能注册,部分长期关闭注册。建议把它们当作可遇不可求的备用通道,重要工作流仍走官方付费端点。
哪家免费大模型 API 最快?
速度因模型和提供商而异。按「最多测试」排序找数据最稳的,或在上方按模型系列筛选。每行展示真实 API 测试得到的 tokens/秒 中位值与首字延迟。
LMSpeed 如何测量速度和延迟?
对每家提供商使用相同 prompt 做五轮压力测试,使用 tiktoken 统计输出 token 数,测量吞吐量(tokens/秒)和首字到达时间。所有指标以中位数聚合以抵抗异常值,并按固定节奏刷新。
免费大模型 API 能用在生产环境吗?
用于原型、个人项目和低流量工具是可以的。生产流量很快就会撞到速率限制。建议把免费额度当成「试用通道」:先验证模型和服务商表现,再切到同模型的付费端点上线。
为什么我想要的模型不在列表里?
可能目前没有提供商提供免费版本、免费活动已结束,或者尚未被基准测试覆盖。可以在该模型的详情页查看付费方案,或通过页脚反馈链接告诉我们漏了哪家。
