发现各大提供商提供的免费大模型 API,对比速度与延迟数据。免费模型 2774服务商 156免费服务 8766
| 模型 | 服务商 | 速度 | 延迟 | 测试 |
|---|---|---|---|---|
doubao-pro-128k-240515字节跳动免费 | N/A | N/A | 0 | |
doubao-lite-4k-pretrain-character-240516字节跳动免费 | N/A | N/A | 0 | |
doubao-lite-4k-character-240828字节跳动免费 | N/A | N/A | 0 | |
LMSpeed 追踪了来自 156 家 API 提供商的 2774 个免费大语言模型。各提供商的免费额度不同——有的限制每日请求数,有的为新用户提供免费额度。所有速度数据均来自真实 API 测试。
先找到合适的免费模型,对比它背后的服务商,再进入模型或服务商详情页确认限制与表现。
使用搜索、模型系列筛选和能力标签,把目录缩小到真正想测试的免费模型。
查看服务商数量、测试量、吞吐速度和首字延迟,不只按价格选择。
在服务商详情页确认可用性、健康检测、价格备注和免费额度限制,再用于测试或集成。
关于免费额度与如何使用这份目录的常见问题。
| N/A |
| N/A |
| 0 |
doubao-lite-4k-240328字节跳动免费 | N/A | N/A | 0 |
doubao-lite-32k-character-250228字节跳动免费 | N/A | N/A | 0 |
doubao-lite-32k-character-241015字节跳动免费 | N/A | N/A | 0 |
doubao-lite-32k-240828字节跳动免费 | N/A | N/A | 0 |
doubao-lite-32k-240628字节跳动免费 | N/A | N/A | 0 |
doubao-lite-32k-240428字节跳动免费 | N/A | N/A | 0 |
doubao-lite-128k-240828字节跳动免费 | N/A | N/A | 0 |
doubao-lite-128k-240428字节跳动免费 | N/A | N/A | 0 |
doubao-embedding-vision-250328字节跳动免费 | N/A | N/A | 0 |
doubao-embedding-vision-241215字节跳动免费 | N/A | N/A | 0 |
doubao-embedding-text-240515字节跳动免费 | N/A | N/A | 0 |
doubao-1.5-vision-pro-250328字节跳动免费 | N/A | N/A | 0 |
doubao-1.5-vision-lite-250315字节跳动免费 | N/A | N/A | 0 |
doubao-1.5-ui-tars-250328字节跳动免费 | N/A | N/A | 0 |
doubao-1-5-vision-pro-32k-250115字节跳动免费 | N/A | N/A | 0 |
doubao-1-5-thinking-pro-m-250428字节跳动免费 | N/A | N/A | 0 |
doubao-1-5-thinking-pro-m-250415字节跳动免费 | N/A | N/A | 0 |
doubao-1-5-pro-32k-character-250228字节跳动免费 | N/A | N/A | 0 |
wan2-1-14b-t2v-250225免费 | N/A | N/A | 0 |
qwen2-5-72b-20240919阿里巴巴免费 | N/A | N/A | 0 |
Qwen/Qwen3-32B-TEE阿里巴巴免费 | N/A | N/A | 0 |
zai-org/GLM-5-TEE智谱免费 | N/A | N/A | 0 |
Qwen/Qwen3-235B-A22B-Thinking-2507-TEE阿里巴巴免费 | N/A | N/A | 0 |
zai-org/GLM-5.1-TEE智谱免费 | N/A | N/A | 0 |
MiniMaxAI/MiniMax-M2.5-TEE免费 | N/A | N/A | 0 |
deepseek-ai/DeepSeek-V3.2-TEEDeepSeek免费 | N/A | N/A | 0 |
google/gemma-4-31B-turbo-TEE免费 | N/A | N/A | 0 |
Qwen/Qwen3.6-27B-TEE阿里巴巴免费 | N/A | N/A | 0 |
Qwen/Qwen3.5-397B-A17B-TEE阿里巴巴免费 | N/A | N/A | 0 |
moonshotai/Kimi-K2.5-TEEMoonshot免费 | N/A | N/A | 0 |
moonshotai/Kimi-K2.6-TEEMoonshot免费 | N/A | N/A | 0 |
draw免费 | N/A | N/A | 0 |
SenseChat-5免费 | N/A | N/A | 0 |
SenseChat免费 | N/A | N/A | 0 |
grok-2-minixAI免费 | N/A | N/A | 0 |
qwen3.5:397b-cloud阿里巴巴免费 | N/A | N/A | 0 |
ReasoningFilesVision131.1KGoogle 的 Gemini 3.1 Flash Image是Gemini 3.1 系列的图像生成模型,专为文本到图像生成与图像编辑任务优化。 | N/A | N/A | 0 |
FilesVision32.8KReasoningGoogle 的 Gemini 3 Pro Image是Gemini 3 系列的图像生成模型,专为文本到图像生成与图像编辑任务优化。 | N/A | N/A | 0 |
North Mini Code is Cohere's first agentic coding model and the debut of its North family. A sparse mixture-of-experts model with 30B total parameters and 3B active, it is optimized... | N/A | N/A | 0 |
ReasoningToolsOpen Weights1MZhipu GLM-5.2 is Zhipu latest flagship coding and agentic model with a 1M-token context window, enhanced reasoning modes, and long-horizon software engineering capabilities. | N/A | N/A | 0 |
Mercury 2 is an extremely fast reasoning LLM, and the first reasoning diffusion LLM (dLLM). Instead of generating tokens sequentially, Mercury 2 produces and refines multiple tokens in parallel, achieving... | 505.21 t/s | 1.33 s | 35 |
mimo-v2.5-promimo免费 ReasoningToolsFilesOpen Weights | 52.90 t/s | 5.04 s | 5 |
LongCat-Flash-Thinking免费 | N/A | N/A | 0 |
LongCat-Flash-Omni-2603免费 | N/A | N/A | 0 |
LongCat-Flash-Chat-2602-Exp免费 | N/A | N/A | 0 |
ReasoningTools1MFilesXiaomi 的 MiMo-V2-Pro是语言模型,专为通用对话与文本生成任务优化。 | N/A | N/A | 0 |
mimo-v2.5mimo免费 ReasoningToolsFilesOpen Weights | N/A | N/A | 0 |
gpt-image-2-highOpenAI免费 imagegpt2khigh | N/A | N/A | 0 |
grok-4.3-betaxAI免费 xaigrok | N/A | N/A | 0 |
ReasoningToolsFilesOpen WeightsMoonshotAI: Kimi K2.7 Code is a coding-focused model in Moonshot AI's Kimi K2 family, built to complete end-to-end programming tasks reliably over long contexts. It uses a native multimodal mixture-of-experts... | N/A | N/A | 0 |
Moonshot Kimi K2.7 is an open-weight MoE model with 1T total parameters, 256K context, and ~30% lower reasoning token usage than K2.6 for long-horizon agent and MCP tool workflows. | N/A | N/A | 0 |
128K64K对话推理DeepSeek Reasoner是语言模型,专为通用对话与文本生成任务优化。 | 29.86 t/s | 4.71 s | 5 |
echo-flashTest免费 | N/A | N/A | 0 |
echoTest免费 | N/A | N/A | 0 |
test-embeddingTest免费 | N/A | N/A | 0 |
claude-sonnet-4-7Anthropic免费 | N/A | N/A | 0 |
指的是某家提供商上输入和输出价格都为 $0 / token 的模型组合。部分提供商提供长期免费额度,部分仅向新账号一次性赠送。只有在公开价格为零时才会被标记为免费,价格页会定期复核。
大多数有速率限制——每分钟请求数、每日总量、上下文长度上限——很多要求实名注册并绑定手机号或支付方式。部分是阶段性活动。在依赖某个免费端点之前,请仔细阅读提供商的条款和配额。
部分条目是社区运营的「公益站」或聚合中转——站长用自掏腰包的上游 key 打包再免费分发。它们通常额度更大、可用模型更全,但稳定性远低于官方 API:站长随时可能停服或「跑路」,额度和价格也可能毫无预警地变动;很多站点是邀请制,需要 GitHub 邀请码、社区推荐或特定圈子才能注册,部分长期关闭注册。建议把它们当作可遇不可求的备用通道,重要工作流仍走官方付费端点。
速度因模型和提供商而异。按「最多测试」排序找数据最稳的,或在上方按模型系列筛选。每行展示真实 API 测试得到的 tokens/秒 中位值与首字延迟。
对每家提供商使用相同 prompt 做五轮压力测试,使用 tiktoken 统计输出 token 数,测量吞吐量(tokens/秒)和首字到达时间。所有指标以中位数聚合以抵抗异常值,并按固定节奏刷新。
用于原型、个人项目和低流量工具是可以的。生产流量很快就会撞到速率限制。建议把免费额度当成「试用通道」:先验证模型和服务商表现,再切到同模型的付费端点上线。
可能目前没有提供商提供免费版本、免费活动已结束,或者尚未被基准测试覆盖。可以在该模型的详情页查看付费方案,或通过页脚反馈链接告诉我们漏了哪家。