免费大模型 API
发现各大提供商提供的免费大模型 API,对比速度与延迟数据。免费模型 2824服务商 158免费服务 8616
最新大语言模型
查看 LMSpeed 最新收录并发布的大语言模型,进入模型页对比服务商、价格、性能与免费可用性。
- GLM 5.3 FlashZ.ai
GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...
发布于 2026年8月26日15 家服务商 - GLM 5.3Z.ai
GLM-5.3 is a large-scale reasoning model from Z.ai, built for complex software engineering and long-horizon agent tasks. It supports text input and output with a 1M-token context window, and improves...
发布于 2026年8月18日14 家服务商 - Qwen3.8 27BQwen
Qwen3.8 27B is an open-weight dense vision-language model from Qwen. It is suited for coding, professional workflows, research, multimodal interaction, and long-running agent tasks, with flexible thinking that can be...
发布于 2026年8月14日0 家服务商 - Gemini 3.7 FlashGoogle
Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...
发布于 2026年8月13日11 家服务商 - Qwen3.8 2.4T A95BQwen
Qwen3.8 2.4T A95B is an open-weight sparse mixture-of-experts model from Qwen and the open-weight variant of [Qwen3.8 Max](/qwen/qwen3.8-max), with 95 billion active parameters out of 2.4 trillion total. It is...
发布于 2026年8月12日0 家服务商 - DeepSeek V4 Pro 0813DeepSeek
DeepSeek V4 Pro 0813 is a large-scale mixture-of-experts model from DeepSeek. This is the GA release of DeepSeek V4 Pro.
发布于 2026年8月12日0 家服务商
免费模型目录
按服务商数量、速度和首字延迟对比免费模型,数据来自真实 API 测试。
| 模型 | 服务商 | 速度 | 延迟 | 测试 |
|---|---|---|---|---|
Qwen3.8 Max is the flagship model in Alibaba's Qwen3.8 series, the general-availability successor to the Qwen3.8 Max Preview. It is a multimodal reasoning model intended for complex reasoning, visual understanding,... | N/A | N/A | 0 | |
ReasoningToolsFilesVisionGemma 4 31B Instruct is Google DeepMind's 30.7B dense multimodal model supporting text and image input with text output. Features a 256K token context window, configurable thinking/reasoning mode, native function... | N/A | N/A | 0 | |
gpt-5.5OpenAI免费 ReasoningToolsFilesVision | 40.54 t/s | 6.70 s | 105 | |
claude-haiku-4-5-20251001-thinkingAnthropic免费 文本 | N/A | N/A | 0 | |
claude-3-opus-latestClaude免费 文本 | N/A | N/A | 0 | |
claude-3-7-sonnet-20250219Anthropic免费 ReasoningToolsFilesVision | N/A | N/A | 0 | |
claude-3-sonnet-20240229Anthropic免费 ToolsFilesVision200K | N/A | N/A | 0 | |
PaddlePaddle/PaddleOCR-VL-1.5SiliconFlow (China)免费 FilesOpen WeightsVision16.4K | N/A | N/A | 0 | |
[free]DeepSeek-V4-FlashDeepSeek免费 | N/A | N/A | 0 | |
aisingapore/sea-lion-7b-instruct免费 | N/A | N/A | 0 | |
claude-3-opus-20240229Anthropic免费 ToolsFilesVision200K | N/A | N/A | 0 | |
claude-3-haiku-20241022Claude免费 文本 | N/A | N/A | 0 | |
claude-3-5-haiku-latestClaude免费 文本 | N/A | N/A | 0 | |
claude-3-5-sonnet-latestClaude免费 文本 | N/A | N/A | 0 | |
Kwai-Kolors/Kolors免费 | N/A | N/A | 0 | |
Doubao-1.5-vision-pro-32k字节跳动免费 文本 | N/A | N/A | 0 | |
Doubao-1.5-pro-256k字节跳动免费 文本 | N/A | N/A | 0 | |
Cursor-c4Claude免费 文本 | N/A | N/A | 0 | |
Qwen/Qwen2.5-Coder-7B-Instruct阿里巴巴免费 | N/A | N/A | 0 | |
[free]DeepSeek-V3.2DeepSeek免费 | N/A | N/A | 0 | |
abab5.5-chatMiniMax免费 文本 | N/A | N/A | 0 | |
agnes-image-2.1-flash免费 | N/A | N/A | 0 | |
claude-3-haiku@20240307Claude免费 文本 | N/A | N/A | 0 | |
claude-3-haiku-allClaude免费 文本 | N/A | N/A | 0 | |
claude-3-haiku-20240307Anthropic免费 文本 | N/A | N/A | 0 | |
claude-3-haiku-20240229Claude免费 文本 | N/A | N/A | 0 | |
chatglm_std智谱免费 文本 | N/A | N/A | 0 | |
claude-3-5-haiku-20241022Anthropic免费 ToolsFilesVision200K | N/A | N/A | 0 | |
claude-3-5-sonnet-20241022Anthropic免费 ToolsFilesVision200K | N/A | N/A | 0 | |
claude-3-5-sonnet-allClaude免费 文本 | N/A | N/A | 0 | |
7eapi-1免费 | N/A | N/A | 0 | |
FLUX.1-Kontext-pro免费 生图 | N/A | N/A | 0 | |
FunAudioLLM/SenseVoiceSmall免费 | N/A | N/A | 0 | |
K2.7免费 | N/A | N/A | 0 | |
Cursor-c4-thinkingClaude免费 文本 | N/A | N/A | 0 | |
Cursor-co4Claude免费 文本 | N/A | N/A | 0 | |
Cursor-c37Claude免费 文本 | N/A | N/A | 0 | |
Cursor-c37-thinkingClaude免费 文本 | N/A | N/A | 0 | |
01-ai/yi-large零一万物免费 | N/A | N/A | 0 | |
Cursor-co4-thinkingClaude免费 文本 | N/A | N/A | 0 | |
THUDM/GLM-4.1V-9B-Thinking智谱免费 | N/A | N/A | 0 | |
THUDM/GLM-Z1-9B-0414SiliconFlow (China)免费 ReasoningTools131K | N/A | N/A | 0 | |
[free]deepseek-v4-flashDeepSeek免费 | N/A | N/A | 0 | |
[free]deepseek-v4-proDeepSeek免费 | N/A | N/A | 0 | |
adept/fuyu-8b免费 | N/A | N/A | 0 | |
agnes-2.0-flash免费 | N/A | N/A | 0 | |
7eimage-2免费 | N/A | N/A | 0 | |
claude-3-7-sonnet-20250219-thinkingAnthropic免费 文本 | N/A | N/A | 0 | |
babbage-002免费 文本 | N/A | N/A | 0 | |
chatglm_lite智谱免费 文本 | N/A | N/A | 0 | |
bigcode/starcoder2-15b免费 | N/A | N/A | 0 | |
big-pickleopencode zen免费 ReasoningTools200K | N/A | N/A | 0 | |
claude-3-7-sonnet-latestClaude免费 文本 | N/A | N/A | 0 | |
claude-3-7-sonnet-thinkingClaude免费 ReasoningToolsFilesVision | N/A | N/A | 0 | |
Doubao-1.5-lite-32k字节跳动免费 文本 | N/A | N/A | 0 | |
chatglm_pro智谱免费 文本 | N/A | N/A | 0 | |
chatglm_turbo智谱免费 文本 | N/A | N/A | 0 | |
claude-2Claude免费 文本 | N/A | N/A | 0 | |
claude-3-5-sonnet-20240620Anthropic免费 ToolsFilesVision200K | N/A | N/A | 0 | |
LongCat-2.0免费 | N/A | N/A | 0 |
LMSpeed 追踪了来自 158 家 API 提供商的 2824 个免费大语言模型。各提供商的免费额度不同——有的限制每日请求数,有的为新用户提供免费额度。所有速度数据均来自真实 API 测试。
如何使用
先找到合适的免费模型,对比它背后的服务商,再进入模型或服务商详情页确认限制与表现。
- 1
按模型系列筛选
使用搜索、模型系列筛选和能力标签,把目录缩小到真正想测试的免费模型。
- 2
对比速度与延迟
查看服务商数量、测试量、吞吐速度和首字延迟,不只按价格选择。
- 3
进入服务商详情
在服务商详情页确认可用性、健康检测、价格备注和免费额度限制,再用于测试或集成。
免费大模型 API 常见问题
关于免费额度与如何使用这份目录的常见问题。
LMSpeed 上的「免费 API」是怎么界定的?
指的是某家提供商上输入和输出价格都为 $0 / token 的模型组合。部分提供商提供长期免费额度,部分仅向新账号一次性赠送。只有在公开价格为零时才会被标记为免费,价格页会定期复核。
这些免费 API 真的免费吗?有什么坑?
大多数有速率限制——每分钟请求数、每日总量、上下文长度上限——很多要求实名注册并绑定手机号或支付方式。部分是阶段性活动。在依赖某个免费端点之前,请仔细阅读提供商的条款和配额。
列表里有「公益站」/ 社区中转吗?还需要注意什么?
部分条目是社区运营的「公益站」或聚合中转——站长用自掏腰包的上游 key 打包再免费分发。它们通常额度更大、可用模型更全,但稳定性远低于官方 API:站长随时可能停服或「跑路」,额度和价格也可能毫无预警地变动;很多站点是邀请制,需要 GitHub 邀请码、社区推荐或特定圈子才能注册,部分长期关闭注册。建议把它们当作可遇不可求的备用通道,重要工作流仍走官方付费端点。
哪家免费大模型 API 最快?
速度因模型和提供商而异。按「最多测试」排序找数据最稳的,或在上方按模型系列筛选。每行展示真实 API 测试得到的 tokens/秒 中位值与首字延迟。
LMSpeed 如何测量速度和延迟?
对每家提供商使用相同 prompt 做五轮压力测试,使用 tiktoken 统计输出 token 数,测量吞吐量(tokens/秒)和首字到达时间。所有指标以中位数聚合以抵抗异常值,并按固定节奏刷新。
免费大模型 API 能用在生产环境吗?
用于原型、个人项目和低流量工具是可以的。生产流量很快就会撞到速率限制。建议把免费额度当成「试用通道」:先验证模型和服务商表现,再切到同模型的付费端点上线。
为什么我想要的模型不在列表里?
可能目前没有提供商提供免费版本、免费活动已结束,或者尚未被基准测试覆盖。可以在该模型的详情页查看付费方案,或通过页脚反馈链接告诉我们漏了哪家。
