发现各大提供商提供的免费大模型 API,对比速度与延迟数据。免费模型 2774服务商 156免费服务 8766
| 模型 | 服务商 | 速度 | 延迟 | 测试 |
|---|---|---|---|---|
grok-4.3-fastxAI免费 | N/A | N/A | 0 | |
doubao-seed-1-8字节跳动免费 | N/A | N/A | 0 | |
hy3-free免费 | N/A | N/A | 0 | |
jina-embeddings-v4 |
LMSpeed 追踪了来自 156 家 API 提供商的 2774 个免费大语言模型。各提供商的免费额度不同——有的限制每日请求数,有的为新用户提供免费额度。所有速度数据均来自真实 API 测试。
先找到合适的免费模型,对比它背后的服务商,再进入模型或服务商详情页确认限制与表现。
使用搜索、模型系列筛选和能力标签,把目录缩小到真正想测试的免费模型。
查看服务商数量、测试量、吞吐速度和首字延迟,不只按价格选择。
在服务商详情页确认可用性、健康检测、价格备注和免费额度限制,再用于测试或集成。
关于免费额度与如何使用这份目录的常见问题。
| N/A |
| N/A |
| 0 |
openai-5.5(xhigh)OpenAI免费 | N/A | N/A | 0 |
gcp-speech-to-textGoogle免费 | N/A | N/A | 0 |
command-r7b-12-2024Cohere免费 | N/A | N/A | 0 |
command-r-plus-08-2024Cohere免费 | N/A | N/A | 0 |
command-r-08-2024Cohere免费 | N/A | N/A | 0 |
command-a-vision-07-2025Cohere免费 | N/A | N/A | 0 |
command-a-translate-08-2025Cohere免费 | N/A | N/A | 0 |
command-a-reasoning-08-2025Cohere免费 | N/A | N/A | 0 |
command-a-03-2025Cohere免费 | N/A | N/A | 0 |
nvidia/nemotron-3.5-content-safety:free免费 | N/A | N/A | 0 |
cohere/north-mini-code:free免费 | N/A | N/A | 0 |
gpt-image-2-pptOpenAI免费 | N/A | N/A | 0 |
kimi-k2.7-codeMoonshot免费 | N/A | N/A | 0 |
laguna-xs.2免费 | N/A | N/A | 0 |
openai-5.5-xhighOpenAI免费 | N/A | N/A | 0 |
qwen3-235b-thinking百炼Qwen免费 | N/A | N/A | 0 |
cobuddy免费 | N/A | N/A | 0 |
grok-imagine-image-editxAI免费 | N/A | N/A | 0 |
dolphin-mistral-24b-venice-editionMistral免费 | N/A | N/A | 0 |
gpt-searchOpenAI免费 | N/A | N/A | 0 |
claude-sonnet-4-6-webAnthropic免费 | N/A | N/A | 0 |
grok-imagine-video-1.5-previewxAI免费 | N/A | N/A | 0 |
grok-4.20-0309-reasoning-openai-compactxAI免费 | N/A | N/A | 0 |
diffusiongemma-26b-a4b-it免费 | N/A | N/A | 0 |
llama-3.2-nv-embedqa-1b-v2Meta免费 | N/A | N/A | 0 |
nsfw-classifier免费 | N/A | N/A | 0 |
embed-v4.0免费 | N/A | N/A | 0 |
nemotron-nano-9b-v2免费 | N/A | N/A | 0 |
nonescape-v0免费 | N/A | N/A | 0 |
doubao-seedream-4-5字节跳动免费 | N/A | N/A | 0 |
embed-multilingual-v3.0免费 | N/A | N/A | 0 |
nemotron-3.5-content-safety免费 | N/A | N/A | 0 |
nemotron-nano-12b-v2-vl免费 | N/A | N/A | 0 |
0wFF免费 | N/A | N/A | 0 |
kat-coder-air-V1-128k免费 | N/A | N/A | 0 |
grok-imagine-image-qualityxAI免费 | N/A | N/A | 0 |
nemotron-3-nano-omni免费 | N/A | N/A | 0 |
nemotron-3-nano免费 | N/A | N/A | 0 |
nemotron-3-nano-30b-a3b免费 | N/A | N/A | 0 |
nemotron-3-super免费 | N/A | N/A | 0 |
music-2.6免费 | N/A | N/A | 0 |
doubao-seed-1-6字节跳动免费 | N/A | N/A | 0 |
gpt-image-2-psdOpenAI免费 | N/A | N/A | 0 |
llama-3.3-70b-instructMeta免费 | N/A | N/A | 0 |
llama-3.2-11b-vision-instructMeta免费 | N/A | N/A | 0 |
llama-3.2-3b-instructMeta免费 | N/A | N/A | 0 |
lfm-2.5-1.2b-thinking免费 | N/A | N/A | 0 |
doubao-1-5-pro字节跳动免费 | N/A | N/A | 0 |
llama-3.1-70b-instructMeta免费 | N/A | N/A | 0 |
cerebras/gemma-4-31b免费 | N/A | N/A | 0 |
c4ai-aya-vision-32b免费 | N/A | N/A | 0 |
Qwen3-VL-30B-A3B-Instruct is a multimodal model that unifies strong text generation with visual understanding for images and videos. Its Instruct variant optimizes instruction-following for general multimodal tasks. It excels in perception... | N/A | N/A | 0 |
Qwen3-VL-235B-A22B Instruct is an open-weight multimodal model that unifies strong text generation with visual understanding across images and video. The Instruct model targets general vision-language use (VQA, document parsing, chart/table... | N/A | N/A | 0 |
Tools262KOpen Weights128KQwen3-Coder-30B-A3B-Instruct is a 30.5B parameter Mixture-of-Experts (MoE) model with 128 experts (8 active per forward pass), designed for advanced code generation, repository-scale understanding, and agentic tool use. Built on the... | N/A | N/A | 0 |
Hy3 preview is a high-efficiency Mixture-of-Experts model from Tencent designed for agentic workflows and production use. It supports configurable reasoning levels across disabled, low, and high modes, allowing it to... | N/A | N/A | 0 |
文本Sonnet 5 is Anthropic's most capable Sonnet-class model, with frontier performance across coding, agents, and professional work. It supports adaptive thinking with selectable reasoning effort levels (low, medium, high, max,... | N/A | N/A | 0 |
指的是某家提供商上输入和输出价格都为 $0 / token 的模型组合。部分提供商提供长期免费额度,部分仅向新账号一次性赠送。只有在公开价格为零时才会被标记为免费,价格页会定期复核。
大多数有速率限制——每分钟请求数、每日总量、上下文长度上限——很多要求实名注册并绑定手机号或支付方式。部分是阶段性活动。在依赖某个免费端点之前,请仔细阅读提供商的条款和配额。
部分条目是社区运营的「公益站」或聚合中转——站长用自掏腰包的上游 key 打包再免费分发。它们通常额度更大、可用模型更全,但稳定性远低于官方 API:站长随时可能停服或「跑路」,额度和价格也可能毫无预警地变动;很多站点是邀请制,需要 GitHub 邀请码、社区推荐或特定圈子才能注册,部分长期关闭注册。建议把它们当作可遇不可求的备用通道,重要工作流仍走官方付费端点。
速度因模型和提供商而异。按「最多测试」排序找数据最稳的,或在上方按模型系列筛选。每行展示真实 API 测试得到的 tokens/秒 中位值与首字延迟。
对每家提供商使用相同 prompt 做五轮压力测试,使用 tiktoken 统计输出 token 数,测量吞吐量(tokens/秒)和首字到达时间。所有指标以中位数聚合以抵抗异常值,并按固定节奏刷新。
用于原型、个人项目和低流量工具是可以的。生产流量很快就会撞到速率限制。建议把免费额度当成「试用通道」:先验证模型和服务商表现,再切到同模型的付费端点上线。
可能目前没有提供商提供免费版本、免费活动已结束,或者尚未被基准测试覆盖。可以在该模型的详情页查看付费方案,或通过页脚反馈链接告诉我们漏了哪家。