免费大模型 API

发现各大提供商提供的免费大模型 API,对比速度与延迟数据。免费模型 2794服务商 153免费服务 8378

最新大语言模型

查看 LMSpeed 最新收录并发布的大语言模型,进入模型页对比服务商、价格、性能与免费可用性。

浏览全部模型

免费模型目录

按服务商数量、速度和首字延迟对比免费模型,数据来自真实 API 测试。

1–60 / 2794
模型服务商速度延迟测试
deepseek-v4-flash-vision-exp-freeDeepSeek免费
N/AN/A0
buzz-free免费
N/AN/A0
你妈-16x9免费
文生图
N/AN/A0
你妈-9x16免费
文生图
N/AN/A0
你妈-4x3免费
文生图
N/AN/A0
你妈-1x1免费
文生图
N/AN/A0
你妈-2x3免费
文生图
N/AN/A0
你妈-3x2免费
文生图
N/AN/A0
kilo-auto/free免费
N/AN/A0
mj_inpaintMidjourney免费
绘画异步
N/AN/A0
mj_custom_zoomMidjourney免费
生图绘画异步
N/AN/A0
[free]GLM-5.3-flash智谱免费
42.58 t/s28.35 s5
[free]GLM-5.3智谱免费
N/AN/A0
[free]gpt-5.6-solOpenAI免费
N/AN/A0
[free]claude-opus-5Anthropic免费
N/AN/A0
[free]grok-4-6xAI免费
N/AN/A0
[free]kimi-k3Moonshot免费
N/AN/A0
[free]gemini-3.7-flashGoogle免费
N/AN/A0
[free]deepseek-v4-pro-0813DeepSeek免费
N/AN/A0
[free]qwen3.8-max阿里巴巴免费
N/AN/A0
Nemotron 3 UltraNVIDIA免费
NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it...
59.59 t/s0.89 s5
Nemotron 3 SuperNVIDIA免费
NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer...
N/AN/A0
Muse Glimmer 30B is a dense, open-weight multimodal model from Meta Superintelligence Labs, distilled from Muse Spark and optimized for autonomous agents on consumer hardware. It is suited for long-horizon...
N/AN/A0
Gemma 4 26B A4BGoogle免费
ReasoningToolsFilesOpen WeightsGemma 4 26B A4B IT is an instruction-tuned Mixture-of-Experts (MoE) model from Google DeepMind. Despite 25.2B total parameters, only 3.8B activate per token during inference — delivering near-31B quality at...
N/AN/A0
Gemma 4 31BGoogle免费
ReasoningToolsFilesVisionGemma 4 31B Instruct is Google DeepMind's 30.7B dense multimodal model supporting text and image input with text output. Features a 256K token context window, configurable thinking/reasoning mode, native function...
N/AN/A0
ox-alphaOpenRouter免费
88.65 t/s8.97 s5
sensenova-6.8-flash-liteSenseNova免费
293.60 t/s6.69 s5
dots-3-note-preview免费
101.36 t/s1.07 s5
diffusiongemma-26b-a4b-itGemini免费
796.82 t/s1.98 s5
brave-deep-research免费
N/AN/A0
cc-glm-5智谱免费
文本
N/AN/A0
brave免费
N/AN/A0
babbage-002免费
文本
N/AN/A0
cc-glm-5-turbo智谱免费
文本
N/AN/A0
cc-glm-5.1智谱免费
文本
N/AN/A0
agnes-image-2.1-flash免费
N/AN/A0
agnes-video-2.5-flash免费
N/AN/A0
cf41b0e0dd7d53e5免费
N/AN/A0
abab6.5-chatMiniMax免费
文本
N/AN/A0
abab5.5-chatMiniMax免费
文本
N/AN/A0
abab6.5s-chatMiniMax免费
文本
N/AN/A0
chatglm_lite智谱免费
文本通用
N/AN/A0
chatglm_pro智谱免费
文本通用
N/AN/A0
[free]DeepSeek-V3.2DeepSeek免费
N/AN/A0
Cursor-co4-thinkingClaude免费
文本代码推理
N/AN/A0
[free]DeepSeek-V4-FlashDeepSeek免费
N/AN/A0
01-ai/yi-large零一万物免费
N/AN/A0
aa/agnes-3.0-flash免费
N/AN/A0
abab5.5s-chatMiniMax免费
文本
N/AN/A0
abab6-chatMiniMax免费
文本
N/AN/A0
adept/fuyu-8b免费
N/AN/A0
agnes-image-2.5-flash免费
N/AN/A0
agnes-2.5-flash免费
N/AN/A0
agnes-3.0-flash免费
N/AN/A0
agnes-video-v2.0免费
N/AN/A0
aisingapore/sea-lion-7b-instruct免费
N/AN/A0
bigcode/starcoder2-15b免费
N/AN/A0
big-pickleopencode zen免费
ReasoningTools200K
N/AN/A0
Doubao-1.5-pro-256k字节跳动免费
文本长上下文
N/AN/A0
SparkDesk-v1.1讯飞免费
文本通用
N/AN/A0

LMSpeed 追踪了来自 153 家 API 提供商的 2794 个免费大语言模型。各提供商的免费额度不同——有的限制每日请求数,有的为新用户提供免费额度。所有速度数据均来自真实 API 测试。

如何使用

先找到合适的免费模型,对比它背后的服务商,再进入模型或服务商详情页确认限制与表现。

  1. 1

    按模型系列筛选

    使用搜索、模型系列筛选和能力标签,把目录缩小到真正想测试的免费模型。

  2. 2

    对比速度与延迟

    查看服务商数量、测试量、吞吐速度和首字延迟,不只按价格选择。

  3. 3

    进入服务商详情

    在服务商详情页确认可用性、健康检测、价格备注和免费额度限制,再用于测试或集成。

免费大模型 API 常见问题

关于免费额度与如何使用这份目录的常见问题。

LMSpeed 上的「免费 API」是怎么界定的?

指的是某家提供商上输入和输出价格都为 $0 / token 的模型组合。部分提供商提供长期免费额度,部分仅向新账号一次性赠送。只有在公开价格为零时才会被标记为免费,价格页会定期复核。

这些免费 API 真的免费吗?有什么坑?

大多数有速率限制——每分钟请求数、每日总量、上下文长度上限——很多要求实名注册并绑定手机号或支付方式。部分是阶段性活动。在依赖某个免费端点之前,请仔细阅读提供商的条款和配额。

列表里有「公益站」/ 社区中转吗?还需要注意什么?

部分条目是社区运营的「公益站」或聚合中转——站长用自掏腰包的上游 key 打包再免费分发。它们通常额度更大、可用模型更全,但稳定性远低于官方 API:站长随时可能停服或「跑路」,额度和价格也可能毫无预警地变动;很多站点是邀请制,需要 GitHub 邀请码、社区推荐或特定圈子才能注册,部分长期关闭注册。建议把它们当作可遇不可求的备用通道,重要工作流仍走官方付费端点。

哪家免费大模型 API 最快?

速度因模型和提供商而异。按「最多测试」排序找数据最稳的,或在上方按模型系列筛选。每行展示真实 API 测试得到的 tokens/秒 中位值与首字延迟。

LMSpeed 如何测量速度和延迟?

对每家提供商使用相同 prompt 做五轮压力测试,使用 tiktoken 统计输出 token 数,测量吞吐量(tokens/秒)和首字到达时间。所有指标以中位数聚合以抵抗异常值,并按固定节奏刷新。

免费大模型 API 能用在生产环境吗?

用于原型、个人项目和低流量工具是可以的。生产流量很快就会撞到速率限制。建议把免费额度当成「试用通道」:先验证模型和服务商表现,再切到同模型的付费端点上线。

为什么我想要的模型不在列表里?

可能目前没有提供商提供免费版本、免费活动已结束,或者尚未被基准测试覆盖。可以在该模型的详情页查看付费方案,或通过页脚反馈链接告诉我们漏了哪家。