Fireworks AI 提供 Fireworks Inference Cloud 平台,用于部署和扩展开源 AI 模型。其模型库包括 Chronos Hermes 13B v2、Gemma 3 27B Instruct 和 Qwen3 Coder 480B A35B Instruct,支持微调(Fireworks RFT)和全球扩展。主要功能涵盖代码辅助、对话式 AI、代理系统、搜索、多媒体处理和企业 RAG。该平台强调速度和优化,适用于 IDE 副驾驶、客户支持机器人和安全文档检索等用例。
- 延迟
- 0.00 s
- 创建时间
- 12/7/2025
API 地址
- 接口 1
api.fireworks.ai
完成站点认证,解锁以下权益:
- 编辑服务商名称、正文和链接
- 获得优先流量扶持和曝光推荐
- 展示官方认证徽章,提升用户信任
排行榜排名
排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。
关于 Fireworks AI
健康检查
API 基准测试与价格
按 36 个模型行对比最新 audit、最新测速、吞吐、延迟与按 token 计费价格。
accounts/fireworks/models/qwen3p8-2p4t-a95b | - | - | ||||||||||
accounts/fireworks/models/qwen3p8-max | - | - | ||||||||||
accounts/fireworks/models/deepseek-v4-flash | - | - | ||||||||||
accounts/fireworks/models/deepseek-v4-flash-0731 | - | - | ||||||||||
accounts/fireworks/models/inkling | - | - | ||||||||||
accounts/fireworks/models/kimi-k2p7-code | - | - | ||||||||||
accounts/fireworks/models/kimi-k3 | - | - | ||||||||||
accounts/fireworks/models/minimax-m2p7 | - | - | ||||||||||
accounts/fireworks/models/minimax-m3 | - | - | ||||||||||
accounts/fireworks/models/muse-glimmer-30b | - | - | ||||||||||
accounts/fireworks/models/nemotron-3-ultra-nvfp4 | - | - | ||||||||||
accounts/fireworks/models/nemotron-lightning-3p5-30b-a3b | - | - | ||||||||||
accounts/fireworks/models/qwen3-embedding-8b | - | - | ||||||||||
accounts/fireworks/models/qwen3-reranker-8b | - | - | ||||||||||
accounts/fireworks/models/qwen3p7-plus | - | - | ||||||||||
accounts/fireworks/routers/glm-5p2-fast | - | - | ||||||||||
accounts/fireworks/routers/kimi-k2p6-turbo | - | - | ||||||||||
accounts/fireworks/routers/kimi-k2p7-code-fast | - | - | ||||||||||
accounts/fireworks/routers/kimi-k3-fast | - | - | ||||||||||
accounts/fireworks/models/deepseek-v4-pro | - | - | ||||||||||
accounts/fireworks/models/flux-1-schnell-fp8 | - | - | ||||||||||
accounts/fireworks/models/glm-5p1 | - | - | ||||||||||
accounts/fireworks/models/glm-5p2 | - | - | ||||||||||
accounts/fireworks/models/kimi-k2p6 | - | - | ||||||||||
accounts/fireworks/models/kimi-k2p5 | 123.5 t/s | 5.72 s |
当前显示 25 / 36 个模型行
免费资源
社区分享的与 Fireworks AI 相关的 API Key 和兑换码。
免费 API Key
2| API Key / 状态 | API URL | 模型 | 发布人/日期 |
|---|---|---|---|
fw_4aK***MYRF 不可用 | https://api.fireworks.ai/inference/v1 | 模型检测中 | maghw· 2026年7月17日 |
fw_CgT***Yzzs 不可用 | https://api.fireworks.ai/inference/v1 | 模型检测中 | maghw· 2026年7月17日 |
最近测试记录
| 时间 | 模型 | 速度 | 延迟 |
|---|---|---|---|
| Mar 14, 09:48 AM | accounts/fireworks/models/deepseek-v3p2 | 89.86 tok/s | 5.05s |
| Mar 14, 09:45 AM | accounts/fireworks/models/glm-5 | 78.26 tok/s | 13.33s |
| Mar 14, 09:38 AM | accounts/fireworks/models/kimi-k2p5 | 123.54 tok/s | 5.72s |
| Jan 13, 04:45 PM | accounts/fireworks/models/glm-4p7 | 103.08 tok/s | 10.59s |
| Jan 13, 04:39 PM | accounts/fireworks/models/glm-4p7 | 120.41 tok/s | 8.25s |
| Jan 13, 04:22 PM | accounts/fireworks/models/glm-4p7 | 82.21 tok/s | 11.73s |
| Jan 13, 02:55 AM | accounts/fireworks/models/gpt-oss-120b | 136.18 tok/s | 0.85s |
| Jan 13, 01:51 AM | accounts/fireworks/models/gpt-oss-120b | 153.24 tok/s | 0.74s |
| Jan 13, 01:23 AM | accounts/fireworks/models/minimax-m2p1 | 192.15 tok/s | 2.12s |
| Jan 13, 01:22 AM | accounts/fireworks/models/kimi-k2-thinking | 127.75 tok/s | 3.47s |
相似 API 替代服务商对比
用 115 个 LMSpeed 信号,把 Fireworks AI 的 6 个相近 API 替代服务商放在一起比较:共享模型覆盖、价格、实测速度、可用性和免费模型。
| 服务商 | 对比理由 | 模型数 | 免费项 | 均价 | 速度 | 30 天可用性 |
|---|---|---|---|---|---|---|
| Fireworks AI api-fireworks-ai Fireworks AI provides a cloud platform for running and fine-tuning open-source AI models with optimized inference for production applications. | 当前服务商基线 | 36 | 0 | N/A | 139 tok/s | 7110% |
| OpenRouter openrouter A unified API interface providing access to over 300 models from 60+ providers, including OpenAI, Anthropic, and Google. |
| 561 | 0 | N/A | 85 tok/s | 9990% |
| NVIDIA NIM nvidia-nim NVIDIA NIM provides optimized AI model inference APIs for LLMs, vision, and embedding models through NVIDIA cloud infrastructure. |
| 166 | 0 | N/A | 78 tok/s | 9960% |
| 并行科技 llmapi-paratera-com Provides high-performance computing (HPC) and AI infrastructure services, including GPU cloud servers, MaaS platforms, and industry-specific solutions. |
| 97 | 0 | N/A | 195 tok/s | 0% |
| 七牛云 qiniu-2 七牛云提供AI大模型推理服务,包括多种模型调用、智能问答助手、代码助手等企业级AI解决方案。 |
| 89 | 0 | N/A | 90 tok/s | 9980% |
| SophNet www-sophnet-com An AI development platform offering API access to models like DeepSeek and Qwen for tasks such as text generation and code creation. |
| 72 | 0 | N/A | 122 tok/s | 9960% |
| iTokens itokens iTokens is an OpenAI-compatible AI API gateway with usage-based access to models from DeepSeek, GLM, Kimi, Qwen, MiniMax, KwaiKAT, and other developers. It publishes per-model token pricing and offers promotional credits to new users. |
| 12 | 0 | $0.168/M | 149 tok/s | 9920% |
注释
- 健康检查: 统计范围:72 小时图表和近期可用率只衡量 API 连通性,每个柱形汇总一小时内的检查结果。 检查目标:LMSpeed 会优先尝试已配置的健康检查 URL 和 Provider 状态 URL,再尝试从已知 API Host 与近期测速 Base URL 推导出的 API 端点;只有官网地址本身明显是 API 地址时才会作为候选。 探测步骤:每个候选地址依次进行 DNS 解析、TCP 连接、HTTPS 的 TLS 握手,以及自动跟随重定向的 HTTP HEAD 请求;找到首个可达地址后停止尝试。 可达标准:所有必需的网络步骤都必须成功。除被归类为拦截的状态外,低于 500 的 HTTP 响应均视为可达;其中 401 表示需要鉴权,但也证明 API 端点已响应。 拦截结果:HTTP 403、429、521、525、530,以及识别出的 WAF 或 Cloudflare 挑战会标记为“被拦截”,不计入可用率,因为 LMSpeed 无法据此判断 API 本身是否宕机。 模型可用性:配置专用测试 Key 后,LMSpeed 会向推导出的 /models 端点发送带鉴权的 GET 请求,并将返回的模型 ID 与该 Provider 收录的模型进行比对。逐模型结果显示在“模型与价格”中,不计入 Provider 连通性百分比。 超时限制:TCP 连接、TLS 握手、HTTP 连通性请求和模型请求分别使用 20 秒超时;尝试多个候选地址时,整轮检查可能超过 20 秒。 检查频率:后台 Worker 默认每 5 分钟检查一次所有 Provider;72 小时图表会将这些采样汇总为小时柱形,运营方也可以调整调度。 限制说明:自动抽样结果不构成 SLA,也不能保证账户额度、所有模型、所有地区或实际补全请求始终成功;作出运维决策前请同时查看 Provider 官方状态页。
- Domain Rating 数据来自 Ahrefs。它是基于外链估算的 0–100 域名强度信号,不代表 API 速度或可用性。
- 页面上的公告和 FAQ 来自该服务商的 NewAPI 状态快照(如果可用)。LMSpeed 会保存服务商状态源中的原始内容和可选英文翻译,并在页面上展示对应语言字段。
