StepFun
·Released on 2026年5月28日

Step 3.7 Flash API 基准测试 价格和服务商数据

选择与 Step 3.7 Flash 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Step 3.7 Flash 页面汇总基准测试、API 价格和服务商数据,覆盖 69 家服务商,价格从 $0.0010/request 起。Step 3.7 Flash 免费 API 额度来自 10 家服务商。页面同时展示实测速度和首字延迟。

Step 3.7 Flash is StepFun's latest high-efficiency multimodal Mixture-of-Experts model. It pairs a 196B-parameter language backbone with a vision encoder for native image and video understanding, acti...

质量
#63of 102
53.0
LMSpeed 评分
速度
#42of 79
148char/s
22.50 s
成本
#34of 183
$0.0010/ 1M · 8:1 in:out
$0.0002 in · $0.0008 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
6 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体53.6代码49综合推理52.7知识42数学-多语言-多模态59指令遵循51.6
#1多模态59暂定评分1/4 实测维度
80% 区间: 44.573.5
perception ocr59
simplevqa · simple_vqa / v_star · v_star
document spatial仅先验
visual reasoning仅先验
video action仅先验
#2智能体53.6正式评分全站排名 #244/4 实测维度
80% 区间: 47.959.3
planning51.3
deep_planning · gert_labs
tool use58.7
tau · tau2_bench / toolathlon · toolathlon
environment execution51.8
browsecomp · browse_comp / deep_search_qa · deep_search_qa / gdpval_aa · benchlm_agentic_gdpval_aa / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability52.5
apex_agents · apex_agents_aa / claw_eval · claw_eval
#3综合推理52.7估算2/4 实测维度
80% 区间: 41.963.5
abstract logic仅先验
scientific causal53
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints仅先验
evidence verification52.4
lcr · lcr
#4指令遵循51.6暂定评分1/4 实测维度
80% 区间: 35.667.6
constraint following仅先验
structured output仅先验
novel instruction generalization51.6
ifbench · aa_if_bench
long multiturn instruction仅先验
#5代码49估算3/4 实测维度
80% 区间: 39.758.3
code generation52.2
scicode · scicode
repository engineering48.5
swe_pro · swe_pro
debugging testing仅先验
tooling quality46.3
terminalbench · benchlm_coding_terminal_bench2
#6知识42暂定评分1/4 实测维度
80% 区间: 26.058.0
broad knowledge42
aa_omniscience · aa_omniscience_index
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
暂无数据:数学多语言

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
262.1Ktokens
314.6 pages of text
OUTPUT
230.4Ktokens
8K128K1M4M
262.1K

能力

Technical Details

输入
输出
发布日期
May 2026
Tokenizer
Other
架构
text+image+video->text
内容审核
支持参数
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月3日

综合

1 个指标

Overall score53.0#63 / 102
Overall score
站内排名#63
分数53.0
更新时间2026年8月20日
置信度1

速度与延迟

2 个指标

输出速度94.7 tok/s#42 / 79首字延迟1.58 s#49 / 79
输出速度
Output speed
站内排名#42
分数94.7 tok/s
更新时间2026年9月3日
置信度4
首字延迟
Time to first token
站内排名#49
分数1.58 s
更新时间2026年9月3日
置信度4

价格

2 个指标

输入价格$0.200/M#34 / 183输出价格$1.15/M#49 / 183
输入价格
Input price
站内排名#34
分数$0.200/M
更新时间2026年9月3日
置信度4
输出价格
Output price
站内排名#49
分数$1.15/M
更新时间2026年9月3日
置信度4

智能体

V3.0

13 个指标 · 正式评分

分数53.6#2480% 区间47.9–59.34/4 实测维度Agentic score52.3#47 / 71Terminal-Bench 2.059.5#32 / 53
维度与证据
规划拆解51.3
1 个基准族 · 1 个指标
deep_planning · gert_labs · z 0.18 · q 1.00
工具调用58.7
2 个基准族 · 2 个指标
tau · tau2_bench · z 1.29 · q 1.00
toolathlon · toolathlon · z 0.15 · q 1.00
环境与长程执行51.8
4 个基准族 · 4 个指标
browsecomp · browse_comp · z -0.37 · q 1.00
deep_search_qa · deep_search_qa · z 0.94 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z -0.41 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z -0.27 · q 1.00
恢复与完成可靠性52.5
2 个基准族 · 2 个指标
apex_agents · apex_agents_aa · z -0.81 · q 1.00
claw_eval · claw_eval · z 1.27 · q 1.00
Agentic score
站内排名#47
分数52.3
更新时间2026年8月20日
置信度1
Terminal-Bench 2.0V3 计分证据
站内排名#32
分数59.5
更新时间2026年8月20日
置信度1
BrowseCompV3 计分证据
站内排名#20
分数75.8
更新时间2026年8月20日
置信度1
DeepSearchQAV3 计分证据
站内排名#4
分数92.8
更新时间2026年8月20日
置信度1
GDPval-AA
站内排名#45
分数25.8
更新时间2026年8月20日
置信度1
ToolathlonV3 计分证据
站内排名#11
分数49.5
更新时间2026年8月20日
置信度1
Claw-EvalV3 计分证据
站内排名#6
分数67.1
更新时间2026年8月20日
置信度1
HLE w/ tools
站内排名#6
分数47.2
更新时间2026年8月20日
置信度1
Gert LabsV3 计分证据
站内排名#20
分数51.6
更新时间2026年8月20日
置信度1
AA Agentic Index
站内排名#46
分数21.7
更新时间2026年8月20日
置信度1
Τ²-bench resultsV3 计分证据
站内排名#3
分数98.5
更新时间2026年8月20日
置信度1
GDPval-AAV3 计分证据
站内排名#45
分数1018.0
更新时间2026年8月20日
置信度1
APEX-Agents-AAV3 计分证据
站内排名#17
分数14.8
更新时间2026年8月20日
置信度1

代码

V3.0

6 个指标 · 估算

分数4980% 区间39.7–58.33/4 实测维度SciCode40.0%#87 / 208Coding score41.2#72 / 82
维度与证据
代码生成52.2
1 个基准族 · 1 个指标
scicode · scicode · z 0.17 · q 1.00
仓库工程48.5
1 个基准族 · 1 个指标
swe_pro · swe_pro · z -0.12 · q 1.00
调试与测试仅先验
工具化开发与质量46.3
1 个基准族 · 1 个指标
terminalbench · benchlm_coding_terminal_bench2 · z -0.49 · q 1.00
SciCodeV3 计分证据
站内排名#87
分数40.0%
更新时间2026年9月3日
置信度4
Coding score
站内排名#72
分数41.2
更新时间2026年8月20日
置信度1
SWE-bench ProV3 计分证据
站内排名#29
分数56.3
更新时间2026年8月20日
置信度1
Terminal-Bench 2.0V3 计分证据
站内排名#25
分数59.5
更新时间2026年8月20日
置信度1
AA Coding Index
站内排名#53
分数39.6
更新时间2026年8月20日
置信度1
AA-SciCodeV3 计分证据
站内排名#70
分数40.0
更新时间2026年8月20日
置信度1

综合推理

V3.0

4 个指标 · 估算

分数52.780% 区间41.9–63.52/4 实测维度GPQA80.9%#94 / 215HLE21.4%#79 / 212
维度与证据
抽象逻辑仅先验
科学与因果推理53
3 个基准族 · 3 个指标
critpt · critpt · z -0.09 · q 1.00
gpqa · gpqa · z 0.21 · q 1.00
hle · hle · z 0.34 · q 1.00
多步约束仅先验
证据整合与验证52.4
1 个基准族 · 1 个指标
lcr · lcr · z -0.04 · q 1.00
GPQAV3 计分证据
站内排名#94
分数80.9%
更新时间2026年9月3日
置信度4
HLEV3 计分证据
站内排名#79
分数21.4%
更新时间2026年9月3日
置信度4
AA-LCRV3 计分证据
站内排名#53
分数69.7
更新时间2026年8月20日
置信度1
CritPtV3 计分证据
站内排名#56
分数2.3
更新时间2026年8月20日
置信度1

知识

V3.0

5 个指标 · 暂定评分

分数4280% 区间26.0–58.01/4 实测维度Artificial Analysis Intelligence Index30.9#71 / 112AA-GPQA Diamond80.9#73 / 109
维度与证据
广泛知识42
1 个基准族 · 1 个指标
aa_omniscience · aa_omniscience_index · z -1.14 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#71
分数30.9
更新时间2026年8月20日
置信度1
AA-GPQA Diamond
站内排名#73
分数80.9
更新时间2026年8月20日
置信度1
AA-HLE
站内排名#65
分数21.4
更新时间2026年8月20日
置信度1
AA-Omniscience Accuracy
站内排名#66
分数25.8
更新时间2026年8月20日
置信度1
AA-Omniscience Hallucination Rate
站内排名#31
分数85.0
更新时间2026年8月20日
置信度1

数学

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

4 个指标 · 暂定评分

分数5980% 区间44.5–73.51/4 实测维度SimpleVQA79.2#2 / 8V*95.3#4 / 11
维度与证据
感知与 OCR59
2 个基准族 · 2 个指标
simplevqa · simple_vqa · z 1.04 · q 1.00
v_star · v_star · z 0.52 · q 1.00
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
SimpleVQAV3 计分证据
站内排名#2
分数79.2
更新时间2026年8月20日
置信度1
V*V3 计分证据
站内排名#4
分数95.3
更新时间2026年8月20日
置信度1
AA-MMMU-Pro
站内排名#30
分数75.3
更新时间2026年8月20日
置信度1
Design Arena Website
站内排名#47
分数1202.0
更新时间2026年8月20日
置信度1

指令遵循

V3.0

1 个指标 · 暂定评分

分数51.680% 区间35.6–67.61/4 实测维度AA-IFBench67.3#44 / 84
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化51.6
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z -0.07 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#44
分数67.3
更新时间2026年8月20日
置信度1

OpenRouter 端点

3 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
DeepInfra
deepinfra
$0.160/M$0.920/M99.9%undefined tokens / undefined tokens
StepFun
stepfun/fp8
$0.200/M$1.15/M99.1%undefined tokens / undefined tokens
Novita
novita/fp8
$0.200/M$1.15/M97.7%undefined tokens / undefined tokens

价格对比

对比 Step 3.7 Flash 在 59 家服务商的 API 价格。价格从 $0.0010/request 到 $1998.00/M,其中 CM-API 公益站 提供最低价 $0.0010/request。 10 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
兔子API
免费
L1
100%
step-3.7-flash-free
default
免费
免费
L1
100%
stepfun/step-3.7-flash:free
free
$0.0010/request
-
L1
100%
Step-3.7-Flash
国产模型
$0.010/request
-
L1
100%
step-3.7-flash
default
-26%$0.148/M
-23%$0.887/M
L1
100%
step-3.7-flash
default
$1.40/M
$8.05/M
L1
100%
L2
54%
step-3.7-flash
nvidia
$75.00/M
$75.00/M
L1
99%
stepfun-ai/Step-3.7-Flash
default
$0.0048/request
-
L1
100%
step-3.7-flash
nvidia
$0.400/M
Cache read$0.080/M
$2.30/M
L1
100%
L2
81%
step-3.7-flash
default
$75.00/M
$75.00/M
L1
100%
stepfun-ai/step-3.7-flash
default
$375.00/M
$375.00/M
L1
100%
step-3.7-flash
default
$375.00/M
$375.00/M
L1
100%
stepfun/step-3.7-flash-free
default
$375.00/M
$375.00/M
L1
99%
step-3.7-flash
default
-93%$0.014/M
-93%$0.079/M
L1
99%
step-3.7-flash
default
免费
免费
L1
99%
daipai/step-3.7-flash
按次福利模型
$0.0020/request
-
L1
100%
stepfun-ai/step-3.7-flash
default
$75.00/M
$75.00/M
L1
99%
step-3.7-flash
default
$0.661/M
Cache read$0.132/M
$3.97/M
L1
99%
step-3.7-flash
91vip
$1.35/M
$7.77/M
L1
99%
stepfun-ai/step-3.7-flash
default
$75.00/M
$75.00/M
L1
99%
step-3.7-flash
免费
$0.375/M
-67%$0.375/M
当前显示 20 个模型 ID,共 37 个。

替代方案与相似模型

常见问题

Step 3.7 Flash 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Step 3.7 Flash 的基准测试、API 价格、输出速度、首字延迟和 69 家服务商数据。
Step 3.7 Flash API 价格是多少?
Step 3.7 Flash69 家服务商有价格记录,价格从 $0.0010/request $1998.00/M。最低价由 CM-API 公益站 提供。
Step 3.7 Flash API 价格表包含什么?
Step 3.7 Flash API 价格表会对比 69 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Step 3.7 Flash API 价格最低?
CM-API 公益站 当前提供 Step 3.7 Flash 的最低收录价格:$0.0010/request,共对比 69 家服务商。
可以同时对比 Step 3.7 Flash API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Step 3.7 Flash API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Step 3.7 Flash 的 API 免费吗?
是的,Step 3.7 Flash 免费 API 可通过 LMSpeed 上的 10 家服务商使用,包括WSocket AI, Dext API, 兔子API, 兔子API, Zero API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Step 3.7 Flash 免费 API?
LMSpeed 当前收录了 10 家 Step 3.7 Flash 免费 API 服务商,包括WSocket AI, Dext API, 兔子API, 兔子API, Zero API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

Step-3.7-Flashdaipai/step-3.7-flashstep-3-7-flashstep-3.7-flashstep-3.7-flash-free

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档