DeepSeek
·Released on 2025年8月21日

DeepSeek Chat V3.1 API 基准测试 价格和服务商数据

选择与 DeepSeek Chat V3.1 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

页面同时展示实测速度和首字延迟。

DeepSeek Chat V3.1是指令微调语言模型,专为通用指令跟随与对话任务优化。

速度
23char/s
2.02 s

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
163.8Ktokens
196.6 pages of text
OUTPUT
144.9Ktokens
8K128K1M4M
163.8K

能力

Technical Details

输入
输出
发布日期
Aug 2025
知识截止
2025-03-31
Tokenizer
DeepSeek
架构
text->text
指令类型
deepseek-v3.1
内容审核
支持参数
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

OpenRouter 端点

8 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
CoreWeave
coreweave/fp8
$0.550/M$1.65/M100.0%undefined tokens / undefined tokens
DeepInfra
deepinfra/fp4
$0.250/M$0.950/M99.9%undefined tokens / undefined tokens
AtlasCloud
atlas-cloud/fp8
$0.300/M$0.950/M99.7%undefined tokens / undefined tokens
Novita
novita/fp8
$0.270/M$1/M99.4%undefined tokens / undefined tokens
SambaNova
sambanova/fp8
$0.650/M$1.50/M98.7%undefined tokens / undefined tokens
SiliconFlow
siliconflow/fp8
$0.270/M$1/M97.6%undefined tokens / undefined tokens
Mara
mara
$0.600/M$1.70/M96.7%undefined tokens / undefined tokens
Google
google-vertex/us-west2
$0.600/M$1.70/M0%undefined tokens / undefined tokens

替代方案与相似模型

别名

deepseek-chat-v3-1deepseek-chat-v3.1deepseek/deepseek-chat-v3.1deepseek/deepseek-chat-v3.1:freeopenrouter:deepseek/deepseek-chat-v3.1

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档