DeepSeek V4 Flash 0731 评测:推理强、价格低

Artificial Analysis 对 DeepSeek V4 Flash 0731(推理版,最大努力)进行了全面评测。该模型在 Artificial Analysis Intelligence Index v4.1 上得分 50,远超同类开源模型的中位数 25,评测过程中生成了 2.1 亿 tokens,显示其输出较为冗长。定价方面,输入每百万 tokens 0.14 美元,输出每百万 tokens 0.28 美元,均显著低于同类模型中位数(输入 0.43 美元,输出 1.20 美元),在开放权重模型中性价比突出。
模型上下文窗口为 100 万 tokens,总参数 2840 亿,激活参数 130 亿,属于大型开源模型。其推理能力由 9 项评测支撑,包括 GDPval-AA v2、Terminal-Bench v2.1、GPQA Diamond 等。此次评测共花费 72.02 美元。该模型在 Hugging Face 上提供权重,许可协议为 MIT,允许自由使用。
当前开源模型竞争激烈,DeepSeek V4 Flash 以低价和高智能表现,可能对同类产品形成压力。对于开发者而言,这意味着可以在推理任务中显著降低成本,尤其是处理长上下文或复杂逻辑问题时,该模型提供了有吸引力的选择。不过,其高度冗长的输出特性可能在部分场景下增加处理开销,需要实际权衡。
关键信息
- DeepSeek V4 Flash 0731 为开源权重模型,2026 年 7 月发布
- Artificial Analysis 智能指数得分 50,中位数为 25
- 输入价格 0.14 美元/百万 tokens,输出价格 0.28 美元/百万 tokens
- 上下文窗口 100 万 tokens,总参数 2840 亿,激活参数 130 亿
- 评测过程生成 2.1 亿 tokens,总花费 72.02 美元
- 模型在 Hugging Face 提供权重,MIT 许可
DeepSeek V4 Flash 0731 (Reasoning, Max Effort) is amongst the leading models in intelligence and well priced when comparing to other open weight models of similar size.
DeepSeek V4 Flash 0731(推理版,最大努力)在智能水平上位居领先,并且在与其他同类规模的开源权重模型相比时价格合理。
Hacker News
为什么上榜
如果你想用低价开源模型做高难度推理任务,这个评测直接帮你省筛选时间。
每天早上,把当日 AI 精选送进你的邮箱
公众号 AI去噪 · 每日一期同步推送
