资讯动态

DeepSeek推出新模型,性价比超高反超GPT-5.6

2026-09-12
5682次

9月10日,DeepSeek发布了V4.1 Flash模型,参数量达到552B,并采用MIT许可,具备8B的输入激活和16B的输出激活,支持高达100万token的上下文和图像输入。与此同台的闭源旗舰分别是于7月9日发布的GPT-5.6 Sol和7月24日推出的Claude Opus 5。虽然三者均在进行Agent编程的推广,但DeepSeek在价格和分数对比上表现出显著的优势。

在定价方面,V4.1 Flash的高峰期输出价格为每百万token仅8元,而GPT-5.6 Sol的价格为20美元(约合142元),Claude Opus 5则为25美元(约178元)。换算后,V4.1 Flash的价格不到Sol的6%,与Opus 5相比,闲时价格仅为其2.3%,节省约97%。在输入缓存命中方面,V4.1 Flash的费用为0.04元,而Opus 5则为0.5美元,两者相差约90倍。

在性能测试方面,DeepSeek的技术报告中显示,三款模型在最高推理强度的统一测试中,V4.1 Flash得分74.2,超越了GPT-5.6 Sol的73.0分以及Claude Opus 5的74.0分,成为三者中得分最高的。虽然在Terminal-Bench 2.1上三款模型评分接近于90分,但在中低难度的Agent编程任务中,这一价格便宜的开源模型展现出明显的竞争力,得分超越或持平于两款闭源旗舰。 球友会

about image

V4.1 Flash能够实现如此低的价格,得益于其独特的Causal Encoder-Decoder非对称设计,输入部分仅激活8B,而输出部分则激活16B,特别适用于输入量远大于输出量的Agent场景,KV Cache每token仅需890字节。此外,它也是三款模型中唯一公开结构细节并能进行私有化部署的选择。

然而,尽管在中低难度任务中取得了优势,但在更高难度的项目上闭源旗舰仍有领先之处。在Terminal-Bench 4.0中,Opus 5的得分超出V4.1 Flash超过20分,在高级推理任务中也有明显优势。DeepSeek本身也承认在视觉任务方面与闭源模型存在差距。

总体来看,在应对中低难度、批量处理和成本敏感的Agent编程时,V4.1 Flash以不到对手6%的价格取得持平甚至反超的成绩,而在高难任务中,付出更多的资金确实获得了更好的成功率。许多团队的实际策略是将V4.1 Flash用作常规请求处理,然后在面对复杂任务时再转向闭源模型,从而整体成本只有纯闭源方案的两到三成。 球友会

全国咨询热线

13594780347

球友会.(中国)官方网站

联系电话:13594780347

联系人:李总

邮箱:liturgical@outlook.com

公司地址:南平市丰欺入口477号


微信扫一扫

手机官网