DeepSeek发新模型,对HBM需求降至原来1/4
(文/赖家琪 编辑/吕栋)
9月10日,DeepSeek正式发布新模型DeepSeek V4.1 Flash。官方给出的测试结果显示,这款定位为“Flash”的模型不仅更智能、更快、更高效,降低了对高带宽内存(HBM)的需求,在基准测试中也超过了此前的旗舰模型V4 Pro。
据介绍,V4.1 Flash是DeepSeek全新模型结构系列中最小尺寸的模型,为5520亿个参数的MoE(混合专家)模型,同时原生支持多模态视觉理解能力。
与此前的模型不同,V4.1 Flash采用了全新的Causal-Encoder-Decoder(因果编码器-解码器)架构,其输入和输出采用不对称设计:输入激活参数量仅为80亿,输出激活参数量为160亿。
更重要的是,V4.1 Flash采用新的预训练方法,并经过更大规模的强化学习后训练,最终取得了“优于旗舰模型的”结果。根据官方公布的基准测试结果,V4.1 Flash在性能、费用、速度和总用时等多个维度均超过V4 Pro。

DeepSeek称,新一代大模型大幅压缩了键值缓存(KV Cache)的规模。KV Cache是模型在处理长上下文和连续任务时的重要缓存机制,但它也会大量占用显存和存储资源。因此,V4.1 Flash与上一代模型相比,对HBM的需求降至原来的1/4,对固态硬盘(SSD)的需求则降至原来的1/8。

这一变化对于智能体(Agent)场景尤其重要。当AI Agent需要连续调用模型、执行复杂任务时,缓存命中产生的费用往往占据较高比例。KV Cache被压缩后,不仅意味着硬件资源占用下降,也能直接降低Agent类任务的使用成本。
在模型上线的同时,DeepSeek也开始对现有产品线进行调整。目前,V4.1 Flash已经同步接入DeepSeek API,原生支持多模态能力。
开发者只需将调用的模型名称改为“deepseek-flash”,即可使用最新模型。此前的V4 Flash和V4 Flash Vision Exp已经下线。出于兼容考虑,“deepseek-v4-flash”和“deepseek-v4-flash-vision-exp”两个旧模型名称暂时仍会自动路由至V4.1 Flash。
但DeepSeek已经明确准备让V4 Pro“退场”。
DeepSeek表示,经测试,V4.1 Flash在性能、费用、速度、总用时等指标上已经全面超过V4 Pro,因此公司计划有序下线V4 Pro。
根据安排,北京时间9月14日12时之后至V4.1 Pro上线之前,所有访问“deepseek-v4-pro”的请求将全部路由至V4.1 Flash,并按照V4.1 Flash的价格计费。
除了API服务,V4.1 Flash也已经进入开发者常用的编程工具。腾讯WorkBuddy、CodeBuddy以及OpenCode作为官方合作伙伴,均已全量接入该模型。
在价格上,DeepSeek这次也是“降价上新”。
受益于模型架构的调整,DeepSeek称其能以更低的成本服务更多客户,因此相应下调了V4.1 Flash的价格。与此同时,V4.1 Flash将继续采用峰谷定价机制,闲时价格为高峰时段的一半,鼓励用户根据实际需求错峰执行任务。新价格已于9月10日12时正式生效。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”




