国家超算互联网中心今日迎来新成员——DeepSeek V4.1 Flash模型正式上线。用户只需登录官网并进入模型服务页面,即可轻松访问该模型的API调用界面,开启高效智能应用新体验。
作为一款552B参数的MoE架构模型,DeepSeek V4.1 Flash采用创新的Causal-Encoder-Decoder结构设计,实现了输入输出激活参数的差异化配置。其输入激活参数仅8B,输出激活参数16B,在保持模型性能的同时,将运行成本压缩至同类规模产品的显著水平以下。通过引入新型预训练机制与大规模强化学习后训练技术,该模型在多项基准测试中表现优异,甚至超越了DeepSeek V4 Pro等旗舰级产品。
在硬件资源优化方面,新模型展现出突破性进展。通过深度压缩KV Cache缓存结构,其对高带宽内存(HBM)的需求较前代降低75%,固态硬盘(SSD)存储需求减少87.5%。这种优化在智能体(Agent)应用场景中效果尤为显著——缓存命中成本的大幅下降,直接降低了复杂任务处理的总体开支,为大规模商业化部署铺平了道路。











