ITCOW牛新网 9月10日消息,深度求索今日推出全新的DeepSeek V4.1 Flash,它属于新一代架构系列当中体量最小的模型,原生就具备多模态视觉理解能力,新架构的设计目标是拉高能力上限,同时实现更快推理速度与更高吞吐,还可以向更大参数规模进行扩展。

该模型为552B总参数的MoE混合专家模型,采用全新Causal‑Encoder‑Decoder非对称架构,输入环节仅激活8B参数,输出环节激活16B参数,相比同规格模型,整体使用成本得到明显下降。模型经过全新预训练流程,还完成更大规模的强化学习后训练,多项基准测试结果表现突出,综合能力已经超过DeepSeek V4 Pro等过往旗舰模型。


这一模型也完成对DeepSeek Harness框架的适配,能够很好的支撑Agent智能体相关开发工作。按照官方安排,旧版V4 Pro服务会推迟至9月14日下线,在V4.1 Pro正式问世之前,原本指向V4 Pro的调用请求会被转接至V4.1 Flash执行。
