资讯

DeepSeek V4.1 Flash正式发布:性能全面超越V4 Pro 成本更低

驱动之家·2026/9/10 06:43:00🔗 原文

📋总体概括

深度求索9月10日正式发布DeepSeek V4.1 Flash,这是全新模型结构系列中尺寸最小的模型,原生支持多模态视觉理解。该模型采用552B参数MoE架构,引入全新的Causal-Encoder-Decoder结构,输入侧仅激活8B参数、输出侧激活16B参数的不对称设计,使其推理成本显著低于同尺寸模型。官方基准测试显示,V4.1 Flash在多项测试中超越包括DeepSeek V4 Pro在内的旗舰模型,同时新架构为后续扩展至更大参数规模模型打下基础。

关键信息

  • 深度求索发布全新模型结构系列最小尺寸模型V4.1 Flash,原生支持多模态视觉理解
  • 采用552B参数MoE架构,引入全新的Causal-Encoder-Decoder结构
  • 输入侧仅激活8B参数、输出侧激活16B参数的不对称设计,推理成本显著低于同尺寸模型
  • 官方基准测试显示V4.1 Flash在多项测试中超越DeepSeek V4 Pro等旗舰模型
  • 新结构旨在提升能力上限、加快推理速度并提高吞吐,为扩展更大参数规模打基础

🔥犀利点评

小尺寸Flash反而全面碾压自家旗舰V4 Pro,这不只是参数胜利,更是架构层面的代差碾压——不对称激活设计说明深度求索已跳出堆参数的内卷逻辑。真正值得警惕的是海外厂商:对手一边降本一边升性能,还顺手铺好了通往更大模型的架构地基。不过官方跑分自说自话的成分永远要打折,等第三方实测和真实API体验再下重注不迟。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文