资讯

DeepSeek V4.1 Flash正式发布:性能全面超越V4 Pro 成本更低

驱动之家·2026/9/10 06:43:00🔗 原文

📋总体概括

深度求索9月10日正式发布DeepSeek V4.1 Flash,为新模型结构系列中尺寸最小的模型,原生支持多模态视觉理解。该模型采用552B参数MoE架构和全新Causal-Encoder-Decoder结构,输入输出不对称设计:输入侧仅激活8B参数,输出侧激活16B参数,使推理成本显著低于同尺寸模型。官方基准测试显示其性能全面超越包括V4 Pro在内的旗舰模型。新架构旨在提升能力上限、加快推理速度,为后续更大参数规模模型扩展奠基。

关键信息

  • 深度求索9月10日发布DeepSeek V4.1 Flash,原生支持多模态视觉理解
  • 模型采用552B参数MoE架构,引入全新Causal-Encoder-Decoder结构
  • 输入侧仅激活8B参数、输出侧激活16B参数,推理成本显著低于同尺寸模型
  • 官方基准测试显示性能全面超越包括DeepSeek V4 Pro在内的旗舰模型
  • 采用新预训练方式并经过更大规模强化学习后训练,架构为更大规模模型扩展奠基

🔥犀利点评

小参数激活跑赢大旗舰,DeepSeek这次把『效率即性能』的逻辑又推进一步——不对称激活结构若真如官方所称,等于直接挑战同行的推理成本底线。但所有数据均出自官方基准,缺第三方验证前需保留态度;真正值得注意的是其刻意强调『为更大参数规模打基础』,说明Flash只是新架构的试金石,后续旗舰才是主菜。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文