DeepSeek V4.1 Flash正式发布:552B新架构,输入只激活8B
发布时间:2026-09-10
动察 Beating AI 快讯,DeepSeek 正式发布 V4.1 Flash。新模型总参数 552B(5520 亿),采用全新的 Causal-Encoder-Decoder 架构,并原生支持图片理解。它也是 DeepSeek 这套新架构系列里目前最小的模型。这套架构把输入和输出分开处理。读取输入时只激活 8B(80 亿)参数,生成回答时激活 16B(160 亿)。DeepSeek 称,这让 552B 的大模型也能把推理成本压下来。经过新的预训练和更大规模强化学习后,V4.1 Flash 在官方基准中已经超过 V4 Pro。缓存也被大幅压缩。相比上一代,V4.1 Flash 对 HBM 显存的需求降至 1/4,SSD 存储需求降至 1/8,主要用来降低长上下文和 Agent 反复调用时的成本。V4.1 Flash 已同步上线 API,模型名改成 deepseek-flash 即可调用。----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考----------交流群:https://t.me/dunwangyuanhuiwang

动察 Beating AI 快讯,DeepSeek 正式发布 V4.1 Flash。新模型总参数 552B(5520 亿),采用全新的 Causal-Encoder-Decoder 架构,并原生支持图片理解。它也是 DeepSeek 这套新架构系列里目前最小的模型。


这套架构把输入和输出分开处理。读取输入时只激活 8B(80 亿)参数,生成回答时激活 16B(160 亿)。DeepSeek 称,这让 552B 的大模型也能把推理成本压下来。经过新的预训练和更大规模强化学习后,V4.1 Flash 在官方基准中已经超过 V4 Pro。


缓存也被大幅压缩。相比上一代,V4.1 Flash 对 HBM 显存的需求降至 1/4,SSD 存储需求降至 1/8,主要用来降低长上下文和 Agent 反复调用时的成本。


V4.1 Flash 已同步上线 API,模型名改成 deepseek-flash 即可调用。

----------缘辉旺盾网量化工具温馨提示:数字货币投资有风险,入市需谨慎;本文章不作为投资依据,仅供参考 ----------交流群:https://t.me/dunwangyuanhuiwang