全新模型DeepSeek V4.1 Flash上线,自带原生视觉多模态能力

时间:2026-09-15来源:互联网作者:tjxz

      DeepSeek官方宣布,DeepSeek V4.1 Flash模型于今日正式推出。该模型属于DeepSeek新模型系列里的轻量版本,拥有原生多模态视觉理解能力。


      DeepSeek称,新模型架构旨在提升能力上限、加快推理速度、提高吞吐,并支持拓展至更大参数版本。 DeepSeek V4.1 Flash是552B参数的MoE模型,使用全新非对称架构,输入激活仅8B、输出激活16B,运行成本更优。该模型经过全新预训练与大规模强化学习,基准测试综合性能超越DeepSeek V4 Pro等旗舰模型。

      V4.1 Flash优化了KVCache缓存开销,相比上一代,HBM显存占用降到原先的四分之一,SSD存储需求缩减至八分之一。在Agent智能体场景下缓存开销较高,这项压缩优化可明显降低任务调用成本。

      DeepSeek V4.1 Flash现已接入DeepSeek API,开发者使用deepseek-flash标识调用即可,旧版V4 Flash与V4 Flash Vision Exp已下线,原有接口标识会临时导流至新模型,方便业务平稳迁移。

      由于V4.1Flash各项表现强于V4 Pro,官方将逐步关停V4 Pro。自北京时间9月14日12点起,deepseek-v4-pro的请求会自动转发至V4.1Flash,并按新模型价格计费,直到V4.1Pro推出。腾讯WorkBuddy、CodeBuddy、OpenCode已完成全量接入。

      依托架构优化降低运行成本,官方下调API价格,保留峰谷分时计费,闲时资费为高峰一半,新计价规则2026年9月10日12点生效。

相关文章 更多>>

热门推荐