DeepSeek上线新一代V4.1-Flash模型,这是其全新架构家族中体量最小的一款,首次在基座层面内置原生视觉理解能力,可同时处理文本与图像。该模型采用混合专家设计,总参数约五千五百亿,支持最高百万级token的上下文窗口,并以MIT许可证开放。架构上的重点是通过重新设计的编解码结构大幅压缩键值缓存占用,据称可将智能体场景下的显存开销降低约四分之三,从而显著提升推理速度与吞吐。随着新模型上线,接口价格同步下调,原有的旧版视觉与文本模型逐步被替换,部分旗舰调用也开始路由至新版本。在多项公开评测中,V4.1-Flash在研究生级科学问答、竞赛编程与终端操作等任务上表现亮眼,延续了该团队以更低成本逼近甚至超越自家旗舰的一贯风格,进一步压低了高性能多模态模型的使用门槛。