【php中文网快讯】据 deepseek 官方通报,deepseek v4.1 flash 模型已于今日正式上线。该模型是 deepseek 全新架构体系中体积最小、部署最轻量的版本,原生支持多模态视觉理解能力。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜
官方指出,此次模型结构的设计目标聚焦于四大方向:进一步突破能力上限、显著提升推理效率、扩大单位时间处理吞吐量,并为未来向更大参数规模演进预留充分扩展空间。
公开信息显示,DeepSeek V4.1 Flash 是一款总参数量达 552B 的 MoE(Mixture of Experts)混合专家模型,首次采用 Causal-Encoder-Decoder 非对称结构——输入端仅激活约 8B 参数,输出端则激活约 16B 参数,实现“按需分配算力”,大幅优化运行开销。模型还引入了升级版预训练范式,并经过更广域、更深度的强化学习后训练。多项权威基准测试结果表明,其在综合智能表现上已超越 DeepSeek V4 Pro 等主流旗舰模型。

在系统资源占用方面,V4.1 Flash 对 KV Cache 进行了深度精简:相较前代模型,HBM(高带宽内存)使用量压缩至原有水平的 25%,SSD 存储占用亦降至 12.5%。由于 Agent 类应用高度依赖缓存复用,此项优化可直接降低其服务部署与调用成本。
V4.1 Flash 已全面接入 DeepSeek 开放平台 API,开发者可通过模型标识 deepseek-flash 调用最新版本;原 V4 Flash 及 V4 Flash Vision Exp 已完成下线。为保障服务连续性,历史接口标识将临时指向 V4.1 Flash。
WorkBuddy Mac版 5.4.7 官方下载,构建号 5.4.7.37521366,适合 macOS 用户安装 AI 办公助手、任务自动化与多工具协作桌面客户端。
鉴于其在性能、响应延迟、单位请求成本及整体任务耗时等关键指标上均优于 V4 Pro,DeepSeek 宣布将启动 V4 Pro 的逐步退服计划:自北京时间 9 月 14 日 12:00 起,在 V4.1 Pro 正式发布前,所有发往 deepseek-v4-pro 的请求将自动重定向至 V4.1 Flash,并统一按 V4.1 Flash 的资费标准结算。
腾讯旗下 WorkBuddy、CodeBuddy 和 OpenCode 已完成对该模型的全量集成与上线部署。
依托底层架构革新带来的能效提升,DeepSeek 同步调整了 API 收费策略,延续峰谷分时计费机制——闲时单价为高峰时段的 50%,以鼓励资源错峰调度。新版定价已于 2026 年 9 月 10 日 12:00 起正式执行。










