☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

本周,DeepSeek 推出 V4.1 Flash 版本,其底层架构相较前代发生显著重构,整体升级幅度之大,已具备跨代特征,按常规逻辑足以命名为 V5;但官方选择延续小版本号命名策略,保持低调姿态。与此同时,Pro 系列新品已确认定名为 V4.1 Pro,具体技术细节与能力提升尚未公开披露;若此次 V4 到 V4.1 的演进路径与 Flash 版本一致,则 V4.1 Pro 的理论性能天花板亦将大幅提升。不过,鉴于此前 V4 Pro-0813 正式版实际表现未达市场预期,当前对 V4.1 Pro 的期待值仍宜理性看待。
DeepSeek Code 2.0 被曝即将登场,聚焦“电脑操控”核心能力
据多方消息透露,DeepSeek 下一阶段重点模型 DeepSeek Code 2.0 计划于 9 月正式发布,目标直指当前全球顶尖水平——有望在综合能力上超越 Mythos 5.1 与 GPT-6 Astra 这两大前沿模型。
值得注意的是,该模型将继续坚持开源路线,并将“Computer Use”(即 AI 主动操作本地计算机)作为核心设计方向:通过深度集成操作系统接口与自动化执行框架,实现由 AI 全流程接管桌面任务,例如文件管理、软件调用、多步骤办公流程编排等。而 Astra 当前诸多惊艳演示,正是依托此类原生电脑控制能力所达成。
通过 Sophnet Qwen-Image-Plus 生成图像并轮询任务完成。适用于用户请求 Sophnet 图像生成、Qwen-Image-Plus 或从 Sophnet API 获取图像。
3 万亿参数量,刷新国内最大规模纪录
爆料指出,DeepSeek Code 2.0 参数规模将突破 3 万亿大关,成为目前中国境内参数量最高的大模型。横向对比来看:K3 模型以 2.8 万亿参数位居现役榜首,通义千问 Qwen 3.8 Max 参数量为 2.4 万亿,而 DeepSeek 自家 V4 Pro 为 1.6 万亿参数。
结合 V4.1 Flash 已通过架构革新实现参数量翻倍的事实,Code 2.0 从现有 1.6 万亿跃升至超 3 万亿的路径具备较强合理性。面对 Mythos 5.1 和 Astra 这类高参数、强推理的竞品,唯有达到同量级参数基础,才可能支撑起更复杂的认知建模与长程任务调度能力,从而真正实现性能对标。
当然,该消息尚未获 DeepSeek 官方证实,可信度仍待观察。回顾 2023 至 2024 年间,DeepSeek 曾陆续发布三款冠名“Code”的模型,但当时市场反响较为平淡;若此次以 Code 2.0 为突破口,转向专注代码理解、逻辑推演与系统级交互的旗舰定位,或将形成差异化竞争格局——同时让 V4.1 Pro 与 Flash 更聚焦于通用 Agent 场景,各司其职,协同推进产品矩阵演进。









