superclue-vlm 2026年4月中文多模态视觉语言模型评测榜单正式揭晓,国产模型迎来集体跃升。字节跳动doubao-seed-2.0-pro-260215以90.66分高居总榜榜首,力压谷歌gemini-3.1-pro-preview(89.35分)。

本次测评共纳入全球17款主流视觉语言模型,其中国产模型表现尤为亮眼——阿里Qwen3.5系列、商汤SenseNova、智谱GLM等悉数跻身榜单前列;而OpenAI GPT-5.4、X.AI Grok等国际头部模型则止步中游,整体被国产阵营反超。
评测体系围绕基础认知能力、视觉逻辑推理、视觉实际应用三大核心方向构建,覆盖通用图像识别、图表理解与分析、医学影像判读等25个细分任务。国产模型在基础感知与数据解析类任务中优势突出,平均得分突破90分,展现出高度的系统性与稳定性;但在复杂视觉推理及工业检测、临床辅助诊断等垂直领域仍存优化空间,部分专业场景得分尚待加强。


综合来看,此次榜单标志着中文多模态人工智能迈入新阶段,国产模型在中文语境理解深度、跨模态协同能力及本土化任务适配性等方面已实现全面领先。












