蚂蚁集团旗下的百灵大模型系列今日迎来关键升级,
这款总参数量达 104B、实际激活参数量为 7.4B 的 Instruct 类大模型,在正式发布前曾以代号“Elephant Alpha”匿名入驻 OpenRouter 平台开展先行验证。在为期两周的公开测试中,研发团队持续收集真实场景下的用户反馈,并据此完成多轮迭代优化,显著提升了中英文语境无缝切换的自然性,同时大幅增强了对主流编程语言及开发框架的原生支持能力。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

技术突破:融合式架构与高能效比
- 融合线性计算架构:依托底层算子级深度优化,模型展现出优异的推理吞吐性能。在配备 4 张 H20 显卡的环境中,最高推理速度可达 340 tokens/s;在 Prefill 阶段的吞吐能力上,更是达到 Nemotron-3-Super 的 2.2 倍,有效压缩端到端响应时延。
-
领先的“智效比”表现:研发团队在训练阶段即对 Token 利用效率进行精细化调优。实测表明,执行同等质量任务时,
平均仅需消耗约 15M tokens,仅为同级别竞品的十分之一,显著压缩规模化落地的算力开销与运营成本。Ling-2.6-flash
应用聚焦:智能体(Agent)场景深度赋能
围绕当前大模型落地最核心的 Agent 应用方向,
目前,该模型已正式开源,开发者可通过 Hugging Face 及 ModelScope(魔搭社区)平台免费获取全部模型权重与配套工具链,加速其在金融、研发、客服、内容生成等多领域的实践探索与商业落地。











