☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

在刚刚结束的WWDC2026大会上,LM Studio携手苹果带来了一场震撼业界的技术展示——仅凭四台Mac Studio构建的本地计算集群,便成功完成了月之暗面旗下万亿级参数大模型Kimi K2.6的完整推理任务。此举彻底颠覆了“万亿参数模型必须仰赖云端GPU集群”的传统认知,标志着消费级硬件支撑前沿AI算力的时代正式到来。
Kimi K2.6整体参数量突破1万亿,基于MoE(Mixture of Experts)稀疏架构设计,每次推理激活参数约320亿,具备超长上下文理解能力、多模态输入兼容性以及智能体协同任务处理功能。本次演示中,四台Mac Studio依托苹果自研内存共享与高速互联协议组建为统一计算单元,聚合可用内存接近1.5TB,完全满足该超大规模模型的部署与推理需求。前期开发者实测数据显示,在同等配置下,Kimi K2.6可稳定输出约28 tokens/s的响应速度,同时功耗显著低于主流数据中心级GPU方案。
iPhone一键接入本地集群,全程数据零上传
将小说章节转换为电影分镜剧本。用户上传txt/md/docx文本,AI分析场景、角色、情绪、镜头语言,输出专业分镜脚本。适用于用户提及“分镜”“storyboard”“小说转分镜”“影视改编”“镜头脚本”或需要将小说改编为分镜的场景。
尤为引人注目的是,现场同步演示了LM Studio全新升级的LM Link远程访问能力。用户可通过MacBook Neo笔记本或iPhone设备,安全、低延迟地直连后端Mac Studio集群,并与正在运行的大模型开展实时交互。整个过程所有数据均在本地网络内闭环流转,不经过任何第三方服务器或公有云节点。
目前,LM Link已深度集成至LM Studio macOS客户端及Locally AI iOS应用中,支持端到端加密通信与身份双向认证。这意味着即便使用轻量级终端设备,用户也能随时调用集群级别的AI算力资源,同时确保敏感信息始终保留在个人可控范围内。结合苹果Thunderbolt 5 RDMA等先进跨设备内存协同技术,一个覆盖端侧、桌面与集群层级的AI本地化技术生态正加速成型。
此次联合演示释放出明确信号:万亿参数大模型的本地化部署,已从实验室构想迈入实际工程落地阶段。随着苹果硬件间协同能力持续跃升,消费级设备承载超大规模AI推理的能力边界,或将迎来新一轮突破。










