☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

据最新消息,苹果正与硅谷新兴AI企业PrismML展开深入合作,共同探索一种突破性的AI模型轻量化技术。该技术旨在大幅缩减当前主流大模型的体积与算力需求,使其具备在iPhone等移动设备上本地部署与实时推理的能力。若验证成功,不仅将强化苹果“数据不出设备”的隐私护城河,更有望为长期停滞不前的Siri带来实质性智能化跃升。
PrismML CEO对外表示,苹果已启动对其核心技术的初步评估工作。尽管双方合作尚处初期阶段,但沟通节奏积极、反馈良好。巧合的是,这一进展紧随iOS 17公测版发布次日——新版Siri迎来深度重构,并首次面向公众开放测试,意在直面OpenAI、Anthropic等新一代AI助手的竞争压力。
将AI运算重心向终端迁移,不仅能显著缩短响应时延、节省云端带宽与服务器开销,还能保障用户在无网络环境下持续使用核心AI功能。这与苹果一贯坚持的隐私优先战略高度一致。Counterpoint资深分析师Pathak指出:“端云协同AI架构将成为下一代智能体验的关键——高复杂度任务由云端承担,而涉及身份、对话、生物特征等敏感数据,则全程在设备端闭环处理。”
PrismML脱胎于加州理工学院,早期即获得Khosla Ventures投资支持。该公司已开源其对阿里巴巴Qwen系列模型的压缩成果:将原始约54GB的大模型精简至4GB以内,成功实现270亿参数模型在iPhone 15及后续机型上的本地运行。接下来,团队还将适配更多主流开源大模型,持续拓展终端侧AI的应用边界。
技术细节显示,PrismML的压缩方案可将原本需8张GPU并行运算的云端模型,压缩为单GPU即可承载;更进一步,使原本仅能在数据中心运行的模型,顺利下沉至智能手机与笔记本电脑。需注意的是,尽管单任务资源占用大幅下降,但整体芯片性能与能效优化仍面临全新挑战。
划重点:
? 苹果携手PrismML,加速推进大模型终端化落地,目标直指iPhone本地AI运行。
? 技术落地后,有望重塑Siri交互体验,并巩固苹果在隐私计算领域的差异化优势。
? PrismML已实现Qwen模型超13倍压缩(54GB→











