在mac上本地运行deepseek模型需完成ollama安装、模型拉取、chatbox ai可视化配置三步:下载安装ollama并验证服务运行;根据硬件选择对应deepseek-r1版本(如m1/m2选1.5b,m1 pro/max选7b)并执行ollama run命令拉取;最后配置chatbox ai直连ollama api,实现离线低延迟推理。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

在Mac上本地运行DeepSeek模型,避免网页版服务器繁忙、响应慢、无法离线使用等问题,需要完成Ollama安装、模型拉取、可视化界面配置三步闭环。整个过程不依赖Windows模拟器或云服务,全部走原生Metal加速路径。
Ollama安装与验证
打开浏览器,访问 https://www.php.cn/link/2575c857df983996d49550f3e924755f,点击「Download for macOS」下载最新版Ollama(2026年8月已适配macOS Sonoma/Ventura/Monterey全系)。
双击下载的Ollama-*.pkg文件,按向导操作:拖入「应用程序」→点击「Next」→输入管理员密码→点击「Install」。
安装完成后,系统会自动启动Ollama后台服务;若未自动启动,打开「终端」,直接输入ollama回车——看到ollama is running即表示服务就绪。
【注意】不要手动kill ollama进程或删掉~/Library/Application Support/Ollama目录,否则模型将丢失且无法恢复。
选择并拉取DeepSeek模型
进入 https://www.php.cn/link/27e9efa7a852bcaa4d9fe0791d2d37b1,根据你的Mac硬件选模型:
· M1/M2基础款(8GB内存)→ 选 deepseek-r1:1.5b
· M1 Pro/Max 或 M2 Ultra(16GB+内存)→ 可选 deepseek-r1:7b
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
· Mac Studio(32GB+统一内存)→ 才考虑 deepseek-r1:14b,否则极易触发内存压缩导致卡死。
点击对应版本右侧的「Copy」按钮,然后回到终端,粘贴并执行(例如):ollama run deepseek-r1:7b
首次运行会自动拉取模型层(.safetensors)、权重文件和tokenizer,M1芯片约需8–15分钟,期间终端持续输出进度条;出现Successfully pulled和>> 提示符即表示加载完成。
配置Chatbox AI可视化界面
第一步:访问 https://www.php.cn/link/de487db7a08250a136f966ead11da262,下载macOS版Chatbox AI(v1.9.5+,支持Metal后端直连Ollama)。
第二步:解压后将Chatbox.app拖入「应用程序」文件夹,右键→「显示简介」→勾选「仍要打开」解除Gatekeeper限制。
第三步:启动Chatbox,在设置页选择「使用自己的API」→「Ollama API」→「模型」下拉框中选中刚拉取的deepseek-r1:7b(若为空,点「刷新模型列表」)→点击「保存」。
第四步:关闭设置页,回到主界面,直接输入问题(如“写一段Python代码读取CSV并画折线图”),回车即得本地推理结果,全程无网络上传、无云端延迟。









