workbuddy支持无缝接入各类openai协议兼容大模型:方法一填api key直连gemini、gpt-4等主流商业模型(需v1.8.0+);方法二通过火山云ark平台接入deepseek-v4等12个模型;国产模型如混元hy3、qwen2.5等深度适配,部分需开启长文本模式;自建模型需配置base url、api key、model name及timeout,并启用流式响应测试连通性。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

WorkBuddy支持接入所有符合OpenAI API协议规范的第三方大模型服务,无需修改代码或重装软件,直接在设置中填写参数即可启用。
主流商业模型全兼容
方法一:直接填API Key接入
Gemini、GPT-4、Claude系列(如Claude-3.5-Sonnet)、Command R+等已验证可用。需确保WorkBuddy版本 ≥ v1.8.0,否则「添加自定义模型」入口将灰显不可用。
方法二:使用火山云Ark平台
目前已实测接入DeepSeek-V4、Kimi-K2.6、GLM-5.2等12个模型。Base URL填https://ark.cn-beijing.volces.com/v1,Model Name必须与Ark控制台中显示的模型标识完全一致,例如deepseek-v4——【大小写和连字符错一个都会报404】。
国产模型深度适配清单
腾讯混元Hy3已首发接入,限时免费至7月22日23:59,当前仍可使用但开始扣积分。Qwen2.5、GLM-4、DeepSeek-R1、MiniMax-ABAB6.5均通过出厂级调优,支持工具调用、多步工作流与本地文件操作。
注意:Hy3最大上下文256K,但WorkBuddy对话区默认截断为32K,如需处理长文档,必须在任务发起前手动开启「长文本模式」开关。
自建/私有化模型接入路径
第一步:确认服务端已部署OpenAI兼容接口
常见方案包括vLLM、Ollama(启用--host 0.0.0.0)、FastChat、LiteLLM代理层。
第二步:在WorkBuddy中配置四项必填参数
Base URL → 填你服务的根地址(如http://192.168.1.100:8000/v1)
API Key → 可留空或填任意非空字符串(部分私有服务不校验)
Model Name → 必须与你vLLM/Ollama中注册的模型名严格一致
Timeout → 建议设为120秒,避免大模型响应慢导致中断
第三步:启用流式响应并测试
勾选「启用流式输出」后点击「测试连接」,成功返回模型信息即表示通路建立。若失败,请检查防火墙是否放行对应端口——【Windows Defender会默认拦截本地非标端口】。











