workbuddy中只有glm-5.0(含turbo)、glm-4-flash、混元-hunyuan-pro、kimi-k2.5-thinking四款模型能真正解析pdf/excel等文件并执行提取、统计、生成报告等操作,其余模型仅支持文本摘要;需在craft或plan模式下切换模型、授权文件访问、上传支持格式文件,并新建对话避免缓存干扰。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

WorkBuddy中上传文件后让AI直接读取内容、提取关键信息、做统计或生成报告,必须依赖能稳定调用文件解析技能的模型——不是所有模型点开“添加文件”按钮就能真正读懂你传的PDF或Excel。
原生深度适配模型才能真正解析文件
点击「+」→「添加文件」后,只有【GLM-5.0(含Turbo)、GLM-4-Flash、混元-HunYuan-Pro、Kimi-K2.5-Thinking】这四款模型能触发底层文件解析技能链。其他模型(如DeepSeek-V3、MiniMax、未配置tool_choice的Ollama本地模型)上传后仅作文本摘要,无法执行表格提取、公式识别、PPT结构还原等操作。
GLM系列是首选:它对docx/xlsx/pptx内嵌格式理解最准,处理带样式/批注/多Sheet的Excel时,不会把=SUMIFS()当普通字符串输出;混元在腾讯生态内调用COS或乐享知识库文档成功率最高;Kimi-K2.5-Thinking仅限Mac微信直连版和桌面版可用,适合长文档逻辑拆解,但不支持图片型PDF文字识别。
切换模型前必须确认工作模式
第一步:确保当前处于Craft模式(做一做)或Plan模式(想一想)。Ask模式(问一问)下即使选了GLM-5.0-Turbo,系统也会禁用所有文件写入与技能调用权限。
第二步:点击右下角头像→「模型设置」→从列表中选择GLM-5.0-Turbo→点击「立即生效」。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
第三步:重新上传文件,再输入指令,例如:“读取这份销售数据表,统计各区域Q2销售额,生成柱状图并存为report.pdf”。这一步必须等模型切换完成后再操作,否则仍走旧模型通道,技能调用会静默失败。
避坑:上传后AI说“已收到文件”却不分析?
方法一:检查文件是否被WorkBuddy授权访问。Windows用户需在首次上传时勾选“允许访问此文件夹”,macOS用户需在系统偏好设置→隐私与安全性→完全磁盘访问中启用WorkBuddy。
方法二:确认文件类型在支持范围内。目前明确支持解析的是.docx、.xlsx、.pptx、.pdf(文字型)、.jpg/.png(需模型开启vision_enabled且为多模态版本),不支持.rar/.7z压缩包内嵌文件、加密PDF、扫描件PDF(无OCR层)。
方法三:强制刷新上下文。模型切换后历史对话不继承,但若之前对话中已上传过同名文件,系统可能复用缓存结果。此时需新建对话窗口再试,避免AI基于旧缓存“假装分析”。









