skywork ai模型分base、chat、r1v2三层:办公选skywork-13b-base/chat;视频生成用skyreels-v3;图像理解+数学推理才需r1v2;命名后缀决定能力边界,如-chat不支持视觉任务。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想快速搞懂Skywork AI旗下十几个模型各自能干什么、该在什么场景下选哪个,又不想被冗长的白皮书和术语绕晕——这篇指南直接按真实使用路径拆解,从基础能力到高阶组合,一步一验证。
先分清三大模型层级:Base、Chat、R1V2不是并列关系
第一步:打开Skywork官方GitHub仓库(https://github.com/SkyworkAI),进入models目录,你会看到三个主干文件夹:skywork-13b、skyreels-v3、r1v2。它们不是同一类模型,强行并列对比会出错。
第二步:确认你的任务类型——如果是写周报、改PPT、生成表格等办公类任务,【必须从skywork-13b-Base或skywork-13b-Chat起步】;如果是做视频生成(比如把商品图变带货短视频),跳过前两者,直奔skyreels-v3;如果任务同时含图像理解+数学推理(例如“分析这张财报截图里的异常数据点并推演下季度趋势”),才需要调用r1v2。
第三步:注意模型命名后缀。所有以-base结尾的模型都不带对话优化,仅适合SFT微调或作为下游任务基座;所有以-chat结尾的模型已内置对话历史管理与多轮指令记忆,但【不支持视频生成或视觉推理】,强行输入图像会返回格式错误而非降级处理。
SkyReels-V3三大能力实操验证路径
方法一:参考图像转视频(Reference Images-to-Video)
① 准备1–4张同主体、不同姿态/背景的PNG图像,确保分辨率≥512×512且无水印;
② 在SkyReels-V3 Web UI中上传图像→输入文本提示(如“主播微笑介绍新款耳机,镜头缓慢推进”)→点击Generate;
③ 生成耗时约90秒(A100×2环境),输出为MP4,首帧与最后一张参考图身份一致性误差<3.2%(官方测试集均值)。
方法二:视频延长(Video Extension)
直接拖入一段已有视频(MP4/H.264编码,时长≤8秒),选择延长模式(Loop/Forward/Reverse)→设置延伸帧数(最大64帧)→执行。注意:【原始视频若含快速镜头切换或剧烈运动,延长后可能出现帧间抖动】,建议先导出关键帧检查运动矢量连续性。
方法三:音频驱动虚拟形象(Talking Avatar)
天工AI (iOS) 5.2.1版本新增 PPT 生成页数配置、十余种专业视频模板,并且支持设置视频比例与时长;定时任务可指定模型并推送到 IM 渠道。修复了下载失败等问题,提升了稳定性与内容创作体验,让创作更自由、更高效。
上传一段WAV格式人声(采样率16kHz,时长≤30秒)→选择预置形象(共7个,含中英文双语口型适配)→勾选“Lip Sync Precision Mode”→生成。这一步操作起来很简单,直接点击即可启动,但生成结果依赖音频信噪比,环境噪音>15dB时口型同步准确率下降超40%。
R1V2混合强化学习能力落地检验
第一步:访问R1V2 API沙箱(https://api.sandbox.skywork.ai/r1v2/v1/chat),粘贴以下JSON payload:
{"messages":[{"role":"user","content":[{"type":"image_url","image_url":{"url":"https://example.com/chart.png"}},{"type":"text","text":"分析图表中2025年Q3销售峰值成因,并用公式推导Q4预测值"}]}],"model":"r1v2"}
第二步:观察响应结构——正确输出应包含三段:① 图表要素识别(坐标轴、图例、数据点标注);② 归因分析(含外部事件时间戳对齐);③ 公式推导过程(LaTeX格式,含变量定义与边界条件说明)。任一环节缺失即表明未触发慢思考链路。
第三步:若需强制启用深度推理,必须在payload中添加参数"reasoning_depth": "full",否则默认只走轻量级视觉理解路径。这一步不能省略,漏加会导致模型降级为普通多模态模型。
天工Skywork超级智能体调用逻辑
方法1:文档/PPT/表格三件套生成
在tiangong.cn首页选择“文档智能体”→输入需求(如“生成一份面向Z世代的咖啡品牌营销方案,含SWOT、竞品对比表、3页PPT大纲”)→等待Deep Research模块自动检索最新行业报告(平均调用12.7个可信源)→生成内容右上角显示溯源标记(可点击跳转原始网页)。
方法2:跨智能体串联工作流
在“专家智能体”面板中,先运行“网页智能体”抓取小红书近30天爆款咖啡笔记→将结果喂给“文档智能体”生成用户洞察摘要→再将摘要导入“PPT智能体”生成可视化幻灯片。整个流程无需复制粘贴,系统自动完成格式转换与上下文对齐。
方法3:本地文件直连分析
点击界面左下角“










