音述ai反推功能需开通权限、切换模型、规范上传:先购基础包获30次额度,再手动选image-analyzer v2.3模型,最后传无ui元素的原图,导出json才带权重。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想用音述AI把一张好图快速变成可复用的提示词,却找不到功能入口、点错页面、上传后没反应——这三步卡点让90%的人在第一关就放弃。音述AI的反推功能藏在二级菜单深处,不手动切换模型类型会默认走文生图流程,根本不会触发图片解析。
确认账号与模型权限
打开音述AI官网或APP,登录你的账号。若首页顶部显示「未开通反推权限」红标,点击该提示→跳转至会员中心→选择「基础创作包」并完成开通。该套餐含每月30次免费反推额度,【未开通前所有上传操作均无响应】。
进入主界面后,右上角模型选择器必须手动切换为「Image-Analyzer v2.3」。其他如「SDXL-Pro」「Kling-Base」等模型无法调用反推模块,选错即白传。
上传参考图并触发解析
点击左侧导航栏「创意工坊」→「提示词反推」,页面中央出现虚线上传区。
支持三种方式:① 拖拽本地图片(JPG/PNG/WebP,≤8MB);② 点击「相册选取」调取手机图库;③ 粘贴小红书/抖音/Instagram公开链接(需确保原图未设私密或防盗链)。
⚠️ 注意:截图带系统状态栏、微信聊天框边框、网页滚动条的图片,AI会将这些误判为画面元素,导致提示词混入“白色圆角矩形”“灰色时间戳”等无效描述。
生成与导出提示词
上传成功后,页面自动跳转至分析页,倒计时3秒后显示结果。
结果区默认展开「结构化提示词」标签页,含6个字段:主体|场景|风格|光影|构图|负面词。每个字段右侧有「复制」按钮,可单独复制某一项用于微调。
点击顶部「导出为JSON」按钮,生成含权重标记(如主体:1.3、阴影:0.8)的机器可读文件,该格式能直接导入Stable Diffusion的Prompt Matrix插件,【普通文字版不带权重,复制后需手动加括号标注】。











