minimax m3模型可自动解析竞品详情页截图,提取文字、坐标、视觉焦点与动线,支持单图精析或多图对比,经清洗后生成热力表、动线路径及结构化表格,省时80%。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要快速拆解竞品详情页的视觉结构和文案逻辑,但人工逐张截图、抄写、归类耗时且易漏关键信息——MiniMax M3模型能直接解析图片中的文字、布局层级、商品卖点分布与视觉动线,省去80%人工整理时间。
准备竞品详情页截图素材
打开目标竞品商品详情页,用浏览器自带的“全页截图”功能(Chrome右键→“捕获全屏”)保存为PNG格式。不要用手机拍照或滚动截多张拼接,【M3模型对模糊、倾斜、分段截图的OCR识别准确率会下降30%以上】。
将截图按页面顺序重命名为“1_首屏”“2_核心卖点”“3_参数对比”等,确保文件名不含中文标点或空格。
调用MiniMax M3模型解析图片
登录MiniMax控制台→进入Model Studio→选择m3-202409→点击“新建推理任务”。
方法一:单图批量解析
在输入框粘贴如下JSON格式请求体:
{"image_url": "https://your-bucket/1_首屏.png", "prompt": "提取图中所有可读文字,标注每段文字所在区域坐标(x,y,width,height),识别主视觉焦点区域,并判断该区域是否承载核心卖点信息"}
MiniMax 3.0.18 是一款高效、轻量级的系统优化与多媒体增强工具。该版本在核心性能上进一步升级,提供更稳定的运行环境与更低的资源占用。主要功能包括智能内存管理、启动项优化、网络加速及高清音视频解码增强,显著提升设备响应速度与影音体验。新版修复了已知兼容性问题,并优化了界面交互逻辑,适用于日常办公与娱乐场景。MiniMax 3.0.18 秉承简洁实用的设计理念,帮助用户轻松维护系统健康,提升整体使用效率。
方法二:多图串联分析
上传全部截图后,在prompt中明确指令:“对比1_首屏、2_核心卖点、3_参数对比三张图,输出:①文字密度最高区域TOP3及对应文案类型(标题/价格/促销语/技术参数);②从左到右、从上到下的视觉阅读顺序编号;③每张图中按钮/跳转入口的数量与位置特征”。
提交后等待12~18秒,模型返回结构化JSON结果,含文字块、坐标、分类标签和关系判断。
清洗并结构化M3输出结果
第一步:用Python脚本过滤无效字段
加载返回的JSON,删除所有text字段为空、或confidence低于0.65的条目。这一步必须做,否则低置信度识别会污染后续归类。
第二步:合并跨图卖点关键词
遍历全部图片的文字结果,提取含“独家”“专利”“首发”“行业首款”等强主张词的短句,去重后按出现频次排序,生成《竞品核心主张热力表》。
第三步:还原视觉动线路径
依据每张图中文字块的y坐标均值分层(如0–300px为L1层,301–600px为L2层),再按x坐标排序同层内元素,最终输出类似“L1→L2→L1→L3”的跨层跳转模式——这直接对应用户滑动时的注意力回收路径。
第四步:导出可编辑表格
将坐标数据转为Excel,插入“图片名称”“文字内容”“所属模块(首屏/信任背书/场景图)”“是否带数字(是/否)”四列,方便后续交叉筛选。










