用阶跃ai多模态功能拍照即可生成可排序搜索的电子清单,需竖排藏品、自然光拍摄、单图≤40个脊标,上传后输入csv指令或飞书捷径批量处理,最后人工校对导出。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

家里堆着上百张DVD、蓝光碟片和旧书,想做成可排序可搜索的电子清单,又不想花一整天手动敲标题?用阶跃AI的多模态功能,拍张照就能生成结构化表格数据,识别准确率高,操作路径清晰。
准备藏品与拍照
把碟片或书籍竖着排成一排,露出完整书脊或碟盒侧标——这是AI识别的关键前提,横放或堆叠会导致文字被遮挡,识别失败率陡增。
在自然光充足的地方拍摄,避免玻璃反光、手指遮挡或阴影覆盖文字区域;单张照片最多容纳40个脊标,超出易漏识,宁可多拍几张也不贪多。
【必须保证每行文字清晰可辨,模糊或倾斜超过15度的照片,AI会跳过整行不识别】
上传图片并调用Step-1o Vision
打开跃问App → 点击右下角“+”号 → 选择“图片创作” → 从相册选取刚拍好的照片。
上传完成后,在输入框中直接输入指令:“请识别图中所有实体物品的标题、作者/发行方、年份,按三列输出为CSV格式,不要额外解释。”
这一步不能只说“提取文字”,否则AI可能返回段落式描述而非表格结构;CSV格式能直接粘贴进Excel或飞书多维表格,省去二次整理。
批量处理多张图(飞书多维表格捷径法)
第一步:在飞书打开多维表格 → 新建字段 → 类型选“图片” → 点击右侧“字段捷径”图标。
第二步:勾选“阶跃星辰|图像理解” → 在Prompt模板里删掉默认描述,改写为:“提取本图中所有物品名称及对应年份,输出为两列JSON数组,键名为title和year。”
第三步:一次性上传5~8张藏品照片 → 点击“运行捷径” → 表格自动填充结果,每张图对应一行,字段值实时更新。
注意:飞书该功能免费开放,但单次最多处理10张图,超量需分批;若某张图识别异常,系统会在对应行标红提示,点击即可重新触发识别。
校对与导出
逐行检查AI输出的标题是否错字(如“《三体》”误为“《三休》”)、年份是否错位(常把条形码数字当发行年),重点核对相似封面的碟片。
确认无误后,在多维表格中全选数据 → 右键 → “导出为CSV” → 用Excel打开即可排序、筛选、加颜色标签。
这一步不可跳过——AI再强也依赖图像质量,人工扫一眼5分钟,比后期返工两小时更省力。











