用 codexapp 自动清洗脏数据,要让它扫描空值、重复、乱码和格式异常,再确认清洗规则后生成新文件。合格结果应同时保留原始数据、清洗后数据和数量对比。
使用前要准备什么
原始文件被保留,新文件完成清洗,同时留下清洗规则或数量对比。
完成后怎么确认
数据清洗不是把所有异常一删了事。完整流程要包含识别、确认、输出和核对;缺失值、金额、日期和身份字段尤其不能随便推断。
如果页面和截图略有差异,优先看功能名称、按钮含义和输出结果。能进入对应功能并得到可继续使用的内容,就说明操作方向是对的。
操作流程
步骤一:把待处理数据放入工作目录,说明主键、关键字段和不能随意修改的列。

步骤二:让 Codex 扫描异常类型,列出空值、重复值、格式不统一、乱码和可疑行。
通过本地 Codex 或 OpenClaw OAuth 凭证直接调用 ChatGPT/Codex Responses 的 image_generation 工具来生成或编辑光栅图像,然后保存

步骤三:确认清洗规则后生成新文件,检查清洗前后行数、重复数量和异常记录。

使用提醒
重复数据一定要删除吗? 不一定,要看业务主键和合并规则。
清洗规则的留档方式
原始文件被保留,新文件完成清洗,同时留下清洗规则或数量对比。 这个结果达成后,再根据实际场景决定是否继续细化。比如代码类任务看测试,文件类任务看输出文件,内容类任务看是否还能继续编辑。
页面入口如果发生变化,优先找同名功能、设置项或账号权限提示,不要只按截图中的坐标操作。










