在excel里处理乱糟糟的零散文本,最省时间的办法根本不用手动挨个改,先搞清楚你手里的内容是要合并还是拆分就行——合并交给textjoin,拆分交给textsplit,一个负责拼一个负责切,平时整理名单、合并地址、清洗字段、批量重组内容,大部分活靠这俩就能一次搞定。
这两个函数特别适合处理员工名录、商品规格、省市地址、题库答案、部门成员表这类看起来是纯文本,实则暗藏结构的内容。提前把要用的分隔符、空值处理规则和最终要的结果想明白,之后不管是把多列并成一列,还是把单格里塞的一堆信息拆成多列,套完公式之后数据更新结果也会自动跟着变。
第一步:先分清这一格内容是要拼接还是要拆分
动手前先做个超简单的判断:如果现在你对着好几格分散的内容,要汇总成一格结果,优先用TEXTJOIN;如果是单格里塞了一大堆信息,要拆成多列多行,直接找TEXTSPLIT。方向选错了,公式越写越绕,到最后全删了重写反而更省事。
TEXTJOIN的核心逻辑是「按你指定的分隔符,把多段文本拼到一起」,TEXTSPLIT刚好反过来,「按指定分隔符,把一整段文本切成好几段」。这俩经常搭配着用,尤其是批量清理旧表格的时候,先拆再拼、先拼再拆的操作都很常见。

第二步:先用 TEXTJOIN 把符合条件的内容合成一格
筛选名单、汇总部门成员这类场景,TEXTJOIN最实用的写法就是直接把符合条件的内容拼成一格。就像图里的操作,先判断哪些人属于目标城市,再把满足条件的姓名按顿号或者逗号连起来。原本散在不同行的数据,直接就能生成一条可以复制、可以发消息、还能后续直接引用的结果。
这里一定要注意第二个参数,也就是「是否忽略空值」,绝大多数整理场景都建议填TRUE,不然筛选出来的空白位置也会被带进结果里,最后出来的不是干净的名单,全是多余的分隔符。

第三步:把多列地址或字段一次性拼成标准文本
如果你的表格本来就是按省、市、区、详细地址分开存的,用TEXTJOIN做标准化输出最合适。直接把多列地址按空字符或者你要的符号拼起来,就能得到一条完整地址。做发货表、报名表、客户清单的时候这个用法出场率特别高,毕竟你经常需要把好几列的信息合并成一列,用来导出或者粘贴到别的系统里。
这种场景下分隔符选空格、短横线还是什么都不加,全看你最终要把结果用在哪。如果是要导入别的系统当字段,尽量用纯文本最稳妥;如果是给人看的,适当加分隔符反而更好读。先确定好最终要的格式再写公式,后面就不用反复改来改去重拼。
本文档主要介绍如何通过python对office excel进行读写操作,使用了xlrd、xlwt和xlutils模块。另外还演示了如何通过Tcl tcom包对excel操作。感兴趣的朋友可以过来看看

第四步:遇到一格里混着多种符号时,用 TEXTSPLIT 统一拆开
不少旧表格最麻烦的不是没分隔符,是分隔符乱得很:有的用顿号,有的用逗号,有的用分号,甚至同一格里同时混好几种。这时候别手动挨个替换了,直接让TEXTSPLIT按多种分隔符一起拆。先把整段内容拆成独立的字段,后面筛选、排序、重组才能做干净。
写这种公式的时候,先把你表格里实际出现过的所有分隔符都列全,别只盯着当前这一行内容。只写一种分隔符,看着当前行拆分正常,等碰到下一行格式不一样,结果直接就歪了。与其后面反复改公式,不如一开始就把所有常见的分隔符一次性处理完。

第五步:拆完以后再配合 TEXTJOIN,把结果重新整理成标准句子
TEXTSPLIT真正好用的点,不只是把内容切开,拆完之后还能直接交给TEXTJOIN重新整理。像处理题库、答案库、清洗名单这类场景,经常先把原始文本拆成一个个独立片段,删掉没用的符号或者空项,再重新拼成符合要求的标准结果。这么做出来的内容,比手动替换、逐格复制粘贴稳太多。
要是你发现原始文本里既有多余空格,又混着不同分隔符,最稳妥的流程就是先拆、再筛、最后拼。别想着一条公式把所有活都干了,每一步分工明确:TEXTSPLIT负责把乱掉的结构还原,TEXTJOIN负责输出最终结果。之后要改字段、改顺序、改分隔符都特别方便。

第六步:需要把混合内容重组成表格时,再把 TEXTSPLIT 往深一步用
有些内容不是简单拆成几列就完事了,得把一长串混在一起的内容重新做成规整的行列结构。比如部门和成员混着排、标签和明细交替出现的内容,手动复制很容易搞错位。这时候TEXTSPLIT可以搭配其他文本函数,按原始顺序把内容全拆开之后,重新铺成结构化表格,得到的结果后续还能直接用来统计、筛选、做透视表。
这一步不用每次都写得特别复杂,核心思路记住就行:只要原本的文本自带顺序和层级,TEXTSPLIT就不只是「把单格内容切开」这么简单,它能直接把你从一团乱的混合文本里拉出来,重新得到规整的结构化数据。内容结构化之后,不管是写公式、筛数据还是做图表,都顺手很多。

TEXTJOIN和TEXTSPLIT真正能提效率的地方,不是死记两个函数名,而是养出固定的处理逻辑:多列转一列先想怎么拼,单格转多列先想怎么拆,格式乱了就先拆干净,再按最终需求重新拼回去。这个逻辑熟了之后,再碰到内容乱的复杂表格,你很快就能找到下手的地方。










