TRAE 处理 Excel 时,我为什么坚持先转成 xlsx 再读

踩过 csv 的坑就不想再碰了。

坑一:编码。csv 中文一旦不是 UTF-8,读出来全是乱码,TRAE 还一脸无辜接着处理,错误直接传到最后。
坑二:类型推断。csv 里“2026-08-30”可能被当成字符串,“00123”开头的工号会被吃掉前导零变成 123,金额大的还可能被当科学计数法。这些在 csv 里没法固定。

所以我现在的流程:先用脚本(或让 TRAE 写个一次性脚本)把源文件规整成 xlsx,xlsx 能保住日期格式、数字格式、前导零,读的时候类型不再漂移。

批量处理的注意点:文件大时别一次性 load 进内存,按 sheet / 按块读;还有 xlsx 里常有隐藏空行和合并单元格,先让 TRAE 做一遍“空行清理 + 合并单元格展开”再处理,能少很多诡异 bug。

一句话:csv 留给人工看,机器处理用 xlsx。


标签:技巧分享

4 个赞