
pandas 排障证据保留输入、版本与中间结果pandas 报错有时很直白更多时候是结果悄悄多了一行或少了一列。排障第一步不是继续改链式表达式而是把问题缩到可以复现。切出最小失败样本从原数据保留能触发问题的列和少量行同时保存 dtype、索引与排序状态。脱敏不能改变 NULL、重复键或字符串格式否则样本会失去问题特征。中间结果要有路标在 merge、groupby、explode 等边界记录行列数和关键字段摘要。临时输出不必长期保留但排障记录应说明在哪一步首次偏离预期。保存 Python、pandas 和读写引擎版本。记录 warning而不是只截最后的异常。固定随机种子和时间参数。复现后再改一处先在原环境稳定复现再只调整一个操作。修复完成后把失败样本加入回归测试并删除可能包含敏感数据的临时文件。有效证据不等于日志越多越好。能让另一个人重现同一偏差、看到同一中间状态就够用了。