diff --git a/src/scripts/postprocess_existing_output.py b/src/scripts/postprocess_existing_output.py index 80074d2..3e45132 100644 --- a/src/scripts/postprocess_existing_output.py +++ b/src/scripts/postprocess_existing_output.py @@ -27,8 +27,17 @@ else: df = pd.read_csv(input_path, dtype=str, keep_default_na=False) print(f"Loaded {len(df)} rows, {len(df.columns)} columns") -# Format date columns to YYYY/MM/DD -date_cols = [c for c in df.columns if "_DT" in c or "DATE" in c] +# Format CC-team-facing date columns to YYYY/MM/DD. +# Raw 1:1 extracted dates (EFFECTIVE_DT, TERMINATION_DT) and obscure date +# fields (OUTLIER_DT, DISCOUNT_*_DT, PREMIUM_*_DT, SEQUESTRATION_*_DT) are +# preserved as-is. +DATE_COLS_TO_FORMAT = ( + "AARETE_DERIVED_EFFECTIVE_DT", + "AARETE_DERIVED_TERMINATION_DT", + "REIMB_EFFECTIVE_DT", + "REIMB_TERMINATION_DT", +) +date_cols = [c for c in df.columns if c in DATE_COLS_TO_FORMAT] print(f"Formatting {len(date_cols)} date columns: {date_cols}") for col in date_cols: df[col] = df[col].apply(validate_and_reformat_date)