招生录取数据往往同时存在系统字段、中文51列目标表、年度计划表和多套统计口径,人工复制容易出现前导零丢失、专业培养类型混并、招生类别串表和隐私泄露。项目目标是将一次性人工整理改造成可审计的本地自动化流程。系统包含系统字段到51列标准表的转换、表1至表10统一生成、年度专业与学科门类映射、特殊招生边界、异常审计、严格模式和绿色版图形界面。用户在本机选择原始总表及计划/映射文件,程序按字段名读取和标准化,生成新结果文件及不含姓名、证件号的审计文件;源表不被覆盖。对学校市区等无法确认的信息保留未解决状态,不用猜测填充。展示图片全部使用空白模板或合成数据,不含真实考生信息。
我负责将原来分散的转换、前六表和后四表逻辑统一为 generate_ten_reports.py,并维护 convert_admission.py、generate_admission_reports.py、generate_remaining_reports.py 三个底层模块。技术上使用 openpyxl/xlrd 兼容 xlsx、xls 与 xlsm,按字段代号而非固定列序匹配;身份证号、考生号、电话和邮编按文本写出,避免科学计数法及前导零丢失。业务层把普通招生、运动训练、足球运动、3+证书和专升本设置为明确边界,并把专业培养类型冲突、计划口径、分数字段和志愿解析写入审计。工具可一次生成表1—表10及审计,另提供51列转换与免安装绿色版;当前代码库配套22项静态测试用例。难点是年度规则多、模板格式强、真实数据敏感,我采用本地处理、只新建输出、脱敏审计、严格模式和空白/合成回归分层验证。2027扩展包覆盖31个模板工作簿、76张基准工作表,但该数字仅表示模板/合成验证范围,不代表真实生产上线。