业务和功能介绍(精简)
本项目针对原神官网角色配音信息分散,人工整理效率低的问题,目标是爬虫自动抓取角色的中配、日配配音人员数据。项目包含网络请求、数据解析、数据存储三大模块。业务流程:请求官网页面获取数据源,解析提取角色名称、中配、日配信息,清洗无效数据后保存,实现批量采集配音资料,替代手动复制整理工作
项目使用Python,基于requests、BeautifulSoup、pandas库开发。我负责接口请求、配音信息提取与数据保存,完成批量角色配音数据采集并导出csv表格。开发时遇到页面动态加载拿不到完整数据,部分角色配音字段缺失引发报错的问题。通过调用后端JSON接口获取真实数据,增加空值判断容错处理,避免个别缺失数据导致程序崩溃,保障爬虫稳定运行。