5天前活跃

鸮sic

• UID:33484
综合评分 34
方向: 爬虫/脚本-爬虫/脚本
成都市
200元/8h
1年经验
求职意愿:接单·不求职(15天前更新)

个人简介

核心技能:Python数据采集、Playwright浏览器自动化、curl_cffi反爬应对、Pandas数据清洗、Excel批量处理、数据导出校验、自动化脚本与工具开发。 承接场景:网页数据批量采集与整理、多表格合并比对、无水印视频批量下载、定时自动采集与提醒、数据报表生成。 工作方式:先跑样本确认效果再进行后续合作,交付时附带数据校验报告,同款数据支持免费修改一次。长期接单,响应及时,白天晚上的单子都能处理。

技能

核心技能:
其他技能: Python、C、C++、JavaScript
交流语言: 普通话( 母语水平 ) 英语( 母语水平 )
行业经验: 人工智能

项目案例

多站点数据采集与批量处理系统-医保定点机构数据平台
立项背景:医保定点机构数据分散在各地政务平台,查询页面为动态渲染且分页较深,人工整理效率低、易漏录,无法满足行业分析对数据完整性及准确性的要求。 功能目标:构建覆盖多省份政务站点的定点医疗机构自动采集系统,实现机构名称、医保区划、机构等级、信用代码、地址等核心字段的批量结构化落库。 核心模块:①调度模块:配置驱动的任务分发与页码范围控制;②采集模块:浏览器渲染结合接口截获的双通道取数;③清洗模块:字段对齐、去重、空值统计;④导出模块:Excel/CSV/TXT 多格式输出并附数据校验报告。 业务流程:用户配置目标站点与字段 → 系统自动翻页采集 → 双数据源交叉校验合并 → 异常增量补抓 → 输出成果与质量报告,全流程无需人工干预。
医疗健康

工作经历

个人数据服务工作室(自由职业)
  
15-49人
Python数据工程师(自由职业)
2024.06 - 2026.09
独立承接网页数据采集、Excel批量处理、自动化脚本开发等数据服务。负责需求分析、采集方案设计、脚本编写、数据清洗校验与成果交付全流程。技术栈:Python、Playwright、curl_cffi、Pandas。已交付政务公开数据采集、医疗机构信息整理、视频批量下载工具、多表合并比对等多个项目,交付数据附校验报告,支持断点续抓与增量更新。

教育经历

沈阳理工大学
2025.09 - 2029.09
电子科学与技术
本科
相似推荐
佛山市
爬虫/脚本-爬虫/脚本
技能:Selenium WebDriver、Scrapy、Python、Selenium
广州市
Rpa-Rpa、爬虫/脚本-爬虫/脚本
技能:Python
苏州市
前端-Web前端、爬虫/脚本-爬虫/脚本
技能:C++、Python、JavaScript、C、Node.js
惠州市
爬虫/脚本-爬虫/脚本、人工智能-AI应用开发
技能:Java、Python
宁波市
低代码-低代码、爬虫/脚本-爬虫/脚本
技能:Python、JavaScript、Node.js
帮助文档   Copyright @ 2021-2024 程聚宝 | 浙ICP备2021014372号
人工客服