程序聚合 软件案例 眼底疾病智能诊断系统

眼底疾病智能诊断系统

2025-06-30 01:32:55
行业:医疗健康
载体:网站、算法模型
技术:JavaScript、Node.js、Python、PyTorch

业务和功能介绍

业务亮点和立项原因:随着人口老龄化,我国眼科疾病患病人数攀升,医疗资源分布不均问题突出。高水平医院眼科医生工作负担重,漏判、误诊等问题频发,且专业医生培养周期长、数量有限。传统诊断模式依赖肉眼观察眼底图像,耗时耗力且易受主观因素影响。基于此,本项目借助深度学习技术,开发眼科疾病智能诊断系统,以实现对多种常见眼科疾病及正常眼底的准确识别,提升诊断效率和准确性,减轻医生负担,降低误诊漏诊率,缓解医疗资源紧张问题。
立项过程和沟通过程:项目团队与眼科专家、医生、医疗机构管理人员及患者深入交流,收集各方需求。了解医生诊断痛点、医疗机构对系统功能的期望以及患者对诊断流程的需求。同时调研市场现有系统优缺点及行业趋势,明确项目方向。与潜在合作的医疗机构沟通,介绍项目理念和技术优势,探讨合作可能性,根据其反馈优化项目方案,最终确立项目。
具体功能模块及使用者功能
图像处理功能:对眼底图像进行轮廓裁剪、CLAHE 处理和双目拼接,提取视盘区域,消除光照不均干扰,增强血管纹理细节,实现左右眼图像空间对齐,为诊断提供清晰统一的图像。
疾病检测功能:支持单张或批量图像上传,通过多标签分类能力判别 7 类眼科疾病与正常类别,允许单张图像存在多个病理标签,精准诊断复杂病例。
报告生成功能:快速生成详细诊断报告,支持打印和 PDF 格式导出,方便医生查看、存档及与患者沟通。
历史记录查询功能:便捷查询历史检测记录,包括时间、诊断结果和 AI 建议,便于病情复核与长期存档。
诊断建议功能:集成医疗大模型,依据诊断结果生成个性化治疗建议和健康管理方案,提升患者依从性和诊疗效率。
疾病科普功能:提供常见眼病的详实介绍,包括示意图和文字说明,点击 “了解更多” 可跳转至百度百科获取更多资料。
主要功能路径:用户上传眼底图像,系统对图像进行预处理(轮廓裁剪、CLAHE 处理、双目拼接),然后通过深度学习模型进行疾病检测,生成诊断结果,基于诊断结果生成诊断建议和报告,同时将检测记录存储以便用户查询。用户还可通过疾病科普功能了解相关眼病知识。

项目实现

参与人数:团队共 5 人,包括算法工程师、前端开发工程师、图像处理工程师、产品设计师和数据分析师。
开发周期:从 2025 年 1 月 1 日开始,到 2025 年 4 月 14 日结束,约 3 个半月。
我的任务:负责 AI 诊断模型的设计与调优,选用 EfficientNet-B4 和 Vision Transformer 模型,通过加权融合策略提升模型性能,处理类别不平衡问题,调整超参数,优化模型准确率、精确率和召回率,确保模型在测试集上达到预期性能指标。
技术栈、架构、亮点及难点
技术栈
后端:Flask 框架、PyTorch 深度学习框架、MySQL 数据库、Redis 缓存。
前端:HTML/CSS/JavaScript、Vue.js。
图像处理:OpenCV、NumPy。
模型训练监控:TensorBoard。
架构:采用前后端分离架构,后端负责数据处理、模型推理和业务逻辑,前端负责用户交互和数据展示,通过 RESTful API 接口实现前后端数据交互。
亮点
模型采用 EfficientNet-B4 和 Vision Transformer 加权融合策略,结合两者在细节提取和全局关联建模的优势,提升分类精度和鲁棒性。
针对类别不平衡问题,引入类别权重和 Focal Loss 损失函数,提高模型对少数类疾病的识别能力。
系统功能丰富,集成图像处理、疾病检测、报告生成等多种功能,满足医疗机构、医生和患者的多样化需求。
难点
眼底图像预处理:需要解决亮度不均、噪声去除、双目图像对齐等问题,确保输入数据质量。
模型训练:处理类别不平衡问题,优化超参数,提高模型泛化能力,确保在测试集上达到高精度。
系统集成:将前端、后端和模型训练部分集成,确保系统稳定运行,响应速度快。

示例图片视频


William
30天前活跃
方向: 后端-Python、人工智能-机器学习与深度学习、
交付率:100.00%
相似推荐
智能交互大屏-智能交互大屏
本项目为自研首款 8K 智慧云屏配套客户端软件,采用高规格 8K 显示、一体式硬件整机架构及 X86 安卓 + Windows 双系统共享硬件方案。基于 WPF 技术栈从零打造大屏全套软件体系,覆盖白板书写、屏幕批注、系统设置、Launcher 桌面、侧边栏快捷工具、分屏交互、OTA 固件升级、设备集控、外设管控等 20 余个应用模块与核心功能组件,满足政企会议、智慧办公、工业数字孪生等场景下的高清交互、设备管控、系统运维需求,实现高分辨率触控终端的智能化、一体化软件体验。
水利大模型通用管理平台
项目背景 面向水利行业的 TF 数学模型统一管理平台,将 Python 水利建模文件统一解析、调度与运行,为业务系统提供标准化模型调用与结果管理。为政府水利项目提供充实的保障和便利。 负责 Python 模型文件解析与统一调度接口开发,通过 ProcessBuilder 调用 Python 执行引擎实现模型运行。  参与模型元数据管理与版本控制模块设计,支持模型上传、存储与生命周期管理。  协助完成 GaussDB 数据持久化与 Redis 缓存集成,参与前后端接口联调与自测。  基于 Spring Boot 线程池与 Redis 分布式锁实现多模型并发调度,全局异常拦截返回标准化错误码。
某企业大气污染防治管控系统
基于“数字孪生”等先进信息化技术手段,全面推进企业环境保护工作的数字化能力建设,用数据支撑生态环境保护工作开展,全过程可视可查;不断提升和完善自我动态监测能力,动态感知环境状况,环境风险第一时间发现、第一时间预警、第一时间响应,持续提升环保水平,推动区域和行业高水平发展。
大模型驱动的工业数字孪生平台-LLM Digital Twin
面向智能制造与物联网演示的数字孪生平台,支持用自然语言直接控制虚拟与真实设备。 核心功能:①LLM Agent解析自然语言指令,自动映射为设备操作;②MQTT总线实时同步设备状态,指令下发毫秒级响应;③Three.js三维场景实时渲染,设备状态一屏总览;④Webots仿真环境真机联调,支持虚实融合验证。适用于工厂产线可视化、智能家居演示与物联网教学场景。
无人机管控综合大屏平台-无人机管控综合大屏平台
技术栈:Vue3 + TypeScript + Element‑Plus + OpenLayers + Cesium + ECharts + WebGL + GLSL + GeoServer + PostGIS + Java + Nginx + ArcGIS 平台面向集团水电业务,构建二三维一体化无人机管控系统,实现空间数据服务管理、无人机任务全生命周期管理、机库设备实时监控、飞行航线规划、安全冲突评估、巡检成果可视化、多维统计分析。 1. 二三维地图模块:Cesium 承载三维地形场景,OpenLayers 负责二维业务地图;基于 WebGL/GLSL 自定义着色器,实现管线、航线、巡检区域特效渲染;对接 GeoServer 发布 WMTS/WFS 空间服务,PostGIS 存储管理点位、航线、巡检区域等空间矢量数据;兼容 ArcGIS 各类空间数据格式。 2. 无人机业务模块:机库站点树管理、无人机设备实时状态监控、机库视频预览;业务需求录入、航线航点编辑、空域 / 时间 / 航线三重安全评估;任务拆分、子任务冲突校验、设备指派下发;飞行任务列表管理,展示里程、时长、告警信息,查看图片视频巡检成果。 3. 可视化大屏模块:资源指标概览、任务多维度统计图表,任务类型、任务状态、飞行趋势、机库能力排行、隐患处置排行,支撑运维决策。 4. 后端服务:Java 提供业务接口,PostGIS 处理空间查询、空间计算;Nginx 做反向代理、静态资源、地图服务代理。
帮助文档   Copyright @ 2021-2024 程聚宝 | 浙ICP备2021014372号
人工客服