검색으로 돌아가기
기록
基于强化学习的消化道病理诊断视觉语言大模型构建方法及其应用
발명유효
1조회수
10청구항 · 4 독립항
§ Ⅰ
개요
발명자
朱良慧; 欧阳旻禧; 查伟; 黄强; 王子晗
IPC 분류
G16H 50/20 (2018.01)G16H 50/70 (2018.01)G06T 7/00 (2017.01)G06V 20/69 (2022.01)G06V 10/82 (2022.01)G06N 3/092 (2023.01)G06N 3/0455 (2023.01)G06N 3/084 (2023.01)G06N 5/04 (2023.01)G06N 5/01 (2023.01)
本发明公开了一种基于强化学习的消化道病理诊断视觉语言大模型构建方法及其应用,属于医学图像处理技术领域。该方法首先通过版面分析与自适应阈值处理提取病理信息,重组为包含推理链条的结构化数据集;其次利用视觉编码器和多分支分类器提取特征及置信度,生成动态结构化提示词;最后将图像与提示词输入多模态大模型,进行监督微调热启动,并采用组相对策略优化算法配合包含格式、语义及诊断维度的复合奖励函数进行强化学习训练。本发明解决了通用模型在病理场景下易产生幻觉且缺乏推理逻辑的问题,显著提升了病理报告生成的准确性与逻辑性。