検索に戻る
案件記録

基于强化学习的工业产品取样方法和装置

発明有効
9請求項 · 4 独立
§ Ⅰ

案件概要

発明者

黄震; 陈玉涛; 马达

IPC分類

G06Q 10/063 (2023.01)G06N 5/022 (2023.01)G06N 3/0499 (2023.01)G06N 3/092 (2023.01)G06N 3/006 (2023.01)

本公开的实施例公开了基于强化学习的工业产品取样方法和装置。该方法的一具体实施方式包括:构建工业产品知识图谱;针对每个用户实体,执行以下步骤:将用户实体的嵌入向量确定为当前状态;针对当前状态,执行以下循环步骤:生成当前状态对应的连续动作向量;利用连续动作向量采样工业产品知识图谱的新实体;确定当前状态、新实体和动作向量对应的奖励信息;构建对应的经验元组;将新状态作为当前状态继续执行上述循环步骤;更新初始工业产品推送智能体,得到目标工业产品推送智能体;驱动取样机器人抓取与工业产品清单相关的样品至样品展台。该实施方式提升了取样工业产品的精准度,减少了取样的时间,提高了用户体验。

外部リソース