返回搜索
档案
一种基于任务奖励反馈的流数据轻量交互学习调度方法
发明专利有效
10权利要求 · 1 独立
§ Ⅰ
卷宗概要
发明人
李帅; 王子龙
IPC 分类
G06F 9/48 (2006.01)G06F 17/10 (2006.01)
本发明公开了一种基于任务奖励反馈的流数据轻量交互学习调度方法,涉及资源调度领域,本方法不再依赖固定的任务优先级或单一的历史平均值,而是为每个任务类型维护一个随时间变化的奖励置信区间;该区间在任务每次完成后,根据获得的真实奖励,通过严格的数学公式进行更新;区间宽度反比于执行次数的平方根,执行越多,区间越窄,估计越准,这使得算法能在线学习任务奖励分布的变化。本方法使调度决策能够始终保持较高的调度效率,克服了静态策略僵化、过时的缺点。