搜索与时圣苗相关的论文

搜索筛选:

搜索耗时0.0963秒,为你在为你在102,285,761篇论文里面共找到 3 篇相符的论文内容

类型:

全部期刊学位会议报纸英文

发布年度:

全部 2024 2023 2022 2021 2020 2019 2018 2017 2016 2015 2014 2013 2012 2011 2010 2009 2008 2007 2006 2005 2004 2003 更早

排序方式:

相关性最新发表最早发表

面向深度强化学习的经验回放方法研究

[学位论文] 作者：时圣苗,, 来源：苏州大学年份：2020

深度强化学习方法将深度学习与强化学习相结合,目前已在多种复杂决策任务的处理中展现出了强大的通用性并取得了突破性的进展。利用深度神经网络构建网络模型并根据强化学习...

下载此文

一种加速时间差分算法收敛的方法

[期刊论文] 作者：何斌,刘全,张琳琳,时圣苗,陈红名,闫岩, 来源：自动化学报年份：2021

时间差分算法(Temporal difference methods,TD)是一类模型无关的强化学习算法.该算法拥有较低的方差和可以在线(On-line)学习的优点,得到了广泛的应用.但对于一种给定的TD算法,往往只能通过调整步长参数或其他超参数来加速收敛,这也就造成了加速TD算法收敛的方......

下载此文

一种加速时间差分算法收敛的方法网络首发

[期刊论文] 作者：何斌,刘全,张琳琳,时圣苗,陈红名,闫岩, 来源：自动化学报年份：2019

...

下载此文

看过本文同时还关注