深度强化学习实践(原书第2版)在线阅读
会员

深度强化学习实践(原书第2版)

(俄)马克西姆·拉潘
开会员,本书免费读 >

计算机网络人工智能29万字

更新时间:2021-08-18 17:40:31 最新章节:25.7 总结

立即阅读
加书架
下载
听书

书籍简介

本书的主题是强化学习(ReinforcementLearning,RL),它是机器学习(MachineLearning,ML)的一个分支,强调如何解决在复杂环境中选择最优动作时产生的通用且极具挑战的问题。学习过程仅由奖励值和从环境中获得的观察驱动。该模型非常通用,能应用于多个真实场景,从玩游戏到优化复杂制造过程都能涵盖。
品牌:机械工业出版社
译者:林然 王薇
上架时间:2021-07-01 00:00:00
出版社:机械工业出版社
本书数字版权由机械工业出版社提供,并由其授权上海阅文信息技术有限公司制作发行

最新章节

(俄)马克西姆·拉潘
主页

同类热门书

最新上架

  • 会员
    本书从空间信息处理角度出发,将人工智能领域的理论研究与专业实践相结合,完整介绍人工智能方法及其在空间信息处理中的应用,不仅涵盖人工智能领域的基础概念与基本方法,而且探讨知识图谱、计算智能、新兴机器学习、深度学习等前沿技术,同时介绍人工智能在地理文本大数据、遥感影像、激光点云等空间信息处理中的应用实例,具有较强的代表性和启发性。本书可以作为高等院校空间信息与数字技术、遥感科学与技术等专业高年级本科生
    罗欣 侯卫民 许文波编著计算机23.8万字
  • 会员
    本书结合作者10多年写作经验,基于AI应用ChatGPT、文心一言、智谱清言、讯飞星火、通义千问、Kimi等,详细介绍了使用AI写作的流程、方法和技巧,旨在帮助想要通过内容输出加速个人发展的读者,快速掌握AI自媒体写作的方法和技巧。本书分为11章,涵盖AI自媒体写作概述、AI提示词、AI起标题、AI做选题、AI角色化写作、AI套路化写作、AI仿写、AI模块化写作、AI改写、AI润色、AI智能体写作
    安晓辉计算机9.2万字
  • 会员
    本书着重阐述了深度学习时代的计算机视觉算法的工作原理,首先对深度学习与计算机视觉基础进行了介绍,之后对卷积神经网络结构的演化过程,以及基于深度学习的目标检测算法、图像分割算法、人体姿态估计算法、行人重识别与目标跟踪算法、人脸识别算法以及图像超分辨率重建方法进行了介绍。本书系统讲解了在日常生活和工作中常见的几项计算机视觉任务,并着重介绍了在当今深度学习时代,这些计算机视觉任务是如何工作的,可使读者快
    徐从安 李健伟 董云龙 孙超等计算机9.9万字
  • 会员
    本书从技术、应用和产业3个维度为切入点,对智能语音语义领域相关的热点和趋势展开研究。本书以“人与机器的对话”开篇,讲述人类语音生成、传播和感知的过程,引发对于机器智能语音听说的思考,进而阐述技术探索发展史;然后,分析了以语音交互为核心的技术现状,综合剖析提出全双工、端到端模型构建、语音假冒攻击等热点;其次,从政策、投融资和产业规模上,分析整体智能语音产业环境,纵观国内外企业在相关技术和产品上的积极
    李荪 曾然然 殷治纲编著计算机13.6万字
  • 会员
    随着ChatGPT等人工智能和语言模型不断进步,了解这些技术的含义和潜在陷阱比以往任何时候都更加重要。作为享誉全球的跨技术和设计学科思想家,前田约翰利用他的丰富经验,为企业、产品设计师和决策者提供了可行的指导。通过深思熟虑和偶尔异想天开的例子,他构造了一个可以描述任何机器学习系统的关键功能的框架,并展望了可以如何使用它们来创造富有包容性和改变世界的产品。对任何想要深入了解机器如何“思考”以及未来可
    (美)前田约翰计算机9.6万字
  • 会员
    本书从写作与ChatGPT的基础知识讲起,结合创作者的实际写作经历与写作教学经历,介绍了用ChatGPT写作的基础技巧、进阶写作的方法、不同文体的写作方法、写作变现的秘诀,让读者理解写作技巧与变现思路。
    无戒 杜培培 俞庚言计算机14.7万字
  • 本书是一本深度探讨大模型在低算力环境下实现迁移与微调的实践指南,并深入讲解了大模型的部署与优化策略。书中结合多个垂直领域的应用场景,从理论到技术实现,全程详尽讲解了如何应对大模型在行业落地中的技术挑战,帮助读者逐步掌握大模型的迁移与微调核心技术。无论你是大模型开发者、人工智能研究人员,还是对垂直领域AI应用感兴趣的行业专家,本书都将带你深入大模型的核心领域,提供从构建、优化到部署的全流程指导,助你
    程戈计算机13.7万字
  • 会员
    在人工智能技术的大力驱动下,智能控制与强化学习发展迅猛,先进自动化设计与控制日新月异。本书针对复杂离散时间系统的优化调节、最优跟踪、零和博弈等问题,以实现稳定学习、演化学习和快速学习为目标,建立一套先进的值迭代评判学习控制理论与设计方法。首先,对先进值迭代框架下迭代策略的稳定性进行全面深入的分析,建立一系列适用于不同场景的稳定性判据,从理论层面揭示值迭代算法能够实现离线最优控制和在线演化控制。其次
    王鼎 赵明明 哈明鸣 任进计算机8.7万字
  • 会员
    本书共分为9章,内容涵盖三个层次:介绍与解读、入门学习、进阶提升。第1-2章介绍与剖析了ChatGPT与提示工程,并从多个学科的角度探讨了提示工程学科。第3-5章演示了ChatGPT的实际运用,教你如何使用ChatGPT解决自然语言处理问题,并为你提供了一套可操作、可重复的提示设计框架,让你能够熟练驾驭ChatGPT。第6-9章讲解了来自学术界的提示工程方法,以及如何围绕ChatGPT进行创新。
    陈颢鹏 李子菡计算机9.7万字