当前位置：首页 > article >正文

RL进阶（一）：变分推断、生成模型、SAC

article 2025/1/31 11:01:18

参考资料：视频课程《CS285: Deep Reinforcement Learning, Decision Making, and Control》第18讲、第19讲，Sergey Levine，UCerkeley

课件PDF下载：https://rail.eecs.berkeley.edu/deeprlcourse/

主要内容：变分推断、生成模型、以及Soft Actor-Critic。变分推断在model-based RL和inverse RL中也经常出现。

文章目录

1 概率与变分推断初步
- 1.1 概率隐变量模型(Probabilistic latent variable model)
- 1.2 变分推断(Variational inference)

http://www.kler.cn/a/318854.html

相关文章：

【C++动态规划离散化】1626. 无矛盾的最佳球队|2027

【C语言】内存函数

【张雪峰高考志愿填报】合集

STM32标准库移植RT-Thread nano

16、智能驾驶域控的材料回收

Haproxy入门学习二

ESXI主机加入VCENTER现有集群提示出现常规性错误

Vue 自定义指令实现权限控制

Redis哨兵详细理论实操教程

UE4_后期处理七—仿红外线成像效果

配置Docker镜像加速器

一个10k stars开源的证件照工具

【Go语言】Go语言结构体全面解析

9.24-k8s服务发布

C#|.net core 基础 - 深拷贝的五大类N种实现方式

streamlit 文件上传保存+预览

七层负载均衡和四层负载均衡的区别

苍穹外卖学习笔记(十一)

智谱AI：CogVideoX-2b——视频生成模型的得力工具

短视频矩阵源码/短视频矩阵系统搭建/源码开发知识分享

Github + Hexo + Shoka搭建个人博客以及遇到的部分问题

mysqldump使用cmd窗口和powersell窗口导出sql中文乱码的问题

工厂模式在短信发送中的应用 —— 以腾讯云、阿里云、华为云为例

Vue.js 中，@click 和 @click.stop的区别

Redis 多级缓存

可以把台式电脑做成服务器吗