Skip to content

Folders and files

NameName
Last commit message
Last commit date

Latest commit

 

History

62 Commits
 
 
 
 
 
 
 
 
 
 

Repository files navigation

机器人与具身技能技术

欢迎来到深圳技术大学 IBW0009机器人与具身技能技术 (AI微专业) 的课程主页!

课程通知

  • [2026-3-6] 课程网站发布。
    Archived News - **[2026-3-6]** 课程网站发布。

课程信息

项目 细节
教师 马漫游
助理教授, 深圳技术大学 人工智能学院
Email: mamanyou@sztu.edu.cn
办公室: Room 1717, C1 (人工智能学院)
答疑时间: 周一 2:00 pm - 3:00 pm
时间 周六第三、四、五节 (10:15–12:25)
学分 3
评分 出勤: 10% ; 实验报告: 50% ; 课程汇报: 10% ; 课程项目或论文: 30%

课程资料

课程序号 理论课程 实验内容
01 (3月7日) 第1讲 具身智能基础幻灯片 强化学习基础 幻灯片 OpenAI Gym入门 实验
02 (3月14日) 第2讲 状态价值与贝尔曼方程 幻灯片 冰冻湖环境 I 实验
03 (3月21日) 第3讲 贝尔曼最优方程 幻灯片 冰冻湖环境 II 实验
04 (3月28日) 第4讲 价值迭代与策略迭代 幻灯片 冰冻湖环境 III 实验
05 (4月4日) 放假
06 (4月11日) 第5讲 蒙特卡洛方法 幻灯片 冰冻湖环境 IV 实验
07 (4月18日) 第6讲 随机近似算法 幻灯片 神经网络入门 实验
08 (4月25日) 第7讲 时序差分方法 幻灯片 CarPole环境 实验
09 (5月2日) 放假
10 (5月9日) 调休
11 (5月16日) 第8讲 基于价值的方法 幻灯片 Atari环境 实验
12 (5月23日) 第9讲 基于策略的方法 幻灯片 策略梯度推导 讲解
13 (5月30日) 第10讲 Actor-Critic方法幻灯片1、PPO与DPO 幻灯片2 REINFORCE Cartpole 环境 实验
14 (6月6日) 第11讲 机器人学习入门 幻灯片 Mujoco环境 DDPG 实验
15 (6月13日) 第12讲 变分推断与生成式策略 幻灯片 Mujoco环境 PPO 实验
16 (6月20日) 放假
17 (6月27日) 第13讲 扩散模型与扩散策略 幻灯片 LeRobot机械臂 ACT 实验
18 (7月1日) 第14讲 通用型机器人策略 幻灯片 LeRobot机械臂 DP 实验

About

No description, website, or topics provided.

Resources

Stars

Watchers

Forks

Releases

Packages

Contributors

Languages