POLICY PLAYBACK
学习。
强化学习、视觉检测、SLAM 与深度学习。
理论、实验,还有你的代码。
强化学习
价值、策略与决策。
从多臂老虎机到 PPO。
视觉检测
图像、特征与物体。
从检测基础到 YOLO、DETR。
SLAM
位置、运动与地图。
视觉、激光与惯性融合。
深度学习基础
从一次参数更新开始。
CNN、RNN、Transformer、GNN。
大模型
文本怎样成为训练数据。
对照技术报告与公开实现。
理论课程公开阅读,无需注册。代码练习与项目需邀请码,运行和草稿保存在当前设备。
REINFORCEMENT LEARNING
强化学习
从理论到代码,再到亲手训练智能体。
13开放课程
84代码练习
50理论章节