POLICY PLAYBACK
学习。
从数据与模型,到感知、生成和控制。
理论、实验,还有你的代码。
强化学习
价值、策略与决策。
从多臂老虎机到 PPO。
视觉检测
图像、特征与物体。
从检测基础到 YOLO、DETR。
SLAM
位置、运动与地图。
视觉、激光与惯性融合。
深度学习基础
从一次参数更新开始。
CNN、RNN、Transformer、GNN。
大模型
文本怎样成为训练数据。
对照技术报告与公开实现。
生成模型
从概率分布中画出新样本。
采样、似然与潜变量。
机器人与控制
让运动按你的目标发生。
反馈、PID 与稳定性。
理论课程公开阅读,无需注册。代码练习与项目需邀请码,运行和草稿保存在当前设备。
REINFORCEMENT LEARNING
强化学习
从理论到代码,再到亲手训练智能体。
13开放课程
84代码练习
50理论章节