POLICY PLAYBACK
学习。
从数学与模型,到感知、生成和控制。
读理论,做实验,亲手求解。
强化学习
价值、策略与决策。
从多臂老虎机到 PPO。
视觉检测
图像、特征与物体。
从检测基础到 YOLO、DETR。
SLAM
位置、运动与地图。
视觉、激光与惯性融合。
深度学习基础
从一次参数更新开始。
CNN、RNN、Transformer、GNN。
大模型
从语言建模到视觉与声音。
对照技术报告与公开实现。
生成模型
从概率分布中画出新样本。
采样、似然与潜变量。
机器人与控制
让运动按你的目标发生。
反馈、PID 与稳定性。
群论
从旋转与翻折,认识对称。
子群、置换、商群与群作用。
拓扑学
形状改变,什么仍然不变?
连续、连通、紧致与基本群。
理论课程公开阅读,无需注册。练习与项目需邀请码,运行和草稿保存在当前设备。
REINFORCEMENT LEARNING
强化学习
从理论到代码,再到亲手训练智能体。
13开放课程
84代码练习
50理论章节