跳转到内容
N.W.wolf XJTUROBOCON 四足组文档
搜索
Ctrl
K
取消
GitHub
选择主题
深色
浅色
自动
文档首页
团队与招新
团队与招新介绍
关于四足机器人
关于 ROBOCON
入门学习
入门学习概览
初期培训文档索引
开发基础
任务
Linux 系统及其操作:任务安排
开发基础概览
Linux 系统及其操作
Git/GitHub
Python/C++ 概念
计算机网络及 SSH
AI 与 Agent 协作
AI 与 Agent 协作概览
AI 与 Agent 基础认识
AI 工具选择与快速上手
与 AI 和 Agent 协作
机器人软件基础
机器人软件系统概览
机器人状态、关节与坐标系
机器人程序运行与数据流
ROS 2 快速认识与实践
四足强化学习与仿真
章节概览
基础理解
四足运动控制中的强化学习
强化学习的交互与训练机制
四足强化学习任务的定义与组成
仿真与任务构建
仿真环境与机器人模型
环境状态与策略观测
策略动作与关节控制
运动指令与任务目标
奖励函数与回合机制
策略训练
PPO 与 Actor-Critic 方法
策略训练流程
训练参数与实验管理
策略评估与实验记录
泛化与迁移
地形建模与课程学习
域随机化与扰动建模
跨仿真器迁移与验证
仿真到实机迁移
强化学习理论进阶 *
进阶资料概览
贝尔曼方程
动态规划
蒙特卡洛方法
时序差分方法
多步时序差分
资格迹与 TD(λ)
Dyna-Q
值函数近似
DQN
DQN 改进方法
策略梯度
Actor-Critic
实机部署与调试
内容占位
定位、导航与感知
内容占位
机械臂基础与控制
章节概览
概念速览
刚体变换与矩阵
SolidWorks → URDF
正向运动学(FK)
逆向运动学(IK)
视觉引导感知
轨迹规划
控制基础
电机驱动
架构总览
运动学引擎
视觉感知管线
控制模式设计
任务编排
MuJoCo 仿真基础
工程实践
内容占位
参与协作
怎样协作文档
文档模板
GitHub
选择主题
深色
浅色
自动
实机部署与调试
本章节框架已建立,具体内容将在后续协作中补充。