跳到正文
原文
arXiv cs.RO· Zhouyu Zhang, Chih-Yuan Chiu, Glen Chou·· 3 小时前AI 评分49

CF-KKT:无需不安全数据、基于最优性与反事实正则化的未知约束学习框架

Learning Unknown Constraints without Unsafe Data via Optimality and Counterfactual Regularization

AI 导读

CF-KKT 是一种约束学习框架,利用学习到的可微动力学模型在专家示范上施加 KKT 最优性条件,并通过生成奖励改进的反事实行为构造合成不可行数据,从而在无需已知动力学和额外风险探索的情况下恢复未知约束。

来源:arXiv cs.RO · arxiv.org