HF blog·· 2026-08-31精选AI 评分71
VLAct:面向视觉语言动作模型的表征中心持续预训练
Paper page - Beyond Data Scaling: Representation-Centric Continued Pre-training for Vision-Language-Action Models
AI 导读
论文提出 VLAct,一种面向 VLA 的 VLM 骨干,在任务微调前用多本体机器人数据做持续预训练,通过保留 VLM 先验、多头连续动作协同监督和部分统一的跨本体动作布局来共享动作语义。
推荐理由
论文给出在固定机器人数据预算下以表征为中心的持续预训练路线,并附开源数据与16卡训练配置。
来源:HF blog · huggingface.co