北大与微软亚研提出 BCP,让模型自己决定何时重规划 北大与微软亚研提出 BCP,让模型自己决定何时重规划 关键词: AI新闻,模型训练,Bernoulli-Continuation Policy,BCP 在 action chunking 已成为 VLA 标配的今天,「一次执行多少步」几乎被所有工作当作一个固定的超参数。 来自主题: AI技术研报 5585 点击 2026-08-20 14:22