Xiangxin Zhou
2 indexed papers
Publications per year
Top categories
Frequent co-authors
Research Timeline
This paper introduces MeanFlowNFT, a method that applies reinforcement learning to MeanFlow generators to improve performance and consistency.
The paper introduces SceneActBench, a benchmark for evaluating vision-language model agents' ability to perform actions on multi-object 3D scenes.
Papers
SceneActBench: Can Agents Act on the 3D Scenes They See?
Yifei Zhao, Xiangxin Zhou, Wenhao Yang, Jiaqi Tang +10 more
The paper introduces SceneActBench, a benchmark for evaluating vision-language model agents' ability to perform actions on multi-object 3D scenes.