SVoT: State-aware Visualization-of-Thought for Spatial Reasoning via Reinforcement Learning
Signal
72
Hype
25
En 3 lignesSVoT est un framework de reinforcement learning pour améliorer le raisonnement spatial des MLLMs. Il génère des états intermédiaires vérifiables et des visualisations via chaînes de raisonnement de transition. Entraîné avec GRPO, SVoT atteint 65% de gain de précision sur des domaines étendus (Pacman, Gather) nécessitant interactions multi-objets.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain