Retour au feed
arXiv cs.AI·

SVoT: State-aware Visualization-of-Thought for Spatial Reasoning via Reinforcement Learning

Signal
72
Hype
25
En 3 lignesSVoT est un framework de reinforcement learning pour améliorer le raisonnement spatial des MLLMs. Il génère des états intermédiaires vérifiables et des visualisations via chaînes de raisonnement de transition. Entraîné avec GRPO, SVoT atteint 65% de gain de précision sur des domaines étendus (Pacman, Gather) nécessitant interactions multi-objets.
Lire la source
Ton avis ?
Reinforcement learningVisionRaisonnementBenchmarks

Résumé généré par Claude — vérifié par l'humain