Progress-SQL: Improving Reinforcement Learning for Text-to-SQL via Progressive Rewards
Signal
72
Hype
18
En 3 lignesProgress-SQL propose un cadre d'apprentissage par renforcement multi-tour pour la génération Text-to-SQL. La méthode introduit un arbre de diagnostic guidé par oracle (ODT) qui abstrait les requêtes SQL au niveau des clauses et fournit des récompenses progressives mesurant l'amélioration du SQL initial au final. Évaluée sur BIRD, Spider et variantes robustesse.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain