Retour au feed
arXiv cs.CL·

Progress-SQL: Improving Reinforcement Learning for Text-to-SQL via Progressive Rewards

Signal
72
Hype
18
En 3 lignesProgress-SQL propose un cadre d'apprentissage par renforcement multi-tour pour la génération Text-to-SQL. La méthode introduit un arbre de diagnostic guidé par oracle (ODT) qui abstrait les requêtes SQL au niveau des clauses et fournit des récompenses progressives mesurant l'amélioration du SQL initial au final. Évaluée sur BIRD, Spider et variantes robustesse.
Lire la source
Ton avis ?
Reinforcement learningGénération de codeRaisonnementBenchmarks

Résumé généré par Claude — vérifié par l'humain