Retour au feed
arXiv cs.LG·

Alpha-RTL: Test-Time Training for RTL Hardware Optimization

Signal
82
Hype
18
En 3 lignesAlpha-RTL introduit TTT-RTL, un framework d'apprentissage par renforcement au moment du test pour optimiser la génération RTL par LLM. Sur RTLLM v2.0 (Nangate 45nm), TTT-RTL réduit le produit PPA de 65,1% vs référence et surpasse les baselines gelées de 26,1%. Sur XuanTie C910 FPU (Sky130), réduction ADP de 59,4%. Contrôleur KL-budget adaptatif stabilise les mises à jour de politique.
Lire la source
Ton avis ?
Génération de codeReinforcement learningBenchmarksPapers

Résumé généré par Claude — vérifié par l'humain