Retour au feed
Reddit r/MachineLearning·

Derivative-Free Neural Network Optimization: MNIST Case [R]

Signal
62
Hype
25
En 3 lignesOptimisation sans dérivées d'un réseau de neurones sur MNIST : architecture 784-32-10 (25 450 paramètres). MDP atteint 93,7% en validation et 93,4% en test, surpassant Adam (91,8%/91,7%). Convergence sur 1M évaluations sans gradients ni méthodes population-based.
Lire la source
Ton avis ?
BenchmarksOpen source

Résumé généré par Claude — vérifié par l'humain