Retour au feed
Reddit r/LocalLLaMA·

Nemotron - King of the Deep? Comparison of 4 models <=120B

Signal
72
Hype
25
En 3 lignesBenchmark de 4 modèles ≤120B sur contexte profond (jusqu'à 400k tokens). Nemotron Super 120B surpasse GPT-OSS 120B et Qwen 3.5 122B en vitesse de traitement de prompt (PP) dès 16-32k tokens. Nemotron maintient >100 TPS PP jusqu'à 400k contexte, mais génération de tokens (TG) reste lente (10-20 TPS).
Lire la source
Ton avis ?
BenchmarksQwenOpen source

Résumé généré par Claude — vérifié par l'humain