11:51
2026-10-09
julesbelveze.github.io
machine-learning
The Case for Small Specialized Models
A benchmark by Jules Belveze found that a fine-tuned RoBERTa-base model (125M parameters) scored 0.783 macro-F1 on a 22k-item TLDR newsletter classification dataset, beating the best zero-shot decisio…