StableReported 2026-10-02 12:00
New Pretraining Method Improves Language Model Capabilities Beyond Perplexity
A brief warm-up on abstract, algorithmically generated data during pretraining can improve specific language model capabilities not reflected in perplexity, according to a new study.