安定報道日時 2026-10-02 12:00
新しいプリトレーニング方法が言語モデルの能力を混乱度を越えて向上させます
新しい研究によると、事前学習中に抽象的でアルゴリズム生成されたデータを使った簡単なウォームアップは、混乱度(perplexity)には反映されない特定の言語モデルの能力を向上させることが可能である。
新しい研究によると、事前学習中に抽象的でアルゴリズム生成されたデータを使った簡単なウォームアップは、混乱度(perplexity)には反映されない特定の言語モデルの能力を向上させることが可能である。
Abstract: Language models are typically pretrained from random initialization. Recent work challenges this convention, showing that a brief warm-up on abstract…