norgitov/ trends
Технологии · люди · идеи
К обзору/Daily Papers1 час назад

Синтетическая предварительная подготовка выдерживает масштаб, но не как грамматический приоритет

Предварительная подготовка (PPT) на синтетических данных, не являющихся естественным языком, повышает эффективность использования токенов при предварительной тренировке языковых моделей (PT). Однако исследование показывает, что эффективность PPT на больших масштабах и с разнообразными наборами данных не зависит от грамматического приоритета, а связана с задачами, улучшающими долгосрочную выборку. PPT остается полезной даже при использовании до 100 млрд токенов PT и устойчива к составу данных, при условии наличия веб-текста.

Открыть первоисточник
СИГНАЛ ИЗ ИСТОЧНИКА
5
голосов источника
Наблюдаем с1 октября 2026 г.5 голосов источника
Темп интереса—Нужны повторные замеры
Опубликовано30 сентября 2026 г.Atsuki Yamaguchi, Tatsuro Inaba, Joel Niklaus
ЗА ЦИФРАМИ

Как меняется интерес

История начинает расти

График появится после повторных замеров. Текущий показатель уже получен из источника.

5 голосов источника

Только реальные замеры. История до подключения источника не восстанавливается.

ЗАЧЕМ ОБРАТИТЬ ВНИМАНИЕ

Это исследование дает понимание эффективности синтетической предварительной подготовки в масштабе, указывая, что ее преимущества связаны с задачами долгосрочной выборки, а не с грамматическим приоритетом, что может направлять будущее проектирование задач PPT.

Полезная находка?
ПРОДОЛЖИ ИССЛЕДОВАНИЕ

Рядом по теме

Вся тема