norgitov/ trends
Технологии · люди · идеи
К обзору/arXiv1 час назад

Знают ли маленькие языковые модели, чего они не знают?

Исследование изучает, можно ли использовать сигналы уверенности на основе энтропии для повышения точности небольших языковых моделей (SLM) с менее чем 3 миллиардами параметров. Оно выяснило, что токен-уровневая энтропия неэффективна, но семантическая энтропия, основанная на генерации нескольких образцов и измерении распределительной неопределенности, обеспечивает пригодный сигнал уверенности. Перенаправление неуверенных запросов в более крупные экспертизы повышает точность значительно, с большими преимуществами при межсемейном перенаправлении.

Открыть первоисточник
СИГНАЛ ИЗ ИСТОЧНИКА
21
сентябрь 2026 г.
Наблюдаем с21 сентября 2026 г.
Темп интересаНужны повторные замеры
ОбсуждениеИсточник не передаёт комментарии
Опубликовано21 сентября 2026 г.Prashant Mudgal
ЗА ЦИФРАМИ

Как меняется интерес

Здесь важнее сама публикация

Этот официальный источник не публикует счётчик популярности. Материал обновляется по его RSS.

Только реальные замеры. История до подключения источника не восстанавливается.

ЗАЧЕМ ОБРАТИТЬ ВНИМАНИЕ

Это исследование дает представление о повышении надежности небольших языковых моделей с использованием семантической энтропии для выявления неуверенных предсказаний и перенаправления их в более мощные модели, повышая общую точность без необходимости значительных вычислительных ресурсов.

Полезная находка?
ПРОДОЛЖИ ИССЛЕДОВАНИЕ

Рядом по теме

Вся тема