norgitov/ trends
Технологии · люди · идеи
К обзору/arXiv1 час назад

Объединение токенов для многоязычного распознавания речи: систематическое исследование по масштабу моделей и тонкой настройке

В этой статье представлено систематическое исследование метода объединения токенов для многоязычного распознавания речи, с акцентом на семейство моделей Whisper по 16 языкам и трем размерам моделей. Исследование показывает, что объединение токенов повышает вычислительную эффективность с минимальным влиянием на точность расшифровки, даже после тонкой настройки на языках с низким уровнем ресурсов.

Открыть первоисточник
СИГНАЛ ИЗ ИСТОЧНИКА
15
сентябрь 2026 г.
Наблюдаем с15 сентября 2026 г.
Темп интересаНужны повторные замеры
ОбсуждениеИсточник не передаёт комментарии
Опубликовано15 сентября 2026 г.Dylan Luke Holyoak
ЗА ЦИФРАМИ

Как меняется интерес

Здесь важнее сама публикация

Этот официальный источник не публикует счётчик популярности. Материал обновляется по его RSS.

Только реальные замеры. История до подключения источника не восстанавливается.

ЗАЧЕМ ОБРАТИТЬ ВНИМАНИЕ

Этот метод может значительно снизить вычислительные затраты при развертывании многоязычных систем распознавания речи без значительных потерь точности, что делает его подходящим для сред с ограниченными ресурсами.

Полезная находка?
ПРОДОЛЖИ ИССЛЕДОВАНИЕ

Рядом по теме

Вся тема