norgitov/ trends
Технологии · люди · идеи
К обзору/Daily Papersвчера

OmniVChat: Синтезирование, оценка и обучение для нативного аудиовизуального диалога

В статье представлено OmniVChat — задача нативного аудиовизуального диалога, где модели обрабатывают аудио и видео напрямую без отдельного текста. Представлена OmniVChat-Studio для генерации диалогов, OmniVChat-Bench для оценки и OmniVChat-RL для усиленного обучения, что улучшает производительность как на синтетических, так и на реальных данных.

Открыть первоисточник
СИГНАЛ ИЗ ИСТОЧНИКА
28
голосов источника
Наблюдаем с21 сентября 2026 г.28 голосов источника

Этот источник давно не обновлялся. Время замера указано выше.

Темп интереса+2,64/hпо замерам за 3,03 h
Опубликовано18 сентября 2026 г.Haolin He, Yunfei Chu, Qi Chen
ЗА ЦИФРАМИ

Как меняется интерес

История начинает расти

График появится после повторных замеров. Текущий показатель уже получен из источника.

28 голосов источника

Только реальные замеры. История до подключения источника не восстанавливается.

ЗАЧЕМ ОБРАТИТЬ ВНИМАНИЕ

Эта работа решает проблему обучения и оценки аудиовизуальных систем диалога без использования текста, используя синтетические данные и усиленное обучение для улучшения производительности в реальных условиях.

Полезная находка?
ПРОДОЛЖИ ИССЛЕДОВАНИЕ

Рядом по теме

Вся тема