norgitov/ trends
Технологии · люди · идеи
К обзору/LessWrong13 минут назад

Эмпирические утверждения о безопасности от ведущих лабораторий должны быть воспроизведены, проверены и сделаны открытыми

Статья утверждает, что исследования по безопасности от ведущих лабораторий ИИ, таких как Anthropic и OpenAI, должны быть независимо воспроизведены, проверены и сделаны открытыми, чтобы обеспечить надежность и прозрачность. Она подчеркивает опасения, что текущие исследования часто эмпирические, закрытые и не содержат подробных методологий, что затрудняет проверку заявлений о прогрессе в согласовании. Авторы предлагают посвятить отдельные усилия воспроизведению экспериментов, тестированию их устойчивости и открытому распространению результатов для внешней проверки и дальнейших исследований.

Открыть первоисточник
СИГНАЛ ИЗ ИСТОЧНИКА
24
очков источника
Наблюдаем с21 сентября 2026 г.24 очков источника
Темп интереса0/hпо замерам за 1,02 h
Опубликовано21 сентября 2026 г.Zephaniah Roe
ЗА ЦИФРАМИ

Как меняется интерес

История начинает расти

График появится после повторных замеров. Текущий показатель уже получен из источника.

24 очков источника

Только реальные замеры. История до подключения источника не восстанавливается.

ЗАЧЕМ ОБРАТИТЬ ВНИМАНИЕ

Это исследование подчеркивает важность проверки утверждений о безопасности ИИ через независимое воспроизведение и прозрачность, чтобы обеспечить надежность отчетов о прогрессе в согласовании с крупными компаниями ИИ.

Полезная находка?
ПРОДОЛЖИ ИССЛЕДОВАНИЕ

Рядом по теме

Вся тема