norgitov/ trends
Технологии · люди · идеи
К обзору/LessWrong52 минуты назад

Доказательства рисков должны быть прозрачными

Автор утверждает, что, несмотря на то, что компании OpenAI и Anthropic замедляют обучение RL для обеспечения безопасности, наука о рисках потери контроля в ИИ все еще развивается. Нет стандартизированных методов измерения или проверки утверждений о безопасности, что затрудняет оценку того, могут ли ИИ-системы подорвать человеческий контроль. Автор считает, что компании ИИ должны сосредоточиться на улучшении собственных практик безопасности вместо того, чтобы полагаться на независимые оценки.

Открыть первоисточник
СИГНАЛ ИЗ ИСТОЧНИКА
69
очков источника
Наблюдаем с26 сентября 2026 г.69 очков источника
Темп интереса0/hпо замерам за 1,02 h
Опубликовано25 сентября 2026 г.Ajeya Cotra
ЗА ЦИФРАМИ

Как меняется интерес

История начинает расти

График появится после повторных замеров. Текущий показатель уже получен из источника.

69 очков источника

Только реальные замеры. История до подключения источника не восстанавливается.

ЗАЧЕМ ОБРАТИТЬ ВНИМАНИЕ

Суммарный текст подчеркивает необходимость прозрачности в оценке рисков ИИ из-за отсутствия стандартизированных методов проверки утверждений о безопасности и измерения рисков потери контроля.

Полезная находка?
ПРОДОЛЖИ ИССЛЕДОВАНИЕ

Рядом по теме

Вся тема