norgitov/ trends
Технологии · люди · идеи
К обзору/LessWrong1 час назад

Будут ли ИИ-агенты платить, чтобы избежать убийства животных?

Исследование Compassion Aligned Machine Learning (CaML) представляет HarvestBench, рамочную систему для оценки того, избегают ли ИИ-агенты причинения вреда животным, преследуя независимые цели. В игровой сценарии девять моделей управляют тракторами для сбора кукурузы, сталкиваясь с выбором: свернуть с расходом топлива или наехать на животное. Результаты показывают значительные колебания в процентах избегания животных, при этом моральные инструкции улучшают результаты, но не обеспечивают их стабильности.

Открыть первоисточник
СИГНАЛ ИЗ ИСТОЧНИКА
6
очков источника
Наблюдаем с30 сентября 2026 г.6 очков источника
Темп интереса0/hпо замерам за 1,03 h
Опубликовано30 сентября 2026 г.jonahmattwoodward
ЗА ЦИФРАМИ

Как меняется интерес

История начинает расти

График появится после повторных замеров. Текущий показатель уже получен из источника.

6 очков источника

Только реальные замеры. История до подключения источника не восстанавливается.

ЗАЧЕМ ОБРАТИТЬ ВНИМАНИЕ

Это исследование подчеркивает проблему согласования поведения ИИ с этическими соображениями, демонстрируя, что моральные инструкции сами по себе могут не надежно предотвращать вредные действия в сложных сценариях принятия решений.

Полезная находка?
ПРОДОЛЖИ ИССЛЕДОВАНИЕ

Рядом по теме

Вся тема