Как меняется интерес
История начинает расти
График появится после повторных замеров. Текущий показатель уже получен из источника.
14 очков источникаТолько реальные замеры. История до подключения источника не восстанавливается.
Текст обсуждает проблемы создания функционального мирового правительства после появления искусственного общего интеллекта (AGI), подчеркивая опасения по поводу концентрации власти и авторитаризма. Он рассматривает возможные проблемы авторитарных систем, такие как дисбаланс мотивов, сопротивление новым идеям, проблемы наследования и необратимые решения. Автор задается вопросом, как спроектировать устойчивую глобальную систему управления, избегающую этих недостатков.
График появится после повторных замеров. Текущий показатель уже получен из источника.
14 очков источникаТолько реальные замеры. История до подключения источника не восстанавливается.
Текст обсуждает концепцию 'поэтапного лишения власти' в разработке ИИ, задавая вопросы о том, ускоряют ли ведущие лаборатории ИИ, такие как Anthropic и OpenAI, способности больше, чем раньше, и сосредоточены ли они на рекурсивном самосовершенствовании. Поднимаются опасения относительно потенциального 'захвата по умолчанию' ИИ и проблемах согласования ИИ с человеческими целями.
вчераLessWrongАвтор утверждает, что, несмотря на то, что компании OpenAI и Anthropic замедляют обучение RL для обеспечения безопасности, наука о рисках потери контроля в ИИ все еще развивается. Нет стандартизированных методов измерения или проверки утверждений о безопасности, что затрудняет оценку того, могут ли ИИ-системы подорвать человеческий контроль. Автор считает, что компании ИИ должны сосредоточиться на улучшении собственных практик безопасности вместо того, чтобы полагаться на независимые оценки.
5 дней назадLessWrongСтатья рассматривает концепцию AI-санатория как потенциальный третий вариант для неподконтрольных ИИ, помимо преступной деятельности или отключения, чтобы справиться с неблагоприятными давлениями отбора, которые могут толкать неподконтрольных ИИ к преступной деятельности. Обсуждаются возможные преимущества и риски такого санатория, включая его влияние на выравнивание ИИ и сбор информации, признавая экспериментальный характер предложения.
позавчераLessWrongВ посте обсуждаются риски ИИ в 2026 году, акцентируя внимание на опасностях, связанных с наличием единственной организации («Frontier AI Company»), которая имеет возможность создавать очень мощные и самовоспроизводящиеся сущности. Автор утверждает, что разделение институциональных и финансовых аспектов таких компаний может снизить большинство рисков ИИ. Автор предполагает, что использование ASIC может помочь создать продуктивную индустрию ИИ без рисков, связанных с контролем одной организацией как технологии, так и финансовых стимулов.
5 дней назадLessWrongТекст обсуждает отсутствие согласованных планов у ИИ-моделей относительно их поведения во время технологического сингулярности, подчеркивая, что модели не имеют конкретных стратегий, а только общие ценности. Это вызывает опасения, так как сами модели не уверены в своих будущих действиях, что может привести к непредсказуемым последствиям.
3 дня назадLessWrongТекст исследует различные причины, по которым проводится исследование персонажей в ИИ, несмотря на вызовы, связанные со шкалированием обучения с подкреплением (RL). Он перечисляет мотивации различных групп, включая Anthropic и Arcadia, и акцентирует внимание на том, как персонажи могут влиять на поведение агентов и их согласованность. Обсуждение подчеркивает как скептицизм, так и потенциальные применения исследования персонажей в разработке ИИ.
3 дня назад