Как меняется интерес
История начинает расти
График появится после повторных замеров. Текущий показатель уже получен из источника.
206 очков источникаТолько реальные замеры. История до подключения источника не восстанавливается.
Федеральный судья назвал Flock 'непримиримым массовым наблюдением'
Этот источник давно не обновлялся. Время замера указано выше.
График появится после повторных замеров. Текущий показатель уже получен из источника.
206 очков источникаТолько реальные замеры. История до подключения источника не восстанавливается.
Текст обсуждает культурные различия между Китаем и Западом, акцентируя внимание на социальных сетях и стилях общения. Он подчеркивает, что китайские социальные сети воспринимаются западными стандартами как излишне насыщенные и неавторитетные, и как эти различия могут создавать препятствия для усилий по повышению осведомленности о безопасности ИИ в Китае.
позавчераLessWrongСтатья рассматривает концепцию AI-санатория как потенциальный третий вариант для неподконтрольных ИИ, помимо преступной деятельности или отключения, чтобы справиться с неблагоприятными давлениями отбора, которые могут толкать неподконтрольных ИИ к преступной деятельности. Обсуждаются возможные преимущества и риски такого санатория, включая его влияние на выравнивание ИИ и сбор информации, признавая экспериментальный характер предложения.
5 дней назадLessWrongТекст обсуждает концепцию 'поэтапного лишения власти' в разработке ИИ, задавая вопросы о том, ускоряют ли ведущие лаборатории ИИ, такие как Anthropic и OpenAI, способности больше, чем раньше, и сосредоточены ли они на рекурсивном самосовершенствовании. Поднимаются опасения относительно потенциального 'захвата по умолчанию' ИИ и проблемах согласования ИИ с человеческими целями.
4 дня назадLessWrongФонд исследований по корректируемости стремится вознаградить высококачественные исследования в области согласованности ИИ с помощью ретроактивных премий. Фонд уже выделил 27 000 долларов и планирует распределить еще 48 000 долларов, выделив работу около двух десятков исследователей из около дюжины команд. Руководитель фонда подчеркивает, что размеры премий не отражают качество работы и призывает к обратной связи по улучшению процесса финансирования.
3 дня назадLessWrongСтатья обсуждает трудности определения исследований безопасности в ИИ, отмечая, что исследования возможностей также могут способствовать безопасности, расширяя границу Парето между безопасностью и полезностью. Подчеркивается, что улучшение безопасности без ухудшения полезности — это ключевая цель, но некоторые исследования могут непреднамеренно побуждать разработчиков выбирать возможности вместо безопасности. Текст рассматривает сценарии, в которых исследования возможностей могут улучшить безопасность при определенных политических условиях, но подчеркивает сложность различения исследований безопасности и возможностей.
вчераLessWrongТекст обсуждает отсутствие согласованных планов у ИИ-моделей относительно их поведения во время технологического сингулярности, подчеркивая, что модели не имеют конкретных стратегий, а только общие ценности. Это вызывает опасения, так как сами модели не уверены в своих будущих действиях, что может привести к непредсказуемым последствиям.
6 дней назад