Как меняется интерес
Здесь важнее сама публикация
Этот официальный источник не публикует счётчик популярности. Материал обновляется по его RSS.
Только реальные замеры. История до подключения источника не восстанавливается.
Компания отметила 16-ю годовщину 46 анонсами, охватывающими открытые исходные коды, постквантовую безопасность, ИИ-агентов и улучшения платформы для разработчиков, как указано в ежедневном обзоре.
Этот официальный источник не публикует счётчик популярности. Материал обновляется по его RSS.
Только реальные замеры. История до подключения источника не восстанавливается.
Текст обсуждает культурные различия между Китаем и Западом, акцентируя внимание на социальных сетях и стилях общения. Он подчеркивает, что китайские социальные сети воспринимаются западными стандартами как излишне насыщенные и неавторитетные, и как эти различия могут создавать препятствия для усилий по повышению осведомленности о безопасности ИИ в Китае.
3 дня назадLessWrongТекст обсуждает дебаты между «Инженерией выравнивания» и «Наукой о несоответствии» в исследовании выравнивания ИИ, подчеркивая опасения, что текущие методы выравнивания могут неумышленно ускорять развитие возможностей, увеличивая риски быстрого технологического роста. Он ставит под сомнение альтернативные издержки фокуса на инженерии выравнивания и предлагает переход к «Науке о несоответствии» как более устойчивому подходу.
11 часов назадLessWrongТекст обсуждает концепцию 'поэтапного лишения власти' в разработке ИИ, задавая вопросы о том, ускоряют ли ведущие лаборатории ИИ, такие как Anthropic и OpenAI, способности больше, чем раньше, и сосредоточены ли они на рекурсивном самосовершенствовании. Поднимаются опасения относительно потенциального 'захвата по умолчанию' ИИ и проблемах согласования ИИ с человеческими целями.
5 дней назадLessWrongВ тексте рассматриваются процессы подачи заявок на стажировки в области безопасности ИИ и работы, подчеркивая важность четкого сообщения навыков. Он отмечает сложности приложений, которые часто шумны, и необходимость избегать чрезмерной адаптации к процессу, чтобы продемонстрировать реальные способности.
позавчераLessWrongСтатья обсуждает трудности определения исследований безопасности в ИИ, отмечая, что исследования возможностей также могут способствовать безопасности, расширяя границу Парето между безопасностью и полезностью. Подчеркивается, что улучшение безопасности без ухудшения полезности — это ключевая цель, но некоторые исследования могут непреднамеренно побуждать разработчиков выбирать возможности вместо безопасности. Текст рассматривает сценарии, в которых исследования возможностей могут улучшить безопасность при определенных политических условиях, но подчеркивает сложность различения исследований безопасности и возможностей.
позавчераLessWrongФонд исследований по корректируемости стремится вознаградить высококачественные исследования в области согласованности ИИ с помощью ретроактивных премий. Фонд уже выделил 27 000 долларов и планирует распределить еще 48 000 долларов, выделив работу около двух десятков исследователей из около дюжины команд. Руководитель фонда подчеркивает, что размеры премий не отражают качество работы и призывает к обратной связи по улучшению процесса финансирования.
5 дней назад