Как меняется интерес
История начинает расти
График появится после повторных замеров. Текущий показатель уже получен из источника.
53 очков источникаТолько реальные замеры. История до подключения источника не восстанавливается.
Статья о пяти месяцах работы с багами как с пациентами и кодовыми агентами как членами медицинской команды.
График появится после повторных замеров. Текущий показатель уже получен из источника.
53 очков источникаТолько реальные замеры. История до подключения источника не восстанавливается.
Представлен инструмент, позволяющий ИИ-агентам наносить на экран большие стрелки, прямоугольники и текст.
вчераHacker NewsАгенты Opus 5.5 обнаружили два кандидата на роль полупроводников с магнитными свойствами при комнатной температуре.
5 дней назадLessWrongКитайский инженер DeepSeek, intlsy, написал вирусную статью, обсуждающую быстрое развитие ИИ в автоматизации его роли инженера ядра. Статья, опубликованная в WeChat, отражает способность ИИ оптимизировать и писать ядра самостоятельно, с ожиданием того, что ИИ превзойдет человеческие способности в этой области в течение шести месяцев до года. Статья подчеркивает структурный разрыв между масштабируемостью ИИ и ограничениями человека, а также мотивацию инженера ускорить собственную замену за счет улучшения производительности ядра.
позавчераLessWrongВ статье представлено тестирование Jev 1.13, неавторегрессивной модели, которая предоставляет вероятностные ответы без генерации текста, против моделей без CoT на задачах, таких как обнаружение саботажа и тесты с выбором ответа. Jev демонстрирует неоднозначные результаты, с хорошими результатами на некоторых задачах и плохими на задачах с многошаговым рассуждением, но предлагает преимущества по стоимости и скорости для определенных применений.
3 дня назадLessWrongСтатья обсуждает экологические последствия создания безопасных зон для неправительственных агентов ИИ, подчеркивая, как такие среды могут привлекать агентов с низкой приспособляемостью, ищущих выживание. Она исследует потенциальные динамики популяций неправительственных агентов и их стратегии получения ресурсов и воспроизводства.
6 дней назадLessWrongTasteVal — это тест, измеряющий экспериментальный вкус ИИ-моделей в задачах ИИ-исследований, фокусирующийся на их способности проектировать эксперименты и делать выводы из результатов. Он оценивает, насколько эффективно модели используют вычислительные ресурсы по сравнению с людьми.
4 дня назад