Как меняется интерес
История начинает расти
График появится после повторных замеров. Текущий показатель уже получен из источника.
335 очков источникаТолько реальные замеры. История до подключения источника не восстанавливается.
Claude Opus 5.5 - новая версия серии крупных языковых моделей Claude, разработанная Anthropic. Модель размещена на GitHub, что указывает на открытые исходные коды для исследований и разработки.
График появится после повторных замеров. Текущий показатель уже получен из источника.
335 очков источникаТолько реальные замеры. История до подключения источника не восстанавливается.
Nvidia представила поддержку нативного программирования GPU для языка программирования Rust.
6 дней назадLessWrongСтатья утверждает, что большие языковые модели (LLM) хорошо справляются с математикой и программированием не потому, что эти задачи легко проверить, а потому, что их данные для предварительного обучения содержат высококачественную и точную информацию. В математике большинство литературы верно, позволяя LLM имитировать точные рассуждения. Аналогично, код в интернете часто работает как ожидается, позволяя LLM генерировать рабочий код через имитацию. Однако проблемы, такие как ошибки или неэффективность, требуют дополнительного обучения или усиления с помощью подкрепления.
4 дня назадLobstersСтатья посвящена возрождению языка программирования Vale(n), акцентируя внимание на инициативе 'Золотой гвоздь', направленной на возобновление её разработки и использования.
5 дней назадLobstersТекст содержит различные небольшие программистские трюки.
6 дней назадLessWrongТекст обсуждает концепцию 'Mech Interp' как проверяемую задачу, фокусируясь на замене частей слоев MLP алгоритмами для проверки потерь восстановления. Вводится идея фронтиера ПARETO, балансирующего качество восстановления с простотой, и предполагается, что идеальное разложение модели должно привести к минимальным, извлекаемым и удаляемым цепям с четкими причинно-следственными связями. Цель — определить 'простоту' в терминах количества узлов и ребер в структуре модели.
вчераLessWrongСтатья обсуждает проблемы регулирования тренировки ИИ с помощью ограничений FLOP, подчеркивая, что техники, такие как последовательное связывание или агрегирование тренировочных запусков, могут обойти эти ограничения. Она предполагает, что механизмы проверки могут столкнуться с трудностями в предотвращении таких методов, что затрудняет соблюдение регулирования на основе FLOP.
вчера