Наука
Ghost Attractor Networks: новый декодер для ИИ с улучшением в..
Исследователи представили Ghost Attractor Networks — динамический декодер, который воспроизводит точность гигантских моделей с минимальными...
Девятая АПЛ «Ясень-М»: в России заложили подлодку «Мурманск»..
На производственном объединении «Севмаш» заложили новую атомную подводную лодку «Мурманск» проекта 885М («Ясень-М»). Это девятый корабль в...
Ученые нашли способ очистить финальный вектор забывания в LLM..
Исследователи предложили метод SAGE, который позволяет посмертно корректировать финальный вектор обновления при забывании информации в...
TRIDENT: новый MARL-фреймворк сокращает нарушения безопасности..
Исследователи представили TRIDENT — первый фреймворк многолетнего обучения с подкреплением, который решает проблему одновременного учета...
Метод DRIFT повышает верхнюю границу производительности LLM за..
Исследователи arXiv предложили метод DRIFT, использующий influence functions для уточнения обучающих данных в supervised fine-tuning. Он...
Математики связали теорию ударных волн и обучение нейросетей..
Исследователи из MIT и других университетов установили явную математическую связь между теорией ударных волн и динамикой стохастического...
Artemis: новый метод ИИ устраняет возрастные и половые искажения..
Исследователи представили Artemis — метод причинно-следственного вмешательства на уровне отдельных областей мозга, который корректирует...
CodeBlock: обучение LLM для кода с контролем 1.9% токенов..
Исследователи предложили CodeBlock — фреймворк разреженного контроля, который выбирает структурно полные блоки кода вместо отдельных...
Новая архитектура решает проблему запоминания и забывания в..
Исследователи предложили трёхуровневую архитектуру для LLM-агентов, которая позволяет эффективно управлять извлекаемыми из опыта правилами,...
Новый метод обучения ИИ: отрицательная фильтрация токенов вместо..
Исследователи пересмотрели роль групповых роллаутов в обучении с подкреплением без критика и предложили метод отрицательной фильтрации...



