Наука

Ghost Attractor Networks: новый декодер для ИИ с улучшением в 462 раза по числу параметров

Ghost Attractor Networks: новый декодер для ИИ с улучшением в..

Исследователи представили Ghost Attractor Networks — динамический декодер, который воспроизводит точность гигантских моделей с минимальными...


Девятая АПЛ «Ясень-М»: в России заложили подлодку «Мурманск»

Девятая АПЛ «Ясень-М»: в России заложили подлодку «Мурманск»..

На производственном объединении «Севмаш» заложили новую атомную подводную лодку «Мурманск» проекта 885М («Ясень-М»). Это девятый корабль в...


Ученые нашли способ очистить финальный вектор забывания в LLM без потери сохраненных знаний

Ученые нашли способ очистить финальный вектор забывания в LLM..

Исследователи предложили метод SAGE, который позволяет посмертно корректировать финальный вектор обновления при забывании информации в...


TRIDENT: новый MARL-фреймворк сокращает нарушения безопасности на 95%

TRIDENT: новый MARL-фреймворк сокращает нарушения безопасности..

Исследователи представили TRIDENT — первый фреймворк многолетнего обучения с подкреплением, который решает проблему одновременного учета...


Метод DRIFT повышает верхнюю границу производительности LLM за счет оптимизации данных

Метод DRIFT повышает верхнюю границу производительности LLM за..

Исследователи arXiv предложили метод DRIFT, использующий influence functions для уточнения обучающих данных в supervised fine-tuning. Он...


Математики связали теорию ударных волн и обучение нейросетей

Математики связали теорию ударных волн и обучение нейросетей..

Исследователи из MIT и других университетов установили явную математическую связь между теорией ударных волн и динамикой стохастического...


Artemis: новый метод ИИ устраняет возрастные и половые искажения в нейровизуализации

Artemis: новый метод ИИ устраняет возрастные и половые искажения..

Исследователи представили Artemis — метод причинно-следственного вмешательства на уровне отдельных областей мозга, который корректирует...


CodeBlock: обучение LLM для кода с контролем 1.9% токенов повышает pass@1

CodeBlock: обучение LLM для кода с контролем 1.9% токенов..

Исследователи предложили CodeBlock — фреймворк разреженного контроля, который выбирает структурно полные блоки кода вместо отдельных...


Новая архитектура решает проблему запоминания и забывания в вербальном обучении с подкреплением

Новая архитектура решает проблему запоминания и забывания в..

Исследователи предложили трёхуровневую архитектуру для LLM-агентов, которая позволяет эффективно управлять извлекаемыми из опыта правилами,...


Новый метод обучения ИИ: отрицательная фильтрация токенов вместо групп

Новый метод обучения ИИ: отрицательная фильтрация токенов вместо..

Исследователи пересмотрели роль групповых роллаутов в обучении с подкреплением без критика и предложили метод отрицательной фильтрации...