Наука

Новый метод WMRL ускорил обучение ИИ-исследователей в 3-4 раза

Новый метод WMRL ускорил обучение ИИ-исследователей в 3-4 раза..

Исследователи предложили метод World Model RL, который заменяет реальное окружение мировой моделью при обучении автономных...


HouseGNN: новый метод борьбы с пересглаживанием в графовых нейросетях

HouseGNN: новый метод борьбы с пересглаживанием в графовых..

Исследователи представили HouseGNN — графовую нейросеть на основе отражателей Хаусхолдера. Метод сохраняет норму представлений узлов на...


Разработан X-AddGraph: объяснимость для детектора аномалий без потери точности

Разработан X-AddGraph: объяснимость для детектора аномалий без..

Исследователи представили фреймворк X-AddGraph, который впервые объясняет решения модели AddGraph, предназначенной для обнаружения аномалий...


ИИ для подводных дронов: новый диффузионный алгоритм улучшил совместное слежение

ИИ для подводных дронов: новый диффузионный алгоритм улучшил..

Исследователи представили алгоритм VGG-MADiffRL, который помогает группе автономных подводных аппаратов точнее отслеживать подвижные цели....


Новая архитектура LoKiFormer ускоряет предобучение больших языковых моделей в 1,33 раза

Новая архитектура LoKiFormer ускоряет предобучение больших..

Исследователи представили архитектуру LoKiFormer, которая добавляет к стандартному декодеру два модуля: локальное внимание с свёрткой и...


Учёные: активный учитель повышает эффективность обучения ИИ на основе предпочтений

Учёные: активный учитель повышает эффективность обучения ИИ на..

Исследователи переосмыслили обучение ИИ предпочтениям: вместо пассивного опроса человека предлагается модель активного учителя, который...


Новый алгоритм для разбиения дорожных сетей ускорил вычисления в 17 раз

Новый алгоритм для разбиения дорожных сетей ускорил вычисления в..

Исследователи представили модель ECpM для разбиения дорожной сети на компактные связные территории. Подход на основе shortest-path...


Одно кэш-состояние вместо N: LinearKV вдвое ускоряет вывод в гибридных LLM

Одно кэш-состояние вместо N: LinearKV вдвое ускоряет вывод в..

Учёные представили метод LinearKV для гибридных LLM, использующих и attention, и линейные рекуррентные слои. Он позволяет кэшировать всего...


Реоптимизация позволила улучшить алгоритмы контекстных бандитов с ограничениями

Реоптимизация позволила улучшить алгоритмы контекстных бандитов..

Новая работа на arXiv представляет простые алгоритмы на основе UCB с реоптимизацией для контекстных бандитов с ограничениями. Авторы...


Метод CORA-Diff ускоряет диффузионные языковые модели до 13 раз без потери качества

Метод CORA-Diff ускоряет диффузионные языковые модели до 13 раз..

Исследователи представили CORA-Diff — метод, который ускоряет инференс диффузионных языковых моделей, пропуская уже стабильные токены. В...