Наука

RoPoLL: новый метод оценки ИИ устойчив к предвзятости судей

RoPoLL: новый метод оценки ИИ устойчив к предвзятости судей..

Исследователи представили RoPoLL — метод, который делает оценку языковых моделей робастной к необъективным судьям. В отличие от...


Российские военные применили новые дроны БМ-70 с дальностью до 100 км

Российские военные применили новые дроны БМ-70 с дальностью до..

Вооруженные силы России в зоне СВО начали использовать беспилотники самолетного типа БМ-70. Дроны способны поражать цели на расстоянии до...


Предсказуемое обучение GRPO: новая модель точна на 91%

Предсказуемое обучение GRPO: новая модель точна на 91%..

Исследователи разработали аналитическую модель, предсказывающую динамику обучения алгоритма GRPO с точностью более 91%. Модель объясняет...


Иерархия навыков ускоряет обучение ML-агентов: 77% медалей на Kaggle

Иерархия навыков ускоряет обучение ML-агентов: 77% медалей на..

Новая система HASTE организует знания ML-агентов по трём уровням, что позволило достичь 77,3% медалей на бенчмарке MLE-Bench Lite при вдвое...


Process sidecars: метод отзыва памяти в ИИ-моделях без потери безопасности

Process sidecars: метод отзыва памяти в ИИ-моделях без потери..

Исследователи представили метод process sidecars, позволяющий отзывать выученную память языковых моделей после этапа безопасности. Метод...


Многоагентные ИИ-системы применили для юридических задач: результаты эксперимента

Многоагентные ИИ-системы применили для юридических задач:..

Исследователи применили многоагентные системы на больших языковых моделях для решения задач в области права. Эксперименты показали, что...


ReactionAtlas: ИИ строит карту 47 000 химических реакций для поиска истоков жизни

ReactionAtlas: ИИ строит карту 47 000 химических реакций для..

Международная группа исследователей представила ReactionAtlas — модель машинного обучения, способную автоматически выстраивать сети...


Новый метод LearnStop позволяет моделям ИИ экономить ресурсы за счет ранней остановки рассуждений

Новый метод LearnStop позволяет моделям ИИ экономить ресурсы за..

Исследователи представили LearnStop — метод, который учит языковые модели решать, когда остановиться в процессе рассуждений. В отличие от...


Новый метод HGA позволяет запускать 64K-токеновые модели на RTX 5090 без переобучения

Новый метод HGA позволяет запускать 64K-токеновые модели на RTX..

Исследователи представили Hierarchical Global Attention (HGA) — замену плотного causal attention в предобученных трансформерах. Метод...


BayesBench: новый тест оценивает, насколько LLM обновляют убеждения как байесовцы

BayesBench: новый тест оценивает, насколько LLM обновляют..

Исследователи представили BayesBench — набор сред для оценки того, насколько рационально большие языковые модели обновляют свои убеждения...