Наука
RoPoLL: новый метод оценки ИИ устойчив к предвзятости судей..
Исследователи представили RoPoLL — метод, который делает оценку языковых моделей робастной к необъективным судьям. В отличие от...
Российские военные применили новые дроны БМ-70 с дальностью до..
Вооруженные силы России в зоне СВО начали использовать беспилотники самолетного типа БМ-70. Дроны способны поражать цели на расстоянии до...
Предсказуемое обучение GRPO: новая модель точна на 91%..
Исследователи разработали аналитическую модель, предсказывающую динамику обучения алгоритма GRPO с точностью более 91%. Модель объясняет...
Иерархия навыков ускоряет обучение ML-агентов: 77% медалей на..
Новая система HASTE организует знания ML-агентов по трём уровням, что позволило достичь 77,3% медалей на бенчмарке MLE-Bench Lite при вдвое...
Process sidecars: метод отзыва памяти в ИИ-моделях без потери..
Исследователи представили метод process sidecars, позволяющий отзывать выученную память языковых моделей после этапа безопасности. Метод...
Многоагентные ИИ-системы применили для юридических задач:..
Исследователи применили многоагентные системы на больших языковых моделях для решения задач в области права. Эксперименты показали, что...
ReactionAtlas: ИИ строит карту 47 000 химических реакций для..
Международная группа исследователей представила ReactionAtlas — модель машинного обучения, способную автоматически выстраивать сети...
Новый метод LearnStop позволяет моделям ИИ экономить ресурсы за..
Исследователи представили LearnStop — метод, который учит языковые модели решать, когда остановиться в процессе рассуждений. В отличие от...
Новый метод HGA позволяет запускать 64K-токеновые модели на RTX..
Исследователи представили Hierarchical Global Attention (HGA) — замену плотного causal attention в предобученных трансформерах. Метод...
BayesBench: новый тест оценивает, насколько LLM обновляют..
Исследователи представили BayesBench — набор сред для оценки того, насколько рационально большие языковые модели обновляют свои убеждения...



