Наука
AutoMEM: система памяти для ИИ-агентов превзошла аналоги в..
Исследователи изучили восемь систем памяти для LLM-агентов и создали AutoMEM, которая управляет хранилищем через инструментальные вызовы....
Спецназ ВМФ России получил ударные FPV-дроны для борьбы с БЭК..
Отряды специального назначения ВМФ России получили ударные FPV-дроны. Учения с беспилотниками уже проводятся в подразделениях по...
RUBAS: новый метод обучения делает ИИ-агентов безопаснее при..
Исследователи представили RUBAS — фреймворк на основе подкрепляющего обучения, который оценивает поведение агента по четырём рубрикам....
Автономные ИИ-агенты: тайминг остановки почти невоспроизводим у..
Новое исследование показало, что определение момента для остановки автономного ИИ-агента — крайне субъективная задача. Даже три обученных...
Новый метод LiftQuant сжимает LLM до дробных битов: 70B модель..
Исследователи представили LiftQuant — метод квантизации, позволяющий сжимать большие языковые модели с произвольной точностью, а не только...
StepPRM-RTL: новый метод синтеза RTL-кода на LLM улучшил..
Исследователи представили фреймворк StepPRM-RTL, объединяющий пошаговое моделирование траекторий и метод вознаграждения за процесс. Техника...
Ученые вывели правила масштабирования Gated Delta Networks для..
Исследователи из arXiv представили работу, в которой вывели правила масштабирования для архитектуры Gated Delta Network. Это позволяет...
Новый бенчмарк VAMPS: ИИ решает задачи лучше без визуальных..
Исследователи представили бенчмарк VAMPS для оценки способности ИИ решать математические задачи с помощью графиков. Тестирование показало,...
Новый алгоритм SDPG повышает стабильность обучения языковых..
Исследователи представили SDPG — фреймворк для обучения с подкреплением, использующий самодистилляцию и KL-регуляризацию. Метод сочетает...
Разногласия вместо консенсуса: учёные предложили новый метод для..
Исследователи представили подход, в котором разногласия в рассуждениях мультиагентных систем используются как сигнал для принятия решений....



