Наука

AutoMEM: система памяти для ИИ-агентов превзошла аналоги в кроссплатформенных тестах

AutoMEM: система памяти для ИИ-агентов превзошла аналоги в..

Исследователи изучили восемь систем памяти для LLM-агентов и создали AutoMEM, которая управляет хранилищем через инструментальные вызовы....


Спецназ ВМФ России получил ударные FPV-дроны для борьбы с БЭК

Спецназ ВМФ России получил ударные FPV-дроны для борьбы с БЭК..

Отряды специального назначения ВМФ России получили ударные FPV-дроны. Учения с беспилотниками уже проводятся в подразделениях по...


RUBAS: новый метод обучения делает ИИ-агентов безопаснее при работе с инструментами

RUBAS: новый метод обучения делает ИИ-агентов безопаснее при..

Исследователи представили RUBAS — фреймворк на основе подкрепляющего обучения, который оценивает поведение агента по четырём рубрикам....


Автономные ИИ-агенты: тайминг остановки почти невоспроизводим у людей и LLM

Автономные ИИ-агенты: тайминг остановки почти невоспроизводим у..

Новое исследование показало, что определение момента для остановки автономного ИИ-агента — крайне субъективная задача. Даже три обученных...


Новый метод LiftQuant сжимает LLM до дробных битов: 70B модель влезает в 24 ГБ

Новый метод LiftQuant сжимает LLM до дробных битов: 70B модель..

Исследователи представили LiftQuant — метод квантизации, позволяющий сжимать большие языковые модели с произвольной точностью, а не только...


StepPRM-RTL: новый метод синтеза RTL-кода на LLM улучшил корректность на 10%

StepPRM-RTL: новый метод синтеза RTL-кода на LLM улучшил..

Исследователи представили фреймворк StepPRM-RTL, объединяющий пошаговое моделирование траекторий и метод вознаграждения за процесс. Техника...


Ученые вывели правила масштабирования Gated Delta Networks для эффективного обучения больших языковых моделей

Ученые вывели правила масштабирования Gated Delta Networks для..

Исследователи из arXiv представили работу, в которой вывели правила масштабирования для архитектуры Gated Delta Network. Это позволяет...


Новый бенчмарк VAMPS: ИИ решает задачи лучше без визуальных подсказок

Новый бенчмарк VAMPS: ИИ решает задачи лучше без визуальных..

Исследователи представили бенчмарк VAMPS для оценки способности ИИ решать математические задачи с помощью графиков. Тестирование показало,...


Новый алгоритм SDPG повышает стабильность обучения языковых моделей с подкреплением

Новый алгоритм SDPG повышает стабильность обучения языковых..

Исследователи представили SDPG — фреймворк для обучения с подкреплением, использующий самодистилляцию и KL-регуляризацию. Метод сочетает...


Разногласия вместо консенсуса: учёные предложили новый метод для ИИ-модерации

Разногласия вместо консенсуса: учёные предложили новый метод для..

Исследователи представили подход, в котором разногласия в рассуждениях мультиагентных систем используются как сигнал для принятия решений....