Наука

Новый метод ULPS повышает эффективность обучения с подкреплением при редких наградах

Новый метод ULPS повышает эффективность обучения с подкреплением..

Исследователи представили ULPS — фреймворк, который использует калиброванную языковую модель для управления политикой агента в условиях...


Новый алгоритм AEGIS спасает роботов от сбоев, экономя вычислительные ресурсы

Новый алгоритм AEGIS спасает роботов от сбоев, экономя..

Исследователи представили AEGIS — метод, который с помощью лёгкого зонда выявляет рискованные шаги робота и переключает на более мощную...


Математическая теория памяти: новая книга объясняет устройство глубоких нейросетей

Математическая теория памяти: новая книга объясняет устройство..

Вышла книга, которая предлагает математическую теорию памяти и репрезентативного обучения для понимания принципов работы глубоких...


Квантовая технология CARVE-Q для автономных автомобилей достигла 100% безопасности

Квантовая технология CARVE-Q для автономных автомобилей достигла..

Исследователи представили CARVE-Q — гибридную квантово-классическую систему верификации маневров. В тестах она показала нулевые ошибки по...


Исследователи научили LLM динамически пропускать и повторять слои для ускорения и точности

Исследователи научили LLM динамически пропускать и повторять..

Учёные из arXiv показали, что языковые модели могут пропускать или повторять свои слои в зависимости от входных данных. Предложенный метод...


Исследователи выпустили CrowdMath: датасет для оценки ИИ в коллективном решении математических задач

Исследователи выпустили CrowdMath: датасет для оценки ИИ в..

Учёные представили CrowdMath — датасет из 164 цепочек обсуждений математических задач на форуме AoPS. Тестирование шести передовых языковых...


WAV v1: новый метод маршрутизации остатков для глубоких трансформеров

WAV v1: новый метод маршрутизации остатков для глубоких..

Исследователи предложили метод WAV v1, который улучшает обучение глубоких трансформеров за счет многоразрешающей маршрутизации остаточных...


Lean4Agent: формальная верификация рабочих процессов LLM-агентов повысила точность на 11,94%

Lean4Agent: формальная верификация рабочих процессов LLM-агентов..

Исследователи представили фреймворк Lean4Agent, использующий формальный язык Lean4 для моделирования и проверки рабочих процессов агентов...


Новый алгоритм MSFAN распознает 12 типов полимеров с точностью 85% с помощью терагерцовой спектроскопии

Новый алгоритм MSFAN распознает 12 типов полимеров с точностью..

Ученые разработали нейросеть MSFAN для классификации полимеров по данным терагерцовой спектроскопии. Модель достигла точности 85,2%,...


SafeGene: переиспользуемый адаптер безопасности для LLM, решающий проблему ослабления защиты при дообучении

SafeGene: переиспользуемый адаптер безопасности для LLM,..

Исследователи представили SafeGene — многократно используемый модуль безопасности для больших языковых моделей, который восстанавливает...