Наука

Новый метод MARL с консенсусом координирует тысячи агентов при глобальных ограничениях

Новый метод MARL с консенсусом координирует тысячи агентов при..

Исследователи представили масштабируемый подход для многолетнего обучения с подкреплением (MARL), использующий распределенный консенсус по...


Новый метод DecomposeR улучшает планирование в LLM для глубоких исследований на 5–8 баллов

Новый метод DecomposeR улучшает планирование в LLM для глубоких..

Исследователи разработали DecomposeR — метод обучения с подкреплением для LLM, который улучшает планирование и выполнение сложных...


Экономику назвали главным критерием лидерства в космической гонке

Экономику назвали главным критерием лидерства в космической гонке..

Авторы доклада к ПМЭФ-2026 пришли к выводу, что в новой космической гонке побеждает не столько научный потенциал, сколько способность...


DisjunctiveNet: нейросеть, гарантированно выполняющая логические правила

DisjunctiveNet: нейросеть, гарантированно выполняющая логические..

Новая архитектура DisjunctiveNet объединяет нейронные сети с дифференцируемыми слоями оптимизации, обеспечивая жёсткое соблюдение...


Новый фреймворк PReMISE улучшает точность LLM-судей: оценка по рубрикам стала надежнее

Новый фреймворк PReMISE улучшает точность LLM-судей: оценка по..

Исследователи разработали PReMISE — фреймворк для создания и аудита рубрик оценки LLM-судей. Он повышает точность сравнения ответов с 65%...


Унифицированный фреймворк для градиентной агрегации в многокритериальной оптимизации

Унифицированный фреймворк для градиентной агрегации в..

Исследователи предложили единый математический подход к объединению градиентов в задачах многокритериальной оптимизации. Метод обеспечивает...


AdaCoM: адаптивное управление контекстом повышает эффективность LLM-агентов

AdaCoM: адаптивное управление контекстом повышает эффективность..

Исследователи представили AdaCoM — метод адаптивного управления контекстом для LLM-агентов, решающих долгосрочные задачи. Используя внешнюю...


Семантическое сходство недостаточно: ученые ввели поведенческую неразличимость для дистилляции LLM

Семантическое сходство недостаточно: ученые ввели поведенческую..

Исследователи представили концепцию ограниченной поведенческой неразличимости для оценки дистилляции черного ящика больших языковых...


MAVEN: лёгкий ИИ-каркас повышает точность вызова инструментов с 48% до 71% без дообучения

MAVEN: лёгкий ИИ-каркас повышает точность вызова инструментов с..

Исследователи представили MAVEN — лёгкий символьный каркас для агентного вызова инструментов. На стресс-тесте MAVEN-Bench система на базе...


Нейросети запоминают цифры из тестов: исследование NumLeak

Нейросети запоминают цифры из тестов: исследование NumLeak..

Исследователи представили фреймворк NumLeak, показавший, что ведущие LLM запоминают числовые данные из публичных бенчмарков, а не...