Наука
Новый метод MARL с консенсусом координирует тысячи агентов при..
Исследователи представили масштабируемый подход для многолетнего обучения с подкреплением (MARL), использующий распределенный консенсус по...
Новый метод DecomposeR улучшает планирование в LLM для глубоких..
Исследователи разработали DecomposeR — метод обучения с подкреплением для LLM, который улучшает планирование и выполнение сложных...
Экономику назвали главным критерием лидерства в космической гонке..
Авторы доклада к ПМЭФ-2026 пришли к выводу, что в новой космической гонке побеждает не столько научный потенциал, сколько способность...
DisjunctiveNet: нейросеть, гарантированно выполняющая логические..
Новая архитектура DisjunctiveNet объединяет нейронные сети с дифференцируемыми слоями оптимизации, обеспечивая жёсткое соблюдение...
Новый фреймворк PReMISE улучшает точность LLM-судей: оценка по..
Исследователи разработали PReMISE — фреймворк для создания и аудита рубрик оценки LLM-судей. Он повышает точность сравнения ответов с 65%...
Унифицированный фреймворк для градиентной агрегации в..
Исследователи предложили единый математический подход к объединению градиентов в задачах многокритериальной оптимизации. Метод обеспечивает...
AdaCoM: адаптивное управление контекстом повышает эффективность..
Исследователи представили AdaCoM — метод адаптивного управления контекстом для LLM-агентов, решающих долгосрочные задачи. Используя внешнюю...
Семантическое сходство недостаточно: ученые ввели поведенческую..
Исследователи представили концепцию ограниченной поведенческой неразличимости для оценки дистилляции черного ящика больших языковых...
MAVEN: лёгкий ИИ-каркас повышает точность вызова инструментов с..
Исследователи представили MAVEN — лёгкий символьный каркас для агентного вызова инструментов. На стресс-тесте MAVEN-Bench система на базе...
Нейросети запоминают цифры из тестов: исследование NumLeak..
Исследователи представили фреймворк NumLeak, показавший, что ведущие LLM запоминают числовые данные из публичных бенчмарков, а не...



