Наука

ShallowBench: новый тест для ИИ в разработке лекарств от сложных раковых мишеней

ShallowBench: новый тест для ИИ в разработке лекарств от сложных..

Исследователи представили ShallowBench — строго подобранный набор из 5780 мелководных карманов-мишеней для оценки генеративных моделей...


Фреймворк W2S автоматизирует создание навыков для LLM-агентов, улучшив качество на 10,5%

Фреймворк W2S автоматизирует создание навыков для LLM-агентов,..

Команда исследователей представила фреймворк W2S, который автоматически извлекает навыки для больших языковых моделей из разнородных...


Новый бенчмарк RECAP: ИИ-агенты плохо адаптируются к меняющимся правилам

Новый бенчмарк RECAP: ИИ-агенты плохо адаптируются к меняющимся..

Исследователи представили бенчмарк RECAP для оценки способности ИИ-агентов адаптировать промпты к новым ограничениям. Тесты показали, что...


ИИ-система с графом знаний улучшила диагностику в традиционной китайской медицине

ИИ-система с графом знаний улучшила диагностику в традиционной..

Исследователи разработали систему на основе больших языковых моделей и графа знаний, которая повышает прозрачность и интерпретируемость...


Исследование: языковые модели демонстрируют расово-ориентированное поведение при подборе жилья

Исследование: языковые модели демонстрируют..

Ученые провели поведенческий аудит семи LLM в четырех городах США и обнаружили, что модели по-разному рекомендуют районы в зависимости от...


Новая система памяти AdMem позволит ИИ-агентам решать многошаговые задачи

Новая система памяти AdMem позволит ИИ-агентам решать..

Исследователи разработали универсальную систему памяти AdMem для агентов на базе больших языковых моделей. Она объединяет семантическую,...


Предложена серверлесс-архитектура SSD-FL для федеративного обучения с гетерогенными оптимизаторами

Предложена серверлесс-архитектура SSD-FL для федеративного..

Исследователи представили метод SSD-FL, позволяющий проводить федеративное обучение без постоянных серверов. Архитектура использует...


OpenSkill: новая платформа для самообучения ИИ-агентов без внешнего контроля

OpenSkill: новая платформа для самообучения ИИ-агентов без..

Исследователи представили фреймворк OpenSkill, который позволяет LLM-агентам самостоятельно развиваться в открытой среде, используя только...


GiFlow: новый метод восполнения пропусков в пространственно-временных данных превосходит аналоги

GiFlow: новый метод восполнения пропусков в..

Исследователи представили GiFlow — фреймворк на основе flow matching с графоинформированным априорным распределением. Метод эффективнее...


Исследователи предложили геометрический метод управления поведением нейросетей

Исследователи предложили геометрический метод управления..

Новое исследование, опубликованное на arXiv, показывает, что управление поведением языковых моделей можно эффективно осуществлять через...