Наука
ShallowBench: новый тест для ИИ в разработке лекарств от сложных..
Исследователи представили ShallowBench — строго подобранный набор из 5780 мелководных карманов-мишеней для оценки генеративных моделей...
Фреймворк W2S автоматизирует создание навыков для LLM-агентов,..
Команда исследователей представила фреймворк W2S, который автоматически извлекает навыки для больших языковых моделей из разнородных...
Новый бенчмарк RECAP: ИИ-агенты плохо адаптируются к меняющимся..
Исследователи представили бенчмарк RECAP для оценки способности ИИ-агентов адаптировать промпты к новым ограничениям. Тесты показали, что...
ИИ-система с графом знаний улучшила диагностику в традиционной..
Исследователи разработали систему на основе больших языковых моделей и графа знаний, которая повышает прозрачность и интерпретируемость...
Исследование: языковые модели демонстрируют..
Ученые провели поведенческий аудит семи LLM в четырех городах США и обнаружили, что модели по-разному рекомендуют районы в зависимости от...
Новая система памяти AdMem позволит ИИ-агентам решать..
Исследователи разработали универсальную систему памяти AdMem для агентов на базе больших языковых моделей. Она объединяет семантическую,...
Предложена серверлесс-архитектура SSD-FL для федеративного..
Исследователи представили метод SSD-FL, позволяющий проводить федеративное обучение без постоянных серверов. Архитектура использует...
OpenSkill: новая платформа для самообучения ИИ-агентов без..
Исследователи представили фреймворк OpenSkill, который позволяет LLM-агентам самостоятельно развиваться в открытой среде, используя только...
GiFlow: новый метод восполнения пропусков в..
Исследователи представили GiFlow — фреймворк на основе flow matching с графоинформированным априорным распределением. Метод эффективнее...
Исследователи предложили геометрический метод управления..
Новое исследование, опубликованное на arXiv, показывает, что управление поведением языковых моделей можно эффективно осуществлять через...


