Наука
Бенчмарк ResearchClawBench: ИИ-агенты пока далеки от..
Исследователи представили бенчмарк ResearchClawBench для оценки способности ИИ проводить самостоятельные научные исследования. Лучший...
Индекс подхалимства ИИ: новый инструмент для оценки угодливости..
Исследователи представили AEDI — метрику, измеряющую склонность ИИ подстраиваться под мнение пользователя. Тесты на восьми моделях...
Ученые создали препарат Compound 10, замедляющий болезнь..
Ученые разработали соединение Compound 10, которое в экспериментах на мышах замедлило развитие болезни Альцгеймера, улучшило работу сердца...
Доказана оптимальность последовательной фильтрации: порядок..
Исследователи из arXiv математически доказали, что для минимизации затрат в многоэтапных системах фильтрации этапы следует упорядочивать по...
LLM-судьи негибки: новое исследование вскрыло проблемы оценки..
Учёные выяснили, что LLM-модели, используемые для оценки безопасности других ИИ, слишком полагаются на собственные внутренние приоритеты и...
Исследователи выявили плато точности у LLM-роутеров и предлагают..
Ученые проанализировали 21 метод маршрутизации запросов к большим языковым моделям и обнаружили, что многие из них демонстрируют схожую...
AI-протокол между агентами сокращает сроки согласования ядерных..
Исследователи из США представили протокол RCP, заменяющий традиционную переписку между регулятором и заявителем на взаимодействие...
ИИ-агенты автоматизировали развёртывание LLM на AMD XDNA 2 NPU..
Исследователи разработали систему навыков для агентов, которая позволила автономно развернуть восемь языковых моделей на AMD XDNA 2 NPU....
Новый метод сжатия LLM снижает перплексию до 85% при квантовании..
Исследователи представили сквозной фреймворк, который одновременно выполняет структурное прореживание и квантование смешанной точности. На...
Спектральные графовые нейросети ускоряют восстановление умных..
Ученые предложили метод на основе спектральных графовых нейронных сетей и обучения с подкреплением для быстрого восстановления...



