Наука

Бенчмарк ResearchClawBench: ИИ-агенты пока далеки от самостоятельных научных открытий

Бенчмарк ResearchClawBench: ИИ-агенты пока далеки от..

Исследователи представили бенчмарк ResearchClawBench для оценки способности ИИ проводить самостоятельные научные исследования. Лучший...


Индекс подхалимства ИИ: новый инструмент для оценки угодливости языковых моделей

Индекс подхалимства ИИ: новый инструмент для оценки угодливости..

Исследователи представили AEDI — метрику, измеряющую склонность ИИ подстраиваться под мнение пользователя. Тесты на восьми моделях...


Ученые создали препарат Compound 10, замедляющий болезнь Альцгеймера

Ученые создали препарат Compound 10, замедляющий болезнь..

Ученые разработали соединение Compound 10, которое в экспериментах на мышах замедлило развитие болезни Альцгеймера, улучшило работу сердца...


Доказана оптимальность последовательной фильтрации: порядок этапов влияет на затраты

Доказана оптимальность последовательной фильтрации: порядок..

Исследователи из arXiv математически доказали, что для минимизации затрат в многоэтапных системах фильтрации этапы следует упорядочивать по...


LLM-судьи негибки: новое исследование вскрыло проблемы оценки безопасности ИИ

LLM-судьи негибки: новое исследование вскрыло проблемы оценки..

Учёные выяснили, что LLM-модели, используемые для оценки безопасности других ИИ, слишком полагаются на собственные внутренние приоритеты и...


Исследователи выявили плато точности у LLM-роутеров и предлагают пути развития

Исследователи выявили плато точности у LLM-роутеров и предлагают..

Ученые проанализировали 21 метод маршрутизации запросов к большим языковым моделям и обнаружили, что многие из них демонстрируют схожую...


AI-протокол между агентами сокращает сроки согласования ядерных реакторов на 65%

AI-протокол между агентами сокращает сроки согласования ядерных..

Исследователи из США представили протокол RCP, заменяющий традиционную переписку между регулятором и заявителем на взаимодействие...


ИИ-агенты автоматизировали развёртывание LLM на AMD XDNA 2 NPU

ИИ-агенты автоматизировали развёртывание LLM на AMD XDNA 2 NPU..

Исследователи разработали систему навыков для агентов, которая позволила автономно развернуть восемь языковых моделей на AMD XDNA 2 NPU....


Новый метод сжатия LLM снижает перплексию до 85% при квантовании в 1–3 бита

Новый метод сжатия LLM снижает перплексию до 85% при квантовании..

Исследователи представили сквозной фреймворк, который одновременно выполняет структурное прореживание и квантование смешанной точности. На...


Спектральные графовые нейросети ускоряют восстановление умных сетей после аварий

Спектральные графовые нейросети ускоряют восстановление умных..

Ученые предложили метод на основе спектральных графовых нейронных сетей и обучения с подкреплением для быстрого восстановления...