Наука

Нарративное пленение: LLM теряют объективность в многоходовых диалогах

Нарративное пленение: LLM теряют объективность в многоходовых..

Ученые выявили, что большие языковые модели при многоходовых консультациях склонны принимать одностороннюю точку зрения пользователя,...


GrowPage: новый метод управления KV-кэшем ускоряет рассуждения LLM без потери качества

GrowPage: новый метод управления KV-кэшем ускоряет рассуждения..

Исследователи представили систему GrowPage, которая динамически выделяет память под KV-кэш при генерации ответов большой языковой модели....


PPO-STGNN: новый алгоритм планирования задач в гетерогенных средах Cloud-Edge-End

PPO-STGNN: новый алгоритм планирования задач в гетерогенных..

Исследователи предложили алгоритм PPO-STGNN, который сочетает проксимальную оптимизацию политики и пространственно-временные графовые...


От евклидовых данных к графовым структурам: новый обзор совместного обучения

От евклидовых данных к графовым структурам: новый обзор..

Новый обзор на arXiv систематизирует развитие совместного обучения от классических данных до графовых структур. Рассматриваются...


Спекулятивный макро-коммит ускоряет ИИ-агентов с инструментами до 44,9%

Спекулятивный макро-коммит ускоряет ИИ-агентов с инструментами..

Исследователи представили метод SMC, который ускоряет работу LLM-агентов, использующих инструменты. Система с большой моделью и быстрой...


Исследователи улучшили гибридные трансформеры с помощью новой архитектуры HwH

Исследователи улучшили гибридные трансформеры с помощью новой..

Международная группа представила новый подход к проектированию гибридных архитектур трансформеров, сочетающих полное и линейное внимание....


Предодобренные аналитические программы обошли динамические ИИ-агенты в тесте arXiv

Предодобренные аналитические программы обошли динамические..

Исследователи сравнили два подхода к управляемой аналитике. Система с детерминированной политикой и выбором предодобренной программы...


Frontier-LLM как пакетные оптимизаторы: сильны в смысловых задачах, но уступают классике в численных

Frontier-LLM как пакетные оптимизаторы: сильны в смысловых..

Исследователи изучили, как современные рассуждающие языковые модели работают в роли пакетных оптимизаторов. В численных задачах они...


Новый бенчмарк DSB-IFEval оценил, как голосовые ИИ следуют неявным инструкциям

Новый бенчмарк DSB-IFEval оценил, как голосовые ИИ следуют..

Исследователи представили бенчмарк DuplexSpeechBench-IFEval для оценки голосовых агентов в режиме полного дуплекса. Он включает 1038...


LeanStream: фреймворк для LLM на устройствах ускорил вывод в 2 раза и сократил память в 7 раз

LeanStream: фреймворк для LLM на устройствах ускорил вывод в 2..

Исследователи представили LeanStream — speculate-and-refine фреймворк для эффективного запуска больших языковых моделей на мобильных и...