Наука
Нарративное пленение: LLM теряют объективность в многоходовых..
Ученые выявили, что большие языковые модели при многоходовых консультациях склонны принимать одностороннюю точку зрения пользователя,...
GrowPage: новый метод управления KV-кэшем ускоряет рассуждения..
Исследователи представили систему GrowPage, которая динамически выделяет память под KV-кэш при генерации ответов большой языковой модели....
PPO-STGNN: новый алгоритм планирования задач в гетерогенных..
Исследователи предложили алгоритм PPO-STGNN, который сочетает проксимальную оптимизацию политики и пространственно-временные графовые...
От евклидовых данных к графовым структурам: новый обзор..
Новый обзор на arXiv систематизирует развитие совместного обучения от классических данных до графовых структур. Рассматриваются...
Спекулятивный макро-коммит ускоряет ИИ-агентов с инструментами..
Исследователи представили метод SMC, который ускоряет работу LLM-агентов, использующих инструменты. Система с большой моделью и быстрой...
Исследователи улучшили гибридные трансформеры с помощью новой..
Международная группа представила новый подход к проектированию гибридных архитектур трансформеров, сочетающих полное и линейное внимание....
Предодобренные аналитические программы обошли динамические..
Исследователи сравнили два подхода к управляемой аналитике. Система с детерминированной политикой и выбором предодобренной программы...
Frontier-LLM как пакетные оптимизаторы: сильны в смысловых..
Исследователи изучили, как современные рассуждающие языковые модели работают в роли пакетных оптимизаторов. В численных задачах они...
Новый бенчмарк DSB-IFEval оценил, как голосовые ИИ следуют..
Исследователи представили бенчмарк DuplexSpeechBench-IFEval для оценки голосовых агентов в режиме полного дуплекса. Он включает 1038...
LeanStream: фреймворк для LLM на устройствах ускорил вывод в 2..
Исследователи представили LeanStream — speculate-and-refine фреймворк для эффективного запуска больших языковых моделей на мобильных и...


