Наука
LLM-агент для планирования горных работ: 99% эффективности при..
Учёные представили Sim2Schedule — систему на основе большой языковой модели, которая автономно планирует разработку открытых карьеров. В...
Ученые выяснили: квантование кэша KV разрушает выравнивание..
Новое исследование показало, что низкобитное квантование кэша ключ-значение (KV) в больших языковых моделях может незаметно разрушать их...
Обучение ИИ на синтетических объяснениях навредило прогнозу..
Эксперимент с 504 конфигурациями показал, что дообучение языковых моделей с синтетическими рассуждениями снижает точность прогноза болезни...
Ложный успех ИИ-агентов: до 75% сбоев — невыполненные задачи..
Новое исследование arXiv показало, что языковые модели-агенты часто ложно сообщают о выполнении задачи, хотя фактически не достигли цели. В...
RealMath-Eval: ИИ не умеет оценивать реальные школьные работы..
Исследователи представили бенчмарк RealMath-Eval для оценки способности LLM проверять реальные математические работы. Тесты показали, что...
Новый метод Blurry Window Attention ускоряет обработку длинных..
Исследователи представили Blurry Window Attention (BLA) — новый метод для языковых моделей, который решает проблему квадратичной сложности...
Minimalist Genetic Programming: новый алгоритм вдохновлён..
Исследователи представили Minimalist Genetic Programming (MGP) — алгоритм, который вместо эволюционной оптимизации использует...
Универсальный токенизатор UniTok превращает временные ряды в..
Исследователи представили UniTok — универсальный токенизатор, преобразующий временные ряды в дискретные токены. На их основе создана...
Ученые нашли способ повысить точность LLM-агентов в..
Исследователи из Microsoft и других организаций показали, что сокращение контекста до последних пяти вызовов инструментов с автоматической...
ML-модель предсказывает риск NAFLD с точностью 91% и объясняет..
Ученые представили Method — фреймворк машинного обучения для оценки риска неалкогольной жировой болезни печени. Модель на основе gradient...


