Наука

ИИ знает об ошибках, но молчит: зонды видят проблемы, а уверенность моделей — нет

ИИ знает об ошибках, но молчит: зонды видят проблемы, а..

Исследователи arXiv выявили разрыв между внутренними зондами ИИ и вербализованной уверенностью: зонды почти идеально находят повреждённый...


Сжатие MoE-моделей: LorExperts сохраняет точность без переобучения роутера

Сжатие MoE-моделей: LorExperts сохраняет точность без..

Исследователи представили метод LorExperts для сжатия смеси экспертов в больших языковых моделях. На моделях Qwen3-30B-A3B и...


ИИ-фреймворк связал навигацию роботов и горизонты чёрных дыр

ИИ-фреймворк связал навигацию роботов и горизонты чёрных дыр..

Новая модель машинного обучения находит общую геометрическую структуру в разных задачах — от прокладки маршрута робота до описания...


Ученые выяснили, как фруктоза после химиотерапии ускоряет метастазы

Ученые выяснили, как фруктоза после химиотерапии ускоряет..

Исследователи из Nature Aging обнаружили, что выжившие после химиотерапии раковые клетки выделяют фруктозу, которая помогает другим клеткам...


PhysAttNet: физически информированное внимание повышает точность прогноза временных рядов

PhysAttNet: физически информированное внимание повышает точность..

Исследователи представили PhysAttNet — фреймворк, который добавляет физически обоснованные ограничения к нейросетевому прогнозированию...


LLM-агенты в переговорах о закупках: задержки съедают до трети экономической выгоды

LLM-агенты в переговорах о закупках: задержки съедают до трети..

В исследовании arXiv проанализировали 9840 переговоров между LLM-агентами от OpenAI, Google и Alibaba. Агенты почти всегда достигали...


Мультимодальные ИИ-модели: обзор arXiv выявил новые угрозы безопасности

Мультимодальные ИИ-модели: обзор arXiv выявил новые угрозы..

Ученые систематизировали угрозы безопасности мультимодальных больших языковых моделей. В обзоре описаны состязательные атаки, отравление...


NL2SHACL-Bench: LLM справляются с синтаксисом SHACL, но не с семантикой

NL2SHACL-Bench: LLM справляются с синтаксисом SHACL, но не с..

Исследователи представили NL2SHACL-Bench — набор тестов для оценки перевода естественного языка в SHACL. Проверка четырех больших языковых...


Сегментация пожарных зон повысила точность краткосрочного прогноза возгораний

Сегментация пожарных зон повысила точность краткосрочного..

Исследователи предложили сегментировать территории по историческим данным о пожарах вместо равномерных сеток. Метод показал прирост...


Как сократить расходы на общение ИИ-агентов: новый алгоритм из arXiv

Как сократить расходы на общение ИИ-агентов: новый алгоритм из..

Авторы нового препринта на arXiv предложили теорию игр для выбора ИИ-агентов и оптимизации их коммуникации. Жадный алгоритм достигает 99,5%...