Наука

Роскосмос совместно с правительством будет ежегодно утверждать план космических съемок

Роскосмос совместно с правительством будет ежегодно утверждать..

Роскосмос объявил, что совместно с правительством России начнет ежегодно утверждать план космических съемок. Госкорпорация будет проверять...


Исследование: детерминированные шлюзы на 12% повышают успешность LLM-агентов с инструментами

Исследование: детерминированные шлюзы на 12% повышают успешность..

Учёные выявили скрытый тип сбоев у LLM-агентов, использующих внешние инструменты: агент может нарушить политику, но не сообщать об ошибке....


Автономные агенты получат безопасную среду: концепция Agentic Data Environments

Автономные агенты получат безопасную среду: концепция Agentic..

Исследователи предложили новую концепцию Agentic Data Environments, которая переосмысливает базы данных как активную среду для выполнения...


Новый бенчмарк MIRA-Math проверяет способность ИИ запрашивать недостающие данные для решения задач

Новый бенчмарк MIRA-Math проверяет способность ИИ запрашивать..

Исследователи представили бенчмарк MIRA-Math для оценки умения ИИ запрашивать недостающую информацию при решении математических задач....


Новый подход к машинному обучению в науке: ИИ-агенты проверяют физическую корректность моделей

Новый подход к машинному обучению в науке: ИИ-агенты проверяют..

Исследователи представили метод Physics-Audited Agentic SciML (PA-SciML), который добавляет проверку физических законов в процесс отбора...


EvoSOP: новый фреймворк учит ИИ-агентов создавать собственные процедуры для эффективной работы

EvoSOP: новый фреймворк учит ИИ-агентов создавать собственные..

Исследователи представили EvoSOP — фреймворк, который позволяет LLM-агентам превращать повторяющиеся атомарные действия в стандартные...


Новый метод машинного обучения UASPL повышает надежность и интерпретируемость самоуправляемого обучения

Новый метод машинного обучения UASPL повышает надежность и..

Исследователи представили UASPL — метод обучения с подкреплением, учитывающий неопределенность прогнозов. Он превосходит существующие...


Исследователи раскрыли скрытые механизмы риска в мультиагентных LLM

Исследователи раскрыли скрытые механизмы риска в мультиагентных..

Новое исследование на arXiv показывает, что агрегированные показатели безопасности мультиагентных LLM-систем могут вводить в заблуждение,...


Атаки на модели прогноза цен электроэнергии лишают demand response 10% выгоды

Атаки на модели прогноза цен электроэнергии лишают demand..

Исследователи смоделировали влияние манипуляций с прогнозами цен на промышленное управление спросом. Даже незаметные атаки снижают...


Обучение ИИ социальным нормам повысило эффективность координации с человеком в 4 раза

Обучение ИИ социальным нормам повысило эффективность координации..

Исследователи разработали метод обучения ИИ социальным нормам на основе анализа взаимодействия пешеходов и водителей. В тестах агент на...