Наука

Уязвимость систем программирования по примерам: целенаправленная порча данных оказалась эффективнее случайных ошибок

Уязвимость систем программирования по примерам: целенаправленная..

Исследователи изучили устойчивость систем программирования по примерам (PBE) к атакам на входные данные. Целенаправленная порча примеров...


Auto-FL-Research: новый инструмент для автоматического поиска алгоритмов федеративного обучения

Auto-FL-Research: новый инструмент для автоматического поиска..

Исследователи представили Auto-FL-Research (AFR) — систему на основе ИИ-агентов для автоматического поиска алгоритмов федеративного...


M-QCDNet: нейросеть с Q-матрицей для прозрачной когнитивной диагностики

M-QCDNet: нейросеть с Q-матрицей для прозрачной когнитивной..

Разработан метод M-QCDNet, объединяющий структурную интерпретируемость когнитивных моделей с глубоким обучением. Встраивание Q-матрицы...


Нейро-символический метод PACE повышает реалистичность объяснений ИИ

Нейро-символический метод PACE повышает реалистичность..

Исследователи представили PACE — модульную нейро-символическую структуру для генерации контрфактических объяснений, учитывающих реально...


ИИ-агенты научились менять стиль поведения в играх по команде: исследование arXiv

ИИ-агенты научились менять стиль поведения в играх по команде:..

Ученые представили метод, позволяющий ИИ-агентам в видеоиграх изменять стиль выполнения задач по команде пользователя в реальном времени....


Новый бенчмарк AGI Maze проверяет способность ИИ моделировать мир: LLMs проваливают простые лабиринты

Новый бенчмарк AGI Maze проверяет способность ИИ моделировать..

Исследователи представили AGI Maze — лёгкий фреймворк для оценки способности языковых моделей строить внутренние модели мира. Тесты...


Новый метод HARC защищает LLM от джейлбрейков без потери качества

Новый метод HARC защищает LLM от джейлбрейков без потери качества..

Исследователи представили метод HARC, который усиливает защиту больших языковых моделей от взлома. Техника связывает направления...


AI-native игры: новый критерий — без ИИ геймплей разрушается

AI-native игры: новый критерий — без ИИ геймплей разрушается..

Исследователи определили, что делает игру AI-native: генеративный ИИ должен быть неотъемлемой частью основного игрового цикла. Предложена...


Agri-SAGE: ИИ-система на базе LLM и симуляций превзошла традиционные агроконсультации

Agri-SAGE: ИИ-система на базе LLM и симуляций превзошла..

Исследователи представили Agri-SAGE — замкнутую систему, объединяющую мультиагентный LLM с биологической симуляцией APSIM. Тестирование...


PHREEQC-MCQ-200: бенчмарк для оценки ИИ-агентов в научных симуляциях

PHREEQC-MCQ-200: бенчмарк для оценки ИИ-агентов в научных..

Исследователи представили PHREEQC-MCQ-200 — диагностический бенчмарк для оценки ИИ-агентов, использующих научное ПО. Тестирование показало,...