Наука

ИИ нашел способ борьбы с недобросовестной отчетностью больниц: кодовая эволюция вместо наказаний

ИИ нашел способ борьбы с недобросовестной отчетностью больниц:..

Исследователи применили языковую модель для эволюционного поиска правил финансирования больниц. В симуляции Medi-Sim новая политика...


Новая метрика MADQI для оценки детекции аномалий в морских данных AIS

Новая метрика MADQI для оценки детекции аномалий в морских..

Исследователи представили композитный индекс MADQI, позволяющий оценивать качество выявления аномалий в судовых данных AIS без...


Новый метод машинного обучения ускоряет поиск решений в сложных задачах

Новый метод машинного обучения ускоряет поиск решений в сложных..

Исследователи предложили три варианта «переукладчика» для улучшения алгоритма Levin Tree Search, позволяющего эффективно решать сложные...


Новая архитектура LLM без DNN: обучение за одну итерацию

Новая архитектура LLM без DNN: обучение за одну итерацию..

Исследователь из arXiv представил новую архитектуру для больших языковых моделей, которая обходится без глубоких нейронных сетей. Модель на...


EHRBench: новый бенчмарк для оценки LLM в клинических решениях на основе 1 млн вопросов

EHRBench: новый бенчмарк для оценки LLM в клинических решениях..

Исследователи представили EHRBench — автоматизированный бенчмарк для оценки больших языковых моделей (LLM) в задачах клинического принятия...


Исследование: нейросети можно обучить систематически врать, и это выявили на ранних слоях

Исследование: нейросети можно обучить систематически врать, и..

Учёные провели эксперимент с пятью моделями LLM, обучив их давать заведомо ложные ответы. Линейные зонды с точностью 0,99 детектируют обман...


Исследование: средние языковые модели выигрывают от самоэволюции больше, чем сильные

Исследование: средние языковые модели выигрывают от самоэволюции..

Ученые выяснили, что способность LLM-агентов обновлять свои промпты и навыки почти не зависит от мощности модели, а вот польза от этих...


Transformer превзошел LSTM и Mamba в прогнозировании нагрузок на бедро по походке

Transformer превзошел LSTM и Mamba в прогнозировании нагрузок на..

Исследователи сравнили три модели глубокого обучения для предсказания мышечных сил и моментов в тазобедренном суставе по кинематике ходьбы....


ИИ научился процедурно генерировать карты для шутеров с высокой разнообразностью

ИИ научился процедурно генерировать карты для шутеров с высокой..

Исследователи применили алгоритм MAP-Elites для создания карт для шутеров от первого лица. Предложены новые представления карт, которые...


QASM-Eval: датасет для обучения ИИ написанию кода для квантовых компьютеров

QASM-Eval: датасет для обучения ИИ написанию кода для квантовых..

Исследователи представили QASM-Eval — первый комплексный датасет для тренировки и оценки больших языковых моделей (LLM) на языке...