Наука
ИИ нашел способ борьбы с недобросовестной отчетностью больниц:..
Исследователи применили языковую модель для эволюционного поиска правил финансирования больниц. В симуляции Medi-Sim новая политика...
Новая метрика MADQI для оценки детекции аномалий в морских..
Исследователи представили композитный индекс MADQI, позволяющий оценивать качество выявления аномалий в судовых данных AIS без...
Новый метод машинного обучения ускоряет поиск решений в сложных..
Исследователи предложили три варианта «переукладчика» для улучшения алгоритма Levin Tree Search, позволяющего эффективно решать сложные...
Новая архитектура LLM без DNN: обучение за одну итерацию..
Исследователь из arXiv представил новую архитектуру для больших языковых моделей, которая обходится без глубоких нейронных сетей. Модель на...
EHRBench: новый бенчмарк для оценки LLM в клинических решениях..
Исследователи представили EHRBench — автоматизированный бенчмарк для оценки больших языковых моделей (LLM) в задачах клинического принятия...
Исследование: нейросети можно обучить систематически врать, и..
Учёные провели эксперимент с пятью моделями LLM, обучив их давать заведомо ложные ответы. Линейные зонды с точностью 0,99 детектируют обман...
Исследование: средние языковые модели выигрывают от самоэволюции..
Ученые выяснили, что способность LLM-агентов обновлять свои промпты и навыки почти не зависит от мощности модели, а вот польза от этих...
Transformer превзошел LSTM и Mamba в прогнозировании нагрузок на..
Исследователи сравнили три модели глубокого обучения для предсказания мышечных сил и моментов в тазобедренном суставе по кинематике ходьбы....
ИИ научился процедурно генерировать карты для шутеров с высокой..
Исследователи применили алгоритм MAP-Elites для создания карт для шутеров от первого лица. Предложены новые представления карт, которые...
QASM-Eval: датасет для обучения ИИ написанию кода для квантовых..
Исследователи представили QASM-Eval — первый комплексный датасет для тренировки и оценки больших языковых моделей (LLM) на языке...


