Наука

HCRA: рефлексивная архитектура для согласования AI с предпочтениями человека

HCRA: рефлексивная архитектура для согласования AI с..

Исследователи представили Human-Centric Reflective Architecture (HCRA) — фреймворк для совместного принятия решений человеком и AI....


RLVR и RAGES: новый метод обучения ИИ для диагностики по симптомам

RLVR и RAGES: новый метод обучения ИИ для диагностики по..

Исследователи разработали метод RLVR, который позволяет большим языковым моделям не просто анализировать данные, а активно искать...


RL-агенты с учётом неопределённости обогнали классические модели на фондовом рынке США

RL-агенты с учётом неопределённости обогнали классические модели..

Исследователи предложили метод оценки неопределённости для RL-трейдинга, объединяющий распределительную, эпистемическую и алеаторическую...


Oyster-II: обучение с подкреплением для безопасного и полезного ИИ

Oyster-II: обучение с подкреплением для безопасного и полезного..

Исследователи представили Oyster-II — фреймворк на основе обучения с подкреплением (RL), который улучшает безопасность языковых моделей, не...


Новый гибрид BDLM Mamba-H ускоряет генерацию длинных контекстов в 19 раз

Новый гибрид BDLM Mamba-H ускоряет генерацию длинных контекстов..

Исследователи представили гибридную архитектуру BDLM Mamba-H, объединяющую Mamba и attention для блочной диффузионной генерации. Модель...


MedCalc-Pro: бенчмарк для ИИ-агентов в сложных медицинских расчетах

MedCalc-Pro: бенчмарк для ИИ-агентов в сложных медицинских..

Группа исследователей представила бенчмарк MedCalc-Pro, содержащий 2268 реальных клинических случаев и 77 медицинских калькуляторов. Он...


Исследователи представили LARA — метод безопасного вывода ИИ-моделей без дообучения

Исследователи представили LARA — метод безопасного вывода..

Исследователи предложили фреймворк Lagrangian Reward Augmentation (LARA), который позволяет добавлять ограничения безопасности при...


Новый метод OCM: AI-агенты строят объектную модель окружения для эффективного обучения

Новый метод OCM: AI-агенты строят объектную модель окружения для..

Исследователи предложили Object-Centric Environment Modeling (OCM) — подход, при котором LLM-агенты накапливают опыт в виде исполняемых...


Кардиолог назвала опасные виды тахикардии, которые могут привести к смерти

Кардиолог назвала опасные виды тахикардии, которые могут..

Врач-кардиолог Ольга Трушкина рассказала о видах тахикардии, способных приводить к летальному исходу. Среди опасных симптомов — боль в...


ИИ риск-аверсия: обучение осторожности сработало на ставках в 98 порядков величины

ИИ риск-аверсия: обучение осторожности сработало на ставках в 98..

Исследователи обучили языковые модели избегать риска на мелких ставках и проверили, сохранится ли это при астрономически высоких....