Наука
HCRA: рефлексивная архитектура для согласования AI с..
Исследователи представили Human-Centric Reflective Architecture (HCRA) — фреймворк для совместного принятия решений человеком и AI....
RLVR и RAGES: новый метод обучения ИИ для диагностики по..
Исследователи разработали метод RLVR, который позволяет большим языковым моделям не просто анализировать данные, а активно искать...
RL-агенты с учётом неопределённости обогнали классические модели..
Исследователи предложили метод оценки неопределённости для RL-трейдинга, объединяющий распределительную, эпистемическую и алеаторическую...
Oyster-II: обучение с подкреплением для безопасного и полезного..
Исследователи представили Oyster-II — фреймворк на основе обучения с подкреплением (RL), который улучшает безопасность языковых моделей, не...
Новый гибрид BDLM Mamba-H ускоряет генерацию длинных контекстов..
Исследователи представили гибридную архитектуру BDLM Mamba-H, объединяющую Mamba и attention для блочной диффузионной генерации. Модель...
MedCalc-Pro: бенчмарк для ИИ-агентов в сложных медицинских..
Группа исследователей представила бенчмарк MedCalc-Pro, содержащий 2268 реальных клинических случаев и 77 медицинских калькуляторов. Он...
Исследователи представили LARA — метод безопасного вывода..
Исследователи предложили фреймворк Lagrangian Reward Augmentation (LARA), который позволяет добавлять ограничения безопасности при...
Новый метод OCM: AI-агенты строят объектную модель окружения для..
Исследователи предложили Object-Centric Environment Modeling (OCM) — подход, при котором LLM-агенты накапливают опыт в виде исполняемых...
Кардиолог назвала опасные виды тахикардии, которые могут..
Врач-кардиолог Ольга Трушкина рассказала о видах тахикардии, способных приводить к летальному исходу. Среди опасных симптомов — боль в...
ИИ риск-аверсия: обучение осторожности сработало на ставках в 98..
Исследователи обучили языковые модели избегать риска на мелких ставках и проверили, сохранится ли это при астрономически высоких....



