Наука
ReElicit: новый метод байесовской оптимизации системных промптов..
Исследователи представили ReElicit — фреймворк, который адаптивно строит семантическое пространство признаков для оптимизации системных...
В Llama и Gemma нашли нейронные 'литературные примитивы': новый..
Исследователи с помощью sparse autoencoders обнаружили в моделях Llama 3.1 и Gemma 2 четыре класса нейронных особенностей, отвечающих за...
Ученые предложили метод контролируемого забывания для..
Исследователи представили новый подход к удалению данных из мультизадачных нейросетей, учитывающий взаимное влияние задач. Разработанный...
Новый метод AMSGA повышает точность нейросетей Forward-Forward..
Исследователи представили алгоритм Adaptive Multi-Scale Goodness Aggregation (AMSGA), расширяющий возможности Forward-Forward (FF)...
Исследователи: доверие в сетях ИИ-агентов нужно закладывать..
В новой научной работе утверждается, что безопасность сетей взаимодействующих ИИ-агентов нельзя обеспечить доработкой существующих...
Новый метод квантизации BDQ сокращает потери точности LLM до 1%..
Исследователи представили Bidirectional Diagonal Quantization (BDQ) — метод пост-тренировочной квантизации, который снижает потери точности...
Мультиагентный метод AgentNLQ достиг 78,1% точности в NL2SQL на..
Исследователи представили новый мультиагентный метод AgentNLQ для преобразования естественного языка в SQL. Метод показал 78,1%...
ReCrit: новый метод RL улучшает критическое мышление LLM в..
Исследователи представили ReCrit — фреймворк с усилением, который обучает большие языковые модели корректно реагировать на критику, не...
LBW-Guard: новый алгоритм управления обучением LLM сократил..
Исследователи представили LBW-Guard — слой управления обучением языковых моделей, работающий поверх оптимизатора AdamW. Решение повышает...
Новый метод UCCI снижает затраты на запуск LLM на 31% без потери..
Исследователи представили алгоритм калибровки неопределенности для маршрутизации запросов между языковыми моделями разного размера. На...


