Наука

ReElicit: новый метод байесовской оптимизации системных промптов

ReElicit: новый метод байесовской оптимизации системных промптов..

Исследователи представили ReElicit — фреймворк, который адаптивно строит семантическое пространство признаков для оптимизации системных...


В Llama и Gemma нашли нейронные 'литературные примитивы': новый способ управлять стилем AI

В Llama и Gemma нашли нейронные 'литературные примитивы': новый..

Исследователи с помощью sparse autoencoders обнаружили в моделях Llama 3.1 и Gemma 2 четыре класса нейронных особенностей, отвечающих за...


Ученые предложили метод контролируемого забывания для мультизадачного ИИ

Ученые предложили метод контролируемого забывания для..

Исследователи представили новый подход к удалению данных из мультизадачных нейросетей, учитывающий взаимное влияние задач. Разработанный...


Новый метод AMSGA повышает точность нейросетей Forward-Forward на 1,5%

Новый метод AMSGA повышает точность нейросетей Forward-Forward..

Исследователи представили алгоритм Adaptive Multi-Scale Goodness Aggregation (AMSGA), расширяющий возможности Forward-Forward (FF)...


Исследователи: доверие в сетях ИИ-агентов нужно закладывать изначально

Исследователи: доверие в сетях ИИ-агентов нужно закладывать..

В новой научной работе утверждается, что безопасность сетей взаимодействующих ИИ-агентов нельзя обеспечить доработкой существующих...


Новый метод квантизации BDQ сокращает потери точности LLM до 1%

Новый метод квантизации BDQ сокращает потери точности LLM до 1%..

Исследователи представили Bidirectional Diagonal Quantization (BDQ) — метод пост-тренировочной квантизации, который снижает потери точности...


Мультиагентный метод AgentNLQ достиг 78,1% точности в NL2SQL на бенчмарке BIRD

Мультиагентный метод AgentNLQ достиг 78,1% точности в NL2SQL на..

Исследователи представили новый мультиагентный метод AgentNLQ для преобразования естественного языка в SQL. Метод показал 78,1%...


ReCrit: новый метод RL улучшает критическое мышление LLM в научных задачах

ReCrit: новый метод RL улучшает критическое мышление LLM в..

Исследователи представили ReCrit — фреймворк с усилением, который обучает большие языковые модели корректно реагировать на критику, не...


LBW-Guard: новый алгоритм управления обучением LLM сократил время на 10% и снизил перплексию на 18%

LBW-Guard: новый алгоритм управления обучением LLM сократил..

Исследователи представили LBW-Guard — слой управления обучением языковых моделей, работающий поверх оптимизатора AdamW. Решение повышает...


Новый метод UCCI снижает затраты на запуск LLM на 31% без потери качества

Новый метод UCCI снижает затраты на запуск LLM на 31% без потери..

Исследователи представили алгоритм калибровки неопределенности для маршрутизации запросов между языковыми моделями разного размера. На...