Как сократить расходы на общение ИИ-агентов: новый алгоритм из arXiv
Мультиагентные системы на базе больших языковых моделей часто страдают от неэффективной коммуникации: либо связи между агентами фиксированы заранее, либо используется полное широковещание, что ведет к росту затрат на токены, задержкам и накоплению ошибок. Исследователи представили на arXiv препринт, в котором предложили рассматривать выбор агентов и коммуникацию как кооперативную игру.
Модель разделяет полезность на два компонента: ценность коалиции для конкретной задачи и стоимость активации каждого агента. Для управления используется правило предельной полезности и жадный маршрутизатор, который решает, какие агенты будут общаться, а какие нет. Дополнительно применяются оценки Шепли для предсказания полезности подключения агентов до и во время выполнения задачи.
Эксперименты на синтетических данных показали, что жадный маршрутизатор достигает 99,5% полезности от полного перебора, при этом в среднем активируется только 1,96 агента из восьми. Для сравнения, полное широковещание даёт лишь 38,8% полезности. Устойчивость алгоритма проверена при изменении стоимости активации и веса избыточности.
Однако авторы отмечают, что теоретические гарантии работают для ограниченных случаев. Для основного маршрутизатора доказательство не применяется, и он остаётся эвристикой. При сильных нарушениях субмодулярности или зашумленных оценках эффективность падает до 66%. В работе также предложена связка с теоремой о субмодулярной максимизации и введена сэндвич-оценка для ошибки маршрутизации.
Разработка отличается от существующих подходов, таких как ценообразование Шепли, гедонистическое формирование коалиций и обрезка графа коммуникаций. Следующим шагом авторы видят тестирование на реальных мультиагентных LLM-бенчмарках.






