Как симулировать общества ИИ-агентов на ноутбуке: новый метод из arXiv

Симуляции обществ из множества больших языковых моделей (LLM) стоят дорого, но исследователи нашли способ обойти это ограничение. В работе на arXiv они предлагают заменять каждого LLM-агента на компактную модель, обученную на нескольких сотнях или тысячах дешевых запросов. Такой подход, названный Poor Man's Agentic Modeling, позволяет проводить симуляции с любым числом агентов на обычном ноутбуке.

Ключевая идея — в том, что макроскопические вопросы, ради которых обычно строятся подобные симуляции (фазовые переходы, устойчивые закономерности, зависимость от числа агентов), не требуют точного моделирования когнитивных процессов каждого отдельного агента. Статистическая физика подсказывает, что коллективное поведение часто можно описать через простые эффективные модели.

Авторы разработали таксономию, которая классифицирует агентов по порядку взаимодействия и памяти. Это позволяет заранее предсказать, насколько точно низкопараметрическая модель воспроизведет поведение оригинала, и как ошибка будет меняться с ростом N. Теория дает конкретные прогнозы, которые исследователи проверили на практике.

Для валидации они пересоздали известную макроэкономическую симуляцию EconAgent с помощью предложенного метода, а также протестировали его на семи других симуляциях LLM-агентов. Решения агентов были получены на основе реальных вызовов моделей, в основном DeepSeek. Общая стоимость экспериментов составила всего несколько долларов.

Результаты показали, что предсказанные теоретические тренды ошибок выполняются для большинства случаев. Два опровергнутых прогноза касались случаев с сильно насыщающейся функцией ответа; авторы связали это с кривизной функции и показали, что их теория объясняет и эти отклонения без использования свободных параметров.

Метод открывает путь к массовым симуляциям ИИ-обществ в исследовательских целях — от экономики до социологии. Он снижает вычислительные затраты на порядки, делая эксперименты доступными для небольших лабораторий. Исследование опубликовано в виде препринта и еще не прошло полноценное рецензирование, но уже привлекло внимание специалистов.