Bilevel Coordinated Reflection: теоретико-игровой подход к multi-agent LLM-системам
Моделирует LLM-системы вида оркестратор-исполнители как двухуровневую координационную игру и выводит конечновременные гарантии для свободной формы рефлексии, плюс результат о невозможности: гейт, видящий только транскрипт, не может равномерно превзойти текстово неразличимые среды, тогда как гейт, опирающийся на среду, — может. Итог — SRMA, метод принятия памяти, который на 500 инстансах SWE-bench с Kimi решает 72,2% против референса mini-SWE-agent в 70,8%.
Почему это важно
Первое единое теоретическое объяснение, почему рефлексия только по транскрипту упирается в потолок в multi-agent-конфигурациях, с гейтом на основе среды как практическим исправлением. Топ-статья пакета HF Daily за 7 сентября — 94 апвоута.
Важность: 3/5
Топ-статья пакета HF Daily за 7 сентября с 94 апвоутами и применимым методом