Prime Agent: самоулучшающийся RLM-харнесс
Prime Intellect
Open-source харнесс для долгосрочных воркфлоу кодинга и оценки. Персистентный IPython REPL реализует абстракцию Recursive Language Model; Continual Harness сохраняет истории/памяти/навыки/спецификации сабагентов между траекториями; рекурсивные сабагенты координируются через прямое агент-агент сообщение. На ARC-AGI-3 RHAE Best@1 харнесс поднимает базовую модель с 30% до 95.5% и соответствует или превосходит нативные и популярные харнессы в долгом контексте при кодинге, генерации GPU-ядер, конструировании эмуляторов и автономных спидранах nanoGPT.
Почему это важно
Доклад HF Daily с 18.2k кумулятивных upvotes — единственный выбор харнесса достаточен, чтобы более чем утроить результат на ARC-AGI-3, что говорит о частичной артефактности многих цифр «возможностей модели». Продемонстрированы уточнение и параллелизованные сабагенты на Factorio.
Важность: 2/5
default