Progressive Agent Skill Generation via Reinforcement Learning (Skill-α)
The Chinese University of Hong Kong
Skill-α представляет генерацию навыков агента как последовательный процесс редактирования (CREATE, UPDATE, MERGE, PRUNE, NOOP), обучаемый с наградой за откат, которая сравнивает результат выполнения нижестоящей задачи с исходным навыком против отредактированного на закреплённом запросе. Поддерживает как генерацию навыка из документа, так и из опыта через единый редактор навыков.
Почему это важно
Запись в HuggingFace Daily Papers с 52 голосами; предлагает структурированную, верифицируемую альтернативу разрозненным циклам самоулучшения агентов.
Важность: 3/5
Заметная статья (52 голоса HF Daily Papers, ниже порога бонуса +1).