Macaron-V1: к открытому непрерывному обучению с самосовершенствованием и Mixture-of-LoRA

исследования официальный 2 ист. ~1 мин

Открытая система агентной модели для непрерывного обучения после развёртывания, сочетающая базу GLM-5.2 на 744B параметров с архитектурой Mixture-of-LoRA, которая комбинирует специализированные адаптеры для чата, агентных задач, кодинга и генеративного UI; меньший вариант на 50B на базе Qwen3.6 поддерживает локальное развёртывание.

Почему это важно

324 голоса на HuggingFace Daily Papers; представляет полноценный совместно спроектированный стек (платформа пост-тренинга MinT, RL для длинного контекста LongStraw, агентный RL MindForge), а не отдельную изолированную технику.

Важность: 3/5

HuggingFace Daily Papers с 324 голосами (применён бамп-порог ≥100).

Источники