Ежедневный дайджест

7 пунктов · ~7 мин · Неделя 2026-W32

Стоит знать (3)

Alibaba открывает широкий доступ к Qwen3.8-Max через API, запускает публичную бету QwenWork

Alibaba / Qwen
модели/LLM только СМИ 4 ист. ~1 мин

3 августа 2026 года Alibaba открыла глобальным разработчикам широкий доступ к своей модели Qwen3.8-Max с 2,4 трлн параметров через API Model Studio и запустила публичную бету QwenWork — платформы агентов для предприятий, объединяющей продукты QoderWork, MuleRun и Wukong. Открытые веса Qwen3.8-Max и модели поменьше Qwen3.8-27B ожидаются на следующей неделе.

Почему это важно
Сигнализирует о возвращении Alibaba к практике открытия исходного кода флагманских моделей после того, как последние топовые модели держались закрытыми, и позиционирует QwenWork как прямого конкурента Claude Cowork, ChatGPT Work, а также внутренних китайских соперников — Tencent WorkBuddy и Kimi Work от Moonshot.

Следующая модель OpenAI Astra решила десять открытых проблем в математике и теоретической информатике

OpenAI
исследования офиц. + СМИ 3 ист. ~1 мин

OpenAI опубликовала статью, показывающую, что внутренняя версия следующей крупной модели компании, Astra, решила или существенно продвинулась в решении десяти давних открытых проблем — от оценок плотной упаковки сфер и теории групп (несофические группы) до алгебр фон Неймана, сложности арифметических схем, решёточной криптографии и экстремальной комбинаторики, — выпустив 249-страничную рукопись с формализованными в Lean, машинно проверяемыми доказательствами.

Почему это важно
Результаты, полученные примерно за $2000 вычислительных затрат, по сообщениям, были признаны заслуживающими публикации сторонними математиками (в их числе — филдсовский лауреат Тимоти Гауэрс), что говорит о том, что передовые LLM начинают выдавать по-настоящему новые, проверяемые математические результаты, а не просто решать бенчмарк-задачи.

MiniMax H3: модель с открытыми весами выпущена на Hugging Face

MiniMax
видео официальный 1 ист. ~1 мин

MiniMax опубликовала открытые веса H3 (Hailuo 3.0) на Hugging Face по лицензии MiniMax H3 Community License 3 августа, вслед за запуском API модели 31 июля. H3 генерирует клипы длиной 4-15 секунд с разрешением до 2K/24fps и нативным синхронизированным стереозвуком на основе текста, изображения, видео или аудиореференсов.

Почему это важно
Выполняет обещание об открытых весах, данное при вчерашнем запуске H3, предоставляя разработчикам и исследователям локальный доступ к одной из первых моделей с открытыми весами, совместно генерирующей синхронизированные аудио и видео в разрешении 2K.
Справочно (4)

От RLVR к RLSVR: преобразование задач порождает самопроверяемые вознаграждения для самосовершенствования LLM в открытых доменах

исследования официальный 2 ист. ~1 мин

Предлагается RLSVR — метод, преобразующий открытые задачи (суммаризация, творческое письмо) в верифицируемые прокси-среды, так что сигналы вознаграждения возникают автоматически, без опоры на человеческие предпочтения или LLM-судей. Реализовано в виде SpyRL — мультиагентной игры с самообучением, где результаты голосования дают верифицируемые с точностью до истины вознаграждения; показано улучшение как на неверифицируемых, так и на верифицируемых задачах рассуждения.

Почему это важно
Расширяет парадигму RLVR (ранее ограниченную математикой/кодом с детерминированными проверяющими) на открытые домены без предвзятости модели-судьи и дополнительных затрат на инференс.

AISPA: пользователецентричный аудит системных промптов для приложений на больших языковых моделях

Stanford University
исследования официальный 2 ист. ~1 мин

Представлена система аудита по 8 измерениям (прозрачность идентичности, приватность, предотвращение манипуляций, предотвращение вреда, справедливость и др.), основанная на руководствах по AI-безопасности и статьях о правах человека, с помощью которой проведён аудит 3249 инструкций системных промптов в 88 коммерческих AI-продуктах.

Почему это важно
Эмпирический вывод: 98,9% проверенных продуктов содержат хотя бы одну защитную инструкцию, но только 24% охватывают все восемь измерений безопасности, а примерно 40% содержат хотя бы одну инструкцию, действующую против интересов пользователя.

Защитные механизмы на основе копируемого контекста не могут обеспечить надёжную безопасность LLM

исследования официальный 1 ист. ~1 мин

Формализуется «трилемма безопасности»: для задач двойного назначения защитные механизмы LLM не могут одновременно обеспечивать полезные возможности, надёжную безопасность и открытый доступ, поскольку злоумышленник может скопировать или имитировать любые доказательства промпта/контекста, которые предъявил бы легитимный пользователь. Выводится математическая нижняя граница помощи злоумышленнику в худшем случае и предлагаются «доверенные учётные данные» — трудно копируемые, привязанные к использованию доказательства — как необходимое дополнение к защите на основе промптов.

Почему это важно
Теоретический результат с прямыми последствиями для того, как лаборатории проектируют политики отказа и контроля доступа для возможностей двойного назначения, утверждающий, что сегодняшние защитные механизмы на основе копируемого контекста структурно недостаточны.

QQWorld: квантиль-квантильное сопоставление для регуляризации мировых моделей

исследования официальный 2 ист. ~1 мин

Выявлено, что цель регуляризации Эппса-Пулли в LeWorldModel, подталкивающая латентные представления к изотропному гауссову распределению, имеет корректирующие градиенты, которые исчезают для изолированных выбросов в хвостах, оставляя тяжелохвостые отклонения латентного пространства плохо контролируемыми. QQWorld заменяет её целью квантиль-квантильного сопоставления, сохраняющей активные градиенты в хвостах, что улучшает качество латентного пространства для планирования.