Ежедневный дайджест

15 пунктов · ~15 мин · Неделя 2026-W39

Обязательно к прочтению (1)

xAI выпускает Grok 4.7 — свою самую мощную модель для кодинга и интеллектуальной работы

xAI
модели/LLM офиц. + СМИ 5 ист. ~1 мин

xAI (SpaceXAI) 21 сентября выпустила Grok 4.7, позиционируя его как «нашу самую способную модель для кодинга и интеллектуальной работы»: увеличенная базовая модель, более длительное RL-обучение, улучшенная самоверификация и обработка длинных горизонтов, позволяющая модели автономно работать часами. Цена — $2/$6 за миллион входных/выходных токенов, без изменений относительно Grok 4.6 и заметно ниже конкурентов; доступен с первого дня в Cursor, Grok Build, Grok API, GitHub Copilot и Devin. Независимые бенчмарки неоднозначны: в кодинге прирост над GPT-5.6 Sol, но по большинству агрегированных бенчмарков модель всё ещё уступает Claude и GPT-6.

Почему это важно
Флагманский релиз объединённой лаборатории xAI-SpaceX, демпингующий по цене фронтальных конкурентов при сохранении второго эшелона в бенчмарках

Стоит знать (2)

Yandex открывает исходные коды AliceAI Foundation 80B-A3B — российской базовой модели, обученной с нуля, под Apache 2.0

Yandex
модели/LLM офиц. + СМИ 4 ист. ~1 мин

Yandex опубликовала веса AliceAI-Foundation-80B-A3B-Base — mixture-of-experts базовой модели, обученной с нуля (80B суммарно, ~3B активных параметров), под лицензией Apache 2.0. В собственных бенчмарках она обходит значительно более крупную DeepSeek-V4-Flash-Base (284B, 13B активных) на тестах фактичности, включая WikiWebFacts (86,5 против 83,2) и HardMultiQA, и сравнивается с Alibaba Qwen3.5-35B-A3B-Base по олимпиадной математике. Yandex позиционирует модель как экспериментальную платформу для архитектуры будущей единой reasoning-модели, на которой будут основаны агентные функции Alice AI.

Почему это важно
Первая крупная открытая российская базовая модель с коммерческой лицензией, обученная без иностранных компонентов; её пермиссивный релиз и сильные результаты против моделей DeepSeek и Nvidia — веха для суверенного российского AI-стека.

CodeMidas: масштабирование RL-окружений агентного кодинга из самого кода

Xiaomi MiMo
исследования офиц. + СМИ 2 ист. ~1 мин

Агентный пайплайн, преобразующий реализованную функциональность в существующих опенсорсных кодовых базах в исполняемые RL-окружения для coding-агентов, используя только исходный код как вход — без issues и коммитов. Агенты исследуют код, пишут поведенческие спецификации, затем строят задачи с надёжными верификаторами.

Почему это важно
Устраняет главный bottleneck масштабируемости RL для coding-агентов (окружения из артефактов разработки); топовая статья HF Daily Papers батча с 88 апвоутами.
Справочно (12)

OpenAI предлагает «стандарты строительства для следующей фазы AI»

OpenAI
индустрия офиц. + СМИ 2 ист. ~1 мин

В политическом посте от 21 сентября OpenAI изложила своё предложение по стандартам, регулирующим следующую фазу развития AI; широко освещалось как призыв к лидерству США в разработке глобальных стандартов AI.

Почему это важно
Фронтальная лаборатория, явно продвигающая стандарты AI при поддержке государства, сигнализирует о превентивной смене позиционирования перед следующими поколениями моделей

Yandex называет лауреатов международной премии Yandex ML Prize 2026

Yandex
индустрия только СМИ 2 ист. ~1 мин

Yandex объявила и наградила восьмерых лауреатов международной премии Yandex ML Prize 2026 — из ВШЭ, МФТИ, МГУ, ИТМО и Новосибирского государственного университета. Премия отмечает преподавателей университетов, обучающих следующее поколение специалистов по AI и ML в России.

Почему это важно
Сигнализирует о продолжающихся инвестициях Yandex в российский ML-пайплайн талантов, на котором строятся амбиции инфраструктуры Petra AI и долгосрочная база модельных исследований.

OpenAI формирует консультативную группу по математике и AI

OpenAI
исследования офиц. + СМИ 2 ист. ~1 мин

21 сентября OpenAI объявила о создании независимой консультативной группы по математике и искусственному интеллекту при участии Princeton. TechCrunch сообщил о создании группы наряду с заявлением OpenAI, что её AI решил более 100 открытых математических проблем; группа также будет участвовать в проверке исследовательских публикаций.

Почему это важно
Независимая математическая проверка заявлений фронтальных моделей отвечает растущему требованию верифицировать раскрытия об исследовательских достижениях AI

Grounded Skill Synthesis from Code at Scale for Agentic Intelligence (Code2Skill)

Ant International
исследования офиц. + СМИ 2 ист. ~1 мин

Code2Skill автоматически превращает исходный код в привязанные к реализации записи атомарных операций, композитных workflow и повторяющихся паттернов, верифицируя каждый выученный навык по исполняемым доказательствам. Подход избегает как траекторного синтеза (требует предшествующего опыта агента), так и навыков из документации (без верификации).

Почему это важно
Масштабируемое, верифицируемое получение навыков без предварительного запуска агентов — прямой путь к переносимым процедурным знаниям для агентов; 85 апвоутов на HF Daily Papers.

RecreationWorld: масштабируемые и верифицируемые окружения для гибридных computer-use-агентов

Qwen (Alibaba)
исследования офиц. + СМИ 2 ист. ~1 мин

Фреймворк из пяти платформ (Ubuntu, macOS, Windows, Android, Web) для обучения гибридных computer-use-агентов, чередующих GUI-взаимодействие с написанием кода и работой в командной строке. Получив работающее референс-приложение, агент должен выявить его поведение и построить точную реализацию без предписанного workflow.

Почему это важно
Первое крупномасштабное верифицируемое окружение, трактующее GUI-использование и разработку ПО как одну чередующуюся задачу, а не две отдельные линии агентов; 60 апвоутов, от команды Qwen.

EvoOntology: самоэволюционирующий слой онтологии для data-агентов

RUC-DataLab (Renmin University)
исследования офиц. + СМИ 2 ист. ~1 мин

Предлагается самоэволюционирующий слой онтологии, закрывающий разрыв между агентами и гетерогенными данными (таблицы, файлы, базы данных). Вместо исследования сырых данных или рукотворных семантических слоёв онтология адаптируется к поведению агента и масштабируется на крупные источники данных.

Почему это важно
Собрала максимум вовлечённости сообщества батча (245 комментариев) и заняла 3-е место по апвоутам (69) — признак сильного интереса к масштабированию архитектур data-агентов за пределы prompt-инъекций схем.

Anthropic предлагает новые метрики для отслеживания темпов развития AI внутри фронтальных лабораторий

Anthropic
исследования официальный 1 ист. ~1 мин

Опубликовано 22 сентября: исследовательская работа Anthropic предлагает новые метрики, дающие общественности видимость темпов фронтального развития AI внутри лабораторий. Это методологическое предложение, а не релиз модели или продукта.

Почему это важно
Первое конкретное предложение лаборатории по внешне читаемому измерению прогресса фронтальных способностей

OpenAI запускает Astra for Law — агент для юридической работы

OpenAI
инструменты офиц. + СМИ 3 ист. ~1 мин

21 сентября OpenAI анонсировала Astra for Law — предложение для юридической отрасли на базе агента GPT-6 Astra, с инструментами, ориентированными на юридические фирмы. Освещение (Business Standard, The Indian Express) подаёт это как выход OpenAI на рынок юридического AI.

Почему это важно
Первая вертикально-специализированная упаковка агентного стека OpenAI для регулируемой профессии

OpenAI рассказывает, как V7 даёт AI-агентам институциональную память

OpenAI
инструменты официальный 1 ист. ~1 мин

В разборе от 21 сентября «How V7 gives AI agents institutional memory» OpenAI описывает, как V7 обеспечивает общую, персистентную базу знаний и контекста для AI-агентов OpenAI между задачами.

Почему это важно
Персистентная общая память — необходимое условие для запуска флотов агентов внутри организаций

Z.ai открывает исходные коды ZCode — harness своего GLM-агента для кодинга

Zhipu AI / Z.ai (GLM)
инструменты официальный 2 ист. ~1 мин

Z.ai опубликовала полный исходный код ZCode — harness своего coding-агента, доступного как десктоп-приложение, браузерный workbench и терминальный TUI, под Apache-2.0 в GitHub-организации zai-org. Позиционируется как официальный harness для GLM-5.3; поддерживает длительные целевые задачи, удалённое управление ботами через WeChat/Feishu/Telegram и рабочие окружения SSH/WSL.

Почему это важно
Крупная китайская лаборатория, выпускающая свой флагманский продакшен-harness агента под Apache-2.0, даёт открытой экосистеме workbench класса Cursor/OpenCode как основу для развития.

OpenCode выпускает v1.18.32 с исправлениями Bedrock-изображений и Together AI streaming

SST
инструменты официальный 1 ист. ~1 мин

OpenCode v1.18.32 (21 сентября 2026) исправляет вложения изображений Bedrock так, что они поднимаются только для моделей Claude, Nova и Llama 4, а также чинит отчётность по streaming usage в Together AI. Контрибьютор сообщества @dc85 добавил Grok 4.7 и DeepSeek V4.1 Flash в OpenCode Zen и Go.

Почему это важно
Минорный релиз, но добавление Grok 4.7 и DeepSeek V4.1 Flash в модельный прокси OpenCode (Zen/Go) сигнализирует о быстром подключении моделей в экосистеме опенсорсных coding-агентов.

vLLM v0.30.0 помечена тегом на GitHub; релиз ещё не опубликован в PyPI

vLLM project
инструменты официальный 1 ист. ~1 мин

Git-тег v0.30.0 появился в репозитории vLLM 21 сентября 2026 года, через две минорные версии после v0.29.0 (9 сентября). По состоянию на 22 сентября релиз ещё не опубликован в GitHub Releases, а PyPI всё ещё показывает 0.29.0 как последнюю версию.

Почему это важно
vLLM — доминирующий опенсорсный стек LLM-serving; срез минорной версии предвещает новую волну фич, однако release notes пока недоступны — содержимое версии считать неподтверждённым до публикации в PyPI.