Ежедневный дайджест

7 пунктов · ~7 мин · Неделя 2026-W30

Стоит знать (1)

RESOURCE2SKILL: дистилляция исполняемых агентных навыков из мультимодальных ресурсов, созданных людьми

Microsoft Research
исследования официальный 2 ист. ~1 мин

Microsoft Research предлагает метод дистилляции переиспользуемых, исполняемых агентных навыков из созданных людьми мультимодальных ресурсов, таких как обучающие видео, с организацией их в иерархическую wiki-подобную библиотеку навыков, которую агенты могут находить, изучать и комбинировать в разных программных областях — дизайне слайдов, работе с таблицами, CAD и создании музыки.

Почему это важно
Набрала 121 голос на HuggingFace Daily Papers (2026-07-20); заявлено улучшение в среднем на +11,9 п.п. по сравнению с базовыми агентами без навыков на семи бенчмарках по созданию контента.
Справочно (6)

Маск заявил, что двухтриллионная модель xAI Grok 4.6 завершила начальное обучение

xAI
индустрия только СМИ 2 ист. ~1 мин

Илон Маск сообщил, что следующая крупная модель xAI, ожидаемо получившая название Grok 4.6 и построенная примерно на 2 триллионах параметров, завершила первичный предобучающий прогон на неделе 20 июля 2026 года — спустя несколько дней после релиза Moonshot AI открытой модели Kimi K3 на 2,8 триллиона параметров.

Почему это важно
Отмечает прямой ответ xAI на китайские открытые (open-weight) передовые модели, такие как Kimi K3, хотя пост-обучение, оценки безопасности и red-teaming, по сообщениям, всё ещё займут у xAI 4–6 недель, так что публичный релиз в ближайшее время не подтверждён.

Anthropic открывает приём заявок на гранты AI for Science по исследованию редких заболеваний

Anthropic
индустрия официальный 1 ист. ~1 мин

Anthropic принимает заявки до 2 августа 2026 года в рамках нового направления по редким заболеваниям программы AI for Science, предлагая до $50 000 в виде кредитов Claude на шесть месяцев по двум направлениям: клинические исследования (с партнёрами вроде Monarch Initiative) и биотехнологии для разработки лекарств.

Почему это важно
Расширяет инициативу Anthropic Claude Science до полноценной грантовой программы, сигнализируя об углублении фокуса на прикладных научных и биомедицинских сценариях использования за пределами продуктов общего назначения.

Понимание рассуждения: от предобучения к пост-обучению

исследования официальный 1 ист. ~1 мин

Используя шахматы как контролируемый тестовый стенд, охватывающий весь пайплайн от предобучения до RL, авторы показывают, что RL-пост-обучение не просто «затачивает» обученную с учителем политику: на лёгких задачах оно усиливает ходы, которые модель уже предпочитала, а на сложных — выявляет правильные ходы, почти отсутствовавшие после SFT, причём модели с более долгим предобучением получают больше пользы от RL.

Почему это важно
Представлена на HuggingFace Daily Papers 2026-07-20 с 20 голосами; даёт механистическое объяснение того, что именно RL-пост-обучение меняет в политике модели, связывая масштаб предобучения с отдачей от RL.

Recursive Harness Self-Improvement (RHI): доработка агентных «обвязок» по обратной связи от выполнения

Sakana AI
исследования официальный 2 ист. ~1 мин

Исследователи Sakana AI и UC Berkeley представляют Recursive Harness Self-Improvement — итеративный алгоритм, дорабатывающий созданные пользователем агентные «обвязки» (harness) с помощью попарной обратной связи, извлекаемой из истории выполнения самого агента, без переобучения базовой модели.

Почему это важно
Расширяет недавно запущенную исследовательскую программу Sakana AI по рекурсивному самоулучшению — часть более широкого отраслевого движения к ИИ-системам, улучшающим собственные инструменты, а не полагающимся исключительно на рост вычислительных мощностей.

Claude Code v2.1.216 добавляет опцию отключения файловой песочницы и исправляет изоляцию git worktree

Anthropic
инструменты официальный 1 ист. ~1 мин

Claude Code v2.1.216, вышедший 20 июля 2026 года, добавляет настройку sandbox.filesystem.disabled для отключения изоляции файловой системы при сохранении контроля сетевого исходящего трафика, исправляет квадратичное замедление нормализации сообщений в длинных сессиях и устраняет несколько багов изоляции worktree, из-за которых субагенты могли перенаправлять git-операции в общий checkout.

Почему это важно
Баг изоляции git worktree мог приводить к тому, что git-команды субагента «утекали» не в тот checkout репозитория, а опция отключения песочницы даёт командам более тонкий контроль над изоляцией файловой системы и сети по отдельности.

OpenCode v1.18.4 добавляет адаптивное управление режимом «размышления» для моделей Kimi

SST (OpenCode)
инструменты официальный 1 ист. ~1 мин

OpenCode v1.18.4, вышедший 20 июля 2026 года, добавляет адаптивное управление режимом «размышления» для моделей Kimi у Anthropic-совместимых провайдеров, синхронизирует тему встроенного терминала десктоп-приложения с общей темой приложения, снижает таймауты заголовков у провайдера OpenAI и восстанавливает поддержку Azure Cognitive Services.

Почему это важно
Инкрементальный, но стабильный прогресс open-source агента для кодинга OpenCode, расширяющий совместимость с провайдерами и моделями, на которую разработчики полагаются в мультипровайдерных агентных сценариях.