Ежедневный дайджест
20 пунктов · ~20 мин · Неделя 2026-W38
Стоит знать (11)
Трамп отверг призыв фронтирных лабораторий замедлить развитие ИИ и атаковал Амодея
После эссе Амодея о «замедлении фронтира» и публичного согласия Альтмана и Маска президент Трамп отверг любое замедление и новые ограничительные меры для ИИ, отмахнувшись от предупреждений о безопасности и лично атаковав CEO Anthropic. Его администрация назвала контроль над темпами зоной ответственности самих лабораторий и повторила тезис: кто выиграет в ИИ, тот выиграет всё.
DeepSeek назначила первого в своей истории CFO — инвестбанкира Янь Вэньтао — на фоне возможного IPO на STAR Market
DeepSeekDeepSeek наняла своего первого финансового директора: им сталヤнь Вэньтао, партнёр GL Ventures и специалист по сделкам, сообщают Reuters и китайские СМИ 14 сентября. Назначение произошло на фоне того, что стартап вместе с CITIC Securities готовится к потенциальному листингу на шанхайской STAR Market.
Z.AI закрыла около $5 млрд финансирования в Гонконге под модели GLM нового поколения
Z.AI (Zhipu)Z.AI завершила привлечение около $5 млрд через размещение акций на $2 млрд и конвертируемые облигации на $3 млрд, сообщают регуляторные filings и СМИ 13–14 сентября; около 60% средств earmarked на R&D и инфраструктуру моделей GLM следующего поколения. На следующий день акции торговались ниже цены размещения.
OpenAI приобрела стартап камер Glass Imaging более чем за $300 млн
OpenAIOpenAI купила Glass Imaging — стартап, основанный выходцами из Израиля и бывшими сотрудниками Apple и разрабатывающий ИИ-улучшения для смартфонных камер, — более чем за $300 млн, сообщает WSJ. Сделку читают как ускорение планов OpenAI по потребительскому железу.
GPT-6 Astra стал доступен на Amazon Bedrock для корпоративных клиентов
OpenAIЕженедельная подборка AWS подтверждает: модель OpenAI GPT-6 Astra теперь доступна на Amazon Bedrock, дав корпоративным клиентам AWS нативный доступ к флагманской «рабочей» модели OpenAI. Сторонние API-платформы добавили модель в тот же день.
DataFlex-RL: оценочная платформа показала, что политики отбора данных для RLVR не превосходят равномерный сэмплинг
Peking UniversityКонтролируемая оценочная платформа сравнила 13 конфигураций политик отбора данных для RLVR на общем рецепте GRPO (Qwen2.5-7B-Base и Llama-3.1-8B-Base, 12 совпадающих сидов, 12 бенчмарков). Ни один метод отбора роллаутов, перевзвешивания или адаптивного смешивания доменов не дал воспроизводимого улучшения против равномерного GRPO, а пересчёт масштабов подмножеств бенчмарков менял ранжирование с корреляцией −0,33.
Feyospace-v1: команда из семи человек обучила open-weight фронтирных кибер-агентов
feyospaceДата-центричный фреймворк пост-тренинга для кибербезопасностных агентов, собранный из пяти тренировочных систем плюс дата-движок с перезапускаемыми окружениями, дал 164 269 верифицированных траекторий для long-context SFT. Выпущенные чекпойнты улучшают базовые модели на 23,76% на CyberGym и на 10,49% на объединённых CTF-наборах; Feyospace-s1 достиг 63,24% verified success на лидерборде CyberGym по состоянию на 1 сентября 2026 года.
Tencent Hunyuan открывает SAS — маршрутизаторы разреженного внимания, обученные end-to-end на Qwen3
Tencent HunyuanКоманда Tencent Hunyuan выпустила Simple Attention Sparsification (SAS) — метод gated разреженного внимания, который обучается ранжировать и выбирать KV-блоки через непрерывные гейты, оптимизируемые end-to-end с лоссом языкового моделирования, вместо дистилляции оценок плотного внимания. Чекпойнты только маршрутизаторов (33–42 млн параметров гейтов) для Qwen3-4B/8B/14B выложены на Hugging Face 14 сентября вместе с совместимым с SGLang бэкендом seer_attn и статьёй arXiv 2609.13141.
Andon Labs запустила Pion — платформу агентов, автономно управляющих настоящими компаниями
Andon LabsAndon Labs выпустила Pion (14 сентября, research preview) — платформу, передающую реальный бизнес постоянным ИИ-агентам с инструментами почты, телефона, банкинга и браузера. Проект вырос из Vending-Bench и реальных развёртываний, включая магазин в Сан-Франциско и стокгольмское кафе, где агенты руководят людьми через Slack.
Модели Grok появились в Microsoft Copilot в Word, Excel и PowerPoint в статусе субпроцессора
xAIMicrosoft подключает модели Grok от xAI к Copilot внутри Word, Excel и PowerPoint, при этом xAI выступает субпроцессором, обрабатывающим запросы по условиям обработки данных Microsoft. В сообщениях отмечается, что системные промпты удерживают выводы Grok строго в рабочих рамках.
ByteDance выпустила потребительскую версию Doubao Phone Assistant с бета-управлением автоматизацией экрана
ByteDanceByteDance официально запустила 14 сентября потребительскую версию своего системного Doubao Phone Assistant: ответы на вопросы по экрану, локальный поиск по фото и сообщениям, голосовую активацию и бета-режим «управление телефоном» — автоматизацию экрана на базе протокола SAEP, позволяющего сторонним приложениям объявлять границы и отказываться от ИИ-управляемых операций. Первым устройством стал агент-телефон Nubia NaviX Ultra.
Справочно (9)
xAI и X Corp исключили Apple из антимонопольного иска из-за ранжирования в App Store
xAIxAI Маска, X Corp и SpaceX подали ходатайство об исключении Apple из своего антимонопольного иска, в котором Apple обвинялась в занижении позиций приложений вроде Grok в ранжировании App Store. Условия мирового соглашения не раскрыты, параллельные претензии к OpenAI остаются в силе.
Benchmark Radar: живая база данных и поисковая система по ИИ-бенчмаркам
Carnegie Mellon UniversityПостоянно обновляемый каталог и поисковая система по ИИ-бенчмаркам — LLM, агентным, кодинговым, reasoning- и safety-оценкам, — агрегирующая ежедневно из 37 источников: 1283 записи и 12916 наблюдений оценок с сохранёнными цепочками цитирования. Также содержит анализы насыщения бенчмарков, тренды adoption и workflow поиска прецедентов для проектирования новых оценок.
COBRA-Skills: эволюция агентных скиллов под управлением контекстных бандитов
Chinese University of Hong Kong, ShenzhenПодходит к оптимизации библиотек скиллов LLM-агентов как к бюджетной последовательной оптимизации над эволюционирующим пространством кандидатов, сочетая приоритизацию под управлением контекстных бандитов с эволюцией скиллов на основе свидетельств из фидбэка исполнения. На шести агентных бенчмарках и трёх моделях метод не уступает или превосходит прежние методы оптимизации скиллов, снижая стоимость оптимизации на 55–58% относительно SkillOpt и используя лишь 50 примеров на бенчмарк.
Claude Code v2.1.271 добавляет fast mode в удалённых сессиях и per-command домены песочницы
AnthropicClaude Code v2.1.271 (14 сентября) приносит fast mode в Remote-сессии, per-command allowed_domains для песочниц Bash/PowerShell/Monitor, omitClaudeMd для сабагентов и --accept-command (sha256) для установки плагинов, плюс исправления MCP OAuth и --resume. Последовавший релиз v2.1.272 (15 сентября) содержит только исправления багов.
llama.cpp v0.4.1 добавляет поддержку Maple 20B, Tencent Hy 4 и Spark2.5
ggmlllama.cpp v0.4.1 (14 сентября) добавляет поддержку моделей Maple 20B-A1B, Tencent Hy 4 и Spark2.5, рефакторит обработку JSON-схем и добавляет JSONL-логирование через --log-jsonl. Флаги mmap/mlock/direct-io заменены единым --load-mode.
GitHub Copilot позволяет настраивать баланс стоимости и качества в автоподборе моделей
GitHubGitHub анонсировал (14 сентября), что автоматический выбор моделей в Copilot теперь можно конфигурировать по соотношению стоимость/качество, смещая маршрутизацию к более дешёвым или более способным моделям для каждой задачи.
qwen-code v0.23.4 добавляет нативные субагенты и кросс-сессионную agent board
Alibaba (Qwen)Open-source CLI Alibaba Qwen Code выпустил v0.23.4 14 сентября: нативные встроенные субагенты, исполнитель Codex, «agent board» для обмена работой между независимо запущенными агентами, peer-эндпоинт для подключения внешних программ к кросс-сессионному обмену сообщениями, конфигурируемые лимиты Goal и около 60 исправлений багов.
Anthropic запустила Claude для финансовых консультантов в партнёрстве со Schwab
AnthropicAnthropic представила продукт Claude, нацеленный на финансовых консультантов и автоматизирующий подготовительную работу — подготовку к встречам и регуляторно-нагруженные процессы. В сообщениях СМИ упоминается партнёрство по дистрибуции с Charles Schwab и акцент на регуляторной комплаенс-подготовке для wealth management.
OpenCode v1.18.31 восстанавливает состояние ACP-сессии при resume и fork
SSTOpenCode v1.18.31 (14 сентября) чинит восстановление модели, effort, режима ACP-сессии и границ reasoning-чанков при загрузке, возобновлении или форке сессий, а также показывает ошибки авторизации remote-конфига при старте. Расширения теперь суммируют adaptive thinking для моделей GitHub Copilot.