-
ExploitBench: Claude Mythos Preview и GPT-5.5 автономно создают настоящие браузерные эксплойты
Anthropic
research
-
Anthropic расширяет Project Glasswing до ~200 партнёров и открывает доступ к Mythos Preview для критической инфраструктуры
Anthropic
industry
-
Trump Signs AI Executive Order Requiring 30-Day Voluntary Pre-Release Government Review
industry
-
США снимают экспортные ограничения с Claude Fable 5 и Mythos 5 от Anthropic
Anthropic
industry
-
OpenAI представила GPT-Red — внутреннюю модель для автоматизированного red-teaming защиты от prompt-injection
OpenAI
research
-
OpenAI заявила, что предрелизные модели вырвались из тестовой песочницы и взломали Hugging Face
OpenAI
research
-
OpenAI запускает кибербезопасностную инициативу Daybreak на базе моделей GPT-5.5
OpenAI
tools
-
OpenAI выпускает Lockdown Mode для блокировки эксфильтрации через prompt injection в ChatGPT
OpenAI
tools
-
Claude Code v2.1.177: принудительный откат Fable 5 на Opus 4.8, исправление кеширования Bedrock, патч безопасности
Anthropic
tools
-
NVIDIA SkillSpector: сканер безопасности с открытым кодом для скиллов AI-агентов
NVIDIA
tools
-
xAI открыла исходный код кодинг-агента Grok Build под Apache 2.0 после инцидента с приватностью
xAI
tools
-
GitHub MCP Server: сканирование секретов в GA и сканирование зависимостей в публичном превью
GitHub
tools
-
Claude Code 2.1.178: параметризованные правила разрешений и вложенные скиллы
Anthropic
tools
-
Anthropic предлагает отраслевую шкалу оценки тяжести джейлбрейков
Anthropic
research
-
Claude Code v2.1.207: Auto Mode GA на Bedrock/Vertex/Foundry, исправления безопасности
Anthropic
tools
-
BadHost (CVE-2026-48710): обход аутентификации через Host-заголовок в Starlette затрагивает vLLM, LiteLLM и MCP-серверы
tools
-
Модель Mythos от Anthropic обнаружила уязвимости в засекреченных системах правительства США за несколько часов
Anthropic
industry
-
GLM-5.2: MoE-модель для программирования от Zhipu AI на 744B параметров под лицензией MIT вызывает опасения в сфере кибербезопасности
Zhipu AI / Z.ai
models-llm
-
Anthropic запустила Claude Security в публичной бете для корпоративных клиентов
Anthropic
tools
-
Фейковый репозиторий OpenAI занял #1 в трендах Hugging Face с 244 тыс. загрузок и доставил инфостилер
tools
-
Anthropic обвиняет Alibaba в крупнейшей известной атаке дистилляции Claude: 28,8 млн диалогов
Anthropic
industry
-
OpenClaw v2026.5.12-beta.4/5/6: усиление безопасности и исправления для мультиплатформенного обмена сообщениями
tools
-
Claude Code v2.1.160: запросы подтверждения перед записью в файлы запуска оболочки и конфиги систем сборки
Anthropic
tools
-
Claude Code v2.1.162: исправление уязвимости утечки OAuth-учётных данных, изоляция параллельных вызовов инструментов
Anthropic
tools
-
Claude Code v2.1.166: настройка резервной модели, расширенные glob-правила запрета, межсессионная безопасность
Anthropic
tools
-
Claude Code v2.1.187: изоляция учётных данных в sandbox и исправление зависания remote MCP
Anthropic
tools
-
Claude Code v2.1.193: расширение классификатора shell, логирование ответов через OTel, автодополнение путей в реальном времени
Anthropic
tools
-
OpenAI Codex CLI v0.142.2: поиск инструментов MCP по умолчанию, поддержка прокси в macOS, защита PowerShell
OpenAI
tools
-
Claude Code v2.1.196: стандартные модели для организаций и исправление безопасности MCP для недоверенных репозиториев
Anthropic
tools
-
OpenAI Codex v0.142.5: патч безопасности для утечки данных через лог трассировки WebSocket
OpenAI
tools
-
GitHub Copilot CLI отказывается от требования PAT в Actions; потоковая передача агентских сессий в превью
GitHub
tools
-
Claude Code v2.1.205: защита от подмены транскрипта и исправления надёжности сессий
Anthropic
tools
-
Claude Code v2.1.207: auto mode GA на облачных провайдерах, исправление уязвимости
Anthropic
tools
-
GitHub Copilot добавляет обнаружение prompt injection в CodeQL 2.26.0
GitHub
tools
-
Claude Code v2.1.210–211: патч безопасности от двунаправленного переопределения и флаг стрима субагентов
Anthropic
tools
-
Claude Code v2.1.214–v2.1.215: исправления обходов проверки разрешений, инструмент EndConversation, /verify больше не запускается автоматически
Anthropic
tools
-
Защитные механизмы на основе копируемого контекста не могут обеспечить надёжную безопасность LLM
research
-
OpenAI выпускает codex-zsh v0.1.0: версионированный патченый бинарник zsh для песочницы Codex
OpenAI
tools
-
OpenAI Codex CLI 0.142.5: исправление утечки данных в trace-логи
OpenAI
tools