DeepSeek открыл публичный бета-доступ к API V4-Flash-0731, обошедшему собственный флагман на агентных бенчмарках

DeepSeek

модели/LLM офиц. + СМИ 3 ист. ~1 мин

DeepSeek выпустил сборку V4-Flash-0731 своего API в публичную бету 31 июля — та же архитектура, что и в превью V4-Flash, но с повторным пост-тренингом, позволившим превзойти собственный V4-Pro-Preview по всем девяти опубликованным агентным и coding-бенчмаркам, включая Terminal-Bench 2.1 и DeepSWE. Модель нативно поддерживает формат Responses API и совместима с Codex.

Почему это важно

Более дешёвая модель уровня 'flash' теперь обходит флагманское превью DeepSeek на агентных coding-бенчмарках, показывая, что один только пост-тренинг способен закрыть большую часть разрыва с более крупной моделью.

Важность: 3/5

Заметный релиз: модель более дешёвого тира превосходит флагманское превью своей же лаборатории по всем опубликованным агентным/coding-бенчмаркам, официальный источник + 2 независимых подтверждения в СМИ.

Источники

официальный DeepSeek API Change Log