vLLM v0.30.0 опубликован: DeepSeek-V4.1-Flash с FlashMLA KV в MXFP8 на Blackwell
vLLM project
Продолжение вчерашней истории с тегом без релиза: vLLM выпустил v0.30.0 22 сентября — 762 коммита от 315 контрибьюторов (104 новых). Главное: поддержка DeepSeek-V4.1-Flash со всем KV-кэшем в MXFP8 через FlashMLA V4.1 на SM100, плюс другие новые модели.
Почему это важно
Поддержка новой Flash-модели DeepSeek за день, с оптимизированным под SM100 attention-путём, делает её сразу пригодной для масштабного сервинга на GPU Blackwell.
Важность: 2/5
Продолжение вчерашней новости: релиз теперь опубликован
Источники
официальный
vllm-project/vllm v0.30.0 release notes