vLLM v0.30.0 опубликован: DeepSeek-V4.1-Flash с FlashMLA KV в MXFP8 на Blackwell

vLLM project

инструменты официальный 1 ист. ~1 мин

Продолжение вчерашней истории с тегом без релиза: vLLM выпустил v0.30.0 22 сентября — 762 коммита от 315 контрибьюторов (104 новых). Главное: поддержка DeepSeek-V4.1-Flash со всем KV-кэшем в MXFP8 через FlashMLA V4.1 на SM100, плюс другие новые модели.

Почему это важно

Поддержка новой Flash-модели DeepSeek за день, с оптимизированным под SM100 attention-путём, делает её сразу пригодной для масштабного сервинга на GPU Blackwell.

Важность: 2/5

Продолжение вчерашней новости: релиз теперь опубликован

Источники