Ollama v0.33.1: поддержка Qwen3.8 Flash Next и structured-output в mlxrunner
Ollama
v0.33.1 (26 авг.) добавляет поддержку MLX для Qwen3.8 Flash Next, делает патчи совместимости cmake идемпотентными, обновляет встроенные деревья MLX и llama.cpp, а также добавляет поддержку structured-output в MLX runner (включая обход таймаутов Metal GPU при загрузке моделей с медленных накопителей).
Почему это важно
Qwen3.8 Flash Next на Apple Silicon закрывает разрыв между десктопной сборкой Ollama и свежей линейкой Qwen; structured-output в mlxrunner открывает сценарии constrained-decoding на локальных Mac.
Важность: 2/5
default
Источники
официальный
Ollama v0.33.1 release